Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

OpenAI и Microsoft са знаели, че започват „порочен кръг“ за мрежата

OpenAI и Microsoft са знаели, че поставят началото на „порочен кръг“ за уеб

Компаниите са знаели, че ни водят към Google Zero, и въпреки това са го направили.

Компаниите са знаели, че ни водят към Google Zero, и въпреки това са го направили.

от Terrence O'Brien
18 септември 2026 г., 21:07 UTC
Изображение: Cath Virginia / The Verge, Getty Images
Terrence O'Brien
Terrence O'Brien е редакторът на уикенд изданието на The Verge. Той отразява технологичната индустрия повече от 18 години и разбира от синтезатори.

Наскоро разсекретени съдебни документи по делото на New York Times срещу OpenAI и Microsoft са доста уличаващи. Собствената документация на компаниите предупреждава, че това поставя началото на „порочен кръг“, който ще навреди на уеб, определя извличането на данни за обучението на моделите им като „най-голямата кражба на труд в човешката история“ и заявява, че то прави „пълна подигравка с идеята за честна употреба“.

Много от най-впечатляващите цитати в документа са на директора по приложни науки на Microsoft Брент Хехт. Компанията обаче се опита да се дистанцира от твърденията на Хехт. Говорителят на Microsoft Алекс Хаурек каза пред The Verge: „Тези коментари отразяват индивидуалната гледна точка на един служител, не представляват правен анализ и не изразяват позицията на компанията.“

В отделно съдебно заявление Джордан Усдън, генерален мениджър по стратегията и операциите с данни в Microsoft AI, определи ролята на Хехт като противопоставяща се. Той заяви, че Хехт „има различни, академични и насочени към бъдещето възгледи за това как трябва да функционират екосистемите от данни за изкуствения интелект и е нает в Microsoft, за да представя асиметрични, футуристични и академични гледни точки … нито пък е човек, който говори от името на Microsoft конкретно по отношение на теоретичните си възгледи за потенциалния ефект на изкуствения интелект върху създателите на съдържание“.

Но независимо дали Microsoft иска да поеме отговорност за тези коментари, ясно е, че това се сбъдна. Google Zero е реалност! Изкуственият интелект поглъща уеб!

В заявлението на NYT има още много диви твърдения от различни личности, включително Сатя Надела, Сам Алтман и други служители на OpenAI. Ето някои акценти от документа от 92 страници.

„Невероятна кражба“

This case is about, as Microsoft’s Director of Applied Science [Brent Hecht] put it, “an astonishing theft of unprecedented proportions”; SF1437, perhaps the “largest theft of labor in human history.”SF1652. Defendants repeatedly copied millions of Plaintiffs’ copyrighted articles in their entiretywithout permission to produce substitutive commercial AI products. OpenAI’s Head of ChatGPTwrote that “[p]ublishers” face an “existential threat” from those products, SF1466, which, he said,“are largely substitutive, period” and “will get more and more substitutive as they get better.”SF1473-74. Such admissions eviscerate Defendants’ “fair use” defense because substitution is“copyright’s bête noire.” Andy Warhol Foundation for the Visual Arts, Inc. v. Goldsmith, 598 U.S.508, 528 (2023). For Defendants to prevail on this defense “would,” the same Microsoft executiverecognized, arguably “make a complete mockery of the idea of ‘fair use.’” SF1450.

Въведението цитира Хехт и ръководителя на ChatGPT в OpenAI (вероятно Ник Търли) по начин, който изглежда показва, че компаниите са знаели, че представляват „екзистенциална заплаха“ за издатели като New York Times. Хехт нарича извличането на данни от ChatGPT и Copilot „най-голямата кражба на труд в човешката история“ и казва, че защитата на Microsoft прави „пълна подигравка с идеята за „честна употреба“.“

Това е „порочен кръг“

Microsoft’s CEO Satya Nadella agreed under oath that conversing with chatbots “hassubstituted … giving you the information right there on the website on the AI platform versusneeding to go to the underlying source.” SF1432. A Microsoft document recognizes that nobodywins that contest: “Our AI content strategy has started a ‘doom loop’ that will hurt the performanceof our models and the entire web at the same time: It is highly unusual that an end-product threatensthe economic foundations of its essential suppliers, but that is the situation we have created for ourLLM business with respect to its ‘content supply chain.’”

Сатя Надела признава, че чатботовете на практика са заменили търсенето и са премахнали необходимостта човек да посещава директно източника за информация. Но може би още по-уличаващ е вътрешен документ на Microsoft, в който се казва: „Нашата стратегия за съдържание с изкуствен интелект постави началото на „порочен кръг“, който едновременно ще навреди на представянето на моделите ни и на целия уеб: твърде необичайно е краен продукт да застрашава икономическите основи на основните си доставчици, но това е ситуацията, която създадохме за бизнеса си с LLM по отношение на неговата „верига за доставки на съдържание“.“

Това дори не е истинско число

Around the same time, OpenAI co-founderGreg Brockman wrote he was “deeply motivated by the gazillions” he hoped to gain bycommercializing OpenAI’s technology. SF630. Lately, it has been reported that OpenAI isplanning an IPO based on a $1 trillion valuation.

Не се заблуждавайте от твърденията на OpenAI или Microsoft за алтруистични намерения. Съоснователят на OpenAI Грег Брокман се интересува повече от „милиардите“ долари, които потенциално би могъл да спечели чрез комерсиалния изкуствен интелект.

Платена стена — какво толкова

Individuals within OpenAI and Microsoft ignored such issues as circumventing paywallsand violating terms of use when acquiring data. SF521-47, 790-92. For example, OpenAI’scorporate representative testified that he was unaware of “any effort to detect paywall content inits training datasets” or “to remove paywall content from its training datasets.”

Въпреки че по-късно Надела е цитиран да казва: „всичко, което е зад платена стена, трябва да бъде лицензирано“, представител на OpenAI призна, че не му е известно да са полагани усилия за откриване или премахване на съдържание зад платена стена от данните за обучение.

„Невероятно добър в повтарянето“

That same year, OpenAI recognized that its API “might outputexisting content verbatim.” SF945. By 2021, OpenAI considered the prevention of memorizationimportant “for fair use [compliance] and minimizing copyright violations in model output.” SF946.In June 2022, OpenAI employees acknowledged that GPT-4 would have “memorized a ton of dataand therefore will be insanely good at regurgitation.”

Изглежда, че вътрешно OpenAI е било напълно наясно със склонността на ChatGPT просто да възпроизвежда защитени с авторски права материали „дословно“. Въпреки че компанията е признавала, че „предотвратяването на запаметяването“ е важно за „минимизиране на нарушенията на авторските права“, служители са признали, че GPT-4 е „запаметил тонове данни и затова ще бъде невероятно добър в повтарянето“.

В заявлението след това са посочени няколко примера за това как ChatGPT извежда дълги откъси директно от статии в Times, Mercury News, The Denver Post, LifeHacker и Eurogamer в отговор на запитвания.

„Поглъщане“ на целия им труд

 As Microsoft recognized: “millions of people around the world will soon considerlarge models ‘hoovering up’ all their work to be an astonishing theft of unprecedented proportions”and admitted that “almost no one intended for content they created to be used in this fashion, norare they compensated for its use.”

Microsoft е знаела как ще бъде възприето масовото ѝ извличане на съдържание от интернет и е признала, че „почти никой не е възнамерявал създаденото от него съдържание да бъде използвано по този начин, нито получава възнаграждение за употребата му“.

„Заместител на труда на хората“

OpenAI Policy Director Jack Clark similarly wrote: “[O]ur work on AI and Creativity isgoing to increasingly lead to us creating systems that substitute for the labor of the people thatdefine the ‘culture’ of society[.]” SF1677. OpenAI internal documents characterize ChatGPT as“[t]he modern newsstand,” SF1500, and brag that ChatGPT provides “fast, timely answers…whichyou would have previously needed to go to a search engine for” including “up-to-date sportsscores, news, stock quotes, and more.”

Директорът по политиките на OpenAI Джак Кларк е видял какво предстои, заявявайки, че компанията „създава системи, които заместват труда на хората, определящи „културата“ на обществото“. Вътрешни документи описват ChatGPT като „модерната будка за вестници“. По-късно Ник Търли от OpenAI е цитиран да казва, че след като получите отговор от чатбота, „няма основателна причина да кликвате“ върху връзка към източника.

Унищожаване на собствената верига за доставки

Defendants acknowledge the predictable consequences of this design. Per Microsoft, the“[p]romise of LLMs is largely in the same information work domains from which they get theircontent... They naturally compete with their content supply chain.” SF1798. They substitute forthe “labor of the people” who produced the original content on which they were trained, including,among other things, newspapers and books. SF1452, 1677. There is a “real risk” that GenAI could“significantly disrupt[] the employment of the very people who generated the data on which thefoundation model was trained.” SF1467. “LLMs are a product that destroys its supply chain.”

Цитира се признание на Microsoft, че „LLM са продукт, който унищожава собствената си верига за доставки“, тъй като в много случаи е заместител на собствените му данни за обучение.

OpenAI знае, че убива трафика от препратки

Another OpenAI economic expert, Dr. Goldfarb, opined: “I find that the decline in referral trafficto The Times’s properties has been driven by a combination” of factors including “e.g., Google AIOverviews.” SF1784, 1786. Dr. Goldfarb also opined that “Google’s introduction of AI overviewsmay have depressed search referrals by 20 to 60 percent” for DNP. SF1785. Dr. Sinnreich,OpenAI’s media expert, opined based on a 2026 Reuters Institute analysis that “referral traffic topublishers from both Google Search and Google Discover has dropped considerably (from over 5billion monthly referrals via Discover to fewer than 4 billion, and from well over 3 billion viaSearch to slightly more than 2 billion) since Google introduced AI overviews.” SF1787. Dr.Sinnreich also admitted that declines in Google referrals are related to AI-generated summaries,among other things.

Собствените медийни и икономически експерти на OpenAI свързват спада на трафика от препратки към сайтове като Times директно с обобщенията от изкуствен интелект, като Google AI Overviews. Те предполагат, че трафикът от търсене може да е намалял с цели 60 процента.

Говорителят на Microsoft Хаурек предупреди, че „показанията на Сатя и позицията на Microsoft по това дело са напълно последователни. Той говори за общи принципи и за текущите промени в начина, по който хората намират и потребяват информация. Тези наблюдения не трябва да се бъркат с изводи по въпросите за авторските права, разглеждани от съда, към които Microsoft се отнася в своите заявления.“

Но въз основа на този новоразсекретен документ изглежда съвсем ясно, че Microsoft и OpenAI са знаели, че ще навредят непоправимо на издателската индустрия, на „милионите хора“, които тя заема, и по този начин ще навредят на собствения си продукт, но въпреки това са продължили в преследване на „милиарди“ долари — независимо от порочния кръг.

Следвайте теми и автори от тази статия, за да виждате още подобни материали в персонализирания си поток на началната страница и да получавате актуализации по имейл.
  • Terrence O'Brien

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Verge на

Прочетете оригинала в The Verge ↗

Текстът и изображенията са собственост на The Verge и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини