OpenAI и Microsoft са знаели, че започват „порочен кръг“ за мрежата
Компаниите са знаели, че ни водят към Google Zero, и въпреки това са го направили.
Компаниите са знаели, че ни водят към Google Zero, и въпреки това са го направили.
Наскоро разсекретени съдебни документи по делото на New York Times срещу OpenAI и Microsoft са доста уличаващи. Собствената документация на компаниите предупреждава, че това поставя началото на „порочен кръг“, който ще навреди на уеб, определя извличането на данни за обучението на моделите им като „най-голямата кражба на труд в човешката история“ и заявява, че то прави „пълна подигравка с идеята за честна употреба“.
Много от най-впечатляващите цитати в документа са на директора по приложни науки на Microsoft Брент Хехт. Компанията обаче се опита да се дистанцира от твърденията на Хехт. Говорителят на Microsoft Алекс Хаурек каза пред The Verge: „Тези коментари отразяват индивидуалната гледна точка на един служител, не представляват правен анализ и не изразяват позицията на компанията.“
В отделно съдебно заявление Джордан Усдън, генерален мениджър по стратегията и операциите с данни в Microsoft AI, определи ролята на Хехт като противопоставяща се. Той заяви, че Хехт „има различни, академични и насочени към бъдещето възгледи за това как трябва да функционират екосистемите от данни за изкуствения интелект и е нает в Microsoft, за да представя асиметрични, футуристични и академични гледни точки … нито пък е човек, който говори от името на Microsoft конкретно по отношение на теоретичните си възгледи за потенциалния ефект на изкуствения интелект върху създателите на съдържание“.
Но независимо дали Microsoft иска да поеме отговорност за тези коментари, ясно е, че това се сбъдна. Google Zero е реалност! Изкуственият интелект поглъща уеб!
В заявлението на NYT има още много диви твърдения от различни личности, включително Сатя Надела, Сам Алтман и други служители на OpenAI. Ето някои акценти от документа от 92 страници.
„Невероятна кражба“
Въведението цитира Хехт и ръководителя на ChatGPT в OpenAI (вероятно Ник Търли) по начин, който изглежда показва, че компаниите са знаели, че представляват „екзистенциална заплаха“ за издатели като New York Times. Хехт нарича извличането на данни от ChatGPT и Copilot „най-голямата кражба на труд в човешката история“ и казва, че защитата на Microsoft прави „пълна подигравка с идеята за „честна употреба“.“
Това е „порочен кръг“
Сатя Надела признава, че чатботовете на практика са заменили търсенето и са премахнали необходимостта човек да посещава директно източника за информация. Но може би още по-уличаващ е вътрешен документ на Microsoft, в който се казва: „Нашата стратегия за съдържание с изкуствен интелект постави началото на „порочен кръг“, който едновременно ще навреди на представянето на моделите ни и на целия уеб: твърде необичайно е краен продукт да застрашава икономическите основи на основните си доставчици, но това е ситуацията, която създадохме за бизнеса си с LLM по отношение на неговата „верига за доставки на съдържание“.“
Това дори не е истинско число
Не се заблуждавайте от твърденията на OpenAI или Microsoft за алтруистични намерения. Съоснователят на OpenAI Грег Брокман се интересува повече от „милиардите“ долари, които потенциално би могъл да спечели чрез комерсиалния изкуствен интелект.
Платена стена — какво толкова
Въпреки че по-късно Надела е цитиран да казва: „всичко, което е зад платена стена, трябва да бъде лицензирано“, представител на OpenAI призна, че не му е известно да са полагани усилия за откриване или премахване на съдържание зад платена стена от данните за обучение.
„Невероятно добър в повтарянето“
Изглежда, че вътрешно OpenAI е било напълно наясно със склонността на ChatGPT просто да възпроизвежда защитени с авторски права материали „дословно“. Въпреки че компанията е признавала, че „предотвратяването на запаметяването“ е важно за „минимизиране на нарушенията на авторските права“, служители са признали, че GPT-4 е „запаметил тонове данни и затова ще бъде невероятно добър в повтарянето“.
В заявлението след това са посочени няколко примера за това как ChatGPT извежда дълги откъси директно от статии в Times, Mercury News, The Denver Post, LifeHacker и Eurogamer в отговор на запитвания.
„Поглъщане“ на целия им труд
Microsoft е знаела как ще бъде възприето масовото ѝ извличане на съдържание от интернет и е признала, че „почти никой не е възнамерявал създаденото от него съдържание да бъде използвано по този начин, нито получава възнаграждение за употребата му“.
„Заместител на труда на хората“
Директорът по политиките на OpenAI Джак Кларк е видял какво предстои, заявявайки, че компанията „създава системи, които заместват труда на хората, определящи „културата“ на обществото“. Вътрешни документи описват ChatGPT като „модерната будка за вестници“. По-късно Ник Търли от OpenAI е цитиран да казва, че след като получите отговор от чатбота, „няма основателна причина да кликвате“ върху връзка към източника.
Унищожаване на собствената верига за доставки
Цитира се признание на Microsoft, че „LLM са продукт, който унищожава собствената си верига за доставки“, тъй като в много случаи е заместител на собствените му данни за обучение.
OpenAI знае, че убива трафика от препратки
Собствените медийни и икономически експерти на OpenAI свързват спада на трафика от препратки към сайтове като Times директно с обобщенията от изкуствен интелект, като Google AI Overviews. Те предполагат, че трафикът от търсене може да е намалял с цели 60 процента.
Говорителят на Microsoft Хаурек предупреди, че „показанията на Сатя и позицията на Microsoft по това дело са напълно последователни. Той говори за общи принципи и за текущите промени в начина, по който хората намират и потребяват информация. Тези наблюдения не трябва да се бъркат с изводи по въпросите за авторските права, разглеждани от съда, към които Microsoft се отнася в своите заявления.“
Но въз основа на този новоразсекретен документ изглежда съвсем ясно, че Microsoft и OpenAI са знаели, че ще навредят непоправимо на издателската индустрия, на „милионите хора“, които тя заема, и по този начин ще навредят на собствения си продукт, но въпреки това са продължили в преследване на „милиарди“ долари — независимо от порочния кръг.
- Terrence O'Brien
Най-популярни
- Apple Watch Series 12 поставя началото на нова ера за носимите устройства
- Филмът „Одисея“, генериран от изкуствен интелект, е с 2,5 часа прекалено дълъг
- Голямата актуализация на камерата на iPhone 18 Pro е свързана с малките подобрения
- Внезапно разрастващият се свят на безопасността на изкуствения интелект отвътре
- Вашето роботакси може да ви следи
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

![This case is about, as Microsoft’s Director of Applied Science [Brent Hecht] put it, “an astonishing theft of unprecedented proportions”; SF1437, perhaps the “largest theft of labor in human history.”SF1652. Defendants repeatedly copied millions of Plaintiffs’ copyrighted articles in their entiretywithout permission to produce substitutive commercial AI products. OpenAI’s Head of ChatGPTwrote that “[p]ublishers” face an “existential threat” from those products, SF1466, which, he said,“are largely substitutive, period” and “will get more and more substitutive as they get better.”SF1473-74. Such admissions eviscerate Defendants’ “fair use” defense because substitution is“copyright’s bête noire.” Andy Warhol Foundation for the Visual Arts, Inc. v. Goldsmith, 598 U.S.508, 528 (2023). For Defendants to prevail on this defense “would,” the same Microsoft executiverecognized, arguably “make a complete mockery of the idea of ‘fair use.’” SF1450.](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/Screenshot-2026-09-18-at-12.47.37-PM.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)



![That same year, OpenAI recognized that its API “might outputexisting content verbatim.” SF945. By 2021, OpenAI considered the prevention of memorizationimportant “for fair use [compliance] and minimizing copyright violations in model output.” SF946.In June 2022, OpenAI employees acknowledged that GPT-4 would have “memorized a ton of dataand therefore will be insanely good at regurgitation.”](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/regurgitation.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)

![OpenAI Policy Director Jack Clark similarly wrote: “[O]ur work on AI and Creativity isgoing to increasingly lead to us creating systems that substitute for the labor of the people thatdefine the ‘culture’ of society[.]” SF1677. OpenAI internal documents characterize ChatGPT as“[t]he modern newsstand,” SF1500, and brag that ChatGPT provides “fast, timely answers…whichyou would have previously needed to go to a search engine for” including “up-to-date sportsscores, news, stock quotes, and more.”](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/substitute.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)
![Defendants acknowledge the predictable consequences of this design. Per Microsoft, the“[p]romise of LLMs is largely in the same information work domains from which they get theircontent... They naturally compete with their content supply chain.” SF1798. They substitute forthe “labor of the people” who produced the original content on which they were trained, including,among other things, newspapers and books. SF1452, 1677. There is a “real risk” that GenAI could“significantly disrupt[] the employment of the very people who generated the data on which thefoundation model was trained.” SF1467. “LLMs are a product that destroys its supply chain.”](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/destroys.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)
