OpenAI и Microsoft знали, что запускают «порочный круг» для интернета
Компании знали, что ведут нас к Google Zero, и всё равно сделали это.
Компании знали, что ведут нас к Google Zero, и всё равно сделали это.
Недавно рассекреченные судебные документы по делу New York Times против OpenAI и Microsoft выглядят весьма компрометирующими. Собственные документы компаний предупреждали, что это запускает «петлю обречённости», которая нанесёт ущерб интернету, называли сбор данных для обучения их моделей «крупнейшей кражей труда в истории человечества» и утверждали, что это «полностью высмеивает саму идею добросовестного использования».
Многие из наиболее примечательных цитат в документе принадлежат директору Microsoft по прикладным наукам Бренту Хехту. Однако компания попыталась дистанцироваться от его утверждений. Представитель Microsoft Алекс Хаурек сказал The Verge: «Эти комментарии отражают личную точку зрения одного сотрудника, не являются юридическим анализом и не выражают позицию компании».
В отдельном судебном документе Джордан Усдан, генеральный менеджер по стратегии и операционной деятельности в сфере данных в Microsoft AI, охарактеризовал роль Хехта как оппозиционную. Он заявил, что Хехт «придерживается отличающихся, академических и ориентированных на будущее взглядов на то, как должны функционировать экосистемы данных для ИИ, и работает в Microsoft, чтобы привносить асимметричные, футуристические и академические точки зрения… при этом он не является человеком, выступающим от имени Microsoft конкретно по своим теоретическим взглядам на потенциальное влияние ИИ на создателей контента».
Но хочет Microsoft считать эти комментарии своими или нет, очевидно, что это сбылось. Google Zero существует! ИИ поглощает интернет!
В иске NYT есть ещё немало диких заявлений самых разных людей, включая Сатью Наделлу, Сэма Альтмана и других сотрудников OpenAI. Вот некоторые выдержки из документа на 92 страницы.
«Ошеломляющая кража»
Во введении цитируются Хехт и руководитель ChatGPT в OpenAI (предположительно Ник Тёрли), причём так, что создаётся впечатление: компании знали, что представляют «экзистенциальную угрозу» для таких издателей, как New York Times. Хехт называет сбор данных ChatGPT и Copilot «крупнейшей кражей труда в истории человечества» и говорит, что защита Microsoft «полностью высмеивает саму идею “добросовестного использования”».
Это «петля обречённости»
Сатья Наделла признаёт, что чат-боты фактически заменили поиск и устранили необходимость обращаться непосредственно к первоисточнику за информацией. Но, возможно, ещё более компрометирующим является внутренний документ Microsoft, в котором говорится: «Наша стратегия в области ИИ-контента запустила “петлю обречённости”, которая одновременно ухудшит работу наших моделей и всего интернета: крайне необычно, чтобы конечный продукт угрожал экономическим основам своих ключевых поставщиков, но именно такую ситуацию мы создали для нашего бизнеса, связанного с большими языковыми моделями, в отношении его “цепочки поставок контента”».
Это даже не настоящее число
Не дайте себя обмануть заявлениями OpenAI или Microsoft об альтруистических намерениях. Сооснователя OpenAI Грега Брокмана гораздо больше интересуют «газиллионы» долларов, которые он потенциально может заработать на коммерческом ИИ.
Платный доступ — ну и что
Несмотря на то, что позднее Наделла заявил: «Всё, что защищено платным доступом, должно лицензироваться», представитель OpenAI признал, что ему «не известно» ни о каких попытках выявлять или удалять контент, защищённый платным доступом, из обучающих данных.
«Безумно хорош в воспроизведении»
Похоже, внутри OpenAI прекрасно знали о склонности ChatGPT просто воспроизводить защищённые авторским правом материалы «дословно». Хотя компания признавала, что «предотвращение запоминания» важно для «минимизации нарушений авторских прав», сотрудники признавали, что GPT-4 «запомнил огромное количество данных и поэтому будет безумно хорошо воспроизводить их».
Далее в иске приводится несколько примеров того, как ChatGPT в ответ на запросы выдавал длинные фрагменты текста прямо из статей Times, Mercury News, The Denver Post, LifeHacker и Eurogamer.
«“Пылесосящие” всю их работу»
Microsoft знала, как будет воспринято массовое сканирование интернета, и признала, что «почти никто не предполагал, что созданный им контент будет использоваться таким образом, и никто не получает компенсации за его использование».
«Замена труду людей»
Директор по политике OpenAI Джек Кларк видел, к чему всё идёт, заявляя, что компания «создаёт системы, которые заменяют труд людей, определяющих “культуру” общества». Во внутренних документах ChatGPT описывался как «современный газетный киоск». Позднее цитируется Ник Тёрли из OpenAI: получив ответ от чат-бота, пользователь «не имеет веской причины нажимать» на ссылку на источник.
Уничтожение собственной цепочки поставок
Microsoft цитируется как признавшая, что «большие языковые модели — это продукт, уничтожающий собственную цепочку поставок», поскольку во многих случаях они заменяют собственные обучающие данные.
OpenAI знает, что убивает реферальный трафик
Собственные эксперты OpenAI в области медиа и экономики напрямую связали падение реферального трафика на такие сайты, как Times, с ИИ-сводками, например Google AI Overviews. Они предположили, что переходы из поиска могли сократиться на 60 процентов.
Представитель Microsoft Хаурек предупредил: «Показания Сатьи и позиция Microsoft по этому делу полностью согласуются. Он говорил об общих принципах и происходящих изменениях в том, как люди находят и потребляют информацию. Эти наблюдения не следует путать с выводами по вопросам авторского права, рассматриваемым судом, — Microsoft излагает их в своих документах».
Но из этого недавно рассекреченного документа довольно ясно следует, что Microsoft и OpenAI знали: они нанесут непоправимый ущерб издательской индустрии, «миллионам людей», которых она нанимает, и, как следствие, навредят собственному продукту, но всё равно продолжили этот путь в погоне за «газиллионами» долларов — к чёрту эту петлю обречённости.
- Терренс О’Брайен
Самое популярное
- Apple Watch Series 12 знаменуют начало новой эры носимых устройств
- Сгенерированный ИИ фильм «Одиссея» длительностью 2,5 часа слишком длинный на 2,5 часа
- Главное обновление камеры iPhone 18 Pro — в небольших улучшениях
- Внутри внезапно стремительно развивающегося мира безопасности ИИ
- Ваше роботакси может оказаться стукачом
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

![This case is about, as Microsoft’s Director of Applied Science [Brent Hecht] put it, “an astonishing theft of unprecedented proportions”; SF1437, perhaps the “largest theft of labor in human history.”SF1652. Defendants repeatedly copied millions of Plaintiffs’ copyrighted articles in their entiretywithout permission to produce substitutive commercial AI products. OpenAI’s Head of ChatGPTwrote that “[p]ublishers” face an “existential threat” from those products, SF1466, which, he said,“are largely substitutive, period” and “will get more and more substitutive as they get better.”SF1473-74. Such admissions eviscerate Defendants’ “fair use” defense because substitution is“copyright’s bête noire.” Andy Warhol Foundation for the Visual Arts, Inc. v. Goldsmith, 598 U.S.508, 528 (2023). For Defendants to prevail on this defense “would,” the same Microsoft executiverecognized, arguably “make a complete mockery of the idea of ‘fair use.’” SF1450.](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/Screenshot-2026-09-18-at-12.47.37-PM.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)



![That same year, OpenAI recognized that its API “might outputexisting content verbatim.” SF945. By 2021, OpenAI considered the prevention of memorizationimportant “for fair use [compliance] and minimizing copyright violations in model output.” SF946.In June 2022, OpenAI employees acknowledged that GPT-4 would have “memorized a ton of dataand therefore will be insanely good at regurgitation.”](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/regurgitation.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)

![OpenAI Policy Director Jack Clark similarly wrote: “[O]ur work on AI and Creativity isgoing to increasingly lead to us creating systems that substitute for the labor of the people thatdefine the ‘culture’ of society[.]” SF1677. OpenAI internal documents characterize ChatGPT as“[t]he modern newsstand,” SF1500, and brag that ChatGPT provides “fast, timely answers…whichyou would have previously needed to go to a search engine for” including “up-to-date sportsscores, news, stock quotes, and more.”](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/substitute.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)
![Defendants acknowledge the predictable consequences of this design. Per Microsoft, the“[p]romise of LLMs is largely in the same information work domains from which they get theircontent... They naturally compete with their content supply chain.” SF1798. They substitute forthe “labor of the people” who produced the original content on which they were trained, including,among other things, newspapers and books. SF1452, 1677. There is a “real risk” that GenAI could“significantly disrupt[] the employment of the very people who generated the data on which thefoundation model was trained.” SF1467. “LLMs are a product that destroys its supply chain.”](https://platform.theverge.com/wp-content/uploads/sites/2/2026/09/destroys.png?quality=90&strip=all&crop=0%2C0%2C100%2C100&w=2400)
