Правителството на САЩ застава на страната на OpenAI по въпроса за обучението на LLM върху материали, защитени с авторски права
По дело, заведено от New York Times срещу OpenAI, администрацията на Тръмп представи становище от 20 страници в защита на използването без лиценз от създателя на ChatGPT на защитени с авторски права материали за обучението на неговите LLM модели.
„Съединените щати имат силен интерес да продължат да развиват стабилна и конкурентоспособна
индустрия за изкуствен интелект, която да задава стандарта за практиките и процедурите при използването на ИИ
в световен мащаб… Поради това е от решаващо значение Съединените щати да „запазят глобалното лидерство в изкуствения интелект“,“ се казва в становището, като се цитира указ, подписан от президента Доналд Тръмп миналата година.
LLM моделите, които захранват чатботове като ChatGPT, Claude и Gemini, се обучават върху невъобразимо огромни бази данни от публикувани произведения, включително защитени с авторски права книги, статии и други медии, които компаниите за ИИ добавят в тези бази данни без разрешение. Много издатели, включително New York Times по това дело, се опитват да докажат, че е незаконно компании за ИИ като OpenAI да обучават моделите си за ИИ с техни материали, защитени с авторски права.
Този въпрос — може ли да се използват защитени с авторски права материали за обучение на ИИ? — не е еднозначен, оттам и продължителният правен дебат по темата. Тези разговори често се съсредоточават върху добросъвестното използване — изключение в авторското право, което допуска определени сценарии, при които използването на защитено с авторски права произведение на друг човек без разрешение може да бъде обявено за законно. В този случай дебатът за добросъвестното използване разглежда дали употребата на защитени с авторски права произведения от компаниите за ИИ е достатъчно „трансформираща“, за да постанови съдията, че тя е законна.
„Ограничаването на разработването на LLM модели въз основа на неправилно разбиране на доктрината за добросъвестното използване би осуетило този творчески и научен напредък, като същевременно възпрепятства американския просперитет и икономическата мобилност“, се казва в становището.
Досега делата, свързани с обучението на ИИ и нарушаването на авторски права, като цяло са били благоприятни за компаниите за ИИ. Миналата година съдия Уилям Олсъп нареди на Anthropic да изплати споразумение за 1,5 милиарда долара по дело за авторски права на група писатели, чиито произведения са били използвани за обучението на моделите за ИИ на компанията; Anthropic обаче не беше санкционирана за самото обучение на ИИ. Вместо това компанията беше глобена за използването на незаконни сенчести библиотеки, за да пиратства книгите, използвани за обучението.
„Както всеки читател, който се стреми да стане писател, LLM моделите на Anthropic са се обучавали върху произведения не за да ги изпреварят и възпроизведат или изместят — а за да направят рязък завой и да създадат нещо различно“, написа съдия Олсъп, сравнявайки обучението на LLM модела с четенето на книга от човек.
Това ново становище на администрацията на Тръмп не е съдебно решение, тъй като делото се разглежда във Федералния окръжен съд за Южния окръг на Ню Йорк, а авторите на становището нямат юрисдикция над него. Намесата на администрацията на Тръмп обаче все пак може да има тежест.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.