OpenAI почне маркувати текст ChatGPT у ЄС
OpenAI почне додавати невидимий водяний знак до тексту, згенерованого ChatGPT і Codex, у Європейському Союзі, щоб дотримуватися вимог Закону ЄС про ШІ, повідомила компанія в понеділок у дописі в блозі.
Правила прозорості Закону ЄС про ШІ, які набули чинності 2 серпня, зобов’язують компанії, що розробляють ШІ, позначати контент, створений штучним інтелектом, так, щоб його могли ідентифікувати інші системи.
OpenAI повідомила, що протягом найближчих тижнів водяний знак буде доступний користувачам ChatGPT і Codex, які відповідають вимогам, на всіх тарифних планах, але лише в ЄС. Розробники, які використовують API OpenAI в будь-якій точці світу, можуть увімкнути його для вибраних моделей уже сьогодні; за замовчуванням він вимкнений. OpenAI зазначила, що на момент запуску не робитиме водяні знаки для тексту глобальним налаштуванням за замовчуванням.
Водяний знак не є фактичним символом, а працює завдяки непомітному формуванню вибору слів моделлю, залишаючи шаблон, якого читачі не бачать, але який може виявити спеціальний детектор. Оскільки він міститься безпосередньо в словах, то зберігається разом із текстом під час копіювання та вставлення. OpenAI повідомила, що водяний знак не ідентифікує користувача, а також не побачила суттєвих змін у продуктивності своїх моделей після його ввімкнення.
OpenAI також опублікувала технічний звіт про свій метод під назвою textGrain разом із цим оголошенням. Звіт, написаний у співавторстві з дослідниками Пенсильванського університету та Єльського університету, демонструє на прикладі використання секретного ключа для впорядкування прогнозів наступного слова під час завершення речення. Якщо об’єднати сотні таких непомітних змін, детектор зможе виявити контент, створений ШІ, використовуючи лише текст і ключ.
Чи можна видалити водяний знак редагуванням? Тести OpenAI свідчать, що так. В одному з тестів заміна 10% слів синонімами знизила показник виявлення приблизно з 92% до 66%. Компанія також повідомила, що короткі уривки, математичні відповіді та перекладений текст важче виявити.

«Ці обмеження зумовили наше рішення спочатку надати доступ до детектора лише схваленим дослідникам і експертним організаціям, які можуть допомогти нам оцінити його надійність і відповідальне використання», — заявила компанія.
OpenAI також застерегла, що відсутність водяного знака «не доводить авторство людини». Текст може бути надто коротким або надто сильно відредагованим, або ж він може походити від ШІ іншої компанії.
«[Водяні знаки] можуть свідчити про те, що система OpenAI згенерувала або обробила частину уривка, але не показують, скільки людського судження, редагування чи творчості було в нього вкладено», — повідомила компанія.
Оголошення з’явилося через два місяці після того, як Anthropic заявила, що додаватиме водяні знаки до тексту, згенерованого Claude, причому цей крок компанія застосовує в усьому світі. Це рішення викликало обурення деяких користувачів Claude, які стверджували, що саме вони надали «інструкції, контекст і рішення», тоді як Claude був лише «інструментом».
OpenAI раніше вже розробила водяний знак для тексту, але не поспішала його випускати, частково через побоювання, що користувачі перейдуть до конкурентів, які не використовують водяні знаки, повідомляла The Wall Street Journal у 2024 році.
Anthropic, Google, Meta, Microsoft і OpenAI — серед компаній, які зобов’язалися дотримуватися кодексу практик ЄС щодо контенту, створеного ШІ.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.