Anthropic наносить водяні знаки на всі результати Claude у всьому світі — позначки «можуть зберігатися після деяких редагувань»
Ключові моменти
- Anthropic підписала Кодекс практики Закону ЄС про штучний інтелект і починаючи із серпня 2026 року оснащуватиме всі нові моделі Claude машиночитаними позначками. Вимога діятиме в усьому світі.
- Текст отримуватиме невидимі водяні знаки, які зберігаються під час копіювання. Файли, як-от зображення, отримуватимуть підписані метадані про походження відповідно до стандарту C2PA.
- Anthropic визнає обмеження: водяний знак не доводить, що контент написав Claude, оскільки люди часто використовують ШІ для редагування або перекладу власного тексту. Значне редагування чи зміна формату також можуть повністю видалити позначки, однак вони «можуть зберігатися після певного редагування».
Anthropic підписала Кодекс практики Закону ЄС про штучний інтелект щодо прозорості контенту, створеного ШІ. Починаючи із серпня 2026 року, нові моделі Claude вбудовуватимуть водяні знаки в текст і додаватимуть до файлів підписані метадані про походження.
Моделі Claude, які будуть запущені в ЄС 2 серпня 2026 року або пізніше, матимуть вбудоване це маркування. Вимога не обмежиться кордонами ЄС. Вона поширюватиметься на всі продукти Claude у світі, зокрема API, Claude, Claude Code, Claude Cowork і Claude Tag.
Згенерований текст міститиме вбудовані водяні знаки, а згенеровані файли отримуватимуть цифровий підпис метаданих про походження. Для наявних моделей закон передбачає перехідний період, але Anthropic заявляє, що вже працює над їхньою модернізацією.
Компанія також планує випустити інструменти перевірки, щоб користувачі та треті сторони могли перевіряти позначки, хоча поки не повідомила, коли саме. За словами Anthropic, розробники, які інтегрують Claude у свої продукти, мають визначити, які вимоги статті 50 поширюються на їхні сервіси.
Два способи ідентифікації контенту, створеного ШІ
Anthropic планує використовувати два типи позначок. За словами компанії, текст, створений Claude, міститиме невидимий водяний знак, який не впливає на його зміст, якість чи читабельність. Водяний знак зберігається під час копіювання та вставлення і «може зберігатися після певного редагування». Він застосовується на рівні моделі, тому не має значення, яким продуктом Claude ви користуєтеся.
Підтримувані файли, зокрема зображення у форматах .svg, .png і .jpg, міститимуть підписані метадані про походження на основі відкритого стандарту C2PA, розробленого Коаліцією за походження та автентичність контенту. Підпис свідчить, що Claude обробив файл, і може виявити подальше втручання. Водяні знаки в тексті також мають працювати через хмарних партнерів, таких як AWS, Google Cloud і Microsoft Foundry, хоча ці платформи можуть не підтримувати підписані метадані.
Виявлення має певні обмеження
Anthropic відкрито говорить про обмеження. Виявлений водяний знак не означає, що контент насправді написав Claude. Люди постійно використовують Claude для коректури, перекладу або узагальнення, тож результат може містити водяний знак, навіть якщо ідеї належали людині.
Відсутність водяного знака також не прояснює ситуацію. Модель могла бути випущена до впровадження водяних знаків, текст могли суттєво відредагувати або перекласти, уривок може бути надто коротким для надійного виявлення, або метадані могли бути видалені під час конвертації формату чи створення знімка екрана.
Справжнє випробування — наскільки добре ці водяні знаки зберігатимуться після редагування, зміни форматування та перекладу. Якщо вони витримають такі зміни, перевірка на наявність відомого водяного знака має бути надійнішою за інструменти на кшталт Pangram, чиї запатентовані методи виявлення не розкривають, що саме спричинило результат. Сторонні детектори могли б додати підтримку водяного знака Anthropic, отримавши надійніший сигнал.
Виявлення тексту, створеного ШІ, залишається чутливим питанням для суспільства
Anthropic не єдина компанія, яка працює в цьому напрямі. Google DeepMind відкрила код своєї системи водяних знаків SynthID, вбудувавши її в моделі Gemini. SynthID незначно змінює значення ймовірностей під час прогнозування токенів, щоб створити водяний знак без погіршення якості тексту. Система працює різними мовами, але має труднощі з текстом, який редагували після генерації.
OpenAI вже близько двох років тримає детектор тексту з точністю 99,9 відсотка, але досі його не випустила. Серед причин — те, як легко користувачі можуть обійти його за допомогою перекладу чи перефразування, ризик стигматизації певних груп і, ймовірно, побоювання, що загальнодоступний детектор може зашкодити власному бізнесу OpenAI.
Цей ризик особливо серйозний в освіті, де ненадійні детектори можуть призводити до хибних звинувачень у списуванні. Водночас є вагомі причини хотіти знати, коли і наскільки активно використовували ШІ. Дослідження показують, що надмірна залежність від інструментів ШІ може послаблювати навички критичного мислення та письма, особливо серед студентів, які сприймають їх як швидкий спосіб отримати відповідь, а не як допомогу в навчанні. Проблема виходить за межі академічної сфери: шахраї вже зараховують фіктивних студентів до американських коледжів і використовують ШІ, щоб без зусиль виконувати навчальні завдання та отримувати фінансову допомогу.
Рішення Anthropic також може вплинути на її бізнес. Claude популярний для інтелектуальної роботи, особливо серед школярів і студентів, оскільки навіть старіші моделі створюють досить природний текст. На тлі того, як школи й університети вже сперечаються щодо використання ШІ в навчальній роботі, надійніше виявлення може зробити Claude менш привабливим для таких користувачів.
Новини про ШІ без галасу — відібрані людьми
Підпишіться на THE DECODER, щоб читати матеріали без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний передовий звіт «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.