Anthropic анонсувала API для виявлення водяних знаків, який дозволить третім сторонам виявляти тексти ШІ Claude
Незабаром Anthropic запропонує API для виявлення водяних знаків, який дасть змогу стороннім розробникам інтегрувати виявлення текстів, створених ШІ, у власні застосунки.
Компанія використовує для своєї ШІ-моделі Claude варіант методу SynthID Text, який Google DeepMind опублікувала в журналі Nature у 2024 році. Водяний знак змінює джерело випадковості під час вибору слів, створюючи шаблон, який можна відстежити. За словами Anthropic, це не впливає «на зміст, рівень креативності чи читабельність тексту Claude». Google DeepMind візуалізувала цей процес у 2024 році за допомогою наведеної нижче анімації.
Водяний знак працює менш надійно в коротких текстах або насичених фактами уривках, де не так багато альтернативних формулювань. Те саме стосується коду. Звичайні виправлення, під час яких людина самостійно обирає кожне слово, також не міститимуть водяного знака. Переклади — інша справа, оскільки там Claude добирає всі слова. За словами Anthropic, ґрунтовне перефразування може видалити водяний знак у опублікованому FAQ.
Водяний знак може лише вказати на ймовірну участь Claude у створенні тексту. Він не може визначити, чи написав Claude весь текст, чи лише суттєво його відредагував, а також не може встановити, чи походить текст від людини або іншої моделі ШІ.
Регулювання ЄС стимулює глобальне розгортання
Anthropic додає водяні знаки, щоб дотримуватися вимог Закону ЄС про ШІ. У липні 2026 року компанія разом із приблизно 190 іншими підписантами підписала Кодекс практики ЄС щодо прозорості контенту, створеного ШІ. Оскільки наразі не існує технічної можливості обмежити цю функцію за регіонами, водяні знаки запускаються в усьому світі. За словами Anthropic, компанія постійно вивчає додаткові можливості й повідомлятиме про оновлення.
Усі моделі, випущені після 2 серпня 2025 року, підтримують водяні знаки одразу після запуску. Старіші моделі Claude отримають цю функцію в найближчі місяці. Для файлів Anthropic використовує відкритий стандарт C2PA, який додає метадані, не змінюючи сам файл.
Система водяних знаків Anthropic працює інакше, ніж зовнішні інструменти виявлення ШІ, такі як Pangram. Ці сервіси не мають доступу до ключів Anthropic. Натомість вони шукають типові закономірності в текстах, створених ШІ, як-от характерні формулювання або надмірно вживані слова. Перевірка на наявність водяного знака — принципово інший підхід, який на практиці має бути надійнішим.
Новини про ШІ без зайвого галасу — відібрані людьми
Підпишіться на THE DECODER, щоб читати матеріали без реклами, отримувати щотижневу розсилку про ШІ, наш ексклюзивний звіт про передові технології «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.