Anthropic маркує результати Claude водяними знаками, але критики ставлять під сумнів компроміси
Ключові моменти
- Anthropic вбудовує у Claude водяний знак, який позначає тексти ШІ за допомогою статистичних закономірностей у виборі слів для дотримання норм ЄС.
- Критики стверджують, що якість тексту погіршується, оскільки модель обирає слова на основі ключа водяного знака, а не значення. Водночас такі інструменти, як Declaude, можуть видалити це маркування.
- Для юридичних фірм система здебільшого не становить проблеми. Однак можливість назавжди виявляти текст, створений ШІ, може створити незручності під час переговорів про гонорари або коли договори прямо забороняють використання ШІ.
Текстовий водяний знак Anthropic для Claude має зробити контент, створений ШІ, виявлюваним. Але критики сумніваються, що вибір слів залишається незмінним, а юристи стикаються з новими проблемами у сфері прозорості.
Anthropic наполягає, що текстовий водяний знак для Claude не впливає на зміст, творчість чи читабельність. Метод ґрунтується на підході Google SynthID-Text і змінює джерело випадковості для вибору слів під час генерації тексту, створюючи статистично виявлювану закономірність. Видимі позначки не вставляються. Приховані символи не додаються.
Блогер Джон Грубер із цим не погоджується. У розлогому дописі на Daring Fireball він стверджує, що жодні два синоніми не мають абсолютно однакового значення. Коли Claude обирає між словами «хмарний» і «сірий» на основі секретного ключа водяного знака, а не семантичної точності, якість тексту неминуче погіршується. Система іноді підвищує ймовірність гіршого слова й знижує її для найкращого, пише Грубер. За його словами, твердження Anthropic про те, що різниця є «непомітною», просто неправильне.
Грубер веде впливовий технологічний блог Daring Fireball із 2002 року. Він також був одним зі співавторів Markdown — мови форматування, яку тепер широко використовують чат-боти.
Грубера не переконує навіть дослідження SynthID, опубліковане Google DeepMind у журналі Nature і процитоване Anthropic. Виміряні там показники оцінок «подобається»/«не подобається» не є достовірним мірилом якості тексту, стверджує він. Ніхто не ставить чат-боту негативну оцінку через те, що він написав «банани» замість «ананасів». Грубер припускає, що репутація Gemini як слабшої моделі порівняно з Claude і ChatGPT частково може бути пов’язана з тим, що SynthID уже активний.
Юридичним фірмам потрібно готуватися до питань щодо прозорості
Галузеве юридичне видання Artificial Lawyer дослідило, що водяні знаки Anthropic означають для юридичних фірм. Висновок видання здебільшого спокійний. Позначки нешкідливі, стверджує Artificial Lawyer, і в більшості випадків ні клієнти, ні суди не заперечували б проти використання ШІ. Як зазначається в аналізі, деякі клієнти навіть активно просять використовувати його.
Однак у конкретних ситуаціях усе стає складніше, згідно з оцінкою Artificial Lawyer. Якщо клієнти прямо заборонили використання ШІ у своїх справах або суддя скептично ставиться до нього, внесок ШІ можна буде довести навіть тоді, коли поданий документ є бездоганним з фактичного погляду. Це може вплинути на перебіг провадження або судового процесу.
Водяні знаки також переходять разом із текстом, зауважує Artificial Lawyer. Складний договір може містити положення з маркуванням ШІ, тоді як решту тексту написала людина. Майбутні договори, створені на основі старих шаблонів із розділами, згенерованими ШІ, успадковуватимуть ці позначки. Якщо використовуються кілька великих мовних моделей, різні водяні знаки можуть навіть накладатися один на одного в одному документі.
Переговори про гонорари також можуть змінитися. Якщо клієнти вимагатимуть знижок, оскільки ШІ спростив роботу, частку внеску ШІ в принципі можна буде перевірити, зазначає видання.
Сама Anthropic стверджує, що у фрагментах, насичених фактами, водяний знак трапляється рідше, оскільки там менше альтернативних варіантів слів. Для юридичних текстів, які залежать від точності, це важливе застереження, хоча емпіричних досліджень на цю тему поки немає.
Той, хто хоче видалити позначки, може зробити це за допомогою інструментів перефразування, таких як Declaude. Його розробник Джеймс Падолсі критикує відповідне регулювання ЄС як довільне. За його словами, система переважно зачіпає звичайних користувачів, водночас майже не перешкоджаючи навмисному обходу.
Anthropic запроваджує водяні знаки для дотримання вимог Закону ЄС про штучний інтелект, але застосовує їх у всьому світі, оскільки не може обмежити цю функцію за регіонами. Усі моделі Claude, випущені після 2 серпня, підтримують маркування. Старіші моделі будуть доопрацьовані в найближчі місяці.
Новини ШІ без хайпу — відібрані людьми
Підпишіться на THE DECODER, щоб читати матеріали без реклами, отримувати щотижневу розсилку новин про ШІ, наш ексклюзивний звіт про передові розробки «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.