Sakhanda Wire
NVDA $225.16 -0.06% MSFT $495.40 -0.30% GOOGL $345.90 -0.13% META $589.85 -0.86% AMZN $262.65 -0.94%
← До новин

Anthropic розкриває більше подробиць про те, як працюватимуть нові водяні знаки Claude

Anthropic опублікувала допис у блозі в п’ятницю, намагаючись відповісти на деякі базові запитання про те, як вона маркуватиме текст, згенерований її чатботом Claude. Наприклад: як насправді працюватиме маркування? Чи можна його приховати за допомогою редагування? І як це вплине на код?

Користувачі Claude обговорюють цей крок відтоді, як компанія на початку цього тижня повідомила, що маркуватиме тексти, щоб дотримуватися Кодексу прозорості Закону ЄС про штучний інтелект, який вимагає від компаній, що працюють із ШІ, використовувати системи, здатні ідентифікувати контент, створений ШІ.

Наприклад, на Reddit один користувач охарактеризував це як змову проти невинних користувачів Claude, тоді як інший заявив: «Єдина причина, чому ви не хотіли б цього, — бажання брехати людям». А Business Insider повідомляє, що «десятки» користувачів у X заявили про скасування своїх підписок на Claude унаслідок цього.

Новий допис Anthropic починається із загального огляду концепції маркування. У ньому пояснюється, що під час ухвалення «рішень із незначними наслідками» — наприклад, вибору між словами «похмурий» і «сірий» для опису погоди — Claude може створювати у своїх відповідях шаблон, який є «непомітним для читача, але виявляється будь-ким, хто має ключ, що його кодує».

«Маркування не впливає на якість результатів Claude, — заявила компанія. — Для читача маркована відповідь не відрізняється від немаркованої».

Якщо точніше, Anthropic заявила, що використовуватиме підхід SynthID-Text, який команда Google DeepMind описала у 2024 році, а також планує випустити API для виявлення маркування. Компанія також зазначила, що маркування відрізняється від підходів до виявлення ШІ, які пропонують такі компанії, як Pangram, що шукають у тексті «характерні ознаки» використання ШІ (наприклад, конструкцію «це не [X], а [Y]»): «Виявлення таких шаблонів принципово відрізняється від перевірки на наявність водяного знака».

Чи може хтось просто переписати текст, щоб приховати водяний знак? Anthropic заявила, що це можливо, але «легке редагування, ймовірно, не видалить водяний знак повністю», тоді як «повне переписування, під час якого замінюється кожне слово, — видалить».

«У другому випадку, звісно, можна сперечатися, чи можна такий текст надалі називати створеним ШІ», — заявила компанія.

Щодо того, чи буде водяний знак помітний у тексті, який Claude лише перевірив або відредагував, Anthropic заявила, що це залежатиме від «довжини тексту та того, наскільки сильно Claude його відредагував». Якщо редагування було незначним, «майже всі слова» напише автор-людина, і «водяному знаку буде практично нема за що (якщо взагалі буде за що) зачепитися».

Водночас у коді водяний знак має бути менш помітним, ніж в іншому тексті, оскільки моделі потрібно створити робочий код, і вона не матиме можливості обирати між різноманітними однаково прийнятними варіантами. 

«Водночас у тих частинах коду, де є довільний вибір між певними словами або термінами, водяний знак можна використовувати, наприклад у коментарях до коду, — заявила Anthropic. — Але за визначенням він матиме незначний вплив на фактично створений код».

Anthropic також заявила, що Claude не буде єдиним чатботом зі ШІ, який генеруватиме маркований текст, оскільки «інші великі розробники моделей підписали той самий Кодекс практики й запроваджуватимуть власні водяні знаки».

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням TechCrunch

Читати оригінал на TechCrunch ↗

Текст і зображення належать TechCrunch і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини