Новий водяний знак Scarlet Letter у Claude невидимий — поки що
Anthropic повідомила, що невдовзі додаватиме водяні знаки до контенту, який обробляється (а не лише генерується!) будь-якою з її моделей. У статті служби підтримки Anthropic пояснила, що впроваджує машинозчитувані водяні знаки, щоб дотримуватися Закону Європейського Союзу про штучний інтелект, який вимагає від усіх постачальників систем ШІ маркувати створені або змінені ШІ результати обробки аудіо, зображень, тексту та відео. Закон поширюється на будь-яку модель ШІ, випущену після 2 серпня, і передбачає пільговий період до грудня 2026 року, протягом якого постачальники можуть оновити раніше випущені моделі.
Anthropic підтвердила, що надалі всі нові моделі, доступні в усьому світі, — не лише в ЄС — маркуватимуть контент, створений ШІ, «від першого дня». Текстові результати «міститимуть вбудовані водяні знаки», невидимі для користувача, а інші «згенеровані файли міститимуть цифрово підписані метадані походження, якщо це підтримується», заявила Anthropic.
Примітно, що Anthropic застосовує підхід «знищити це з орбіти», наносячи водяні знаки на весь оброблений контент, де це підтримується, хоча ЄС не вимагає цього у випадках, коли система ШІ виконує «допоміжну функцію для стандартного редагування» (у власному прикладі в рекомендаціях ідеться про виправлення граматики) або коли вона не «суттєво змінює» текст користувача чи його зміст. Водяний знак, застосований на рівні моделі, не може відрізнити повне генерування від виправлення коми, тож Claude може зрештою маркувати саме той контент, який закон мав залишити без маркування. Наскільки ретельно насправді здійснюватиметься маркування, стане відомо лише після того, як Anthropic випустить інструмент виявлення, який можна буде протестувати. Компанія заявила, що зрештою планує оприлюднити подробиці про те, як виявляти ці позначки, щоб забезпечити технічну підтримку, якої вимагає закон ЄС.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.