Anthropic открывает доступ к выявлению текстов Claude AI для регуляторов, СМИ, фактчекеров и других
Anthropic запускает API для проверки водяных знаков, позволяя одобренным организациям проверять, содержит ли текст цифровой водяной знак Claude. Закон ЕС об искусственном интеллекте с 2 августа 2025 года требует, чтобы новые модели Claude встраивали невидимые водяные знаки в выдаваемый ими текст. «Регуляторы, правоохранительные органы, СМИ, фактчекеры, независимые исследователи, образовательные организации и группы гражданского общества ЕС» могут запросить доступ, как и компании, которым необходимо проверять наличие водяных знаков для соблюдения собственных требований. Anthropic планирует со временем расширять доступ.
Система основана на методе SynthID для текста Google, но случайность выбора слов изменена таким образом, чтобы создавать статистически обнаруживаемый шаблон, который, по словам Anthropic, «может сохраняться после некоторых видов редактирования». Это должно сделать систему гораздо надежнее, чем традиционные детекторы вроде Pangram.
Anthropic заявляет, что водяной знак не содержит пользовательских данных и не влияет ни на качество, ни на содержание текста. Критики с этим не согласны: если Claude выбирает синонимы на основе ключа водяного знака, а не смысла, качество текста страдает. Отраслевое издание «Artificial Lawyer» также отмечает риски для прозрачности, поскольку обнаруживаемые признаки текста, созданного ИИ, могут стать проблемой там, где договоры запрещают использование ИИ, или в ходе переговоров о гонорарах, хотя издание прогнозирует, что водяные знаки в основном безвредны.
Новости ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ и наш эксклюзивный обзор передовых разработок «AI Radar» шесть раз в год, иметь полный доступ к архиву и разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.