Anthropic внедряет водяные знаки во все результаты Claude по всему миру — отметки «могут сохраняться после некоторых правок»
Ключевые моменты
- Anthropic подписала Кодекс практики Закона ЕС об ИИ и с августа 2026 года будет снабжать все новые модели Claude машиночитаемыми метками. Это требование действует во всём мире.
- Текст получает невидимые водяные знаки, сохраняющиеся при копировании. Такие файлы, как изображения, получают подписанные метаданные происхождения в соответствии со стандартом C2PA.
- Anthropic признаёт ограничения: водяной знак не доказывает, что контент написала Claude, поскольку люди часто используют ИИ для редактирования или перевода собственного текста. Сильное редактирование или изменение формата также могут полностью удалить метки; однако они «могут сохраняться после некоторого редактирования».
Anthropic подписала Кодекс практики Закона ЕС об ИИ в области прозрачности контента, созданного ИИ. С августа 2026 года новые модели Claude будут встраивать водяные знаки в текст и добавлять к файлам подписанные метаданные происхождения.
Модели Claude, которые будут выпущены в ЕС 2 августа 2026 года или позднее, будут поставляться со встроенной маркировкой. Это требование не ограничится границами ЕС. Оно будет действовать во всём мире для всех продуктов Claude, включая API, Claude, Claude Code, Claude Cowork и Claude Tag.
Сгенерированный текст будет содержать встроенные водяные знаки, а сгенерированные файлы будут получать цифровую подпись с метаданными происхождения. Для существующих моделей законодательство предусматривает переходный период, но Anthropic заявляет, что уже работает над их обновлением.
Компания также планирует выпустить инструменты проверки, чтобы пользователи и третьи стороны могли проверять метки, хотя пока не сообщила, когда именно. По словам Anthropic, разработчики, интегрирующие Claude в свои продукты, должны определить, какие требования статьи 50 применимы к их сервисам.
Два метода идентификации контента, созданного ИИ
Anthropic планирует использовать два типа меток. По словам компании, текст, созданный Claude, будет содержать невидимый водяной знак, который не влияет на его смысл, качество или читаемость. Водяной знак сохраняется при копировании и вставке и «может сохраняться после некоторого редактирования». Он применяется на уровне модели, поэтому не имеет значения, каким продуктом Claude вы пользуетесь.
Поддерживаемые файлы, включая изображения в форматах .svg, .png и .jpg, будут содержать подписанные метаданные происхождения на основе открытого стандарта C2PA, разработанного Коалицией за происхождение и подлинность контента. Подпись указывает, что Claude обработала файл, и может выявить последующее вмешательство. Текстовые водяные знаки также должны работать через облачных партнёров, таких как AWS, Google Cloud и Microsoft Foundry, хотя эти платформы могут не поддерживать подписанные метаданные.
У обнаружения есть некоторые ограничения
Anthropic открыто говорит об ограничениях. Обнаруженный водяной знак не означает, что контент действительно написала Claude. Люди постоянно используют Claude для проверки, перевода или обобщения текстов, поэтому результат может содержать водяной знак, даже если идеи исходили от человека.
Отсутствие водяного знака тоже не проясняет ситуацию. Модель могла быть выпущена до внедрения водяных знаков, текст мог быть существенно отредактирован или переведён, отрывок может быть слишком коротким для надёжного обнаружения, либо метаданные могли быть удалены при конвертации формата или создании снимка экрана.
Настоящая проверка заключается в том, насколько хорошо эти водяные знаки сохраняются после редактирования, изменения форматирования и перевода. Если они выдержат такие изменения, проверка на наличие известного водяного знака будет надёжнее, чем инструменты вроде Pangram, чьи проприетарные методы обнаружения не раскрывают, что именно вызвало результат. Сторонние детекторы могли бы добавить поддержку водяного знака Anthropic, получив более надёжный сигнал.
Обнаружение текста ИИ остаётся чувствительной проблемой для общества
Anthropic не единственная компания, работающая в этом направлении. Google DeepMind открыла исходный код своей системы водяных знаков SynthID, встроив её в модели Gemini. SynthID слегка изменяет значения вероятностей при предсказании токенов, создавая водяной знак без ухудшения качества текста. Система работает на разных языках, но испытывает трудности с текстом, отредактированным после генерации.
OpenAI уже около двух лет держит при себе детектор текста с точностью 99,9 процента и до сих пор его не выпустила. Среди причин — то, насколько легко пользователи могут обойти его с помощью перевода или перефразирования, риск стигматизации определённых групп и, вероятно, опасения, что общедоступный детектор может навредить собственному бизнесу OpenAI.
Этот риск особенно серьёзен в образовании, где ненадёжные детекторы могут привести к ложным обвинениям в списывании. В то же время есть веские причины хотеть знать, когда и в каком объёме использовался ИИ. Исследования показывают, что чрезмерная зависимость от инструментов ИИ может ослаблять навыки критического мышления и письма, особенно у студентов, которые воспринимают их как способ обойти обучение, а не как учебное средство. Проблема выходит за пределы академической сферы: мошенники теперь зачисляют фиктивных студентов в общественные колледжи США и используют ИИ, чтобы без труда выполнять учебные задания и получать финансовую помощь.
Решение Anthropic также может повлиять на её бизнес. Claude популярен для интеллектуальной работы, особенно среди школьников и студентов, поскольку даже старые модели создают достаточно естественный текст. В условиях, когда школы и университеты уже спорят об использовании ИИ в учебной работе, более надёжное обнаружение может сделать Claude менее привлекательной для этих пользователей.
Новости ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, эксклюзивный годовой отчёт о передовых разработках «AI Radar» шесть раз в год, полный доступ к архиву и разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.