Sakhanda Wire
NVDA $225.16 -0.06% MSFT $495.40 -0.30% GOOGL $345.90 -0.13% META $589.85 -0.86% AMZN $262.65 -0.94%
← К новостям

Anthropic объясняет, как будут работать невидимые водяные знаки в тексте Claude

Возьмём предложение «Сегодня погода была холодной и…». Следующим словом с очень низкой вероятностью будет «сладкой». Но вполне вероятно, что это будет «пасмурной» или «серой». В большинстве случаев читателю не столь важно, какое из этих двух последних слов в итоге выберет модель, — смысл предложения в любом случае в основном остаётся тем же. В подобных случаях выбор определяется случайным числом.

Водяные знаки используют такие незначимые варианты выбора — они возникают множество раз в тексте, сгенерированном моделью, — чтобы оставлять в ответах Claude определённый паттерн. Читатель его не заметит, но его может обнаружить любой, у кого есть ключ, кодирующий этот паттерн. При использовании водяного знака выбор по-прежнему делается случайным образом, но источник случайности меняется. Вместо того чтобы использовать произвольный генератор случайных чисел для выбора следующего слова, водяной знак использует ключ и несколько предшествующих слов, чтобы определить, какое слово должна выбрать модель.

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием The Verge

Читать оригинал на The Verge ↗

Текст и изображения принадлежат The Verge и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости