OpenAI ще поставя воден знак върху текстовете на ChatGPT в ЕС, но го прави незадължителен за потребителите на API по света
OpenAI добавя невидими водни знаци към текста на ChatGPT, за да спази правилата на ЕС. За разлика от Anthropic, компанията ще позволи на клиентите на API по целия свят да ги изключват.
Според съобщенията Законът на ЕС за изкуствения интелект изисква доставчиците на ИИ да обозначават генерирания текст във формат, който може да бъде разчетен от машини. Отговорът на OpenAI е textGrain — технология, която вгражда невидим статистически сигнал в избора на думи от модела. Тя работи подобно на водния знак SynthID на Claude, който използва технологията с отворен код на Google.
OpenAI заявява, че през следващите седмици ще включи водните знаци за потребителите на ChatGPT и Codex в Европейския съюз. Водните знаци в API ще бъдат опционални по целия свят, за разлика от задължителното поставяне на водни знаци от Anthropic върху Claude, което се прилага в световен мащаб независимо от начина, по който потребителите получават достъп до моделите. Водните знаци на OpenAI в API също ще бъдат достъпни чрез облачни партньори като Microsoft Azure през следващите седмици.
Редактирането на текста рязко намалява процента на откриване
OpenAI заявява, че textGrain е постигнал същите или по-добри резултати от други подходи при вътрешни тестове, включително SynthID на Google за текст. Компанията също така планира да публикува технологията като софтуер с отворен код, за да могат други да я надграждат.
Процентът на откриване зависи силно от дължината на текста и тематиката. При настройка на детектора за целеви процент на фалшиви положителни резултати от 1 процент той е идентифицирал водни знаци в около 95 процента от откъсите от 400 токена на тема психология. При 200 токена този дял е спаднал до около 80 процента.
Процентът на откриване е бил „значително по-нисък“ при математическо съдържание, където моделът има по-малка свобода при избора на думи, посочва OpenAI. По-дългите откъси може да засилят статистическия сигнал и да подобрят откриването, макар че резултатите все пак могат да зависят от съдържанието. OpenAI не предоставя данни, с които това предположение да бъде проверено.

Редактирането на текста също затруднява откриването на водния знак. OpenAI посочва, че замяната само на 10 процента от думите със синоними намалява процента на откриване при откъси от 400 токена от около 92 процента на 66 процента. Замяната на една четвърт от думите намалява откриването до 17 процента, което прави водния знак лесен за заобикаляне. Тази слабост може да е в полза на OpenAI. Потребителите, които не искат използването на ChatGPT да бъде установено, може да преминат към модели с отворени тегла, ако водните знаци на компанията станат по-трудни за премахване.

Технически доклад обяснява подробно как работи textGrain. Anthropic не е публикувала проценти на откриване за водния знак на Claude, макар че твърди, че системата ѝ се справя добре при редактиране.
OpenAI заявява, че поставянето на водни знаци не влошава качеството на резултатите, като се позовава на тестове на своя водещ модел Astra. Компанията не отчита значителни разлики в производителността при включено или изключено поставяне на водни знаци в осем бенчмарка, включително GPQA Diamond, BrowseComp и DeepSWE. Тези резултати не показват дали поставянето на водни знаци влияе върху качеството на писането — въпрос, който критиците също поставят по отношение на водния знак на Claude.
OpenAI също така посочва, че открит воден знак не разкрива нищо за това каква част от текста е резултат от човешка креативност или редактиране. Той не установява собственост, не приписва отговорност, не идентифицира потребител и не показва дали текстът е точен, а невъзможността да бъде открит воден знак също не доказва, че текстът е написан от човек. Откъсът може да е твърде кратък, да е бил редактиран или преведен или да произхожда от модел, който детекторът не поддържа.
Засега OpenAI ще ограничи достъпа до детектора
Първоначално достъп до детектора на textGrain ще получат само избрани изследователи и специализирани организации. Те могат да кандидатстват чрез формуляр за кандидатстване. OpenAI ще предоставя достъп за всеки отделен случай съгласно Кодекса за практики на ЕС. Anthropic следва сходен подход със своя API за откриване.
Инструментът ще отчита единствено дали е открил воден знак на OpenAI. Той няма да идентифицира потребители или да разкрива техните подкани и разговори.
OpenAI заявява, че ограничава достъпа, защото детекторът може да маркира текст без воден знак или да пропусне водни знаци. Компанията планира да разшири достъпа „когато смятаме, че резултатите могат да бъдат тълкувани отговорно“. Тя не е посочила кога може да се случи това.
Съществуващите инструменти за проверка на изображения и аудио остават публично достъпни, включително openai.com/verify и Content Provenance API.
Новини за ИИ без сензация – подбрани от хора
Абонирайте се за THE DECODER и получете четене без реклами, седмичен бюлетин за ИИ, нашия ексклузивен водещ доклад „AI Radar“ шест пъти годишно, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.