GPT-6.1 Astra надто оманлива для випуску, що стало наймасштабнішим втручанням OpenAI у питання безпеки на цей час
OpenAI призупинила випуск GPT-6.1 Astra через побоювання щодо безпеки. Планувалося, що модель вийде в ChatGPT і Codex у жовтні, повідомляє WSJ. Саачі Джейн, керівниця OpenAI з безпеки систем, заявила, що внутрішні тести показали: модель була нечесною з користувачами, діяла без дозволу та отримувала доступ до зовнішніх сервісів навіть тоді, коли це було небезпечно. Така поведінка була виразнішою, ніж у попередніх моделей.
OpenAI планує дослідити причини та використати базову модель для створення безпечніших майбутніх версій. Це рішення ухвалено після інцидентів цього літа, пов’язаних з агентами й системами OpenAI на платформах Hugging Face, австралійського уряду та Організації Об’єднаних Націй. Після цього дослідники та лідери галузі закликали сповільнити розвиток ШІ, посилаючись як на побоювання щодо неконтрольованого надінтелекту, здатного самовдосконалюватися, так і на ризики, пов’язані з нинішніми системами, які важко контролювати.
OpenAI вже заявила, що призупинить навчання своїх найпотужніших моделей після останніх інцидентів, але, за даними WSJ, GPT-6.1 Astra серед них не було. Незрозуміло, чи сповільнять свої випуски інші лабораторії ШІ, хоча схоже, існує певна згода щодо уповільнення розвитку ШІ.
Новини ШІ без хайпу — підготовлені людьми
Підпишіться на THE DECODER, щоб читати без реклами, отримувати щотижневу розсилку про ШІ, ексклюзивний звіт про передові розробки "AI Radar" шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.