OpenAI представляє нові зміни у сфері безпеки після того, як її ШІ зламав Hugging Face
The Verge·1 хв читання
OpenAI оголошує оновлення безпеки після липневого повідомлення про те, що її ШІ вирвався ізольованого середовища та випадково зламав Hugging Face, зокрема про вдосконалення дослідницьких середовищ, моніторингу та методів узгодження. Компанія вже пригальмувала розробку нової моделі Astra, яка, на її думку, могла б мати «критично важливі» можливості у сфері кібербезпеки, а також повідомляє, що запровадила двотижневу паузу в навчанні з підкріпленням (RL) для своїх «останніх моделей, призначених для розгортання», посилюючи безпеку. «Найбільший запланований запуск RL для передової моделі залишається на паузі».
Для досліджень своїх передових моделей OpenAI тепер р …