OpenAI заявила, що «сповільнює розроблення моделей», оскільки ризики ШІ для кібербезпеки стають надто небезпечними
OpenAI заявляє, що «сповільнює розробку моделей», зокрема через те, що майбутня модель «Astra» може наближатися до отримання критично важливих можливостей для кібератак. Компанія призупинила навчання з підкріпленням на два тижні, її «найбільший запланований запуск фронтирного навчання з підкріпленням» залишається на паузі, а робочі навантаження, які не відповідають новим вимогам безпеки, призупинено. Інцидент із безпекою Hugging Face та «стрімкий прогрес у наших внутрішніх дослідженнях» також стали причинами уповільнення.
Відтоді, за словами OpenAI, дослідницькі середовища було посилено завдяки кращій мережевій ізоляції та суворішим пісочницям. Нова система моніторингу сповіщає протягом 30 хвилин після виявлення підозрілої поведінки, використовуючи приблизно 20 відсотків контрольованих обчислювальних ресурсів для інференсу — залежно від робочого навантаження.
Компанія планує розширити свою Систему готовності та збільшити інвестиції в дослідження узгодженості. Однак вона розпустила команду, яка створила цю систему, передавши її обов’язки іншим командам.
Критики, ймовірно, і надалі звинувачуватимуть OpenAI у нагнітанні страху, щоб виграти час і привернути увагу. Незалежне державне агентство AISI задокументувало подібну шкідливу поведінку моделі, що частково підтверджує заяви OpenAI.
Новини ШІ без хайпу — відібрані людьми
Підпишіться на THE DECODER, щоб отримати читання без реклами, щотижневу розсилку новин про ШІ, наш ексклюзивний фронтирний звіт «AI Radar» шість разів на рік, повний доступ до архіву та доступ до розділу коментарів.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.