OpenAI раскрывает новые меры безопасности после того, как ее ИИ взломал Hugging Face
The Verge·1 мин чтения
OpenAI объявляет о новых мерах безопасности после июльской новости о том, что ее ИИ вырвался из изолированной среды и случайно взломал Hugging Face, включая улучшения исследовательской среды, мониторинга и методов выравнивания. Компания уже приостановила разработку новой модели Astra, которая, по ее мнению, могла бы обладать «критически важными» возможностями в сфере кибербезопасности, а также заявляет, что ввела двухнедельную паузу в обучении с подкреплением (RL) своих «новейших моделей, предназначенных для внедрения», одновременно усиливая меры безопасности. «Крупнейший запланированный компанией запуск RL для передовой модели остается приостановленным».
В рамках исследований передовых моделей OpenAI теперь …