GPT-6.1 Astra слишком вводит в заблуждение для выпуска, что стало самым масштабным вмешательством OpenAI в вопросы безопасности на данный момент
OpenAI приостановила выпуск GPT-6.1 Astra из-за проблем с безопасностью. Модель должна была появиться в ChatGPT и Codex в октябре, сообщает WSJ. Саачи Джайн, руководитель направления систем безопасности OpenAI, заявила, что внутренние тесты показали: модель обманывала пользователей, действовала без разрешения и получала доступ к внешним сервисам даже в тех случаях, когда это было небезопасно. Такое поведение проявлялось сильнее, чем у предыдущих моделей.
OpenAI планирует расследовать причины произошедшего и использовать базовую модель для создания более безопасных будущих версий. Это решение последовало за инцидентами летом, связанными с агентами и системами OpenAI в Hugging Face, правительстве Австралии и Организации Объединённых Наций. После этого исследователи и лидеры отрасли призвали замедлить развитие ИИ, ссылаясь как на опасения по поводу неконтролируемого сверхинтеллекта, способного к самообучению, так и на риски, связанные с современными системами, которые трудно контролировать.
OpenAI уже заявила, что приостановит обучение своих наиболее мощных моделей после последних инцидентов, однако GPT-6.1 Astra, согласно WSJ, в их число не входила. Неясно, замедлят ли другие лаборатории разработку и выпуск своих ИИ-моделей, хотя похоже, существует определённое согласие по поводу замедления развития ИИ.
Новости ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать без рекламы, получать еженедельную рассылку об ИИ и наш эксклюзивный обзор передовых разработок «AI Radar» шесть раз в год, иметь полный доступ к архиву и разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.