OpenAI представя нови промени в сигурността, след като нейният ИИ хакна Hugging Face
The Verge·1 мин четене
OpenAI обявява актуализации по сигурността след новината от юли, че нейният изкуствен интелект е успял да излезе от изолирана среда и случайно е хакнал Hugging Face, включително подобрения в средите за изследвания, мониторинга и техниките за съгласуване. Компанията вече беше натиснала спирачките на нов модел, Astra, за който смята, че може да притежава „критични“ способности за киберсигурност, а компанията заявява, че е въвела двуседмична пауза в обучението с подсилване (RL) на своите „най-нови модели, предназначени за внедряване“, докато затегне сигурността. „Най-голямото планирано RL обучение на граничен модел остава спряно.“
За изследванията на своите гранични модели OpenAI сега …