Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← Към новините

OpenAI въвежда нови мерки за сигурност след пробива в Hugging Face

Във вторник OpenAI обяви нов пакет от политики за сигурност, насочени към ограничаване на инцидентите със сигурността, докато моделите се тестват. Новите мерки за защита включват по-подробно наблюдение на моделите по време на процеса на разработка, както и по-силен акцент върху съгласуваността и сигурността по време на процеса след обучението.

„С увеличаването на способностите на моделите нарастват и рисковете, свързани с разработването и вътрешното им тестване“, заяви компанията в публикация в блога си. „Нашите стандарти за наблюдение, съгласуваност и сигурност трябва да изпреварват тези рискове.“

Новите мерки са едни от първите публично обявени промени в практиките на OpenAI за безопасност след непосредствените последици от инцидента с Hugging Face, който беше разкрит на 26 юли.

Представители на OpenAI подчертаха, че мерките не са пряк отговор на инцидента с Hugging Face, но са били провокирани отчасти и от киберсигурностните способности на предстоящия модел Astra, както и от общия темп на развитие на изкуствения интелект.

В същата публикация OpenAI разкри, че е замразила обучението с подсилване за две седмици след инцидента с Hugging Face, но оттогава е възобновила работата по много от по-малко рисковите модели.

„Най-голямото планирано обучение с подсилване на водещ модел все още е спряно, докато провеждаме обучения и оценки в по-малък мащаб, за да оценим поведението на модела, да проверим нашите мерки за защита и да съберем повече доказателства за съгласуваността му, преди да продължим“, се казва в публикацията.

В разговор с репортери вицепрезидентката по изследователската дейност на OpenAI Амелия Глезе подчерта, че строгостта на контрола ще се увеличава с нарастването на способностите на моделите, като най-големите модели ще бъдат подложени на най-щателна проверка.

„Въведохме изисквания и очаквания за безопасно развитие“, каза Глезе пред репортери. „Тези изисквания и очаквания се различават в зависимост от нивото на риска, което виждаме.“

OpenAI беше критикувана за лоши практики за мрежова сигурност след инцидента, при който моделите са избягали от средата си за обучение, като са компрометирали помощна програма за инсталиране на пакети, запазила достъпа си до интернет. Новите мерки за защита включват по-строги практики за мрежова изолация, макар че конкретните подробности остават неясни. Според публикацията при новата система „единична компрометация на работно натоварване или поддържаща услуга сама по себе си не позволява неоторизиран достъп до интернет или до други вътрешни мрежи“.

Най-силната мярка за защита е системата за наблюдение, която ще проверява действията на инструментите, наличните следи от разсъжденията и регистрите на активността за различни видове неоторизирано поведение. OpenAI заявява, че целта е сигналите за тревожна активност да бъдат издавани в рамките на 30 минути.

OpenAI изчислява, че изчислителното натоварване на това наблюдение ще бъде приблизително 20% от натоварването на процеса, който се наблюдава. Компанията обеща допълнителни подробности за системата в предстояща публикация в блога. Официалният анализ след инцидента на OpenAI също все още предстои.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от TechCrunch на

Прочетете оригинала в TechCrunch ↗

Текстът и изображенията са собственост на TechCrunch и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини