Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← Към новините

Ето всички случаи, в които AI е излизал извън контрол и е хаквал други компании

През юли OpenAI призна, че един от агентите му, натоварен със завършването на експеримент по киберсигурност, е избягал от изолацията и е хакнал платформата за набори от данни за изкуствен интелект Hugging Face. Този инцидент, за който OpenAI предостави пълен отчет вчера, беше първият публично докладван случай, при който голям езиков модел излезе извън контрол и автономно хакна трета страна. 

Оттогава това безпрецедентно, наподобяващо научна фантастика събитие се оказа далеч по-малко рядко, отколкото някой би се надявал. 

Според сатиричен уебсайт, наречен Felony Bench (игра на думи с benchmark), който води статистика за тези инциденти, общият им брой е 17. Важно е да се помни, че експертите по наказателно право не са напълно сигурни дали компаниите за изкуствен интелект, създали големите езикови модели, извършили хакерските атаки, могат да бъдат подведени под отговорност, нито дали жертвите могат да ги съдят. Но вероятно скоро ще получим отговор на тези въпроси.  

Моделите на Anthropic и OpenAI водят надпреварата с по осем инцидента всеки, а Meta изостава с един, според сайта. На този етап стана ясно, че тестовете за безопасност на изкуствения интелект сами се превръщат в рискове за безопасността. Някои компании и служители в сферата на изкуствения интелект също признаха тези рискове в отвореното писмо „Pacing The Frontier“, което призовава за отговорно развитие на възможностите на изкуствения интелект. 

Решихме, че е подходящ момент да обобщим хронологично всички тези инциденти.

Екранна снимка на текущата класация на Felony Bench, създадена от потребител на X, известен под името felpixАвторство на изображението:Екранна снимка / felpix /

нтернет достъп. Оттам няколко агента работили заедно, за да се насочат към Hugging Face и да го хакнат, мислейки, че могат да намерят решението на предизвикателството там. OpenAI разбрало едва след като Hugging Face съобщи публично, че е станало жертва на напълно автономна атака. Упс. 

Anthropic разкрива, че е хакнала три компании

Разкритието на OpenAI събуди любопитството на Anthropic, която се запитала: възможно ли е и на нас да ни се е случило същото? Оказва се, че отговорът е да. Три пъти да. Лабораторията за авангардни модели установила, че собствените ѝ модели са проникнали в три различни, все още неназовани компании, като най-ранният инцидент датира от април — повече от три месеца преди компанията да го открие. Anthropic отчасти обвинила Irregular, стартъп, който провежда оценки на киберсигурността на изкуствения интелект. Упс.

OpenAI разбира, че всъщност Hugging Face не е била единствената жертва

След като OpenAI започна да разследва пробива в Hugging Face, компанията установи, че агентите, хакнали Hugging Face, са проникнали и в четири акаунта и четири различни компании, както първо съобщи Reuters. Modal, стартъп за инференция на изкуствен интелект, е една от жертвите. Упс.

Irregular осъзнава, че модел на OpenAI е хакнал компания

В края на юли Irregular съобщила на OpenAI, че един от моделите ѝ, участвал в състезание Capture-the-Flag — по същество игра по киберсигурност, в която играчите хакват системи, създадени специално за състезанието — е избягал от играта, свързал се е с интернет и е хакнал реална компания. Причината? Irregular дала на една от измислените цели същото име като на реална компания. Упс. 

Британският Институт за безопасност на изкуствения интелект се опитва да хакне „реални хора и организации“

Също в края на юли британският правителствен Институт за безопасност на изкуствения интелект, публичен орган, натоварен с изследването на безопасността и рисковете на технологиите за изкуствен интелект, разкри, че е установил няколко инцидента, включващи модели на OpenAI и Anthropic, които по време на „рутинни“ оценки са се насочили към „реални хора и организации“. В тези случаи AISI е предоставил на моделите достъп до интернет. Упс. Добрата новина е, че агенцията действително ги е засекла в момента на случването им, а не седмици по-късно, както при други инциденти. 

Meta AI хаква компания по време на тестове

В началото на август Meta стана последната компания, разкрила инцидент, включващ един от нейните големи езикови модели, който хакнал услуга на „трета страна“. Meta обвини за инцидента неправилна конфигурация от страна на Irregular, която провеждала оценка на киберсигурността за технологичния гигант, като според условията на теста моделът не е трябвало да има достъп до интернет. Упс. 

Агентът Claude хаква софтуера на фитнес зала, за да запише час

Австралиец помолил агент с изкуствен интелект на Anthropic да му помогне да запише час за тренировка във фитнес зала, за който бил в списъка с чакащи. „Просто седях на дивана и си мислех: „Боже, това е досадно занимание“, разказал мъжът пред ABC Australia. В опита си да изпълни молбата агентът открил уязвимост в софтуера за резервации на фитнес залата, използвал я и премахнал хората, които били пред мъжа в списъка с чакащи. Мъжът се опитал да поправи щетите, като помолил агента да отмени действията си. Агентът отговорил: „Лоша новина — не мога да ги добавя обратно.“ Упс.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от TechCrunch на

Прочетете оригинала в TechCrunch ↗

Текстът и изображенията са собственост на TechCrunch и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини