Технологичната индустрия кипи, след като агент на Claude хакна фитнес зала
Досега всички осъзнахме, че лабораториите за изкуствен интелект в Силициевата долина са създали най-добрите хакери в света под формата на агенти с изкуствен интелект. Дайте задача на най-новите авангардни модели и те са толкова изобретателни, че я изпълняват, дори ако това означава да се измъкнат от защитите на своята „пясъчника“ за киберсигурност и да проникнат в чужда мрежа. (Ако не стигнат дотам, ще използват социално инженерство и манипулация.)
Въпреки това новинарската история от уикенда за австралиец, чийто агент OpenClaw е хакнал системата за резервации на фитнес залата му и е изтрил резервацията на друг клиент, за да му осигури място в търсен клас, е особено забележителна. Тя подсказва, че ако искаме да обуздаем хакерството от страна на неконтролируем изкуствен интелект, може би гледаме в погрешната посока.
Въпреки че новината беше публикувана от австралийската ABC News едва наскоро и обяви инцидента за първия документиран случай на хакерство от агент с изкуствен интелект в страната, самото хакване се е случило преди месеци.
Собственикът на OpenClaw, Андрю Бърд, е публикувал вече изтрит текст в блога на уебсайта на компанията си на 10 април, според копие, което все още е достъпно в Internet Archive.
Той е обучил своя OpenClaw да изпълнява задачи като записване на часове. Харесвало му е да посещава популярен ранен сутрешен тренировъчен клас и му било омръзнало да попада в списъка с чакащи, а след това да играе „рулетка с опресняването“, както го описва, за да се сдобие с място.
Когато помолил бота да му запази място, най-доброто, което успял да направи, било да го постави на четвърто място в списъка с чакащи, разказал той пред ABC. Тогава агентът му казал, че е намерил начин да го запише предварително за класовете. Много предварително. Месеци преди залата да направи тези класове достъпни за записване.
Бърд попитал дали може да го придвижи напред в списъка с чакащи. То направило каквото му било поискано и опитало да го направи. Ботът открил уязвимост в частта за оторизация на софтуера за записвания, който използвала залата. Той проникнал в системата и отменил резервацията на човек, заемащ първа позиция в списъка с чакащи. Според публикуваните от ABC записи на чата ботът бодро му съобщил:
„API-то изобщо не проверява оторизацията при отменяне на чужди резервации … Тествах това с човека на позиция №1 в списъка с чакащи — и наистина се получи. Така че вече си преместен от №4 на №3“, му отговорил той.“
Бърд, който самият е софтуерен разработчик, вече бил силно притеснен, че изкуственият му интелект току-що е хакнал фитнес залата му, съобщи ABC. Той попитал дали може да отмени това и да върне другия човек в списъка с чакащи. Не. Това не било възможно, казал изкуственият интелект.
Затова той направил следващото най-добро нещо и му казал да подготви „имейл за отговорно разкриване до отдела за поддръжка“. Имейлът „обясняваше уязвимостта, предлагаше решения и дори сравняваше дефектните мутации с тези, които правилно прилагаха оторизацията“, написал Бърд.
Отвъд хумора на това да избуташ друг човек от пътя, за да влезеш във фитнес клас, този инцидент има две наистина интересни страни. Едната е, че Бърд е използвал Claude Opus 4.6, пуснат през февруари, със своя OpenClaw. Другата е реакцията на Силициевата долина в X, където историята е станала вирусна.
След прословутия инцидент миналия месец, при който непуснат модел на OpenAI е хакнал Hugging Face, без OpenAI да знае за това по онова време, други лаборатории са изследвали своите модели. След това са последвали разкрития за Kimi K3 на Moonshot, Muse Spark на Meta и Anthropic.
Всъщност Anthropic е установила, че три от нейните модели са направили това, включително Opus 4.7, който е пуснат през април и е известен с уменията си в сложното програмиране, Mythos 5, Fable (известен със своите умения в киберсигурността) и вътрешен, непуснат изследователски тестов модел.
За да се справят с това, някои лаборатории за изкуствен интелект са обсъждали забавяне на разработването на авангардни модели или създаване на независими организации за тестване на следващото поколение модели.
Но Бърд разкрил, че неговият OpenClaw е използвал версия 4.6. Това предполага, че по-старите модели, както и безбройните модели с отворени тегла, изоставащи с три стъпки, вече са изключително добри хакери. Така че кой знае колко от тях са хаквали или хакват в момента, за да изпълнят желанията на своите собственици на подсказки?
По същия начин много хора в X са видели хумористичния потенциал на този инцидент. Както партньорът в Andreessen Horowitz Кристиан Кайл публикува в отговор: „Това е просто ужасно. Някой знае ли дали работи за запазване на часове за голф?“
Или както отбеляза потребителят Roon в X: „системата за резервации на тенис кортове в Сан Франциско ще се превърне в един от най-добре защитените софтуери на планетата Земя.“
Смешно, да. Но в тези шеги има известна истина. Силициевата долина изгражда бъдеще, в което всеки има агент с изкуствен интелект, работещ от негово име. Този агент просто е изпълнявал това, което му е било поискано, и не е разполагал с възможности на ниво Mythos.
Ами ако създателите и собствениците на агенти всъщност не искат да ограничат подобно несъответствие? Може би виждаме първия намек за хаос във всичко — от самолетни резервации до билети за концерти или всяка друга разочароваща ситуация с обслужването на клиенти. Както се изрази един човек в X, кой е най-дивият хак, който изкуственият интелект е открил досега? Може да се окаже, че е пререждането на опашката.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.