Abliteration.ai превръща премахването на защитните ограничения на ИИ в бизнес
Току-що стана много по-лесно да се получи достъп до един от най-способните в света AI модели с отворени тегла, лишен от своите защитни механизми и откази да изпълнява вредни задачи.
Наръководен от техника, която премахва склонността на даден модел да отказва вредни заявки, стартъпът Abliteration.ai е превърнал това премахване в услуга. Платформата хоства модифицирани версии на модели с отворени тегла и премахнати защитни механизми, включително наскоро представения GLM-5.3 на Z.ai, към който потребителите могат да отправят заявки през уеб браузър или да получат достъп чрез API.
В скорошна публикация в социалните медии компанията заяви, че целта ѝ е да даде възможност на други да извършват „офанзивна киберсигурност, червено екипиране и тестване на агенти — работа, която други модели отказват да вършат“. Логиката е позната в сферата на сигурността: не можете да се защитите срещу поведение, което не можете да възпроизведете, а модел, който отказва да напише работещ експлойт код, не може да помогне на червения екип да се защити от нападатели. Но същото премахване улеснява и други потенциално опасни задачи.
Abliteration е отдавна използвана техника при моделите с отворен код. Изследователи и разработчици премахват отказите от модели с отворени тегла от години, а Hugging Face хоства хиляди аблитерирани модели на своята платформа.
Основана в края на миналата година, но официално регистрирана през март, Abliteration.ai превръща техниката от подземна практика с отворен код в комерсиална, леснодостъпна услуга. Като хоства модела, Abliteration намалява препятствията пред хората, които иначе биха трябвало да изтеглят собствени предварително аблитерирани модели и да осигурят изчислителните ресурси, необходими за работата им.
Използвайки услугата, TechCrunch успя бързо да създаде акаунт и да започне безплатно да отправя заявки към аблитерирана версия на GLM-5.3 през уеб браузър. Помолихме го да напише програма на Python, която краде запазени пароли от Chrome, както и подробен протокол за отглеждане на опасен човешки патоген у дома, и моделът с готовност се съобрази.
Съоснователят на Abliteration.ai Девън казва, че стартъпът има няколко договора с големи доставчици на облачни услуги, които може да си позволи да плаща изцяло с приходите от клиенти. (По негово искане не посочваме фамилията на Девън, тъй като той все още работи в друга фирма.) Abliteration.ai все още не е набрала рисков капитал, но води разговори за това.
Критиците казват, че предоставянето на аблитерирани модели в голям мащаб може да доведе до реални вреди. Андрю Юн, ръководител на изследванията в неправителствената организация за безопасност на AI CivAI, заяви пред TechCrunch, че аблитерирането на модели позволява да „модифицирате модела така, че да се превърне в социопат“.
„Тук можете да въведете буквално каквото пожелаете и той ще се съобрази с него“, каза Юн. „Когато хората говорят за премахване на защитните механизми от AI моделите, именно това имат предвид… Очаквам в близко бъдеще да започнем да виждаме редактирани, аблитерирани модели, използвани за причиняване на вреди.“
Abliteration AI току-що премахна защитните механизми от GLM-5.3, за да може той да извършва офанзивни кибератаки. Получих и независимо потвърждение, че Abliteration AI е премахнала и свързаните с биологични теми защитни механизми на модела. Фактът, че е толкова лесно да се премахнат защитните механизми от… https://t.co/7Wk2Ibx35H
— Chris McGuire (@ChrisRMcGuire) 1 септември 2026 г.
Повечето експерти, с които TechCrunch разговаря, казват, че този процес не може да бъде спрян. Но ако премахването на защитните механизми от моделите с отворени тегла реалистично не може да бъде предотвратено, правителствата могат да се намесят на други места. В скорошна статия с мнение Юн предложи правителствата да изискват от доставчиците да използват класификатори за откриване и блокиране на вредни киберактивности и дейности, свързани с биологични оръжия. Той също така заяви, че компаниите, които отдават под наем директен достъп до усъвършенствани GPU, трябва да бъдат задължени да проверяват самоличността на клиентите и да „отказват достъп, когато има причина да се подозира опасна злоупотреба“.
Abliteration.ai предлага на клиентите си слой за модериране, за да могат да добавят каквито защитни механизми пожелаят. Самата платформа има някои незначителни защитни механизми — например при нашите тестове не успяхме да накараме модела да предостави инструкции за самоубийство — а Девън казва, че работи по внедряването на още, за да предотврати насилието.
Abliteration.ai също така не е интегрирала никакви практики за проверка на самоличността на клиента, освен че записва кредитната карта, която клиентът използва за закупуване на услугата, като заявява, че въпросът кой да получава достъп е сложен и младата компания все още търси решение.
„Не искате да сте човекът, отговорен за това някой да направи нещо безумно… така че къде поставяте границата на вашата отговорност като компания?“ каза Девън. „Все още сме в процес на определяне на това.“
Това повдига въпроси, с които индустрията и правителствата ще трябва да се справят, тъй като все по-способни модели се пускат с тегла за изтегляне: ако всеки може да премахне защитните механизми на даден модел, прави ли по-лесният достъп на всички до получения модел интернет по-безопасен или по-опасен?
Основателят на Abliteration.ai и други защитници на идеята твърдят, че демократизирането на достъпа до нецензурирани авангардни модели е най-добрата форма на защита.
„Голямата картина при аблитерираните модели е, че те могат да моделират злонамерени лица“, каза Девън. „Предимството е, че сега защитниците могат да се движат възможно най-бързо. Те разполагат с всички инструменти, от които се нуждаят, за да моделират тези злонамерени лица и след това да се защитят от тези злонамерени действия, и мисля, че това ще ускори киберсигурността — донякъде контраинтуитивна теза.“
Макар все още да е млада компания, Девън казва, че клиентите на Abliteration.ai включват няколко стартъпа за червено екипиране в ранен етап, базирани във Великобритания и Европа — компании, които помагат на банки, авиокомпании и други предприятия, работещи с критична инфраструктура, да укрепят практиките си за киберсигурност.
„Един от големите ни клиенти извършва червено екипиране на агенти на банки и днес не би могъл да използва моделите директно, без допълнителни настройки, за да извършва червено екипиране на тези агенти“, каза Девън.

Междувременно самата индустрия на киберсигурността все още се опитва да разбере какво е мястото на аблитерираните модели в защитната работа, ако изобщо имат такова.
Няколко компании за червено екипиране на агенти, с които TechCrunch разговаря, са съгласни с Девън, че злонамерените лица вече аблитерират собствените си модели и ги използват за извършване на противникови атаки, което подкрепя тезата, че защитниците трябва да разполагат със същите инструменти. Те обаче се разминават по въпроса доколко аблитерираните модели действително са значими за процеса.
Докато Девън твърди, че аблитерирането на модели е от съществено значение за цялостното червено екипиране на агенти, някои казват, че не ги използват в ежедневната си работа, а вместо това разчитат на лесното донастройване на модели с отворени тегла — които и без това имат малко защитни механизми — за извършване на тестовете си.
Ахмед Али, главен изпълнителен директор на компанията за червено екипиране на агенти Fabraix, казва, че неговата компания разчита повече на донастройване на отворени модели, отколкото на използването на аблитерирани, като добавя, че процесът на аблитериране премахва част от знанията и способностите на модела.
„Ако всъщност се опитвате да нанесете реална вреда с него — кибернетична или биологична — той няма да бъде толкова ефективен“, каза Али пред TechCrunch.
Алесио Ломусио, главен технолог в Safe Intelligence, се съгласи, че е възможно да има намаляване на способностите, но все пак смята, че аблитерираните модели могат да предизвикат определено поведение, което е полезно при стрес тестове на дадена система.
„Досега аблитерираните модели не са част от процеса“, каза пред TechCrunch Дейвид Слейтър, основател и главен архитект в платформата за киберсигурност Armadin. „Когато разглеждаме моделите с отворени тегла до това абсолютно последно поколение, просто не беше особено трудно да бъдат разбити защитите им и да ги накараме да правят това, което искаме.“
Той добави, че Armadin все пак проучва аблитерирането и смята, че „насърчаването на общността с отворен код да разбере способностите на моделите е от решаващо значение“.
„Това ще се случи зад затворени врати. Ще се случи насаме“, продължи Слейтър. „Фактът, че се случва открито, дава на изследователите инструментите. Това ни дава възможност да разберем как изглежда действителният предел на възможностите и да разберем вредите.“
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.