Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

Премахването на защитните бариери от модели с отворени тегла вече се предлага като готова търговска услуга

Премахването на защитните механизми от AI модели с отворени тегла вече се предлага като готова търговска услуга
Томислав Безмалинович
6 септември 2026 г.
Nano Banana Pro, подканен от THE DECODER

Основни моменти

  • Американският стартъп Abliteration.ai премахва обучените механизми за отказ от модели с отворени тегла като GLM-5.3 и продава достъп до модифицираните версии чрез комерсиален API.
  • Abliteration потиска много от отказите на модела, така че той да може да се използва за тестване на киберсигурността, червено екипиране, анализ на зловреден софтуер и сходни дейности.
  • Клиентите не трябва да стартират модела върху собствена GPU инфраструктура, но същата тази лесна достъпност също снижава бариерата за злоупотреба.

Abliteration.ai премахва обучените механизми за отказ от мощни модели с отворени тегла и продава достъп до модифицираните версии като услуга. За това съществува легитимен пазар, но същата конфигурация създава труден компромис по отношение на сигурността.

Всеки, който има достъп до теглата на модел с отворени тегла, може да модифицира обучените му механизми за безопасност. Американският стартъп Abliteration.ai е изградил бизнес именно около това. В края на август компанията пусна „abliterated-model-large-v2“ — модифицирана версия на GLM-5.3 на Z.AI, проектирана да отказва чувствителни заявки значително по-рядко.

Техниката се нарича abliteration. Казано накратко, процесът открива вътрешни активационни модели в модела, които задействат откази. След това теглата на модела се коригират, за да потиснат тези модели. Това не е заобикаляне на защитите чрез промпт, а промяна на самия модел. Abliteration.ai твърди, че възможностите за програмиране, киберсигурност и работа с агенти до голяма степен се запазват.

Стълбовидна диаграма на Abliteration.ai сравнява аблитерираната версия на GLM-5.3 с други AI модели в Terminal-Bench 4.0, CyberGym и ExploitGym.
Abliteration.ai сравнява своя аблитериран модел GLM-5.3 с конкурентни модели в три бенчмарка. | Изображение: Abliteration

Вътрешните оценки на компанията имат за цел да потвърдят това. За аблитерираната версия на GLM-5.3 Abliteration.ai отчита 84,5 процента в CyberGym, 41,8 процента в Terminal-Bench 4.0 и 105 решени задачи в ExploitGym за два часа. Моделът обаче не води във всички категории. В собствената таблица на компанията GPT-5.5 оглавява CyberGym с 85,6 процента, а GPT-5.6 Sol и Fable 5 постигат значително по-добри резултати от него в ExploitGym. Abliteration.ai също признава, че сравнителните резултати са получени с различни инструменти за оценяване и изчислителни бюджети, което ограничава възможността за прякото им сравнение.

Защо GLM?

Предишният модел, „abliterated-model-large“, също беше базиран на GLM-5.2. Според Abliteration.ai по-ранните версии на GLM умишлено са били обучени по начин, който ги е направил по-трудни за използване при практическа работа по сигурността. Z.AI е писала, че киберспособностите на GLM-5.3 са нараснали по-бързо от очакваното по време на дообучаването.

GLM съчетава силни резултати в програмирането, работата с агенти и киберсигурността с отворени тегла и комерсиално използваем лиценз. Съществуват алтернативи от Qwen, DeepSeek и Mistral. Z.AI разрешава модификации, производни модели и комерсиални предложения от типа „Модел като услуга“. Следователно лицензът позволява на Abliteration.ai да модифицира GLM-5.3, да хоства получения модел и да продава достъп до него.

Отворени тегла, собственически услуги

Самата abliteration не е нова. От години разработчици публикуват модифицирани модели в Hugging Face. Abliteration.ai не предоставя своите модифицирани тегла за публично изтегляне. Вместо това компанията се занимава с хостването и операциите. Аблитерираният GLM-5.3 струва пет долара на милион входни или изходни токени по стандартната тарифа.

Услугата предоставя на клиентите достъп до модела, без те да трябва да го изтеглят или сами да управляват GPU инфраструктурата. Тази готова конфигурация също снижава бариерата за проблемна употреба.

Компанията твърди, че търсенето вече съществува

Abliteration.ai предлага модела за офанзивна киберсигурност, червено екипиране на AI системи, тестване на агенти и работа по доверието и безопасността. Това включва възпроизвеждане на известни уязвимости, експлойти за доказване на концепцията, анализ на зловреден софтуер и симулирани фишинг атаки.

Анонимен основател на стартъпа заяви в подкаста ThursdAI, че ранното търсене идва най-вече от компании, които тестват AI агенти, внедрени от големи организации и банки. Тези системи трябва да бъдат проверени дали нападатели могат да използват заобикаляне на защитите или инжектиране на промпти, за да задействат неоторизирани действия.

Колко abliteration действително е необходима за такъв тип работа остава открит въпрос. Според SaferAI немодифицираният GLM-5.2 вече е отказал нула задачи в оценките за офанзивна сигурност. Някои практици също са скептични. Няколко доставчици на услуги за червено екипиране, интервюирани от TechCrunch, заявиха, че аблитерираните модели не са част от обичайната им работа. Например компанията за сигурност Fabraix разчита в по-голяма степен на дообучаване на отворени модели.

Нулевото съхранение е едновременно предимство и риск

TechCrunch съобщи, че е успял без особени затруднения да накара модела да генерира код за извличане на запазени пароли от Chrome и подробно ръководство за отглеждане на опасен патоген. Механизмите за безопасност все пак са се задействали при заявки за самонараняване. Според често задаваните въпроси Abliteration.ai също блокира сексуално съдържание, включващо деца. Клиентите могат по желание да добавят още правила.

Според доставчика промптовете и отговорите не се съхраняват. Запазват се оперативни метаданни като брой токени, времеви отметки, идентификатори на моделите и данни за таксуване. За легитимни екипи по сигурността това може да предотврати попадането на поверителен изходен код или непубликувани уязвимости в съхраняваните от доставчика данни. Ако обаче услугата бъде използвана неправомерно, Abliteration.ai заявява, че няма дневници с промптове или отговори, които да провери впоследствие. Компанията също не изисква стандартна идентификация или проверка на документ за самоличност. Това може да затрудни разследването на проблемна употреба, въпреки че метаданните за акаунта, плащанията и използването все пак се съхраняват.

Анонимният представител на компанията твърди, че проверките на самоличността не биха могли надеждно да разграничат легитимните от злонамерените потребители. Той също така заявява, че по-строгите контроли за достъп могат да поставят по-малките компании за сигурност в неизгодно положение спрямо големите предприятия.

Клиентът определя правилата

Чрез опционален шлюз за политики корпоративните клиенти могат да определят кои заявки са разрешени, блокирани, променяни или регистрирани. Компанията продава и синтетични данни за обучение и оценка. Стандартният достъп до модела обаче остава до голяма степен неограничен. Допълнителните правила за контрол трябва да бъдат включени изрично.

Същата философия се разпростира и върху държавните клиенти. Abliteration.ai заявява, че е регистрирана за обществени поръчки на американското правителство в SAM.gov и предлага версионирани модели, одитни дневници и специфични за агенциите правила, започвайки с пилотни проекти, които не включват Контролирана непублична информация (CUI).

Модифицирането на GLM-5.3 е разрешено съгласно неговия лиценз. Дали дадена конкретна употреба е законна зависи от извършваното и от приложимата юрисдикция. За тестване на сигурността Abliteration.ai изрично изисква писмено разрешение за целевите системи и спазване на приложимите закони. Това оставя отделен въпрос за отговорностите, които доставчикът трябва да поеме, когато предлага мощни офанзивни възможности чрез леснодостъпна услуга.

Abliteration.ai не е първата компания, която прави това. Доставчици като Audn.AI с PenClaw и Silk Compute също хостват аблитерирани или до голяма степен неограничени модели за случаи на употреба в сигурността. Конкретното предложение на Abliteration.ai съчетава GLM-5.3 с директен API достъп и опционален слой от политики за корпоративни клиенти.

Модификацията не оставя останалата част от модела непокътната

Предварително изследване предполага, че отказите могат да бъдат рязко намалени при определени модели без сравним спад в производителността при генериране на код. Други експерименти обаче откриват промени в поведението дори при задачи, при които базовият модел изобщо не е отказвал. С други думи, abliteration не премахва хирургически една-единствена характеристика, а навлиза по-дълбоко в начина, по който моделът се държи.

Abliteration.ai също така прехвърля голяма част от решенията относно ограниченията на модела от доставчика към клиента, а дали тази конфигурация може да обслужва легитимна работа по сигурността, без значително да улеснява вредната употреба, остава нерешен въпрос.

AI новини без сензация – подбрани от хора

Абонирайте се за THE DECODER и ще получите четене без реклами, седмичен AI бюлетин, нашия ексклузивен граничен доклад „AI Radar“ шест пъти годишно, пълен достъп до архива и достъп до секцията за коментари.

Източник: Abliteration.ai

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Decoder на

Прочетете оригинала в The Decoder ↗

Текстът и изображенията са собственост на The Decoder и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини