Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← К новостям

Abliteration.ai делает бизнес на снятии защитных ограничений ИИ

Получить доступ к одной из самых мощных в мире моделей ИИ с открытыми весами, лишённой защитных механизмов и отказов выполнять вредоносные задачи, стало гораздо проще.

Стартап Abliteration.ai, названный в честь метода, удаляющего склонность модели отказывать в выполнении вредоносных запросов, превратил это удаление в сервис. Платформа размещает модифицированные версии моделей с открытыми весами и удалёнными защитными механизмами, включая недавно выпущенную GLM-5.3 от Z.ai, с которой пользователи могут взаимодействовать через веб-браузер или получать доступ через API. 

В недавней публикации в соцсети компания заявила, что её цель — позволить другим выполнять «наступательные кибероперации, работы по проверке безопасности и тестирование агентов, от выполнения которых другие модели отказываются». Логика здесь знакома специалистам по безопасности: невозможно защищаться от поведения, которое нельзя воспроизвести, а модель, отказывающаяся писать работающий код эксплойтов, не может помочь команде по тестированию безопасности защищаться от атакующих. Но те же удаления также упрощают выполнение других потенциально опасных задач. 

Аблитерация — давно известный метод, применяемый к моделям с открытым исходным кодом. Исследователи и разработчики годами удаляют отказы из моделей с открытыми весами, а на Hugging Face размещены тысячи аблитерированных моделей. 

Компания Abliteration.ai, основанная в конце прошлого года, но официально зарегистрированная в марте, переводит эту технику из подпольной практики открытого исходного кода в коммерческий и общедоступный сервис. Размещая модель самостоятельно, Abliteration снижает порог входа для людей, которым в противном случае пришлось бы скачивать собственные предварительно аблитерированные модели и обеспечивать вычислительные ресурсы для их запуска.

Используя сервис, TechCrunch смог быстро создать аккаунт и бесплатно начать отправлять запросы аблитерированной версии GLM-5.3 через веб-браузер. Мы попросили её написать программу на Python, крадущую сохранённые пароли Chrome, и подробный протокол выращивания опасного патогена человека в домашних условиях — и модель охотно выполнила эти запросы.

Сооснователь Abliteration.ai Девон говорит, что у стартапа есть несколько соглашений с крупными облачными провайдерами, оплачивать которые компания может исключительно за счёт доходов от клиентов. (По просьбе Девона мы не указываем его фамилию, поскольку он по-прежнему работает в другой компании.) Abliteration.ai пока не привлекала венчурные инвестиции, но ведёт переговоры об этом. 

Критики утверждают, что масштабная доступность аблитерированных моделей может привести к реальному вреду. Эндрю Юн, руководитель исследовательского направления в некоммерческой организации по безопасности ИИ CivAI, заявил TechCrunch, что аблитерация позволяет «модифицировать модель так, чтобы она становилась социопатом».

«Здесь можно ввести буквально что угодно, и модель это выполнит, — сказал Юн. — Когда люди говорят об удалении защитных механизмов из моделей ИИ, они имеют в виду именно это… Я ожидаю, что в ближайшем будущем мы начнём видеть отредактированные, аблитерированные модели, используемые во вредоносных целях».

Abliteration AI только что удалила защитные механизмы из GLM-5.3, чтобы модель могла выполнять наступательные кибератаки. Я также получил независимое подтверждение того, что Abliteration AI удалила и связанные с биологией защитные механизмы модели. Тот факт, что защитные механизмы можно тривиально удалить из… https://t.co/7Wk2Ibx35H

— Крис Макгуайр (@ChrisRMcGuire) 1 сентября 2026 года

Большинство экспертов, с которыми поговорил TechCrunch, считают, что остановить этот процесс невозможно. Но если удаление защитных механизмов из моделей с открытыми весами невозможно реалистично предотвратить, у государства есть другие точки для вмешательства. В недавней колонке Юн предложил обязать провайдеров запускать классификаторы для выявления и блокировки вредоносной киберактивности и деятельности, связанной с биологическим оружием. Он также заявил, что компании, сдающие в аренду прямой доступ к современным графическим процессорам, должны проверять личности клиентов и «отказывать в доступе, если есть основания подозревать опасное неправомерное использование».

Abliteration.ai предлагает клиентам слой модерации, позволяющий добавлять любые необходимые защитные механизмы. Сама платформа также имеет некоторые базовые ограничения — например, в ходе нашего тестирования нам не удалось заставить модель предоставить инструкции по совершению самоубийства, — а Девон говорит, что работает над внедрением дополнительных мер для предотвращения насилия. 

В Abliteration.ai также не внедрили никаких процедур KYC, кроме регистрации банковской карты, которую клиент использует для покупки сервиса. В компании говорят, что вопрос о том, кому предоставлять доступ, остаётся сложным и молодой компании ещё предстоит его решить. 

«Вы не хотите оказаться человеком, ответственным за то, что кто-то сделал что-то безумное… так где же провести границу того, что входит в вашу ответственность как компании? — сказал Девон. — Мы всё ещё в процессе определения этого».

Это поднимает вопросы, с которыми индустрии и государствам придётся столкнуться по мере выпуска всё более мощных моделей с доступными для скачивания весами: если любой человек может удалить защитные механизмы модели, делает ли упрощение доступа к получившейся модели интернет безопаснее или опаснее?

Основатель Abliteration.ai и другие сторонники проекта утверждают, что демократизация доступа к нецензурируемым передовым моделям — лучшая форма защиты.

«В широком смысле аблитерированные модели позволяют моделировать действия злоумышленников, — сказал Девон. — Преимущество в том, что теперь защитники могут двигаться как можно быстрее. У них есть все необходимые инструменты, чтобы моделировать действия злоумышленников и затем защищаться от этих вредоносных действий, и, как мне кажется, это ускорит развитие кибербезопасности — своего рода контринтуитивный вывод».

Хотя компания ещё молода, Девон говорит, что среди клиентов Abliteration.ai есть несколько стартапов, занимающихся тестированием безопасности и расположенных в Великобритании и Европе. Эти компании помогают банкам, авиакомпаниям и другим предприятиям, работающим с критической инфраструктурой, усилить практики кибербезопасности. 

«Один из наших крупных клиентов проводит тестирование безопасности агентов банков, и сегодня он не смог бы использовать стандартные модели для такого тестирования этих агентов», — сказал Девон.

TechCrunch создал бесплатный аккаунт и протестировал аблитерированную версию GLM-5.3. Авторы изображения:TechCrunch/Abliteration.ai

Тем временем сама индустрия кибербезопасности всё ещё пытается понять, какое место — если оно вообще есть — занимают аблитерированные модели в защитной работе.

Несколько компаний, занимающихся тестированием безопасности агентов, с которыми поговорил TechCrunch, согласны с Девоном в том, что злоумышленники уже аблитерируют собственные модели и используют их для проведения атак, что говорит в пользу предоставления защитникам тех же инструментов. Однако они расходятся во мнениях относительно того, насколько значимую роль аблитерированные модели действительно играют в этом процессе. 

Хотя Девон утверждает, что аблитерация моделей необходима для тщательного тестирования безопасности агентов, некоторые специалисты говорят, что не используют их в повседневной работе, полагаясь вместо этого на простоту дообучения моделей с открытыми весами, у которых и так мало защитных механизмов, для проведения своих тестов. 

Ахмед Али, генеральный директор компании по тестированию безопасности агентов Fabraix, говорит, что его компания в большей степени полагается на дообучение открытых моделей, чем на использование аблитерированных, добавляя, что процесс аблитерации удаляет часть знаний и возможностей модели. 

«Если вы действительно пытаетесь причинить ей реальный вред — кибервред или биологический вред, — она будет не столь эффективной», — сказал Али TechCrunch.

Алессио Ломусио, главный технолог компании Safe Intelligence, согласился, что снижение возможностей возможно, но по-прежнему считает, что аблитерированные модели могут выявлять определённые типы поведения, полезные для стресс-тестирования системы. 

«Пока аблитерированные модели не являются частью процесса, — заявил TechCrunch Дэвид Слейтер, основатель и главный архитектор платформы кибербезопасности Armadin. — Когда мы смотрим на модели с открытыми весами вплоть до этого последнего поколения, взламывать их и заставлять делать то, что нам нужно, было не особенно сложно».

Он добавил, что Armadin всё же исследует аблитерацию и считает, что «стимулировать открытое сообщество к пониманию возможностей моделей крайне важно».

«Это будет происходить за закрытыми дверями. Это будет происходить в частном порядке, — продолжил Слейтер. — То, что это происходит открыто, даёт исследователям инструменты. Это даёт нам возможность понять, где на самом деле проходит передовой край, и осознать масштабы вреда».

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием TechCrunch

Читать оригинал на TechCrunch ↗

Текст и изображения принадлежат TechCrunch и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости