Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

Как хакери са използвали Claude за ракети, рояци от дронове и наблюдение, докато китайски лаборатории са извличали от него данни за обучение

Как хакери използваха Claude за ракети, рояци от дронове и наблюдение, докато китайски лаборатории го използваха за добив на данни за обучение
Максимилиан Шрайер
11 септември 2026 г.
Nano Banana Pro, подканен от THE DECODER

Основни моменти

  • Доклад на Anthropic показва как нейният модел с изкуствен интелект Claude е бил използван неправомерно за шпионаж, наблюдение и разработване на оръжия. Хакери са карали изкуствения интелект автоматично да пренаписва зловреден софтуер, докато други групи са кодирали софтуер за ракети и автономни дронове.
  • Китайски компании за изкуствен интелект като Alibaba и DeepSeek са управлявали тайни мрежи за извличане на данни за обучение от Claude в голям мащаб или тайно са пренасочвали заявките на собствените си клиенти. Сред обработваната информация са били чувствителни данни от правителствено наблюдение.
  • При биологичните изследвания филтрите за безопасност са достигнали пределите си, тъй като легитимното и вредното намерение почти не са могли да бъдат разграничени. Anthropic реагира с по-строги защити в новите модели и призовава достъпът да бъде ограничен до проверени потребители.

Новият доклад за заплахите на Anthropic описва осем месеца злоупотреби с Claude: шпионаж, национално наблюдение, софтуер за оръжия и дистилация от китайски лаборатории за изкуствен интелект.

Докладът за разузнаването на заплахите на Anthropic обхваща периода от декември 2025 г. до август 2026 г. и разделя злоупотребите на седем категории: кибероперации, операции за влияние, наблюдение, измами, злоупотреби с биология, конвенционални оръжия и неразрешена дистилация на модели.

Най-засегнати са били моделите Haiku, Sonnet и Opus, докато по-новите модели Fable и Mythos са се появили само в един случай на дистилация. Anthropic заявява, че документира нови видове злоупотреби, а не типичните случаи.

Основният извод от главата за киберсигурността е, че сложните атаки вече не изискват сложни нападатели, а сложността вече не е надежден сигнал за установяване на извършителя. Самите техники са познати, включително откраднати идентификационни данни, непачнати устройства, SQL инжекции и фишинг. Променила се е икономиката, тъй като разузнаването, експлоатирането на уязвимости и създаването на инструменти вече се възлагат на модели, които работят паралелно с машинна скорост.

Автономността намалява разходната страна на изчисленията на нападателя, казва Anthropic, и прави предишни нерентабилни цели заслужаващи преследване.

Зловреден софтуер, който се възстановява, когато антивирусните инструменти го засекат

Anthropic проследява рускоговорящ шпионски участник с обозначение GTG-20006, който е използвал цикъл за обратна връзка. Агенти с изкуствен интелект непрекъснато проверявали дали използваният зловреден софтуер е засечен от широко разпространени продукти за сигурност, а когато антивирусен инструмент го откривал, агентите сами пренаписвали и прекомпилирали зловредния код, докато той отново не успеел да избегне засичането.

Това прехвърля тежестта обратно върху защитниците, казва Anthropic, защото създаването на нови сигнатури за засичане вече не забавя нападателя, ако той извършва промени по-бързо, отколкото могат да бъдат внедрени нови сигнатури.

Били са набелязани повече от 20 организации, включително правителствени министерства, разузнавателни служби, посолства и отбранителни компании, с фокус върху Украйна и Европа. Веригата за доставки на дронове многократно се е оказвала мишена, а участникът е откраднал, наред с други неща, пълен патентован SDK за система за визуално разпознаване на дронове. Достъпът понякога е минавал през трети страни, например компрометирани доставчици на Wi-Fi за гости в хотели, чиито устройства на гости след това били заразявани със зловреден софтуер — метод, описан от Microsoft през юли 2026 г. като CaptiveCrunch.

При клъстерите, които Anthropic приписва на колектива ShinyHunters (GTG-50014), фокусът е бил върху индустриалното събиране на идентификационни данни. Един хакер е изтеглил 1,8 милиона приложения за Android, декомпилирал ги е и е търсил тайни, записани директно в кода. Anthropic описва подхода като „вайб хакерство“, при което човек задава приблизителна цел, а моделът оценява средата и повтаря процеса, докато задачата бъде изпълнена. Един от хакерите е заявил, че е събирал награди от HackerOne, като същевременно е изнудвал две компании.

Китайски лаборатории пренасочват заявките на собствените си клиенти към Claude

Що се отнася до дистилацията, Anthropic е идентифицирала атаки от още седем китайски лаборатории след първото си разкритие през февруари. Дистилацията като метод за обучение е легитимна, но Anthropic определя нелегитимната версия като тайни кампании в индустриален мащаб, които извличат възможностите на модела без разрешение, обикновено чрез мрежи от фалшиви акаунти, използващи откраднати кредитни карти и API ключове, пренасочени през т.нар. „трансферни станции“.

Най-мащабната измерена досега кампания се приписва на лабораторията Qwen на Alibaba (GTG-16005). Фиксирана подкана е карала Claude да изписва своите разсъждения преди отговора, а транскрипциите са били обработвани като данни за дообучаване на моделите Qwen 3.5, 3.6 и 3.7. Пикът е достигнал почти три милиона обмена дневно от над 3500 измамни акаунта, като общият брой е надхвърлил 151 милиона обмена между май и юли 2026 г., предимно при агентни задачи и разработване на софтуер.

Още по-странни са случаите, в които лаборатории са препредавали заявките на собствените си клиенти към Claude. Moonshot AI (GTG-16002) е препратила почти 300 000 клиентски заявки към Anthropic за десет дни чрез 5380 измамни акаунта, докато потребителите са смятали, че използват модел Kimi. DeepSeek (GTG-16001) е използвала низове, за да засича кога заявките идват от среди като Claude Code, маркирала е тези потребители и е пренасочвала избрани заявки към Claude Opus — над 12,1 милиона обмена за 14 дни.

Сред пренасочените заявки Anthropic е открила потребител, вероятно свързан с Народноосвободителната армия, който е анализирал архивни записи от видеонаблюдение за една-единствена цел — видеоматериали от стотици камери в Чънду, включително камери извън обекти на НОА. Чрез DeepSeek Claude също е получил заявки от оператор с активни идентификационни данни за база данни, свързана с руското Министерство на отбраната, както и работа по система за управление на случаи за китайско бюро за обществена сигурност, която съпоставя профили на движение с полицейски записи.

Xiaomi (GTG-16008) е използвала Claude по различен начин, като е съхранявала заявките и сесиите за кодиране на потребители на собствените си модели MiMo и е възпроизвеждала тези разговори чрез Claude, за да генерира данни за обучение. Anthropic не е открила доказателства, че отговорите на Claude са били предоставяни директно на потребителите на Xiaomi. Препратените заявки обаче са съдържали лични данни като имена, данни за контакт и информация за компании на стотици хора на поне дузина езика.

Zhipu (известна извън Китай като Z.ai) е сменяла 273 акаунта и е прокарала над 770 000 обмена за десет дни през инструмент за почистване на CoT — инструмент, който автоматично превръща уловените следи от разсъждения в използваеми данни за обучение. За да обучи GLM-5.3 по киберзадачи, лабораторията първоначално се е насочила към модела Fable на Anthropic, но се е отказала, след като киберзащитите са влошили производителността му, и след това умишлено е преминала към модели, които е преценила като по-слабо защитени.

Според доклада SenseTime е купувала транскрипции от трети страни, така че не е получила директно извлечените данни от Claude, а чрез посреднически пазар. MiniMax е управлявала собствена прокси мрежа чрез подставена компания, която е предлагала само модели на Anthropic и OpenAI, но не и китайски модели — дори собствения си.

Наблюдението като основен инженерен ресурс

В главата за наблюдението Мали се откроява. Един-единствен консултант е използвал Claude като основен инженерен ресурс за „Lakana 360“ — платформа за наблюдение на приблизително 25 милиона SIM карти в трите национални мобилни оператора. Тя идентифицира хората по гласа при смяна на SIM карти, маркира потребители на криптиране и VPN и свързва лицата с националния биометричен граждански регистър.

Спирането на акаунта е прекъснало само разработката, но не и дейността, тъй като платформата работи с локални модели в локална инфраструктура. Anthropic документира сходни модели при ирански звена, които твърдят, че са наблюдавали и профилирали 6388 иранци в рамките на една година.

Първа глава за конвенционалните оръжия

Що се отнася до оръжията, Anthropic за първи път документира собствени случаи. Клетка в северен Йемен (GTG-87001) е поставила Claude Code на мястото на човешки софтуерни инженери за софтуера за насочване, навигация и управление на три ракетни програми, включително многостепенна ракета с обсег над 2000 километра.

Участниците са управлявали няколко инстанции на Claude паралелно и са разпределяли работата между сесиите, така че никоя отделна сесия да не разкрива намерението. Изглежда, че изпитателен пуск е претърпял неуспех, а в рамките на часове участниците са се върнали към Claude, за да установят причината.

Втори случай (GTG-27005) вероятно включва руски независими участници, които са изградили автономен рояк от FPV дронове камикадзе, с малък езиков модел на борда и насочване във финалната фаза чрез камера. Платформата е била проектирана за автономен смъртоносен ефект, а моделът на борда е могъл да избира цели от клас „човек“ и да задейства детонация без човек в процеса. Според Anthropic класификаторът на изображения е бил обучен с пленени украински бойни кадри.

Китайски случай (GTG-17002) е включвал набор от приблизително 16 модула за електронна война и потискане на противовъздушната отбрана на противника. По средата на проекта сценарият по подразбиране в симулацията е бил променен на дванадесет цели в Тайван.

Биология: Anthropic описва ограниченията на собствените си филтри

Главата за биологията е най-самокритичната. Anthropic документира пет анонимизирани случая с работещи учени, при които Claude е подпомагал потенциално опасни проекти с двойна употреба. В един случай класификаторът за биосигурност е блокирал заявление за грант за изследвания с придобиване на нови функции при вируса чикунгуня, планирани във военен изследователски институт.

Операторът на използваната платформа е изградил резервен механизъм, който е пренасочвал отхвърлените от Claude заявки към модел на конкурент, а според доклада самият Claude е написал по-голямата част от кода за него. Други проекти са протекли до голяма степен безпрепятствено, като например изготвянето на заявление за гени за избягване на имунния отговор при ортопоксвируси.

Изводът е, че класификаторите не могат едновременно да позволяват полезна работа и да предотвратяват вреди, тъй като намерението на потребителя в областите с двойна употреба не може надеждно да бъде установено. В отговор Anthropic пусна Claude Fable 5 с по-строги защити за заявки, свързани с биология с двойна употреба, а срещу дистилацията „запазеното мислене“, въведено с Fable 5.1, има за цел да попречи на нови API акаунти да манипулират контекста. Според Anthropic единственият безопасен път към водещи възможности в биологията минава през програми за проверени потребители.

Новини за изкуствения интелект без хайпа – подбрани от хора

Абонирайте се за THE DECODER за четене без реклами, седмичен бюлетин за изкуствения интелект, нашия ексклузивен шест пъти годишно доклад за водещите технологии „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.

Източник: Anthropic (блог) | Anthropic (доклад)

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Decoder на

Прочетете оригинала в The Decoder ↗

Текстът и изображенията са собственост на The Decoder и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини