Колись популярний для атак на ШІ, ASCII smuggling тепер використовують спамери
Кмітливий метод, який використовують для приховування шкідливих підказок під час атак на ШІ-агентів, спамери почали застосовувати, щоб обходити фільтри на поштових платформах, призначені для виявлення небажаних повідомлень, які використовуються в масових кампаніях.
Цей метод загалом відомий як ASCII-стеганографія. Два роки тому він привернув увагу як спосіб зробити більш непомітним клас атак на ШІ, відомий як ін’єкції підказок. Шкідливі інструкції, вбудовані в електронні листи або інший ненадійний контент, який має оброблятися LLM, не записуються звичайним текстом. Натомість вони відображаються за допомогою спеціального діапазону тегів Unicode. Наприклад, кодова точка U+E0041 відповідає «A», а U+E0061 — «a».
Тепер це не лише спосіб приховувати ін’єкції підказок
Блок із 128 тегів майже ідеально імітує частину американського стандартного коду для обміну інформацією, але має одну суттєву відмінність: закодовані ними символи можуть бути прочитані комп’ютерами, проте за задумом майже повністю невидимі для людей. Виражаючи шкідливі підказки за допомогою цих тегів, LLM виявляють інструкції, але люди, які читають електронний лист, їх не бачать. Більше про ASCII-стеганографію можна прочитати тут.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.