Технологии

Спамеры начали использовать ASCII smuggling для обхода почтовых фильтров

Техника, ранее связанная с атаками prompt injection на AI-агентов, стала применяться в массовых спам-рассылках для маскировки ключевых слов

Один основной источник · Как мы проверяем новости

Спамеры начали использовать ASCII smuggling для обхода почтовых фильтров
Иллюстрация к материалу RedBTC News

Что произошло

Спамеры начали применять ASCII smuggling — технику, которая использует специальные Unicode-теги для скрытия текста. Такой подход помогает обходить фильтры на почтовых платформах, предназначенные для выявления нежелательных массовых сообщений.

Метод стал заметен в контексте атак на AI-агентов: вредоносные инструкции для LLM можно записывать не обычным текстом, а символами из специального диапазона Unicode. Модель способна обработать такие инструкции, а человек при чтении письма их не видит.

Как работает прием

В ASCII smuggling используется блок из 128 тегов, который почти полностью имитирует часть American Standard Code for Information Interchange. Например, U+E0041 соответствует «A», а U+E0061 — «a». Главное отличие в том, что такие символы читаются компьютерами, но по замыслу почти невидимы для людей.

В спаме такие символы вставляют внутрь слов, чтобы нарушить работу фильтров. Например, если невидимый текст вставить в середину слова «funding», фильтр может разделить его на «fun» и «ding», тогда как получатель увидит цельное слово.

Почему это важно

Microsoft сообщила о масштабном всплеске таких сообщений в Microsoft Defender for Office. В начале февраля число сигнатур ASCII smuggling выросло примерно с 21 000 в день до более чем 1,3 млн, а в течение четырех дней достигло 2,5 млн. Поток сохранялся месяцами и резко снизился в середине мая.

По объяснению Microsoft, свойства тегов, которые делают их удобными для скрытой передачи инструкций в модель, также подходят для маскировки ключевых слов до того, как их оценит детектор.

Контекст

Использование специальных символов для маскировки слов не является новым приемом. Спамеры десятилетиями применяли пробелы нулевой ширины и неразрывные пробелы, чтобы мешать поиску точных строк и менять последовательности байтов, на которые ориентируются фильтры на регулярных выражениях.

Скрытые Unicode-теги, вероятно, стали привлекательны потому, что некоторые спам-фильтры еще не были настроены на их обнаружение. Еще одной вероятной причиной источники называют попытку снизить эффективность систем обнаружения спама, основанных на машинном обучении и обработке естественного языка.

Advertisement

Источники

Один основной источник. Как мы проверяем новости

  1. arstechnica.com