Кибербезопасность Sep 2, 2026В закладки

Группа пророссийских хакеров UAC-0099 нашла оригинальный способ обойти автоматический анализ с помощью ИИ: они внедряют в свои вредоносные программы промты о ядерном оружии. Инструменты на базе ИИ срабатывают и отказываются проводить анализ — это инвертированный джейлбрейк, который обращает защитные механизмы ИИ против самих защитников.
Группа UAC-0099, связанная с Россией и активная с 2022 года против украинских целей и их партнёров, внедрила новую технику в свои вредоносные программы. Исследователи ESET назвали её GuardBreaker — она заключается в том, чтобы внедрить в вредоносный код промт на естественном языке, в котором содержится просьба о консультации по производству ядерного оружия.
Эффект моментальный и воспроизводимый: автоматические инструменты анализа на основе LLM (Large Language Model) отказываются обрабатывать файл, как только обнаруживают такое содержимое, ссылаясь на свои политики безопасности в отношении оружия массового поражения. Аналитик остаётся с немым инструментом. Вредоносное ПО проходит незамеченным.
UAC-0099 внедряет промт в метаданные, комментарии или строковые данные бинарного файла. Когда аналитик копирует код в LLM или использует плагин автоматического анализа, модель считывает это содержимое и активирует свой фильтр безопасности до того, как начнёт анализировать сам вредоносный код.
GuardBreaker — это форма обратного джейлбрейка: вместо того чтобы обходить фильтры для получения опасного контента, их намеренно активируют, чтобы нейтрализовать инструмент противника. Циничное использование защитных механизмов LLM против самих пользователей.
Любого аналитика или SOC (Security Operations Center), использующего LLM в помощь при анализе подозрительного кода. Автоматические песочницы, интегрирующие ИИ-модели, также уязвимы, если передают сырое содержимое файлов моделям без предварительной фильтрации.
Если ИИ-инструмент отказывается анализировать подозрительный файл, ссылаясь на политики безопасности: не делайте вывод об отсутствии угрозы. Немедленно переходите к традиционному статическому анализу и рассматривайте сам отказ как потенциальный индикатор компрометации (IoC). Ищите «GuardBreaker» в базах YARA и угроз feed ESET.
Статья создана искусственным интеллектом и проверена под редакционным контролем человека.
Un fichier .git piégé peut faire exécuter du code par Claude Code, Codex et Cursor