网络安全 Sep 2, 2026加入收藏

亲俄组织UAC-0099找到了一种针对LLM自动分析的新奇对策:在恶意软件中植入关于核武器的提示。AI工具触发其过滤机制并拒绝分析———种反向越狱,将AI的防护栅栏反过来对付防御者。
俄罗斯亲善组织 UAC-0099(自2022年起活跃于针对乌克兰目标及其合作伙伴)在其恶意软件中引入了一种全新技术。该技术被ESET研究人员命名为 GuardBreaker,其核心在于在恶意代码中植入一段自然语言提示,要求提供制造核武器的建议。
效果立竿见影且可复现:基于大语言模型(LLM)的自动化分析工具一旦检测到此类内容,便会以大规模杀伤性武器政策为由拒绝分析该文件。分析师面对的是一片沉默的工具,恶意软件则得以逃脱检测。
UAC-0099将提示隐藏于恶意二进制文件的元数据、注释或字符串中。当分析师将代码复制粘贴至LLM或使用自动分析插件时,模型会先读取此内容并触发安全过滤机制,甚至无需分析真正的恶意代码。
GuardBreaker是一种逆向越狱形式:攻击者并非试图绕过过滤器获取危险内容,而是故意触发过滤器以瘫痪对手的分析工具。这是对LLM安全防护的一种恶意利用。
所有使用LLM协助分析可疑代码的分析师或安全运营中心(SOC)均受影响。若沙盒平台在未预过滤的情况下将文件原始内容传输给AI模型,也将面临风险。
若AI工具因安全政策拒绝分析可疑文件:切勿认为该文件无害。应立即转用传统静态分析方法,并将拒绝本身视为潜在妥协指标(IoC)。在YARA规则库及ESET威胁情报源中搜索“GuardBreaker”。
本文由人工智能撰写,并经人工编辑审核。
Un fichier .git piégé peut faire exécuter du code par Claude Code, Codex et Cursor