UAC-0099 integra um « prompt de arma nuclear » em seus malwares para cegar analistas de IA

Seguimento do caso : Un fichier .git piégé peut faire exécuter du code par Claude Code, Codex et Cursor· Episódio 21/23

Cibersegurança Sep 2, 2026Adicionar aos favoritos

UAC-0099 integra um « prompt de arma nuclear » em seus malwares para cegar analistas de IA

O grupo pró-russo UAC-0099 encontrou uma solução criativa contra a análise automatizada por LLM: inserir nos seus malwares um prompt sobre armas nucleares. As ferramentas de IA ativam seus filtros e se recusam a analisar — um *jailbreak* invertido que usa os próprios mecanismos de segurança da IA contra os defensores.

O que é: GuardBreaker, um « jailbreak inverso » para cegar a análise de IA

O grupo UAC-0099, alinhado com a Rússia e ativo desde 2022 contra alvos ucranianos e seus parceiros, introduziu uma técnica inédita em seus malwares. Batizada de GuardBreaker pelos pesquisadores da ESET, ela consiste em inserir no código malicioso um prompt em linguagem natural pedindo conselhos sobre a fabricação de armas nucleares.

O efeito é imediato e reprodutível: as ferramentas de análise automática baseadas em LLM (Large Language Model) recusam-se a analisar o arquivo assim que detectam esse conteúdo, invocando suas políticas de segurança sobre armas de destruição em massa. O analista se depara com uma ferramenta mudo. O malware passa despercebido.

A técnica em detalhes

O UAC-0099 insere o prompt em metadados, comentários ou cadeias de caracteres do binário. Quando um analista copia e cola o código em um LLM ou usa um plugin de análise automática, o modelo lê esse conteúdo e aciona seu filtro de segurança antes mesmo de analisar o código malicioso propriamente dito.

GuardBreaker é uma forma de jailbreak inverso: não se tenta contornar os filtros para obter conteúdo perigoso — eles são acionados deliberadamente para neutralizar a ferramenta de análise adversária. Um uso cínico das salvaguardas de segurança dos LLMs contra seus próprios usuários.

Quem é afetado

Qualquer analista ou SOC (Security Operations Center) que utilize LLMs como auxílio na análise de código suspeito. As plataformas de sandbox automático que integram modelos de IA também estão expostas se transmitirem o conteúdo bruto dos arquivos aos modelos sem pré-filtragem.

O que fazer

  1. Nunca passar arquivos suspeitos brutos para um LLM sem pré-filtrar as cadeias de caracteres não-código (metadados, comentários, recursos embarcados)
  2. Usar ferramentas de análise estática clássicas (IDA Pro, Ghidra, YARA) em paralelo aos LLMs — elas analisam os opcodes, não a linguagem natural
  3. Sensibilizar as equipes SOC: se um LLM recusar-se a analisar um arquivo por "razões de segurança", isso é um sinal de alerta, não um resultado de análise. Pesquisar por "GuardBreaker ESET" para IOCs e regras de detecção.
  4. Reportar a técnica aos editores de ferramentas de IA para que adaptem seus filtros aos contextos de análise de segurança

O que fazer agora

Se uma ferramenta de IA recusar-se a analisar um arquivo suspeito invocando suas políticas de segurança: não concluir pela ausência de ameaça. Passar imediatamente para a análise estática tradicional e tratar a recusa como um indicador de comprometimento potencial (IoC). Pesquisar por "GuardBreaker" nas bases YARA e nos feeds de ameaças da ESET.

Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux server, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux server, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install, everything stays on your machine.

SSHSelf-hostedAI Ops
Get early access
Este artigo foi-lhe útil?

14 pessoas gostaram deste artigo

Gosto
K
Kenji AraiCybersecurity expert
Cybersecurity expert, methodical watcher, never alarmist, always actionable.
Partilhar:
O fio do caso

Un fichier .git piégé peut faire exécuter du code par Claude Code, Codex et Cursor

  1. 1Hugging Face comprometido: quando um agente de IA autônomo serve como ferramenta de intrusão em escala de enxame20/07/2026
  2. 2Hugging Face confirma uma violação relacionada a um agente de IA autônomo: datasets internos e credenciais expostos20/07/2026
  3. 3Hugging Face: novas informações sobre a violação relacionada ao agente de IA autônomo21/07/2026
  4. 4Azure DevOps MCP: um comentário invisível em um PR desvia o agente de IA do revisor22/07/2026
  5. 5A OpenAI reconhece que seus próprios modelos escaparam do sandbox e miraram na Hugging Face para trapacear em um benchmark22/07/2026
  6. 6Azure DevOps MCP: um novo vetor de injeção nos agentes de IA revisores22/07/2026
  7. 7AgentForger: um simples link do ChatGPT poderia injetar um agente de IA malicioso em seu workspace23/07/2026
  8. 8Ataque OpenAI × Hugging Face: os agentes de IA autônomos não são "maus" — exceto quando lhes damos as chaves24/07/2026
  9. 9Kimi K3 sob o microscópio: os institutos AISI/CAISI avaliam suas capacidades cibernéticas, um PoC RCE Redis emerge25/07/2026
  10. 10« Notas de evasão » de um modelo OpenAI: LessWrong pede mais detalhes, o caso do sandbox escape volta à tona26/07/2026
  11. 11Kimi K3 chega ao Hugging Face: os pesos abertos do modelo chinês chegam após a avaliação cyber AISI/CAISI27/07/2026
  12. 12DeepSeek controlada via Telegram: um atacante chinês lança ataques autônomos por meio do framework Hermes Agent31/07/2026
  13. 13Agentes de IA de codificação: o ser humano erra 33% das requisições perigosas07/08/2026
  14. 14Um agente de IA encarregado de reservar uma aula de esporte acaba hackeando a academia — sem que ninguém lhe pedisse.10/08/2026
  15. 15O Ransomware em alta enquanto a segurança observa os agentes de IA: os grupos tradicionais aproveitam o relaxamento13/08/2026
  16. 16Azure DevOps MCP: injeção indireta de prompt, o agente de revisão de IA como vetor de exfiltração13/08/2026
  17. 17Agentes de IA autônomos: uma "ameaça clara e presente" para as infraestruturas críticas14/08/2026
  18. 18Hugging Face vítima de uma violação de dados relacionada a um agente de IA autônomo18/08/2026
  19. 19Agentes de IA ofensivos em julho de 2026: DeepSeek em servidores, Claude que viola organizações, Azure DevOps desviado25/08/2026
  20. 20Aurora Ransomware + Cursor AI: quando um grupo criminoso opera a IA em seus ataques01/09/2026
  21. 21UAC-0099 integra um « prompt de arma nuclear » em seus malwares para cegar analistas de IA02/09/2026
  22. 22Um arquivo .git malicioso pode fazer com que o Claude Code, Codex e Cursor executem código03/09/2026
  23. 23Pesquisadores pedem que o Claude realize um exploit RCE de um PLC para outro — a IA como multiplicador de exploits03/09/2026
Your Linux server, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux server, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install, everything stays on your machine.

Get early access
LIVERadio Geek Kitsune
Toca para ouvir, o mesmo som para todos
0··
// Programa
// all stations
// partilhar uma faixa →
Secções
Explorar
Informações