Novo ataque de "Injeção de Dados de Agente" faz agentes de IA clicar em elementos maliciosos ou executar comandos do atacante
Pesquisadores demonstraram uma nova classe de ataque, batizada de Agent Data Injection (ADI), que engana agentes de IA ao corromper os dados que eles julgam confiáveis, sem precisar sequestrar as instruções originais da tarefa. Usando caracteres que imitam delimitadores estruturais (aspas, chaves, cifrões), o ataque cria campos falsos que o modelo interpreta como parte legítima do contexto. A técnica atingiu de 31% a 100% de sucesso contra agentes como Claude in Chrome, Claude Code, OpenAI Codex e Gemini CLI, dependendo do tipo de dado manipulado.
Fonte ↗