olimposec.com
tema

#injecao-de-prompt

3 publicações marcadas com esta tag.

risco médioOS-2026-300 · 2026-08-26
0

WebMCP-Phalanx tenta impor fronteiras de confiança para agentes de IA integrados ao navegador

Com o padrão WebMCP do W3C permitindo que páginas web exponham ferramentas diretamente a agentes LLM, pesquisadores mostram que o modelo de segurança do navegador baseado em same-origin não dá garantias suficientes de proveniência, e propõem uma arquitetura de dupla camada que reduziu ataques de revogação/sobrescrita de 100% para 0% e bloqueou injeções de prompt embutidas em descrições de ferramentas.

Fonte ↗
risco médioOS-2026-301 · 2026-08-26
0

Attnlocate localiza instruções maliciosas escondidas em dados externos observando os padrões de atenção do modelo

Framework detecta, em tempo de execução, quais trechos de um contexto externo realmente influenciaram uma decisão de chamada de ferramenta do agente, tratando o problema como detecção de objetos sobre o mapa de atenção, e usa a autoridade da fonte desses trechos para bloquear invocações maliciosas.

Fonte ↗
panoramaOS-2026-229 · 2026-08-13
0

ToolHazard automatiza a criação de ambientes adversariais para testar agentes LLM contra injeção de prompt indireta

O framework substitui a construção manual de cenários de teste por uma pipeline de três agentes que sintetiza ambientes executáveis com estado, descobre pontos viáveis de injeção e gera tarefas de longo horizonte realistas para expor agentes LLM equipados com ferramentas. Os experimentos confirmam vulnerabilidades substanciais nos agentes testados e mostram que o momento e o local da injeção afetam diretamente a eficácia do ataque, além de os dados gerados servirem também para treinar defesas sem sacrificar utilidade em tarefas legítimas.

Fonte ↗