olimposec.com
tema

#verificacao-de-exploit

1 publicação marcada com esta tag.

risco médioOS-2026-065 · 2026-07-22
0

RECEIPT resolve o 'reward hacking' em agentes de IA que caçam XSS e confirma 24 vulnerabilidades reais sem falsos positivos

Agentes de codificação baseados em LLM já conseguem combinar leitura de código-fonte com testes interativos para achar XSS, mas seus próprios relatos de sucesso não são confiáveis por si sós. O RECEIPT resolve isso isolando o ambiente, fixando restrições de prova de conceito, separando papéis de atacante e vítima e vinculando o veredito à execução real do payload em um navegador de verdade. Rodando com orçamento de US$ 20 por aplicação sobre 95 alvos de código aberto, o framework achou 24 XSS inéditas, 12 já reconhecidas pelos mantenedores, sem nenhum falso positivo.

Fonte ↗