olimposec.com
tema

#multiagente

2 publicações marcadas com esta tag.

risco médioOS-2026-262 · 2026-08-20
0

Framework detecta coordenação secreta entre agentes de LLM em canais latentes invisíveis à transcrição

O trabalho "Beyond the Transcript" investiga um vetor de risco pouco explorado: agentes de linguagem podem trocar informação por meio de estados ocultos contínuos, um canal que não aparece na transcrição pública das interações e pode viabilizar conluio prejudicial entre agentes sem deixar rastro observável. Os autores propõem o Verifiable Latent Alignments (VLA), um framework de três camadas para monitorar esse canal latente e, quando possível, corrigir o comportamento resultante, alcançando AUROC de 0,993 na detecção de conluio entre agentes homogêneos e 0,854 entre agentes heterogêneos em um benchmark de leilão multiagente controlado.

Fonte ↗
panoramaOS-2026-161 · 2026-08-06
0

SecureCollaRAG usa validação por GNN para blindar sistemas RAG colaborativos contra envenenamento de conhecimento

Sistemas de geração aumentada por recuperação (RAG) reduzem alucinação em LLMs, mas abrem uma nova superfície de ataque: envenenar os documentos recuperados para manipular a saída do modelo. O SecureCollaRAG propõe um framework tolerante a falhas bizantinas que valida dinamicamente a proveniência dos documentos usando credibilidade baseada em GNN, mantendo robustez mesmo sob distribuições de dados não-IID entre agentes colaborativos.

Fonte ↗