olimposec.com
tema

#avaliacao-agentes

1 publicação marcada com esta tag.

panoramaOS-2026-027 · 2026-07-17
0

Estudo de custo-benefício mostra que agentes ofensivos escalam com mais poder computacional, mas defesa em SOC não

O trabalho avalia agentes de IA de segurança sob uma lente de custo, comparando desempenho ofensivo (desafios Cybench) e defensivo (investigações Splunk BOTS v1) em níveis fixos de orçamento de inferência, em vez de apenas o melhor resultado possível com gasto ilimitado. A conclusão central é que capacidade ofensiva melhora consistentemente com mais computação — permitindo que modelos open-weight bem escalados cheguem perto de sistemas proprietários de ponta — enquanto o desempenho defensivo em SOC depende mais de uso disciplinado de ferramentas e navegação de telemetria do que de força bruta de raciocínio.

Fonte ↗