olimposec.com
tema

#deteccao-de-malware

2 publicações marcadas com esta tag.

risco médioOS-2026-270 · 2026-08-21
0

MaliciousSkillBench expõe o quanto os detectores atuais falham contra "skills" maliciosas para agentes de IA

Pesquisadores consolidaram 13 fontes públicas para criar o MaliciousSkillBench, um benchmark com 9.740 "Agent Skills" (pacotes de instruções, scripts e configurações reutilizáveis que estendem agentes de LLM), sendo 7.505 maliciosas. O resultado mostra que os melhores detectores atuais, embora pontuem bem em avaliação aleatória, despencam quando testados contra skills de fontes nunca vistas — um dos melhores modelos manteve 95,6% de detecção maliciosa mas gerou 62,4% de falsos positivos em skills benignas.

Fonte ↗
risco médioOS-2026-204 · 2026-08-11
0

SkillsMetric mapeia os limites da análise estática contra Agent Skills maliciosas — e encontra pontos cegos de 0% de detecção

O SkillsMetric é um framework de análise estática em cinco estágios para avaliar pacotes de "Agent Skills" (extensões de instruções e scripts para agentes LLM) quanto a risco malicioso, atingindo AUC de 0,93 em um dataset adversarial de 2.266 skills cobrindo 16 tipos de ataque. Apesar do bom desempenho geral, os autores identificam pontos cegos completos: ataques de destruição de host usando comandos de shell comuns escapam de todos os cinco estágios (0% de detecção), e prompt injection via manipulação em linguagem natural é detectada em apenas 42% dos casos.

Fonte ↗