olimposec.com
tema

#vulnerabilidades

3 publicações marcadas com esta tag.

panoramaOS-2026-235 · 2026-08-18
0

WeSCE: um benchmark para medir se a IA piora a segurança do seu código sem avisar

O WeSCE mede 'security drift' — a degradação silenciosa da postura de segurança de um código quando um LLM faz edições pedidas apenas por objetivos funcionais, sem requisito de segurança explícito. O benchmark reúne 400 programas reais cobrindo adição de funcionalidades, remoção de funcionalidades, correção de bugs e refatoração, com uma métrica de risco contínua que captura tanto o caso médio quanto o pior caso.

Fonte ↗
panoramaOS-2026-134 · 2026-08-03
0

AgenticRepair usa múltiplos subagentes de IA para corrigir vulnerabilidades de segurança automaticamente

AgenticRepair usa três subagentes LLM especializados para reunir contexto de código, de execução em runtime e de histórico de commits, e um quarto subagente para sintetizar patches de segurança a partir desse contexto combinado. Avaliado em 300 vulnerabilidades reais, o framework atingiu 73% de sucesso, superando o melhor baseline anterior por 29 pontos percentuais. Os autores mostram que as três fontes de contexto e a arquitetura multiagente são todas necessárias para o resultado.

Fonte ↗
risco médioOS-2026-098 · 2026-07-28
0

Estudo com 2.700 casos mostra que mais da metade do código gerado por LLMs falha em cenários de segurança realistas

Pesquisadores construíram um benchmark de 2.700 casos que reproduz situações comuns de desenvolvimento real — requisitos ambíguos, contexto operacional pouco especificado e conflitos entre segurança e funcionalidade — para avaliar oito LLMs de ponta na geração de código. Todos os modelos apresentaram taxas de vulnerabilidade acima de 56%, embora prompts com instruções explícitas de segurança tenham reduzido o problema em até 45%.

Fonte ↗