olimposec.com
tema

#adversarial-training

2 publicações marcadas com esta tag.

risco altoOS-2026-078 · 2026-07-23
0

DARWIN faz ataque e defesa de jailbreak evoluirem continuamente em loop competitivo

O DARWIN trata jailbreak como um processo evolutivo aberto, no qual um adversario (DARWIN-Attack) descobre, muta e seleciona estrategias de ataque continuamente, enquanto uma defesa (DARWIN-Guard) treina de forma online sobre os exemplos adversariais gerados por esse adversario. O ataque atinge quase 100% de sucesso contra alguns modelos de fronteira e mais de 90% contra o GPT-5.5, enquanto a defesa alcanca 91,6% de recall medio de conteudo inseguro em 12 benchmarks.

Fonte ↗
panoramaOS-2026-053 · 2026-07-21
0

Defesa híbrida combina treinamento adversarial e ruído gaussiano para blindar IDS contra FGSM e Carlini & Wagner

Pesquisadores demonstram que um NIDS (sistema de detecção de intrusão de rede) que caía para 26% e 50% de acurácia sob os ataques adversariais FGSM e Carlini & Wagner, respectivamente, recupera 96,57% e 89,20% de acurácia após uma defesa híbrida que combina Adversarial Training com Gaussian Data Augmentation. O estudo varre múltiplos níveis de epsilon e ruído de confiança para validar a robustez da abordagem.

Fonte ↗