CryptanalysisBench: modelos de fronteira já quebram até 86% de cifras com ataques práticos conhecidos e encontram falha inédita em cifra candidata do NIST
Um novo benchmark com 191 tarefas de criptoanálise, extraídas de quatro competições de padronização do NIST, testou cinco modelos de fronteira (Claude Opus 4.8, Sonnet 5, Mythos 5, GPT-5.5 e o modelo de peso aberto GLM-5.2) e descobriu que eles resolvem entre 65% e 86% dos esquemas com quebras práticas já conhecidas. Mais notável: os modelos produziram criptoanálise inédita, incluindo um ataque de recuperação de chave que explora uma falha de design no AEAD SpoC e um erro na prova de segurança CCA publicada do KINDI, nenhum dos dois documentado anteriormente.
Fonte ↗