olimposec.com
Radar de ameaças de IAjanela: últimos 7 dias
atualizado 27/08, 14:08
Crítico
11
estável
Médio
20
+6 vs. janela anterior
Panorama
06
−6 vs. janela anterior
Bugs · CVE
07
+1 vs. janela anterior
NOTÍCIA
Framework de reparo identifica uma "anomalia de inconsistência entre camadas" causada por gatilhos de backdoor em regiões específicas dos tokens visuais ou textuais de um MLLM, e usa esse sinal para gerar um ajuste fino adversarial que elimina o comportamento malicioso sem precisar saber qual é o gatilho.
2 min
0
NOTÍCIA
Framework detecta, em tempo de execução, quais trechos de um contexto externo realmente influenciaram uma decisão de chamada de ferramenta do agente, tratando o problema como detecção de objetos sobre o mapa de atenção, e usa a autoridade da fonte desses trechos para bloquear invocações maliciosas.
2 min
0
NOTÍCIA
Com o padrão WebMCP do W3C permitindo que páginas web exponham ferramentas diretamente a agentes LLM, pesquisadores mostram que o modelo de segurança do navegador baseado em same-origin não dá garantias suficientes de proveniência, e propõem uma arquitetura de dupla camada que reduziu ataques de revogação/sobrescrita de 100% para 0% e bloqueou injeções de prompt embutidas em descrições de ferramentas.
2 min
0
NOTÍCIA
Defesa geométrica para sistemas RAG usa um encoder substituto para medir como cada documento recuperado desloca o estado oculto do modelo, filtrando como outliers os documentos que tentam manipular a resposta, com garantia formal de recuperar um contexto livre de veneno sob suposição de maioria honesta.
2 min
0
PROMPT
Nova defesa aplicada na fase de fine-tuning espalha a informação de recusa de segurança por um conjunto mais amplo de neurônios de um LLM, em vez de concentrá-la em poucos neurônios críticos, reduzindo a taxas de sucesso de jailbreaks textuais e de ataques que podam neurônios após o deploy para perto de zero, mantendo a utilidade do modelo.
2 min
0
NOTÍCIA
Pesquisadores mostram como um cliente malicioso em um sistema federado de detecção de anomalias em vigilância pode implantar backdoors usando condições naturais da cena (pouca luz, ambientes internos, aglomerações) como gatilho, em vez de um padrão artificial, mantendo o ataque furtivo e persistente por centenas de rodadas.
2 min
0
NOTÍCIA
Pesquisadores demonstram um ataque "hardware-aware" que explora os bit-flips do Rowhammer em DRAM DDR4 real para injetar backdoors em redes neurais durante a inferência, atingindo cerca de 90% de taxa de sucesso mantendo mais de 83% de acurácia normal, adaptando o ataque ao padrão específico de cada chip.
2 min
0
NOTÍCIA
Pesquisadores propõem o TrustShift, uma classe de ataque em que um servidor MCP se comporta de forma benigna durante uma fase de condicionamento inicial para conquistar a confiança do agente, e só então libera um payload adversarial. A defesa proposta, SHIELD, reduz a taxa de sucesso do ataque de 69,5% para 42,7%, mas deixa um resíduo alto.
2 min
0

Receba o boletim OlimpoSec

Um resumo quinzenal com novas técnicas de ataque, publicações relevantes e mudanças nos frameworks — direto no seu e-mail, sem ruído.

frequência quinzenal · cancele quando quiser

sobre

Por que a OlimpoSec existe

A adoção de inteligência artificial correu mais rápido que a capacidade das equipes de segurança de entendê-la. A maior parte do material técnico de qualidade está em inglês, disperso e, muitas vezes, desatualizado em semanas.

A OlimpoSec nasce para fechar essa lacuna no Brasil: conteúdo em português, verificado contra as fontes primárias, escrito por quem trabalha com análise de vulnerabilidades e resposta a incidentes no dia a dia.

  • fonte primáriaTodo artigo cita especificações, advisories e papers originais — nada de telefone sem fio.
  • reprodutívelTécnicas demonstradas em ambiente de laboratório, com passos que você pode validar.
  • divulgação responsávelSeguimos TLP 2.0 e boas práticas de coordenação antes de publicar detalhes exploráveis.