olimposec.com
tema

#llm-inference

2 publicações marcadas com esta tag.

risco médioOS-2026-091 · 2026-07-27
0

Sufixos de prompt adversariais conseguem quebrar a aceleração de speculative decoding em LLMs

Pesquisadores demonstram o ADSD, o primeiro ataque de sufixo de prompt capaz de colapsar a taxa de aceitação do verificador em speculative decoding, técnica amplamente usada para acelerar a inferência de LLMs sem perda de qualidade. No dataset GSM8K, o ataque aumentou o tempo médio de amostragem em 62,3% mantendo a qualidade da resposta, e o efeito se mostrou consistente em diferentes domínios, estratégias de decodificação especulativa e arquiteturas de modelo.

Fonte ↗
risco altoOS-2026-080 · 2026-07-23
0

HijackKV sequestra cache KV de LLMs para injetar contexto malicioso invisivel na entrada

Pesquisadores demonstram o HijackKV, um ataque contra sistemas de reuso de cache KV independente de posicao -- uma otimizacao de inferencia cada vez mais comum em servicos de LLM -- que permite a um atacante contaminar o cache de um trecho de texto aparentemente benigno para que ele carregue, de forma invisivel, um objetivo controlado pelo atacante. Quando esse cache e reaproveitado pela vitima, o modelo tem seu comportamento sequestrado mesmo sem nenhum texto malicioso visivel na propria entrada, com taxa media de sucesso de 94% em uma unica tentativa.

Fonte ↗