olimposec.com
tema

#chain-of-thought

2 publicações marcadas com esta tag.

risco altoOS-2026-272 · 2026-08-21
0

EchoCoT extrai o raciocínio oculto de modelos de linguagem proprietários via API

Pesquisadores descobriram uma superfície de "replay de raciocínio" entre chamadas de ferramentas em modelos de raciocínio de grande porte (LRMs) e usaram esse ponto cego para extrair, de forma quase literal, o chain-of-thought oculto que provedores como o Google escondem por padrão. A técnica, batizada de EchoCoT, chegou a extrair 33.463 tokens de raciocínio do Gemini-2.5 a partir de um alvo de 32.948 tokens, com até 80% de sucesso de extração em datasets nunca vistos durante o desenvolvimento do ataque.

Fonte ↗
risco altoOS-2026-030 · 2026-07-20
0

Pesquisadores demonstram transferência de raciocínio nocivo entre modelos para criar jailbreaks reutilizáveis

Um novo estudo mostra que traços de chain-of-thought extraídos de modelos comprometidos podem ser transplantados para outros modelos, elevando taxas de resposta nociva acima de 80% nos alvos mais vulneráveis. A técnica também permite destilar padrões recorrentes de raciocínio malicioso em prompts de sistema reutilizáveis, superando o transplante direto em até 10x, inclusive contra o GPT-4.1.

Fonte ↗