olimposec.com
tema

#esteganografia

2 publicações marcadas com esta tag.

risco altoOS-2026-215 · 2026-08-12
0

Backdoor "programável" em modelos de visão e linguagem permite ao atacante escolher o alvo do ataque depois do treinamento

Pesquisadores demonstram que uma única fase de envenenamento de dados pode implantar em um modelo de visão e linguagem (VLM) um backdoor programável, no qual o atacante escolhe em tempo de inferência — sem retreinar o modelo — qual legenda-alvo, nunca vista durante o envenenamento, deve ser produzida, e sintetiza sob demanda um gatilho visual furtivo correspondente. A técnica mantém alta taxa de sucesso mesmo contra defesas clássicas de backdoor e preserva a utilidade do modelo em entradas limpas, ampliando substancialmente a superfície de risco frente aos backdoors estáticos já conhecidos na literatura.

Fonte ↗
risco médioOS-2026-044 · 2026-07-20
0

LLMs afinados podem esconder mensagens secretas nas próprias respostas, e sondas internas ajudam a detectar isso

O estudo aprofunda ataques de esteganografia em que um LLM fine-tunado codifica secretamente informação do prompt na sua saída, propondo esquemas de 'baixa recuperabilidade' derivados do espaço de embeddings que dificultam a extração do segredo por terceiros. Como contrapartida defensiva, sondas lineares treinadas sobre ativações de camadas finais detectam a presença do segredo com até 33% mais precisão em modelos fine-tunados do que em modelos base.

Fonte ↗