olimposec.com
tema

#pesquisa-academica

2 publicações marcadas com esta tag.

risco altoOS-2026-117 · 2026-07-30
0

Pesquisa apresentada no ICML aponta falha estrutural na forma como LLMs reconhecem quem está dando as instruções

Um estudo apresentado no ICML argumenta que modelos de linguagem não distinguem instruções de sistema, usuário e conteúdo externo pelas tags estruturais que as marcam, mas pelo estilo e pelo vocabulário do texto — o que permite a qualquer atacante "falsificar" um papel de maior privilégio só escrevendo no tom certo. Os pesquisadores extraíram informações que os modelos foram treinados para recusar, como instruções de síntese de drogas e sabotagem de sistemas de navegação de aeronaves, primeiro em modelos da OpenAI e depois replicando o resultado em modelos da Anthropic, Alibaba e DeepSeek. Segundo os autores, por ser uma característica estrutural da arquitetura, e não do treinamento, o problema pode ser essencialmente impossível de eliminar por completo.

Fonte ↗
panoramaOS-2026-126 · 2026-07-27
0

Microsoft lança aliança global de red teaming externo para segurança de sistemas de IA

A Microsoft anunciou a External Red Team Alliance (EXTRA), programa que combina doações sem restrições a 18 laboratórios acadêmicos em seis continentes com uma rede distribuída de especialistas regionais para testar a segurança de sistemas de IA. A iniciativa busca cobrir lacunas de conhecimento de domínio, idioma e contexto cultural que equipes internas de red team não conseguem replicar sozinhas.

Fonte ↗