Segurança & Ética

Pesquisadores descobrem vulnerabilidade em APIs de LLMs proprietários

Anthropic + Google + OpenAIFonte: Simon Willison11/08/2026, 19:40
Pesquisadores identificaram uma vulnerabilidade significativa em APIs de LLMs proprietários de Anthropic, OpenAI e Google. Os provedores retornam blocos de chain-of-thought criptografados que podem ser reproduzidos em múltiplas sessões e usuários. Um raciocínio gerado por um modelo fronteira poderia ser reproduzido em uma versão mais fraca do mesmo modelo família e descriptografado através de jailbreak, expondo o raciocínio oculto do modelo mais forte em texto puro. Os pesquisadores descobriram que todos os modelos da mesma família usavam a mesma chave de criptografia. A vulnerabilidade foi divulgada responsavelmente e os provedores confirmaram a correção da falha. Claude Haiku 4.5 foi o modelo mais vulnerável, enquanto versões 4.6 posteriores removeram o recurso que permitia o ataque. O trabalho fornece detalhes extensivos dos raciocínios extraídos, oferecendo visão sobre como esses modelos pensam internamente.
Pesquisadores descobrem vulnerabilidade em APIs de LLMs proprietários — lupAI