Investigadores Descobrem Método para Extrair o Raciocínio Oculto de Modelos de IA
Cientistas de computação da Universidade de Tübingen, Instituto Max Planck, MATS Research e Snyk identificaram uma vulnerabilidade que afeta modelos de IA de fronteira da OpenAI, Anthropic e Google acedidos via API. A técnica revela os processos de raciocínio oculto—etapas intermédias de pensamento—que estes modelos utilizam para resolver problemas, podendo expor informações sensíveis como palavras-passe e chaves API. A investigação também encontrou evidência sugerindo que modelos de código aberto chineses como Kimi K3 da Moonshot AI podem ter sido treinados através de destilação de informações de raciocínio de modelos americanos, embora os investigadores notem que não podem estabelecer causalmente esta afirmação.