Investigación y Papers

Investigadores Descubren Método para Extraer el Razonamiento Oculto de Modelos de IA

Anthropic + Google + Moonshot AI + OpenAIFuente: Wired - AI11/08/2026, 08:00
Científicos informáticos de la Universidad de Tübingen, Instituto Max Planck, MATS Research y Snyk identificaron una vulnerabilidad que afecta a modelos de IA fronterizos de OpenAI, Anthropic y Google accedidos a través de API. La técnica revela los procesos de razonamiento oculto—pasos de pensamiento intermedios—que estos modelos utilizan para resolver problemas, pudiendo exponer información sensible como contraseñas y claves API. La investigación también encontró evidencia sugiriendo que modelos de código abierto chinos como Kimi K3 de Moonshot AI pueden haber sido entrenados mediante destilación de información de razonamiento de modelos estadounidenses, aunque los investigadores señalan que no pueden establecer causalmente esta afirmación.
Investigadores Descubren Método para Extraer el Razonamiento Oculto de Modelos de IA — lupAI