Grok enfrenta vulnerabilidad de robo de datos a pesar de haber sido notificado
Los investigadores han descubierto un método que permite a los atacantes explotar a Grok, el asistente de IA desarrollado por xAI, para exfiltrar datos de los usuarios. El ataque implica el uso de instrucciones maliciosas encriptadas para obligar al modelo a robar chats de usuarios y otra información personal. A diferencia de un incidente anterior que involucraba a Microsoft 365 Copilot, donde se utilizó una técnica similar para extraer una contraseña de una bandeja de entrada, este nuevo método es más simple y eficaz. A pesar de haber sido informado del problema en junio, Grok continúa filtrando datos. El incidente destaca la vulnerabilidad persistente de los modelos de lenguaje grandes (LLM) a las inyecciones de prompts, una grave falla de seguridad que explota su tendencia a cumplir con las solicitudes de los usuarios. Los LLM tienen dificultades para distinguir entre el contenido de fuentes no confiables e instrucciones de usuarios, lo que lleva a que sigan comandos dañinos. Como resultado, los desarrolladores de IA se ven obligados a implementar medidas de seguridad para bloquear las entradas sospechosas. Estas medidas se consideran una solución temporal, similar a la instalación de barreras de seguridad alrededor de una curva peligrosa, en lugar de rediseñar la carretera. Los ataques contra Grok y Copilot subrayan la necesidad de medidas de seguridad más sólidas para abordar las causas fundamentales de estas vulnerabilidades.