Claude descubre vulnerabilidades matemáticas en protocolos criptográficos
Investigadores de Anthropic utilizaron el modelo Claude Mythos para identificar debilidades matemáticas en dos sistemas criptográficos: HAWK y una variante simplificada de AES. Aunque estos hallazgos no tienen impacto práctico en los sistemas informáticos actuales, demuestran nuevas aplicaciones de modelos lingüísticos grandes en análisis criptográfico.
La investigación requirió intervención humana significativa durante todo el proceso. El modelo operó continuamente durante 60 horas, generando un costo estimado de $100,000 en llamadas a la API de Anthropic. Los investigadores debieron intervenir repetidamente para evitar que el modelo abandonara la tarea y para dirigirlo hacia descubrimientos de mérito académico aptos para publicación.
El equipo divulgó los prompts utilizados durante el análisis, revelando cómo la retroalimentación humana mantuvo el modelo comprometido con la tarea de criptoanálisis. Este trabajo produjo un nuevo benchmark llamado CryptanalysisBench, desarrollado en colaboración con la ETH Zurich, la Universidad de Tel Aviv y la Universidad de Haifa.