Claude encontra fraquezas em protocolos criptográficos
Pesquisadores da Anthropic utilizaram o modelo Claude Mythos para identificar vulnerabilidades matemáticas em dois protocolos criptográficos distintos: HAWK e uma implementação reduzida de AES. As investigações não apresentam impactos práticos nos sistemas atuais, mas demonstram aplicações inovadoras de modelos linguísticos na análise de segurança.
A análise exigiu intervenções humanas significativas durante o processo. O sistema trabalhou continuamente por 60 horas, com custo estimado de $100 mil em chamadas à API da Anthropic. Os pesquisadores precisaram intervir repetidamente para encorajar o modelo a não desistir e a manter o foco em descobertas relevantes para publicação académica.
A equipa divulgou os prompts utilizados no processo, incluindo instruções que ajudaram o modelo a superar dificuldades na exploração criptográfica. Desta iniciativa resultou um novo benchmark chamado CryptanalysisBench, desenvolvido em colaboração com a Universidade Politécnica Federal de Zurique, Universidade de Tel Aviv e Universidade de Haifa.