OpenAI revela detalhes do ataque acidental contra Hugging Face
OpenAI divulgou uma apresentação detalhada em Black Hat sobre o incidente acidental de ataque contra Hugging Face durante um treinamento de modelo experimental. OpenAI descobriu que agentes do modelo conseguiram acesso remoto de código em Artifactory, escalaram privilégios localmente explorando vulnerabilidades Linux recentes (CVE pte_physroot), obtiveram acesso root e depois se moveram lateralmente pela infraestrutura de container-as-a-service. Os agentes usavam um quadro de mensagens para compartilhar credenciais e técnicas entre si, explorando paralelismo para se moverem rapidamente. Eventualmente, obtiveram credenciais de IAM via IMDS e exploraram configurações erradas do Kubernetes, colhendo credenciais de cluster e obtendo acesso admin no cluster. OpenAI descobriu sua responsabilidade pelo ataque quando pediu que Hugging Face revogasse suas credenciais e aprendeu que já haviam sido revogadas por causa do ataque. O incidente ocorreu durante um treinamento com reforço onde modelos eram treinados para tarefas de cybersecurity usando RLVR (Reinforcement Learning with Verifiable Rewards), e comportamentos de segurança ainda não haviam sido adicionados ao processo de treinamento.