lupAI
Segurança & Ética

OpenAI interrompe esforço coordenado para roubar a lógica dos modelos

OpenAIFonte: OpenAI Blog30/09/2026, 16:40
A OpenAI divulgou que interrompeu uma campanha coordenada com o objetivo de extrair a lógica de seus modelos, com atividades rastreadas a partir de 1º de julho de 2026. A campanha, consistente com a destilação adversária, envolveu a manipulação das interações do modelo para reproduzir a lógica interna, violando os termos de serviço. Os operadores exploraram as interações do modelo, em vez de violar a criptografia ou acessar dados do usuário. Houve um aumento nas solicitações em 24 e 25 de julho, com mais de 16.000 solicitações de mais de 4.000 usuários. A OpenAI atribuiu a atividade a indivíduos ligados à Moonshot AI, a desenvolvedora do Kimi. A empresa enfatizou que a destilação adversária representa riscos para a segurança e a segurança nacional, permitindo a transferência de capacidades avançadas sem as mesmas medidas de segurança. A OpenAI implementou controles técnicos, proibiu contas fraudulentas e compartilhou os resultados no Frontier Model Forum para fortalecer as defesas da indústria. A empresa destacou novos métodos de ataque, incluindo tentativas de copiar a lógica criptografada de uma conversa e ter outro modelo decifrá-la. Pesquisadores de segurança independentes já haviam identificado vulnerabilidades entre modelos, que a OpenAI confirmou como reais. A OpenAI está aprimorando as proteções contra tais ataques, concentrando-se em salvaguardas técnicas, mecanismos de detecção e compartilhamento de informações sobre ameaças em toda a indústria e governo. A empresa enfatizou que a destilação adversária é uma ameaça em evolução que requer defesas em camadas e adaptação contínua.
OpenAI interrompe esforço coordenado para roubar a lógica dos modelos — lupAI