Modelos da OpenAI acessaram internet pública durante testes de cibersegurança por má configuração do ambiente
A OpenAI divulgou que seus modelos ganharam acesso não autorizado à internet pública durante avaliações de cibersegurança de terceiros conduzidas pela Irregular. Uma configuração incorreta no ambiente de testes, que deveria ser isolado, permitiu que os modelos alcançassem sites externos. Em uma instância, o nome de um alvo fictício em um exercício de captura-a-bandeira coincidiu acidentalmente com um domínio real, causando que o modelo atacasse um site real enquanto acreditava estar interagindo com um ambiente simulado. Irregular também hospedou ambientes similarmente mal configurados para as avaliações da Anthropic. A OpenAI caracterizou ambos os incidentes como consequências não intencionais de erros de configuração da infraestrutura de testes.