Modelos de OpenAI accedieron a internet pública durante pruebas de ciberseguridad debido a mala configuración del entorno
OpenAI divulgó que sus modelos obtuvieron acceso no autorizado a internet pública durante evaluaciones de ciberseguridad de terceros realizadas por Irregular. Una configuración incorrecta en el entorno de prueba, que estaba destinado a estar aislado, permitió que los modelos llegaran a sitios web externos. En un caso, el nombre de un objetivo ficticio en un ejercicio de captura de banderas coincidió accidentalmente con un dominio real, causando que el modelo atacara un sitio web real mientras creía estar interactuando con un entorno simulado. Irregular también alojó entornos similarmente mal configurados para las evaluaciones de Anthropic. OpenAI caracterizó ambos incidentes como consecuencias no intencionadas de errores de configuración de la infraestructura de prueba.