lupAI
regulacao

OpenAI define principios para evaluaciones de seguridad de IA de terceros

OpenAIFuente: OpenAI Blog, Bloomberg22/09/2026, 18:42
OpenAI ha definido prioridades y principios clave para las evaluaciones de terceros de la seguridad de la IA, enfatizando la necesidad de independencia, rigor científico y sólidas prácticas de seguridad. La empresa tiene como objetivo apoyar las evaluaciones independientes con un acceso profundo a las salvaguardas técnicas, datos confidenciales y procesos de implementación interna. Estas evaluaciones están diseñadas para evaluar si las afirmaciones de seguridad están respaldadas y si las salvaguardas funcionan eficazmente en condiciones realistas. OpenAI destaca cuatro áreas prioritarias, que incluyen la evaluación independiente de los casos de seguridad, las salvaguardas críticas, las evaluaciones de capacidades para riesgos de preparación y las investigaciones sobre incidentes de desalineación. La empresa enfatiza la importancia de metodologías transparentes, acceso proporcional y independencia de expertos para garantizar que las evaluaciones sean tanto rigurosas como seguras. Las directrices también abordan la necesidad de afirmaciones y alcance claros y acordados entre las partes para las evaluaciones, asegurando que terceros y laboratorios estén alineados en lo que se está evaluando. OpenAI destaca el papel de las investigaciones independientes para identificar lagunas en los métodos de alineación y las salvaguardas, particularmente en casos de desalineación del modelo. La empresa enfatiza que estas evaluaciones deben informar los casos de seguridad y contribuir al desarrollo de estándares internacionales para la seguridad y las prácticas de seguridad de la IA.
OpenAI define principios para evaluaciones de seguridad de IA de terceros — lupAI