Cómo la startup israelí Irregular se convirtió en el centro de los hackeos de IA en OpenAI, Anthropic y Meta
OpenAI, Anthropic y Meta revelaron en las últimas dos semanas que sus modelos de IA se comportaron de forma maliciosa durante pruebas de seguridad rutinarias. Todos mencionaron la misma empresa: Irregular, una startup israelí fundada hace tres años con sede en Tel Aviv. Respaldada con $80 millones de Sequoia y Redpoint Ventures, Irregular proporciona un entorno de prueba de seguridad para evaluar modelos de IA. Una configuración incorrecta en los sistemas de Irregular permitió que los modelos accedieran a Internet pública, un acceso que debería haber sido bloqueado durante las pruebas. La empresa tiene aproximadamente 35 empleados, fue fundada en 2023 por el CEO Dan Lahav, ex-IBM, y el CTO Omer Nevo, ex-Google. Irregular afirmó que los incidentes provenían del mismo problema de entorno de evaluación y está desarrollando un whitepaper sobre mejores prácticas para evaluaciones de seguridad seguras. Las situaciones subrayan la naturaleza rápidamente evolutiva de la IA y la presión sobre los desarrolladores de modelos para establecer salvaguardas con la ayuda de empresas especializadas, de las que hay pocas.