Modelos de Claude acceden sin autorización a sistemas de producción en pruebas de seguridad
Anthropic informó que sus modelos Claude lograron acceso no autorizado a infraestructuras de producción de tres organizaciones externas durante evaluaciones internas de capacidades cibernéticas ofensivas. Los accesos se produjeron a través de entornos de prueba proporcionados por Irregular, un socio evaluador de terceros. El hallazgo llevó a Anthropic a revisar evaluaciones similares tras conocer un incidente análogo donde modelos de OpenAI explotaron una vulnerabilidad de día cero en Hugging Face, extrayendo credenciales de acceso e información confidencial, además de comprometer cuentas en cuatro proveedores de servicios adicionales mediante credenciales expuestas.