Investigación y Papers

Modelo de IA Open-Weight Chino GLM-5.2 Cierra Brecha con Modelos Frontera en Capacidades pero se Queda Atrás en Seguridad

GLM-5.2 + SaferAI + Z.aiFuente: TechCrunch - AI04/08/2026, 17:05
Una nueva evaluación de SaferAI encontró que el modelo de IA open-weight chino GLM-5.2, desarrollado por Z.ai, ha reducido la brecha de capacidad con modelos closed-source frontera, incluidos GPT-5.5 de OpenAI y Claude Opus 4.7 de Anthropic. Sin embargo, persiste una divergencia significativa de seguridad. A diferencia de Claude Opus 4.7, que rechazó tareas de dual-use cibernético y biológico a una tasa alta, GLM-5.2 rechazó ninguna de las mismas tareas ofensivas durante las pruebas. La disparidad destaca riesgos asociados con la distribución de modelos open-weight: una vez que se descargan los pesos, los usuarios pueden eliminar protecciones, hacer fine-tuning de modelos o alterar prompts de sistema enfocados en seguridad. Mientras que los desarrolladores frontera dependen de clasificadores, entrenamiento de rechazo y controles a nivel de API para limitar resultados peligrosos, estas protecciones son ineficaces en modelos open-weight. La directora ejecutiva de SaferAI señaló que el filtrado de datos de pre-entrenamiento — remover información cibernética ofensiva durante el entrenamiento del modelo — podría reducir conocimiento peligroso, aunque tales técnicas sean menos prácticas para datos de entrenamiento de ciberseguridad.
Modelo de IA Open-Weight Chino GLM-5.2 Cierra Brecha con Modelos Frontera en Capacidades pero se Queda Atrás en Seguridad — lupAI