Nuevos Desarrollos

Mistral Lanza Shieldstral: Un Clasificador de Seguridad Abierto para la Moderación de Contenido en IA

Mistral + ShieldstralFuente: The Deep View04/08/2026, 17:10
El laboratorio de IA francés Mistral presentó Shieldstral el martes, un clasificador de seguridad multimodal de tres mil millones de parámetros diseñado para simplificar las barreras de seguridad de IA. A diferencia de los modelos tradicionales que requieren reentrenamiento para actualizar políticas de seguridad, Shieldstral acepta instrucciones en lenguaje natural en tiempo de inferencia, permitiendo a los usuarios definir políticas de seguridad personalizadas sin reentrenamiento del modelo. El sistema produce una puntuación de seguridad continua en lugar de verificaciones binarias, dando a los implementadores un control más granular sobre los umbrales de riesgo. Mistral afirma que el modelo coincide con el rendimiento del GPT-OSS-Safeguard de OpenAI, un modelo de veinte mil millones de parámetros, en puntos de referencia de seguridad de texto mientras funciona con apenas 16GB de memoria GPU, reduciendo significativamente los costos computacionales. Lanzado como código abierto bajo licencia Apache 2.0, Shieldstral refleja la estrategia de Mistral de construir herramientas prácticas en toda la pila de IA en lugar de enfocarse únicamente en el desarrollo de modelos fronterizos. El movimiento se alinea con la adhesión reciente de la empresa a la Open Secure AI Alliance, una coalición recientemente lanzada enfocada en herramientas de seguridad de código abierto.
Mistral Lanza Shieldstral: Un Clasificador de Seguridad Abierto para la Moderación de Contenido en IA — lupAI