Novos Desenvolvimentos

Mistral Lança Classificador de Segurança Shieldstral 1.0 3B para Moderação Flexível de Conteúdo

Mistral + ShieldstralFonte: MarkTechPost08/08/2026, 01:36
A Mistral AI lançou o Shieldstral 1.0 3B, um classificador de segurança multimodal de pesos abertos projetado para moderação flexível de conteúdo. Diferentemente dos sistemas tradicionais de segurança que incorporam categorias de risco fixas nos pesos, o Shieldstral aceita políticas como perguntas em linguagem natural no momento da inferência e retorna pontuações de segurança calibradas. O modelo de 3B, construído sobre Ministral-3-3B-Base com um codificador de visão Pixtral nativo, alcança uma pontuação F1 média de 84,9% em segurança de texto, equiparando-se a modelos maiores como GPT-OSS-Safeguard-20B, e 83,8% em segurança multimodal. O modelo é executado localmente em uma única GPU com 16GB de VRAM em precisão BF16 e está licenciado sob Apache 2.0 para uso comercial. O treinamento aproveitou 54,1M amostras incluindo texto de código aberto, dados contrastivos sintéticos gerados reescrevendo texto seguro em variantes de risco direcionadas, e conteúdo multimodal. A infraestrutura de serviço já está integrada com vLLM, llama.cpp, SGLang e Transformers.
Mistral Lança Classificador de Segurança Shieldstral 1.0 3B para Moderação Flexível de Conteúdo — lupAI