Shieldstral de Mistral: un clasificador multimodal de 3B que supera a modelos 7 veces mayores
Mistral's Shieldstral: 3B open-weights model for multimodal moderation
Mistral AI presenta Shieldstral, un clasificador de seguridad multimodal de 3B de pesos abiertos que redefine la moderación de contenido como una tarea de preguntas y respuestas adaptables a políticas. Acepta políticas en lenguaje natural en tiempo de inferencia, unificando la evaluación de seguridad de texto e imágenes sin necesidad de reentrenamiento. Con licencia Apache 2.0, ofrece puntuaciones de seguridad calibradas en diversos benchmarks y funciona eficientemente en una GPU NVIDIA de 16 GB, igualando o superando a modelos hasta 7 veces su tamaño.
Shieldstral adopta un enfoque diferente: escribes la política como una pregunta en lenguaje natural en el momento de la inferencia, y el modelo devuelve una puntuación de seguridad calibrada.