Mistral bringt Shieldstral heraus: 3B-Open-Weights-Modell für multimodale Moderation
Mistral's Shieldstral: 3B open-weights model for multimodal moderation
Mistral AI veröffentlicht Shieldstral, ein 3B-Open-Weights-Modell für multimodale Sicherheitsbewertung, das Modelle bis zur 7-fachen Größe übertrifft. Statt fester Schadenskategorien formuliert es Moderation als beantwortbare Frage: Nutzer definieren die Richtlinie in natürlicher Sprache zur Inferenzzeit, das Modell liefert einen kalibrierten Sicherheitswert. Es vereinheitlicht Text- und Bildmoderation ohne Nachtraining und läuft auf einer einzelnen 16-GB-GPU. Die Gewichte stehen unter Apache 2.0 zur Verfügung.
Das Kernkonzept ist, dass ein kleines Modell viel größere schlagen kann, wenn die Daten stimmen.