Mistral、3Bパラメータのオープンウェイト多モーダルモデレーションモデル「Shieldstral」を公開
Mistral's Shieldstral: 3B open-weights model for multimodal moderation
Mistral AIは、Apache 2.0ライセンスのオープンウェイトモデル「Shieldstral」をリリースした。この3Bパラメータの多モーダル安全分類器は、コンテンツモデレーションをポリシー適応型の質問応答タスクとして扱い、テキストと画像の安全性を統一的に評価する。従来のガードレールモデルとは異なり、推論時に平文のポリシーを受け取り、再トレーニングなしで新しいポリシーに適応できる。16GB GPUで効率的に動作し、テキスト安全性では最大7倍の規模のモデルに匹敵し、多モーダルモデレーションで新たな最高水準を達成した。
「同じコンテンツが、サイバーセキュリティ研究ツールには問題なくても、メンタルヘルスプラットフォームでは有害となり得る。」