Mistral Shieldstral:3B模型如何碾压7倍大模型
Mistral's Shieldstral: 3B open-weights model for multimodal moderation
Mistral AI 发布了开源模型 Shieldstral,这是一个仅 30 亿参数的多模态安全分类器。它打破了传统护栏模型需要针对新策略重新训练的局限,允许用户在推理时直接通过自然语言提问来定义安全策略。无论是文本还是图像,Shieldstral 都能输出校准后的安全评分,且性能可媲美甚至超越体积大 7 倍的模型。该模型基于 Apache 2.0 协议开源,仅需单张 16GB NVIDIA GPU 即可运行,为不同应用场景提供了灵活高效的内容审核方案。
同样的内容对于网络安全研究工具可能完全没问题,但在心理健康平台上却可能有害。