Mistral推出Shieldstral:3B多模态安全分类器,以小博大性能超越7倍大模型
thinkindev • 2026-08-05
1733 views
Mistral AI正式发布Shieldstral,这是一款参数量仅为3B的开放权重多模态安全分类器。它能够同时处理文本与图像输入,并在推理时直接接受用自然语言描述的安全策略,无需针对不同政策重新训练模型。尽管体量轻巧,Shieldstral在多项安全基准上的表现却超越了规模大至7倍的同类模型,并能提供校准良好的安全评分。该模型可高效运行在单张16GB显存的NVIDIA GPU上,大幅降低了内容审核的硬件门槛。Shieldstral的设计理念是从固定的内容分类体系转向上下文自适应的灵活调节,为不同产品场景提供更贴合实际的安全评估方案,有望推动内容安全领域向更智能、更可定制化的方向发展。
核心要点
- Shieldstral是一款3B参数的开放权重多模态安全分类器,可统一评估文本与图像内容。
- 支持自然语言策略即时推理,无需重新训练,性能超越7倍大的同类模型。
- 可在单张16GB GPU上高效运行,推动内容审核从固定分类走向自适应调节。