Mistral 发布面向多模态审核的 Shieldstral
这款 3B 开放权重安全分类器可依据自然语言策略评估文本和图像。
为什么重要
Shieldstral 瞄准了 AI 部署中的一个现实缺口:无需重新训练护栏模型,就能让审核规则适配不同产品。其开放权重发布为开发者测试多模态安全工作流提供了一个更小、更可检查的选择。
核心要点
- 1.3B 开放权重模型,采用 Apache 2.0 许可证发布。
- 2.可在推理时提供自然语言策略。
- 3.支持对文本、图像以及图文混合输入进行审核。
Mistral 发布了 Shieldstral,这是一款用于内容审核的 3B 开放权重多模态安全分类器。该模型将审核视为一种可适配策略的问答任务,可在推理时接收自然语言策略,并为文本、图像以及图文混合内容返回经过校准的安全评分。Mistral 表示,这款采用 Apache 2.0 许可证的模型可在单张 16GB NVIDIA GPU 上运行,并在多项安全基准测试中达到或超过了规模最高为其 7 倍的开放护栏模型。
⚡ 今天就能用
在依赖固定类别的护栏模型之前,应先根据你当前的审核策略评估 Shieldstral。
来源与原始报道
本简报汇总并链接到以下媒体的报道。
觉得这篇简报有用?下一篇直接送到你的邮箱。