AAI News Hub
模型Wed, August 5, 2026·Aug 52 家媒体交叉佐证

Mistral 发布面向多模态审核的 Shieldstral

这款 3B 开放权重安全分类器可依据自然语言策略评估文本和图像。

为什么重要

Shieldstral 瞄准了 AI 部署中的一个现实缺口:无需重新训练护栏模型,就能让审核规则适配不同产品。其开放权重发布为开发者测试多模态安全工作流提供了一个更小、更可检查的选择。

核心要点

  • 1.3B 开放权重模型,采用 Apache 2.0 许可证发布。
  • 2.可在推理时提供自然语言策略。
  • 3.支持对文本、图像以及图文混合输入进行审核。

Mistral 发布了 Shieldstral,这是一款用于内容审核的 3B 开放权重多模态安全分类器。该模型将审核视为一种可适配策略的问答任务,可在推理时接收自然语言策略,并为文本、图像以及图文混合内容返回经过校准的安全评分。Mistral 表示,这款采用 Apache 2.0 许可证的模型可在单张 16GB NVIDIA GPU 上运行,并在多项安全基准测试中达到或超过了规模最高为其 7 倍的开放护栏模型。

今天就能用

在依赖固定类别的护栏模型之前,应先根据你当前的审核策略评估 Shieldstral。

来源与原始报道

本简报汇总并链接到以下媒体的报道。

觉得这篇简报有用?下一篇直接送到你的邮箱。

更多 模型