跳到正文
原文
Mistral AI·· 2026-08-04

Mistral AI 发布 Shieldstral:3B 开源多模态安全分类器

Introducing Shieldstral.

AI 导读

Mistral AI 发布 Shieldstral,一个 3B 开源权重多模态安全分类器,以 Apache 2.0 许可开放下载,可在单张 16GB NVIDIA GPU 上运行。它把内容审核建模为策略自适应的问答任务,推理时用自然语言写出策略即可返回校准后的安全分数,无需重新训练,统一处理文本与图像。官方称其在文本安全上可匹配最高 7 倍参数量的模型,并在多模态审核基准上取得新的最优结果。

入选记录

入选两次之和 139 ≥ 门槛的两倍 120

信源等级
官方一手,这一级的门槛是 60 分
预筛
通过:发布AI多模态安全分类器模型
推荐理由
3B 开源权重安全分类器把内容审核变成可推理时替换的自然语言问答,读者可据此判断小模型在审核场景的可用边界。

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:Mistral AI · mistral.ai