跳到正文

多模态

文本之外的能力:视觉理解、图文混合、音视频输入输出的模型与产品进展。

最新精选

第 1–20 条 · 共 47 条

10月1日

星期四今天

9月29日

星期二

9月25日

星期五

9月24日

星期四

9月23日

星期三

9月22日

星期二

9月3日

星期四

9月2日

星期三

8月28日

星期五

8月17日

星期一

8月12日

星期三

8月11日

星期二

8月10日

星期一

8月4日

星期二
  1. Mistral AI 发布 Shieldstral:3B 开源多模态安全分类器

    Mistral AI 发布 Shieldstral,一个 3B 开源权重多模态安全分类器,以 Apache 2.0 许可开放下载,可在单张 16GB NVIDIA GPU 上运行。它把内容审核建模为策略自适应的问答任务,推理时用自然语言写出策略即可返回校准后的安全分数,无需重新训练,统一处理文本与图像。官方称其在文本安全上可匹配最高 7 倍参数量的模型,并在多模态审核基准上取得新的最优结果。

7月30日

星期四

7月28日

星期二