跳到正文

全部 AI 动态

今日 6 条

8月27日

星期四

8月25日

星期二

8月21日

星期五

8月14日

星期五

8月12日

星期三

8月11日

星期二

8月10日

星期一

8月6日

星期四

8月4日

星期二
  1. Mistral AI 发布 Shieldstral:3B 开源多模态安全分类器

    Mistral AI 发布 Shieldstral,一个 3B 开源权重多模态安全分类器,以 Apache 2.0 许可开放下载,可在单张 16GB NVIDIA GPU 上运行。它把内容审核建模为策略自适应的问答任务,推理时用自然语言写出策略即可返回校准后的安全分数,无需重新训练,统一处理文本与图像。官方称其在文本安全上可匹配最高 7 倍参数量的模型,并在多模态审核基准上取得新的最优结果。

7月30日

星期四
  1. Google DeepMind 在 Flow Music 发布 Lyria 3.5 音乐生成模型

    Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升,包括更复杂自然的旋律结构、提示词遵循与结构感知更好的歌词、更具情感表现力和发音更准确的人声,以及对输出节奏和时长的更易控制。

7月28日

星期二

7月27日

星期一

7月21日

星期二

7月17日

星期五

7月16日

星期四
  1. DharmaOCR 在巴西葡萄牙语 OCR 基准上超越 Mistral OCR4 与 Unlimited-OCR

    DharmaOCR 在葡萄牙语 OCR 基准上以 0.925 的得分超过 Mistral OCR4 的 0.798 和 Unlimited-OCR 的 0.7587。该模型通过两阶段训练实现领域专精:先以葡萄牙语语料监督微调,再用 DPO 提升推理稳定性。作者认为,尽管新架构不断涌现,专注单一语言的参数集中策略仍构成结构性优势。

7月15日

星期三

7月8日

星期三

7月2日

星期四

7月1日

星期三

6月30日

星期二

6月27日

星期六

6月23日

星期二
  1. Mistral 发布 OCR 4 文档解析模型

    Mistral 发布 OCR 4,在提取文本之外返回边界框、块类型分类和逐页逐词置信度,支持 170 种语言并可单容器自托管部署。官方称独立标注者在 600 多份文档的盲评中平均 72% 更偏好 OCR 4,其在 OlmOCRBench 得 85.20、OmniDocBench 得 93.07,但官方提示这两个基准的评分方式存在已知局限。

6月11日

星期四

6月9日

星期二

5月22日

星期五

5月18日

星期一

5月16日

星期六

4月16日

星期四

4月13日

星期一

4月3日

星期五

3月24日

星期二

3月17日

星期二

2月5日

星期四

12月17日

星期三

12月9日

星期二

12月3日

星期三

7月15日

星期二