跳到正文

#模型发布

今日 0 条

9月29日

星期二
  1. NVIDIA 发布 Kumo Tabular 表格预测基础模型

    NVIDIA 发布开源表格基础模型 Kumo Tabular,给定带标签的表格行即可单次前向传播预测新行标签,无需训练、调参和特征工程,覆盖分类与回归。模型提供 28M 到 215M 三种规模,仅用人工合成表格预训练,采用 OpenMDW-1.1 许可可商用,在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准上排名第一。

  2. OpenAI 发布 GPT-6.1 Sol

    OpenAI 发布 GPT-6.1 Sol,官方称其具备接近 Astra 的智能水平,面向编码、计算机操作和专业工作场景。该模型的 API 输入与输出 token 价格为 Astra 标准价格的五分之一。

9月28日

星期一

9月25日

星期五

9月24日

星期四

9月23日

星期三

9月16日

星期三

9月10日

星期四

9月9日

星期三

9月3日

星期四

9月1日

星期二

8月28日

星期五

8月27日

星期四

8月25日

星期二

8月14日

星期五

8月12日

星期三

8月10日

星期一

8月6日

星期四

8月4日

星期二
  1. Mistral AI 发布 Shieldstral:3B 开源多模态安全分类器

    Mistral AI 发布 Shieldstral,一个 3B 开源权重多模态安全分类器,以 Apache 2.0 许可开放下载,可在单张 16GB NVIDIA GPU 上运行。它把内容审核建模为策略自适应的问答任务,推理时用自然语言写出策略即可返回校准后的安全分数,无需重新训练,统一处理文本与图像。官方称其在文本安全上可匹配最高 7 倍参数量的模型,并在多模态审核基准上取得新的最优结果。

7月30日

星期四
  1. Google DeepMind 在 Flow Music 发布 Lyria 3.5 音乐生成模型

    Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升,包括更复杂自然的旋律结构、提示词遵循与结构感知更好的歌词、更具情感表现力和发音更准确的人声,以及对输出节奏和时长的更易控制。

7月28日

星期二

7月27日

星期一

7月21日

星期二

7月17日

星期五

7月15日

星期三

7月8日

星期三

7月2日

星期四

7月1日

星期三

6月30日

星期二

6月23日

星期二
  1. Mistral 发布 OCR 4 文档解析模型

    Mistral 发布 OCR 4,在提取文本之外返回边界框、块类型分类和逐页逐词置信度,支持 170 种语言并可单容器自托管部署。官方称独立标注者在 600 多份文档的盲评中平均 72% 更偏好 OCR 4,其在 OlmOCRBench 得 85.20、OmniDocBench 得 93.07,但官方提示这两个基准的评分方式存在已知局限。

6月11日

星期四

6月9日

星期二

5月22日

星期五