跳到正文
原文
NVIDIA Blog· Zhihan Jiang·· 14 天前

NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1 并取得领先性能

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览结果,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。

入选记录

入选两次之和 124 ≥ 门槛的两倍 120

信源等级
官方一手,这一级的门槛是 60 分
预筛
通过:NVIDIA AI推理平台MLPerf性能结果
推荐理由
原文给出 Vera Rubin NVL72 首次 MLPerf 推理提交的吞吐与扩展效率数据,可供判断推理基础设施的性价比走向。

评分由模型按同一份标准独立打两次,满分 100;两次之和达到门槛的两倍才入选。门槛按信源等级设定。

来源:NVIDIA Blog · blogs.nvidia.com