跳到正文
原文
NVIDIA Technical Blog· Zhihan Jiang·· 17 天前精选AI 评分71

NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐达 GB300 NVL72 的 3.7 倍

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA 在 MLPerf Inference v6.1 中首次提交 Vera Rubin NVL72 预览结果,覆盖 DeepSeek-R1 与 Qwen3-VL 两项基准。

推荐理由

Vera Rubin NVL72 首次 MLPerf Inference 提交在 Qwen3-VL 上吞吐达 GB300 NVL72 的 3.7 倍,并展示 288 GPU 近线性扩展效率。

来源:NVIDIA Technical Blog · blogs.nvidia.com