NVIDIA Technical Blog· Zhihan Jiang·· 17 天前精选AI 评分71
NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐达 GB300 NVL72 的 3.7 倍
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA 在 MLPerf Inference v6.1 中首次提交 Vera Rubin NVL72 预览结果,覆盖 DeepSeek-R1 与 Qwen3-VL 两项基准。
推荐理由
Vera Rubin NVL72 首次 MLPerf Inference 提交在 Qwen3-VL 上吞吐达 GB300 NVL72 的 3.7 倍,并展示 288 GPU 近线性扩展效率。
来源:NVIDIA Technical Blog · blogs.nvidia.com