NVIDIA Blog· Zhihan Jiang·· 16 天前精选AI 评分84
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次提交中实现领先性能
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 预览结果,在 Qwen3-VL 上的吞吐量最高达到 GB300 NVL72 的 3.7x,在 DeepSeek-R1 上最高达到 2.5x。
推荐理由
文章集中比较 Vera Rubin 与 GB300 在吞吐、跨机架扩展和软件优化上的表现,呈现了影响推理成本的系统级因素。
来源:NVIDIA Blog · blogs.nvidia.com