NVIDIA Blog· Zhihan Jiang·· 14 天前精选AI 评分68
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 评测中亮相
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA 公布 MLPerf Inference v6.1 评测结果,Vera Rubin NVL72 系统在 Qwen3-VL 上吞吐量最高达到 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上吞吐量提升最高达 2.5 倍。
推荐理由
原文给出了新一代机架在主流推理模型上的基准吞吐数据,读者可以据此评估大规模算力集群的推理能效与扩展收益。
来源:NVIDIA Blog · blogs.nvidia.com