跳到正文
原文
NVIDIA Blog· Zhihan Jiang·· 14 天前AI 评分49

NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首秀中性能领先

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首秀中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍。GB300 NVL72 凭 288 个 GPU 跨四机架实现 99% 扩展效率;v6.1 提交的软件优化较 v6.0 最高提升 1.6 倍性能。

来源:NVIDIA Blog · blogs.nvidia.com