跳到正文
原文
NVIDIA Blog· Zhihan Jiang·· 15 天前AI 评分48

NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,性能领先

NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut

AI 导读

NVIDIA Vera Rubin NVL72 首次参加 MLPerf Inference v6.1 预览提交即取得领先性能:在 Qwen3-VL 上吞吐量最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上使用 TensorRT-LLM 最高达 2.5 倍。

来源:NVIDIA Blog · blogs.nvidia.com