NVIDIA · AI 筛选· Zhihan Jiang·· 14 天前精选AI 评分76
NVIDIA Vera Rubin NVL72 首度亮相 MLPerf Inference v6.1 评测
NVIDIA Vera Rubin NVL72 Delivers Leading Performance in MLPerf Inference v6.1 Debut
AI 导读
NVIDIA 在 MLPerf Inference v6.1 预览评测中展示了 Vera Rubin NVL72 系统,在 Qwen3-VL 任务上的吞吐量达到 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上的吞吐量最高达到 2.5 倍。
推荐理由
原文通过实测基准数据对比了新一代架构在长上下文与多模态模型上的吞吐与扩展效率,便于评估大模型推理基础设施的代际演进。
来源:NVIDIA · AI 筛选 · blogs.nvidia.com