← 資訊首页 | 货源大厅

NVIDIA Vera Rubin NVL72首次亮相MLPerf预览,吞吐量较GB300最高提升3.7倍

2026-09-16 · 来源:{'name': 'Unite AI', 'url': 'https://www.unite.ai/nvidia-vera-rubin-nvl72-posts-first-mlperf-inference-preview-results/'}

NVIDIA Vera Rubin NVL72首次亮相MLPerf预览,吞吐量较GB300最高提升3.7倍

首批MLPerf Inference预览成绩显示,NVIDIA下一代机架系统在Qwen3-VL基准上的吞吐量最高达到GB300 NVL72的3.7倍。

NVIDIA于2026年9月16日公布MLPerf Inference v6.1提交成绩,其中最受瞩目的是旗下Vera Rubin NVL72系统首次亮相MLPerf Inference预览环节。随成绩一同发布的数据显示,该平台在Qwen3-VL基准上的吞吐量最高达到GB300 NVL72的3.7倍,为这款下一代机架系统留下了首个标准化性能数据点。

上述成绩出自MLPerf Inference: Datacenter测试套件。该套件由MLCommons协会维护,用于衡量系统利用已训练模型处理输入并产出结果的速度。所有提交均按MLCommons的定义发布,而"预览"标识表明这是Vera Rubin NVL72在该套件中的首次亮相,并非标准提交。

对于规划大规模AI部署的组织而言,最值得关注的是这组代际对比。3.7倍是与GB300 NVL72机架对机架的直接比较,且具体测自Qwen3-VL这一负载。"最高"这一限定词意味着这是单一基准上的峰值成绩,而非全套测试的平均值,因此采购方应将其视为新系统吞吐量表现的早期信号,而非对每种模型和每种服务场景都必然成立的确定性提升。

MLPerf Inference: Datacenter的存在意义正在于支持这类比较:相同的工作负载、公开的配置,以及衡量系统将训练好的模型转化为最终输出速度的统一标尺。因此,NVIDIA 2026年9月16日的发布为Vera Rubin NVL72立下了一个早期参照点;随着后续MLPerf轮次迎来更完整的提交,Qwen3-VL上较GB300 NVL72最高3.7倍的领先幅度,将是各方亟待验证——亦待超越——的关键数字。


萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅