算力百科COMPUTEPEDIA

算力百科 › 机型词条 › GB300 NVL72

GB300 NVL72 液冷机柜官方渲染图(厂商图)
厂商图 · 萬安算力百科(NVIDIA 官网)

GB300 NVL72

NVIDIA Blackwell Ultra · 72 卡液冷超节点机柜 · 机型词条 #005

概述OVERVIEW

GB300 NVL72(全称 NVIDIA GB300 NVL72,Blackwell Ultra 平台旗舰形态)是 NVIDIA 于 2025 年 3 月 18 日在 GTC 发布的机柜级超节点:把 72 颗 Blackwell Ultra GPU 和 36 颗 Grace CPU 装进一个全液冷机柜,第五代 NVLink 全互联合计 130TB/s——整个机柜在软件眼里是一颗加速器[1][3]。

它是对话里「NVL72」三个字的载体:N=NVLink 域,72=一个域里的 GPU 数。官方口径对上代 GB200 NVL72 提速 1.5 倍,FP4 Tensor Core 官方规格 1,440 PFLOPS(dense)、GPU 显存合计 20TB HBM3e、供电 132kW 级——机柜级交付意味着买它之前先要有一个能放下它的机房[1][2][3]。

2026 年的现货市场,GB300 NVL72 是大规模训练与推理工厂的舰队旗舰:2025 年 8 月 CoreWeave 率先把它搬上公有云,2026 年 9 月 MLPerf Inference v6.1 首秀给出公开成绩,同轮下一代 Vera Rubin NVL72 也已亮相(最高 3.7× 于 GB300,公开口径[6])——旗舰的位置从不等人,但部署门槛与整机价格同样是一个量级的存在(见「散热与部署」与「行情带」)。

适用场景FIT

萬安指数(0–100):本库按公开规格加权估算——机柜显存规模 40% + 互联 30% + 生态 30%,按场景调权,机柜级估算口径(与单卡词条口径不可互比)。90+ 旗舰级 · 75+ 优秀 · 60+ 可用 · 60 以下不适用。方法透明可复核,不构成性能承诺。

万亿参数级训练96萬安指数
72 卡一个 NVLink 域、20TB 显存同池——梯度同步不走网线,万亿参数训练的「原生单位」。
推理工厂(高并发 MoE)94萬安指数
MLPerf v6.1 首秀 MoE 基准最高 2.5× 提升(对上代 NVL72,公开口径);FP4 稀疏算力扛多副本并发。
集群起步(AI Factory)90萬安指数
多机柜经 Quantum-X800 / Spectrum-X 扩展,每 GPU 800Gb/s 东-西向网络;DGX SuperPOD 参考设计原生支持。
大显存长上下文 / 满血大模型多副本92萬安指数
单柜 20TB 可同驻满血 DeepSeek R1 级模型多副本(FP8 权重约 690GB/副本,推算口径)——单机形态给不了的余量。
存量机房轻改造场景45萬安指数
全液冷 + 132kW 级供电 + 承重要求——存量风冷机房直接部署基本不现实,这类需求请看 B300 NVL8 风冷整机(本库在售主力)。

沿革HISTORY

2025 年 3 月 18 日,GTC keynote 发布 Blackwell Ultra 平台:官方口径 GB300 NVL72 对 GB200 NVL72 提速 1.5 倍,Cisco / Dell / HPE / Lenovo / Supermicro 等 16 家伙伴同年下半年起交付整柜,每 GPU 配 ConnectX-8 SuperNIC 800Gb/s[3]。

2025 年 7-9 月,首批系统落地:CoreWeave 7 月宣布首批 GB300 NVL72 到位,8 月 19 日全球首个 GB300 NVL72 云实例正式商用(Dell 交付),其三季报以「First to deploy NVIDIA GB300 NVL72 systems」入档;Quanta 9 月起出货[8]。

2026 年 9 月,MLPerf Inference v6.1:GB300 NVL72 完成 MLPerf 首秀,MoE 基准对上代最高 2.5 倍提升;同轮下一代 Vera Rubin NVL72 亦首秀,Qwen3-VL 交互场景最高 3.7 倍于 GB300(NVIDIA 官方博客口径)——公开基准里第一次同台出现「现役旗舰 vs 继任者」[6][7]。

对华口径(中性):GB300 属美国出口管制标的,未在对华获批清单(2026-10 公开口径;美方对顶尖芯片对华许可持「推定拒绝」政策,2026 年 1 月 BIS 新规框架延续);2026 年 7 月获批放量入华的是 H200,GB300 级未获批——现货流通以海外及自贸区渠道为主。本库仅记录公开报道口径,不构成法律意见[10]。

技术规格SPECIFICATIONS

项目规格(GB300 NVL72 机柜级 · 官方口径)
配置72× Blackwell Ultra GPU + 36× Grace CPU(2,592× Arm Neoverse V2 核心)
FP4 Tensor Core1,440 PFLOPS(dense)/ 10,802 PFLOPS(稀疏)——发布报道与伙伴目录另有「1.1 EFLOPS 级 FP4 推理」口径
FP8 / FP6 Tensor Core720 PFLOPS
FP16 / BF16 · TF32360 / 180 PFLOPS
FP64100 TFLOPS
GPU 显存合计20TB HBM3e(288GB/卡 × 72 = 20.7TB,推算口径),带宽最高 576TB/s
CPU 内存合计17TB LPDDR5X(带宽 14TB/s);快速内存合计 37TB
卡间互联NVLink 第五代 · 合计 130TB/s(每 GPU 1.8TB/s)+ 9× NVSwitch 托盘全互联
机柜结构18× 计算托盘(每托 4 GPU + 2 Grace)+ 9× NVSwitch 托盘 + 8× 33kW 电源架
散热全液冷(fully liquid-cooled);机内 CDU 250kW 级;托盘级 + 机柜级漏液检测
供电132kW 配置级(8× 33kW 电源架);NVIDIA 参考架构满载最高 142kW
外部网络每 GPU 800Gb/s(ConnectX-8 SuperNIC ×4/托盘)+ BlueField-3 DPU;Quantum-X800 InfiniBand / Spectrum-X Ethernet 扩展
上代 / 下代GB200 NVL72(提速 1.5 倍之差)/ Vera Rubin NVL72(2026-09 首秀)

规格以 NVIDIA 官方公开资料为准[1][2];FP4 dense 为官方规格页无稀疏口径,1.1 EFLOPS 为发布/伙伴目录口径,两档并存各注出处;Tensor 算力除注明外均为含稀疏口径;机柜配置因 OEM 与批次存在差异。

1.13TBH200 8卡2.3TBB300 NVL820.7TBGB300 NVL72单机柜 GPU 显存合计 · 对比(288GB×卡数 推算口径)

单 Compute Tray 拆分口径PER TRAY

项目单个计算托盘(×18)
GPU4× Blackwell Ultra(合计 1,152GB HBM3e)
CPU2× Grace(72 核 ×2,合计 1TB LPDDR5X)
机内网络4× ConnectX-8(800Gb/s 各)+ 1× BlueField-3 DPU
互联界面后部 NVLink 线缆托(cable cartridge)盲插对接 NVSwitch 托盘;液冷接口盲插对接机柜 manifold
运维含义计算托盘可单独抽换维护——托盘级序列号与固件报告是验货最小单元(见「采购与验货」)

托盘级口径出 NVIDIA 参考架构文档[2]。

代际对照 · 两代 NVL72 同览GENERATIONS

项目GB200 NVL72GB300 NVL72
GPU72× Blackwell72× Blackwell Ultra
单卡显存192GB HBM3e288GB HBM3e
GPU 显存合计13.8TB(推算口径)20.7TB(推算口径;官方页 20TB)
官方相对性能基准1.5× AI performance(新闻稿口径)
网络ConnectX-7 400GConnectX-8 800G

GB200 列为公开口径对照,详见 NVIDIA 官方资料;两代均为全液冷、36× Grace 架构。

家族成员FAMILY

GB300 家族按形态分四支,本库在售以 GB300 NVL72 整柜与 DGX GB300 为主力(大陆语境的 B300 NVL8 风冷整机见 B300 词条):

GB300 NVL72(本词条 · 72 卡液冷超节点机柜)DGX GB300(NVIDIA 官方整柜)DGX Station GB300(桌面级工作站点)HGX B300 NVL16(16 卡风冷基板,OEM 整机)B300 NVL8 风冷整机(单机房分批部署 → 见 B300 词条)

散热与部署COOLING & DEPLOYMENT

GB300 NVL72 只有液冷一种形态:计算托盘与 NVSwitch 托盘全部冷板液冷,液冷界面为托盘后部盲插接头对接机柜 manifold,机内 CDU 250kW 级(超微口径,冗余电源)驱动二次侧回路;NVIDIA 参考架构要求托盘级 + 机柜级两级漏液检测[2][4]。部署它不是「买台服务器」,而是一个机房工程项目:

1
供电:132kW 级整柜电力
8× 33kW 电源架(每架 6× 5.5kW PSU,n+n 冗余),参考架构满载最高 142kW——机房需对应的市电容量、母线或 PDU 改造,与风冷 8 卡整机(约 10kW 级/台)差一个量级。
2
液冷:CDU + 一次侧/二次侧管路
机内 CDU 250kW 级;一次侧需机房冷却水/冷却塔配套(水温、流量、水质按 OEM 规范),托盘盲插界面进出场前后都要做漏液检测标定。
3
承重与空间:整柜交付
机柜级整柜运输(超微口径 2236 × 600 × 1068 mm,满配吨级自重),楼层承重、搬运路径与叉车/气垫方案要提前勘测;48U 级机柜位预留前后维护空间。
4
部署节奏参考
行业经验:液冷机柜从到货到跑满负载,快则数周、慢则数月,卡点几乎都在机房侧(水、电、承重)而非设备本身——采购周期要把这部分排进去(本库部署观察口径)。
计算托盘后部 NVLink 线缆托与盲插液冷接头 实拍
托盘后部 NVLink 线缆托 + 盲插液冷接头 · 实拍(图源 ServeTheHome)
超微液冷 GB300 NVL72 机柜 实拍
超微液冷 GB300 NVL72 机柜 · 实拍(图源 ServeTheHome)

模型与集群适配MODEL & CLUSTER FIT

模型 / 场景显存需求(FP8 估算)GB300 NVL72 部署(单柜 20.7TB 推算口径)萬安指数
DeepSeek R1 满血(671B)多副本推理约 690GB / 副本单柜可同驻 20+ 副本(权重口径推算,未含 KV cache)——高并发推理工厂的底气96
万亿参数级 MoE 训练权重+优化器状态 TB 级72 卡 NVLink 域内张量/专家并行,梯度不出柜;多柜经 800G 扩展95
长上下文(百万 token 级)KV cache 随上下文线性膨胀20TB 池化显存给 KV 留足余量,单柜即可支撑大规模并发长上下文92
7B-14B 级小模型批量产线约 8-30GB / 实例能跑但「杀鸡用牛刀」——这类产线用 B300 NVL8 / H200 更划算(经济性口径)58

显存按 FP8 权重 ≈ 参数量 × 1 字节估算(推算口径,未含 KV cache 与激活余量);萬安指数为本库机柜级估算口径,随实测更新。集群扩展形态(DGX SuperPOD / 多柜 InfiniBand 互连)以 NVIDIA 参考设计为准。

GB300 NVL72 液冷机柜官方渲染图
GB300 NVL72 液冷机柜 · 厂商图(NVIDIA 官网)
NVSwitch 托盘与计算托盘官方渲染图
NVSwitch 托盘 + 计算托盘 · 厂商图(NVIDIA 官网)
超微液冷 GB300 NVL72 机柜 实拍
超微液冷机柜整柜 · 实拍(图源 ServeTheHome)
计算托盘内部 实拍
计算托盘内视(铜冷板 + 液冷管路)· 实拍(图源 ServeTheHome)
Grace CPU 与 B300 GPU 特写 实拍
Grace CPU + B300 GPU + ConnectX-8 特写 · 实拍(图源 ServeTheHome)
托盘后部 NVLink 线缆托与盲插液冷接头 实拍
托盘后部 NVLink 线缆托 + 盲插液冷接头 · 实拍(图源 ServeTheHome)

实拍图随验货批次上架持续补充;官方渲染图不冒充实拍,AI 生成图不冒充实拍。

视频讲解VIDEO

本片为 GB300 NVL72 专属机柜级部署视角(整柜就位 → 供电 → 液冷 → 网络 → 上电验收),参数与判例均为 GB300 NVL72 实锚,旁白与场景文本存档见仓库 _wiki_work_1006/gen_tts_gb300.py。

软件与生态ECOSYSTEM

项目要求 / 现状
CUDA / 驱动与 B300 同代同栈:Blackwell 世代支持线(CUDA 12.8 起完整支持),详见 B300 词条与 NVIDIA 官方文档
集合通信NCCL 对 NVLink5 / NVSwitch 全互联原生优化——机柜级验收以 nccl-tests 全机联测为准(见「如何验收」)
集群管理NVIDIA Base Command / DGX SuperPOD 参考设计;第三方 Slurm / Kubernetes 生态通用(公开口径)
推理引擎vLLM / SGLang / TensorRT-LLM 均支持 Blackwell Ultra(FP4 路径为世代新特性,以各引擎发布为准)
网络配套Quantum-X800 InfiniBand / Spectrum-X Ethernet 800G 光互连(多柜扩展)
运维监控DCGM / 托盘级带外管理(SN2201 带外交换机)——RAS 事件计数是机柜验收的硬指标

软件栈版本随时间演进,以 NVIDIA 官方发布为准;生态成熟度判断详见 B300 词条(同代共享)。

采购与验货PROCUREMENT

GB300 NVL72 采购的验货要点(三项,机柜级口径):

1
先分清形态:NVL72 整柜 / DGX GB300 / B300 NVL8
三者价差一个量级:报价与合同必须写明交付形态、托盘数(18 计算托盘 + 9 NVSwitch 托盘)与电源架配置(8× 33kW)——「按柜报价」与「按托盘报价」是两种生意。
2
托盘级序列号验真
机柜由 18 个计算托盘组成——逐托核对序列号与 Blackwell Ultra 丝印、调取官方固件报告(DCGM / 带外管理读数),托盘级验货是最小可信单元;单托以旧换新、混批次是机柜级交易的现实风险。
3
到货联合验收(液冷与供电界面)
盲插液冷接头、manifold、CDU 与电源架逐项对上验货单;「单卡显存实测」在机柜级不可行,改由上电后的 NCCL 全机联测 + RAS 事件计数承担(见「如何验收」)。

机柜级验收五项判例见本词条「如何验收」节。

如何验收(机柜级)RACK ACCEPTANCE

机柜级验收五项口径(与单卡压测是两套体系,数值判例全部按 GB300 NVL72 实锚):上电自检 → 液冷标定 → 整机功耗 → NCCL 全机联测 → RAS 事件计数。

1
上电与托盘自检
8× 33kW 电源架逐架上电,18 计算托盘 + 9 NVSwitch 托盘带外管理逐一报到位;电源架冗余(n+n)拔一路 PSU 整机不掉线为合格。
2
液冷流量与温差标定
CDU 250kW 级按 OEM 规范校一次侧流量/进出水温差与二次侧盲插界面;托盘级 + 机柜级两级漏液检测零告警为合格——液冷问题在上电前解决,不上电后。
3
整机功耗校验
全柜满载整机功耗对齐参考架构口径(132kW 配置级、满载最高 142kW):满载实测显著低于 120kW 说明负载没吃满,异常超 142kW 说明电源或限频配置有问题。
4
NCCL 全机联测
nccl-tests 对 72 卡做 all_reduce:NVLink5 每 GPU 双向标称 1.8TB/s,机内总线带宽实测达到标称的 ≥85% 为合格线(本库验收口径,推算比例沿用单卡带宽判例方法);跨柜扩展另按 800G 光互连单独测。
5
RAS 事件计数
DCGM / 带外管理读 RAS 计数:可纠正 ECC 基线内、无可纠正 ECC 与训练中断事件为合格;托盘级 RAS 记录与序列号报告一并归档,作为保修与残值的凭证。

本节为机柜级验收口径,与单卡词条「如何压测」六项判例不通用;≥85% 等比例线为本库验收口径(推算),最终以 OEM 验收规范为准。

运输与交付LOGISTICS

1
整柜运输与承重勘测
机柜级整柜交付(超微口径 2236 × 600 × 1068 mm、吨级自重):楼层承重、搬运路径、叉车/气垫方案先勘测后发货;GB300 属出口管制机型,报关路径与合规状态直接影响保修与保值,随货文件核验留存(合规属性以主管部门政策与专业意见为准)。
2
运输保险按整柜货值
单柜数百万美元级货值,全额投保 + 冷板/管路运输保护条款写进合同;液冷组件的运输损伤是机柜级特有风险点。
3
到货联合验收
封条、柜体、托盘数(18 计算托盘 + 9 NVSwitch 托盘)三处核对与验货报告逐项对上;液冷界面与电源架到场先检再装,任何一处不符当场拍照留证。

OEM 与变体VENDORS

同一套 GB300 NVL72 参考架构,各家整柜差在交付、液冷配套与服务——选型先看区别(本库在售已覆盖超微 / Dell 口径):

整机厂代表形态差异点适合谁
Supermicro 超微SRS-GB300-NVL72(本库在售口径)机内 CDU 250kW 级、8× 33kW 电源架整柜交付,液冷配套自家闭环[4]现货采购 · 液冷配套一站式
Dell 戴尔GB300 NVL72 整柜(本库在售口径;CoreWeave 首批交付方)全球一线服务网络,公有云大单交付经验[8]跨国部署 · 要服务
NVIDIA 官方DGX GB300 / DGX SuperPOD官方一体交付 + 全栈软件(本库在售 31 处 USD 口径)要开箱即训 · 要原厂支持
Lenovo / HPE / CiscoGB300 NVL72 整柜企业级服务网络(新闻稿伙伴名单口径[3])企业客户渠道采购
Wiwynn / 和碩 / Quanta 等ODM 整柜 / 代工云厂商供应链后端(CoreWeave 等的交付形式之一)云厂商大单 · ODM 渠道

萬安指数 · 部署四维对比(机柜级)WANAN INDEX

整机厂安装简易维护便利性能密度寿命预期
Supermicro 超微72809582
Dell 戴尔78889585
NVIDIA 官方82859485
Lenovo / HPE / Cisco76869484
ODM(Wiwynn/和碩/Quanta)68729580

整机厂信息来自各家官方发布与公开评测(如 ServeTheHome);萬安指数为本库机柜级估算口径(0–100,估分依据=整柜交付形态、液冷配套与服务网络差异;「安装简易」普遍低于风冷 8 卡整机,属机柜级部署的客观属性而非厂商短板),随实机验证更新,不构成采购承诺。具体型号以厂商官方发布为准。

术语卡GLOSSARY

NVL72 / 超节点

N=NVLink 域,72=域内 GPU 数。72 颗 GPU 经 NVSwitch 全互联成一个 NVLink 域,对软件呈现为一颗「巨型加速器」——这是「超节点」的含义,也是机柜级产品与 8 卡整机的本质区别。

Compute Tray 计算托盘

机柜的最小计算单元:每托 4× Blackwell Ultra(合计 1,152GB HBM3e)+ 2× Grace(合计 1TB LPDDR5X),共 18 托。托盘可单独抽换——托盘级序列号与固件报告是机柜验货的最小可信单元。

NVSwitch Tray 交换托盘

9 个交换托盘承接 72 卡的全互联:计算托盘经后部 NVLink 线缆托(cable cartridge)盲插对接交换托盘,构成非阻塞 P2P 矩阵——合计 130TB/s 的 NVLink5 带宽由此而来。

CDU 与盲插液冷

CDU(Coolant Distribution Unit,冷量分配单元)机内 250kW 级,驱动二次侧液冷回路;计算托盘与机柜 manifold 之间是盲插(blind-mate)接头——托盘推入即接通液路。托盘级+机柜级两级漏液检测是标配。

Grace CPU

NVIDIA 的 Arm 架构 CPU(Neoverse V2,72 核),每柜 36 颗、每托 2 颗,配 LPDDR5X 内存(合计 17TB)。Grace 负责「喂饱」GPU:数据预处理、通信与调度,GPU↔CPU 经 NVLink-C2C 互连。

出口管制与合规批次

GB300 属美国对华出口管制标的、未在对华获批清单(2026-10 公开口径);现货流通以海外及自贸区渠道为主。批次与报关路径影响保修与保值,验货必查。本库表述均为公开报道口径,不构成法律意见。

动态与关联事件TIMELINE

局限与争议LIMITS

  • 部署门槛是它的另一面:全液冷 + 132kW 级供电(参考架构满载最高 142kW)+ 吨级整柜承重——存量风冷机房基本无缘,机房改造周期常以月计;预算不够改机房的,B300 NVL8 风冷整机是更现实的第一步(见「散热与部署」)。
  • 代际挤压已经公开化:2026 年 9 月 MLPerf 同轮,下一代 Vera Rubin NVL72 首秀即以最高 3.7× 压过 GB300(Qwen3-VL,NVIDIA 官方博客口径[6])——旗舰机柜的领先窗口期以季度计,采购决策要算好折旧节奏。
  • 对华出口管制标的(中性表述):GB300 未在对华获批清单(2026-10 公开口径),现货流通以海外及自贸区渠道为主,报关路径与合规状态直接影响保修与保值[10]。本库仅记录公开报道口径,不构成法律意见。
  • 价格体量与流动性:单柜数百万美元级(上代 GB200 NVL72 公开报道约 $300 万/柜[9]),整批要价口径为主——二手单柜流通市场极不成熟,残值高度依赖机房条件与原厂保修衔接,转手成本远高于单卡。
  • 显存容量口径差(18TB vs 20TB):官方页口径 20TB(288GB×72=20.7TB 推算吻合),渠道早期资料有 18TB 写法——询价与合同以官方 20TB 口径核对,验收以托盘级固件报告实测为准(本库在售 config 串仍见 18TB 写法,已在本词条口径注标明)。
  • 「一颗大卡」的另一面:NVLink 域是它的性能来源也是它的风险边界——域内故障影响面是整柜级,运维需要托盘级隔离与快速换盘能力(见「如何验收」RAS 项),这对运维团队是实打实的能力要求。

行情带MARKET DATA

GB300 NVL72 · 参考价带
日期口径区域参考价带说明
2026-10-09大厅实时美国(USD)$323万 – 424万28 处报价 ›(整柜要价口径)
2026-10-09大厅实时中国大陆¥4,088万 – 10,918万24 处报价 ›(整柜要价口径 · 海外及自贸区渠道语境)
2026-10-09大厅实时中东(AED)AED 2,292万 – 2,814万39 处报价(整柜要价口径)
2026-10-09大厅实时欧洲(EUR)€467万 – 572万38 处报价(整柜要价口径)
2026-10-09大厅实时新加坡(SGD)S$943万 – 1,173万31 处报价(整柜要价口径)
2026-10-09大厅实时日本(JPY)JPY 105,399万 – 130,125万26 处报价(整柜要价口径)
2025-12渠道参考全球上代 GB200 NVL72 约 $300 万 / 柜公开报道口径[9] · GB300 官方无标价 · 在售整柜 ›
2026-10-09政策口径中国大陆未在对华获批清单GB300 属美国出口管制标的,现货流通以海外及自贸区渠道为主(公开报道口径,不构成法律意见)
口径说明:行情带为本库记录的公开渠道信息与在售报价区间,仅作行情参考,不构成任何交易要约;价格随批次、成色、数量与渠道条件波动,实际以货主报价为准。在售机型均为 GB300 NVL72 整柜(整柜要价口径,unit=rack)。跨币种价带为各区域原币种记录,互不折算。本库价格数据来源:萬安算交所(0 佣金撮合、不参与交易)。行情快照自 2026-10-09 起逐日积累。
时间参考价带(快照口径)
区域

口径:不做推算带——GB300 NVL72 无公开价格史锚,曲线仅呈现本库快照实测:中国大陆锚定在售整柜报价(¥4,041.9-4,529.0 万 · 15 处,2026-10-08 起),北美/欧洲/新加坡/日本/中东按行情快照逐日积累(USD 344.4-422.9 万 · 25 处等,均为原币种口径、互不折算)。GB300 未在对华获批清单,大陆报价为海外及自贸区渠道语境(公开报道口径,不构成法律意见)。本库价格数据来源:萬安算交所(0 佣金撮合、不参与交易,不掌握亦不推测成交价,数据因此中立)。实际以货主报价为准。

价格节点大事记MILESTONES

常见问题FAQ

GB300 NVL72 是什么?

NVIDIA 2025 年 3 月 GTC 发布的 Blackwell Ultra 超节点机柜:72 颗 Blackwell Ultra GPU + 36 颗 Grace CPU 装进一个全液冷机柜,NVLink5 全互联合计 130TB/s,对软件呈现为一颗加速器。FP4 Tensor Core 官方规格 1,440 PFLOPS(dense 口径),GPU 显存合计 20TB HBM3e。

GB300 NVL72 和 8 卡风冷整机(B300 NVL8)怎么选?

看机房与规模:NVL72 需 132kW 级供电、CDU 液冷与承重改造,换来 20TB 显存一个 NVLink 域,是大规模训练与推理工厂形态;NVL8 单卡 288GB、整机 2.3TB,存量机房分批部署。有机房改造预算上 NVL72,没有就 NVL8 起步(本库在售两形态都有,见行情带)。

GB300 对华能买吗?

GB300 属美国出口管制标的,未在对华获批清单(2026-10 公开口径,2026 年 7 月获批放量入华的是 H200);现货流通以海外及自贸区渠道为主。本条为公开报道口径,不构成法律意见,采购前请以主管部门政策与专业合规意见为准。

显存到底是 18TB 还是 20TB?

NVIDIA 官方页口径 20TB HBM3e(288GB/卡 × 72 = 20.7TB,推算吻合;Red Hat 认证目录同口径);渠道早期资料有 18TB 写法(本库部分在售 config 串仍见)。以官方 20TB 为准,询价与合同按此核对,验收以托盘级固件报告实测为准。

机柜怎么「验货」?单卡显存实测还适用吗?

不适用——机柜级是另一套验收体系:上电自检(18+9 托盘逐一报到位)、液冷标定(CDU 流量/温差/漏液检测零告警)、整机功耗(满载 132-142kW 级对齐)、NCCL 全机联测(72 卡 all_reduce 对 NVLink5 标称)、RAS 事件计数(无未纠正 ECC 与中断)。逐托序列号验真是机柜验货的最小可信单元(见「如何验收」)。

B300(单卡 / NVL8)Blackwell 家族页H200NVLinkHBM3eGB200 NVL72(上代)DGX GB300Vera Rubin NVL72(下代 · 未上市)

机型对比与选型COMPARE

参考资料REFERENCES

  1. NVIDIA 官网 — GB300 NVL72 产品页(规格主档,2026-10 实抓) https://www.nvidia.com/en-us/data-center/gb300-nvl72/
  2. NVIDIA — 企业参考架构 NVL72 AI Factory:系统组件(托盘/供电/液冷口径,2026-10 实抓) https://docs.nvidia.com/enterprise-reference-architectures/n…
  3. NVIDIA 新闻室 — NVIDIA Blackwell Ultra AI Factory Platform Paves Way for Age of AI Reasoning(2025-03-18 发布稿:1.5×/H2 2025/16 家伙伴/CX-8 800G) https://nvidianews.nvidia.com/news/nvidia-blackwell-ultra-ai…
  4. Supermicro — SRS-GB300-NVL72 官方页(132kW / CDU 250kW / 尺寸) https://www.supermicro.com/en/products/rack/srs-gb300-nvl72
  5. Red Hat 认证目录 — GB300 NVL72(1.1 ExaFLOPS / 20.7TB HBM3e 伙伴目录口径) https://catalog.redhat.com/en/hardware/system/detail/307917
  6. NVIDIA 官方博客 — Vera Rubin NVL72 MLPerf 首秀、Qwen3-VL 最高 3.7× 于 GB300(2026-09-16) https://blogs.nvidia.com
  7. MLCommons — MLPerf Inference v6.1 结果(GB300 NVL72 首秀,MoE 最高 2.5×,2026-09-17) https://mlcommons.org
  8. CoreWeave — GB300 NVL72 云实例 GA(2025-08-19 changelog)及 Q3 2025 季报「First to deploy」 https://docs.coreweave.com
  9. Forbes — GB200 NVL72 单柜约 $300 万(2025-12-23,上代价格锚) https://www.forbes.com
  10. CNBC / 美国联邦公报 — 对华出口管制与 2026-01 BIS 新规(公开报道口径) https://www.cnbc.com
  11. ServeTheHome — Pegatron NVIDIA GB300 NVL72 and More at NVIDIA GTC 2025(计算托盘实拍) https://www.servethehome.com/pegatron-nvidia-gb300-nvl72-and…
  12. ServeTheHome — Supermicro NVIDIA B300 与 AI Factory 巡礼(超微 GB300 NVL72 机柜实拍) https://www.servethehome.com/checking-out-the-supermicro-nvi…
  13. 行情带数据 — 萬安算交所(本平台在售报价与渠道了解区间,每日更新) https://www.aixx.vip/hall.html
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-09 · 版本 v1.0 · 历次改动均留痕可查。发现错误?欢迎通过勘误通道提交,核实后公开修正并记入版本史。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品