算力百科COMPUTEPEDIA

算力百科 › 机柜词条 › GB200 NVL72

NVIDIA GB200 NVL72 机柜官方图(厂商图)
厂商图 · 萬安算力百科(NVIDIA 官网)

GB200 NVL72

NVIDIA Blackwell · 72 GPU+36 CPU · 机柜级液冷 · 机柜词条

概述OVERVIEW

GB200 NVL72是 NVIDIA 的机柜级超级芯片系统:一个机柜里装下 72 颗 Blackwell GPU + 36 颗 Grace CPU,全液冷散热,72 颗 GPU 经第五代 NVLink 组成单域全互联(单卡 1.8TB/s、聚合 30.4TB/s),对外提供最高 1.44 EF FP4 的推理/训练算力(官方产品页与 Supermicro 整机文档口径[1][2])。

它把「一台服务器」的定义推到了机柜级:计算托盘(每托 4×B200+2×Grace)与 NVLink 交换托盘(每柜 9 台)在机柜内铜互连全宽无阻塞,训练与推理像用一块巨卡(GTC 2024-03 发布口径[3])。2025 年全球 AI 基础建设的主力机柜就是它——部署量、话题量与二手预期价值都在 NVL72 家族里排第一。

2026 年的现货市场,GB200 NVL72 的流通形态是整柜与拆柜并存:项目整柜交付为主,亦有计算托盘/交换托盘级的流通。采购是重工程活:液冷一次/二次回路、供电、吊装、软件栈(NVLink 域健康)逐项都要验。本词条不带行情带——机柜价格以货主实际报价为准。

适用场景FIT

萬安指数(0–100):本库按公开规格加权估算——算力 40% + 互联 30% + 部署门槛 30%。90+ 旗舰级 · 75+ 优秀 · 60+ 可用 · 60 以下不适用。

万亿参数 MoE 训练95萬安指数
72-GPU 单 NVLink 域 + 13.4TB HBM3E 池,万亿参 MoE 的张量/专家并行在柜内全宽互连,跨柜才走 IB/以太网。
超大规模推理服务93萬安指数
FP4 1.44 EF 推理吞吐 + NVLink 域内 KV cache 共享,大模型在线服务的机柜级方案——2025 年头部云厂推理扩容的主力形态。
HPC/科学计算82萬安指数
FP64 不是 Blackwell 主场(弱于 Hopper 代的 FP64 比重),双精度为主的 HPC 选型要掂量。
小规模/探索性部署45萬安指数
整柜起售+液冷+电力改造门槛,几十卡规模的需求看 HGX 基板整机更实际。

沿革HISTORY

2024 年 3 月,NVIDIA 在 GTC 发布 Blackwell 平台与 GB200 NVL72:Grace Blackwell 超级芯片(2×B200+1×Grace)为基,机柜级 NVLink 全互联横空出世——「72 卡一块卡」的叙事从此改写 AI 基础设施(NVIDIA 官方页与 GTC 发布口径[1][3])。

2024-2025 年,规模部署期:北美云大厂首批机柜上线,2025 年全球放量出货——液冷渗透率随 NVL72 家族放量快速抬升(行业口径:AI 数据中心液冷渗透率 2025 年预估超 30%,TrendForce 公开报告口径[4])。供应链上冷板、CDU、歧管、快接头四环节全面随动(液冷详见本库液冷 CDU 词条)。

2025 年,世代接棒:GB300 NVL72(Blackwell Ultra,72×B300)发布并开始交付,GB200 NVL72 从新品转为存量部署与二手预期并行的阶段——两代机柜在 2026 年市场并行流通(GB300 详见词条)。

2026 年,现货定位:GB200 NVL72 以整柜/拆柜两种形态进入流通视野。机柜级设备的跨境流通政策仍在演进,采购时以主管部门政策与专业意见为准(公开报道口径,不构成法律意见)。

技术规格SPECIFICATIONS

项目规格(GB200 NVL72 · 官方口径)
GPU72× NVIDIA Blackwell(B200 超级芯片粒)
CPU36× NVIDIA Grace(72 核 Armv9)
GPU 显存最高 13.4TB HBM3E(全柜合计)
CPU 内存最高 17TB LPDDR5X(ECC)
算力最高 1.44 EF FP4(全柜,官方口径)
互联NVLink 5.0 · 单卡 1.8TB/s · 72-GPU 单域 · 聚合 130TB/s(官方页口径)
计算托盘每托 4×B200 + 2×Grace,每柜 18 托(Supermicro 整机文档口径[2])
交换托盘NVLink 交换托盘 × 9/柜(铜互连全宽无阻塞)
散热机柜级液冷(冷板+CDU 回路,详见液冷 CDU 词条)
发布2024 年 3 月(GTC,Blackwell 平台)

规格以 NVIDIA 官方产品页为准(2026-10 口径)[1];整机功耗与供电细目以整机厂(ODM/OEM)配置为准,本表未列=未实抓,不编。

GB200 NVL72Blackwell · 72 B200+36 Grace GB300 NVL72Blackwell Ultra · 72 B300(详见词条) NVL72 机柜世代对照(官方口径)

NVL72 家族两代对照TWO GENERATIONS

项目GB200 NVL72GB300 NVL72
GPU72× B200(Blackwell)72× B300(Blackwell Ultra)
单卡显存192GB HBM3E 级288GB HBM3E
网络ConnectX-7 代ConnectX-8 代(800G)
定位部署存量主力在售新柜主力
选型一句话存量捡值新购旗舰

GB300 列详见 GB300 NVL72 词条[1];两代机柜液冷架构同源(CDU 回路口径详见液冷 CDU 词条)。

家族成员FAMILY

GB 系机柜按世代与形态分档;GB200 NVL72 是 Blackwell 世代机柜,家族成员如下:

GB200 NVL72(72×B200+36 Grace · 本词条)GB200 NVL4(小型形态 · 4 GPU)GB300 NVL72(72×B300 · Blackwell Ultra 接棒)HGX B300 NVL16(16 卡基板形态 · 详见词条)

散热与部署COOLING

GB200 NVL72 是全液冷机柜:冷板贴遍 GPU/CPU/NVLink 交换芯片,机柜内二次回路经CDU(冷却液分配单元)与机房一次冷却水换热——液冷回路是部署的第一道门槛:一次侧供水温度/流量/水质、二次侧快接头与歧管、CDU 的 N+1 冗余,逐项按方案核(详见本库液冷 CDU 词条)。液冷改造成本与机房条件,是 NVL72 落地的真门槛——风冷机房直接上柜不可行。

供电与吊装是另外两道:整柜功率密度远超传统风冷机柜(按整机厂配置复核电力与母排),机柜重量与运输吊装要提前规划楼板承重与路径。软件侧 NVLink 域健康(NVLink 交换托盘+铜缆背板)是到货验收的重点——一根铜缆异常会伤及 72 卡互联域(本库整理口径)。

场景适配WORKLOAD FIT

负载GB200 NVL72 的表现口径萬安指数
万亿参 MoE 训练72-GPU 单域 + 全柜 13.4TB HBM3E,专家并行免跨柜95
大模型在线推理FP4 1.44 EF + NVLink 域内显存共享,批量并发吞吐旗舰93
视频/多模态生成FP4/FP8 推理管线吃满 NVLink 域带宽88
传统 FP64 HPC非 Blackwell 主场——双精度为主的负载看 Hopper 代或 CPU 集群70

负载档位为本库按公开规格的整理(推算口径,不构成性能承诺)。

NVIDIA GB200 NVL72 机柜官方图
NVIDIA GB200 NVL72 机柜 · 全景(官方图 · NVIDIA 官网)

实拍图随验货批次上架持续补充;AI 生成图不冒充实拍。

软件与生态ECOSYSTEM

项目要求 / 现状
基础软件NVIDIA AI Enterprise / Base Command 系(集群级调度与监控)
集合通信NCCL 对 NVLink 域自动感知,柜内全宽互联免配置
跨柜网络按 fabric 路线配 Quantum-2/X800(IB)或 Spectrum-X(以太网),配 ConnectX-7/8 网卡
存储GPUDirect Storage 直通(详见 NVMe 全闪存储词条)
运维液冷回路巡检 + NVLink 域健康检查是日常两大功课
整机厂Supermicro/Dell/Lenovo/浪潮等 NVL72 整柜方案(Supermicro 文档口径[2])

机柜级系统把「服务器运维」升级为「机房级运维」——液冷与 NVLink 域是两个新增的专项;软件随时间演进,以 NVIDIA 官方发布为准。

采购与验货PROCUREMENT

GB200 NVL72 采购的验货要点(三项):

1
液冷回路整链验收
CDU、歧管、快接头、冷板逐项清点与压力测试——任何一环渗漏在满载下都是事故;一次侧水质与温度条件先与机房对表(详见液冷 CDU 词条)。
2
NVLink 域健康全检
72-GPU 单域是命根:nvidia-smi nvlink 全端口状态、交换托盘固件、铜缆背板逐项检查——单缆异常伤全柜,验收必须整域跑通再签收。
3
托盘级资产核对
18 计算托盘+9 交换托盘+电源模块逐托盘清点序列号;拆柜流通的货要核对托盘成色与原柜配置一致性——混托组装的机器要在合同写明。

完整六项压测判例见本词条「如何压测」节。

如何压测BENCH TEST

六项压测口径,数值判例全部按 GB200 NVL72 实锚:开箱识别 → 液冷回路 → NVLink 域 → 算力基线 → 存储直通 → 长稳烤机。

1
开箱识别
托盘级清点:18 计算+9 交换托盘、序列号与随货清单对上;nvidia-smi 识别 72 颗 GPU 全部在位、Grace CPU 36 颗正常。
2
液冷回路
CDU 启动与一次侧换热正常、二次侧流量与温度达标、全柜快接头无渗漏(24 小时静置观察,判例框架口径)——液冷不过关一切免谈。
3
NVLink 域全检
nvidia-smi nvlink status 全端口 Active;跨托盘 GPU 对带宽抽测达 NVLink 5 标称档(≥85% 合格,推算口径)——单缆劣化整域降速,必须整域过一遍。
4
算力基线
FP4/FP8 档跑标准 benchmark 对照公开基线 ≥80%(判例框架口径);72 卡全柜联合跑,单卡掉队即复测定位。
5
存储直通
GPUDirect Storage 打通验证:NVMe-oF/并行文件系统到 GPU 显存的直通路径延迟与吞吐达标(详见 NVMe 全闪存储词条)。
6
长稳烤机
满柜满载持续 ≥4 小时(判例框架口径):液冷温度曲线平稳、错误计数器零增长、NVLink 域无降速——机柜级烤机是签收前最后一关。

运输与交付LOGISTICS

1
整柜运输与吊装
机柜级货物的运输是工程活:承重、路径、吊装设备提前规划;托盘级流通的货按精密设备防震标准包装。
2
跨境流通合规
GB200 NVL72 属顶级管制敏感机型(公开报道口径)——跨境流通的合规状态务必先与专业意见对表,本库表述不构成法律意见。
3
到货联合验收
封条、托盘、序列号三处核对与验货报告逐项对上;液冷与 NVLink 两专项按「如何压测」整链过完再签收。

OEM 与变体VENDORS

GB200 NVL72 以 NVIDIA 授权整机厂整柜交付为主:

整机厂代表方案差异点2026 年现状
SupermicroSuperCluster GB200 NVL72(官方文档口径[2])托盘配置与交付节奏整柜交付主力之一
DellPowerEdge 机柜级方案全球一线服务网络整柜交付
Lenovo/浪潮等NVL72 整柜方案区域交付与服务半径项目制流通
拆柜/拆盘流通计算托盘/交换托盘级混托组装风险,需逐盘验现货二级市场

整机厂信息来自各家官方发布[2];具体配置以厂商官方文档为准。

术语卡GLOSSARY

机柜级超级芯片

NVL(NVLink)命名的机柜级系统:把传统「多台服务器+交换机」的集群压缩进一个机柜,72 颗 GPU 经 NVLink 组成单域——编程视角就是一块巨卡,跨卡通信不再走网络协议栈。

Grace Blackwell 超级芯片

GB200 的计算单元:2 颗 B200 GPU 与 1 颗 Grace CPU(72 核 Armv9)经 NVLink-C2C 芯片间互连封装——CPU 与 GPU 内存一致性视角统一,是计算托盘的积木块。

NVLink 交换托盘

机柜内 9 台 NVLink 交换机托盘:把 72 颗 GPU 织成单域全互联——铜缆背板互连(柜内免光模块),是 NVL72 与传统 8 卡服务器最大的架构差异。

二次回路 / 一次回路

液冷两段式:二次回路(机柜内冷却液,贴冷板带 heat)经 CDU 与一次回路(机房冷却水/冷冻水)换热——CDU 是两回路的接口设备,NVL72 部署的核心配套。

拆柜与混托

机柜级设备的二级市场形态:整柜拆开按托盘流通。「混托组装」(不同来源托盘拼一柜)要重点验 NVLink 域完整性与托盘成色一致性——合同写明配置来源是自保底线。

局限与争议LIMITS

  • 液冷是硬门槛:风冷机房无法直接落地——一次侧水条件、CDU 冗余、快接头工艺,任何一环不过关都是满载事故(本库整理口径,详见液冷 CDU 词条)。
  • 整柜起售的资金与场地门槛:NVL72 的采购颗粒度是「柜」,预算、机房承重、电力改造、吊装全部前置——中小规模需求看 HGX 基板整机(B300 NVL16 词条)。
  • FP64 不是主场:Blackwell 架构重心在 FP4/FP8/BF16,传统双精度 HPC 用户选型要对照 FP64 口径掂量(公开架构口径)。
  • 二手流通尚在早期:机柜级设备的残值评估没有成熟标尺——液冷部件寿命、NVLink 铜缆状态、托盘混装历史都是变量,二手 NVL72 的验货成本要算进总价(本库验货经验口径)。
  • 管制敏感机型:GB200 NVL72 属出口管制的重点关注对象(公开报道口径)——跨境流通的合规状态务必先与专业意见对表,本库仅作政策演进提醒,不构成法律意见。

行情说明MARKET NOTE

GB200 NVL72 · 行情带暂未开通

GB200 NVL72 以整柜与拆柜两级流通,托盘构成、液冷配套与机房条件让单柜价格离散度极大——暂无可复核的统一行情快照,本库诚实原则:不做行情带,价格以货主实际报价为准。

在售检索:萬安算交所大厅 ›(0 佣金撮合、不参与交易,不掌握亦不推测成交价,数据因此中立)。行情快照积累充分后本节将切换为标准行情带。

常见问题FAQ

GB200 NVL72 和 GB300 NVL72 怎么选?

新购看预算与货期:GB300(B300 288GB/卡+CX-8 800G)是新柜旗舰;GB200 是部署存量最大的上代机柜,二级市场捡值空间看托盘成色与液冷配套。两代同液冷架构,机房条件复用度高。

买 NVL72 机房要改什么?

三件事:液冷(一次侧水条件+CDU 部署,风冷机房不可直接落地)、电力(整柜功率密度远超传统机柜,母排与变压器按整机配置复核)、承重与吊装路径。软件侧 NVLink 域与存储直通按本词条压测口径验收。

能只买计算托盘不买整柜吗?

二级市场存在托盘级流通(18 计算+9 交换托盘可拆),但 NVLink 域完整性依赖机柜级背板与交换托盘——单托盘脱离机柜没有 NVLink 域价值。混托组装必须整域压测后再签收。

NVL72 和 8 卡 HGX 整机(如 B300 NVL16)怎么选?

规模与预算分界:几十卡规模、风冷/混合机房——HGX 基板整机灵活;百卡以上、追求单域互联效率、机房具备液冷条件——NVL72。两者详见各自词条对照。

二手 GB200 NVL72 验货重点?

两专项+一资产:液冷回路整链(CDU/歧管/快接头/冷板压力测试)、NVLink 域全检(全端口 Active+跨托盘带宽)、托盘级资产核对(序列号与混托历史)。按本词条六项压测走完再签收。

机型对比与选型COMPARE

参考资料REFERENCES

  1. NVIDIA 官网 — GB200 NVL72 产品页(规格主档,2026-10 口径) https://www.nvidia.com/en-us/data-center/gb200-nvl72/
  2. Supermicro — SuperCluster GB200 NVL72 Datasheet(整机厂配置文档:托盘构成与互联口径) https://www.supermicro.com/datasheet/datasheet_SuperCluster_…
  3. HPE — GB200 NVL72 QuickSpecs(整机厂第二源) https://www.hpe.com/us/en/collaterals/collateral.a50009224en…
  4. TrendForce — AI 数据中心液冷渗透率公开报告(2025-08,液冷行业口径) https://www.trendforce.com/
  5. 在售检索 — 萬安算交所(0 佣金撮合;GB200 NVL72 暂无行情快照,价格以货主报价为准) https://www.aixx.vip/hall.html?model=GB200
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-10 · 版本 v1.0 · 历次改动均留痕可查。发现错误?欢迎通过勘误通道提交,核实后公开修正并记入版本史。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品