
GB200 超级芯片(Grace Blackwell Superchip)是 NVIDIA 的 CPU+GPU 封装组合:2 颗 Blackwell B200 GPU 与 1 颗 Grace CPU(72 核 Armv9)在主板级组成的最小算力单元——官方双列规格表的单颗粒度口径:NVFP4 40 PFLOPS(稀疏)/20(稠密)、372GB HBM3E(2×186GB)、16TB/s 显存带宽、Grace 侧 480GB LPDDR5X、芯片间 NVLink 3.6TB/s(NVIDIA 官方双列规格表与 Blackwell datasheet 口径[1])。
它与大名鼎鼎的 GB200 NVL72 机柜的关系要讲清楚:NVL72 机柜由 18 个计算托盘组成,每托含 2 颗 GB200 超级芯片(即 4 B200+2 Grace)——超级芯片是机柜的积木块(STH 托盘粒度实测口径[2])。单颗/托盘级流通存在于二级市场与 MGX(NVL4)整机形态,整柜交付则是主力(详见 GB200 NVL72 词条)。
2026 年的现货市场,GB200 超级芯片以托盘级与 MGX 整机形态流通为主:科研、云项目与拆机件并行。验收核心是 C2C 链路与显存口径(372/384GB 双口径如实并列)。本词条不带行情带——价格以货主实际报价为准。
萬安指数(0–100):按 CPU-GPU 协同场景加权(超级芯片特化口径)。
2024 年 3 月 18 日,GTC 发布 Blackwell 平台:GB200 超级芯片作为 Grace Blackwell 世代的封装单元与 GB200 NVL72 机柜同场亮相——2×B200+1×Grace 的组合定义了「超级芯片积木块」(GTC 发布与官方双列规格表口径[1])。
2024-2025 年,机柜级放量:GB200 NVL72 全球部署,超级芯片以计算托盘粒度随机柜交付——18 计算托盘×9 NVSwitch 托盘的机柜架构中,每托 2 颗超芯片(STH 托盘粒度实测口径[2])。
2025-2026 年,多形态分化:MGX(NVL4)整机形态与 DGX 交付并行——GB300 世代(Blackwell Ultra 超级芯片)接棒后,GB200 超级芯片转入存量与机柜配套流通(世代口径详见 GB300 词条)。跨境流通政策仍在演进,本库表述为公开报道口径、不构成法律意见。
| 项目 | 规格(GB200 超级芯片 · 官方双列规格表口径) |
|---|---|
| 构成 | 2× Blackwell B200 GPU + 1× Grace CPU(72 核 Armv9) |
| GPU 算力 | NVFP4 40 PFLOPS(稀疏)/ 20 PFLOPS(稠密) |
| 显存(双口径如实) | 372GB HBM3E / 16TB/s(现行口径)· 发布期口径 384GB / 2×192GB[1] |
| CPU 内存 | 480GB LPDDR5X ECC(Grace 侧) |
| 芯片间互连 | NVLink-C2C 3.6TB/s(芯片内一致性带宽) |
| PCIe | 最高 4× PCIe Gen5 x16(超级芯片粒度) |
| 机柜角色 | GB200 NVL72:18 计算托盘 ×(2 Grace + 4 B200 = 2 颗超芯片) |
| 显存双口径说明 | 现行 372GB(2×186GB)vs 发布期 384GB(2×192GB)——两份官方文档口径并列,合同按产品线写明 |
规格以 NVIDIA 官方双列规格表与 Blackwell datasheet 为准(2026-10 实抓快照[1]);快存 30.5/30.2TB 两份官方文档小差均如实并列。
| 颗粒度 | 形态 | 详见 |
|---|---|---|
| 单颗超芯片 | 2×B200 + 1×Grace 封装 | 本词条 |
| 计算托盘 | 2 颗超芯片/托(4 B200 + 2 Grace) | GB200 NVL72 词条 |
| NVL4 MGX | 4 GPU MGX 服务器形态 | 本词条「交付形态」节 |
| NVL72 机柜 | 18 托盘 + 9 NVSwitch 整柜 | GB200 NVL72 词条 |
超级芯片家族按世代分档;GB200 是 Blackwell 代封装单元:
GB200 超级芯片的散热随形态:计算托盘(NVL72 机柜内)为液冷冷板直触(机柜 CDU 回路,同 GB200 词条);NVL4 MGX 整机为机架级风冷/液冷双兼容。部署三对表:C2C 链路健康(超芯片命根)、Grace 侧 Arm 软件栈盘点(同 Grace 词条)、功耗配置档核算(同 GB200 词条口径)。
二级市场的托盘级流通:单托(2 颗超芯片)脱离机柜后可作为 NVL4/MGX 形态的算力源——但 C2C 与 NVSwitch 的配套完整性决定它能否发挥设计性能(本库整理口径)。
| 负载 | GB200 超级芯片的口径 | 萬安指数 |
|---|---|---|
| 训练数据管线 | Grace 侧预处理 + C2C 直喂 GPU——数据管道不再是瓶颈 | 85 |
| 向量检索 / RAG | 480GB LPDDR5X 一致性池——向量热数据层 | 85 |
| FP4 推理节点 | NVFP4 40 PFLOPS(稀疏)——Blackwell 主打精度的推理吞吐 | 86 |
| 通用 x86 平移 | Arm 生态盘点先行(同 Grace 词条口径) | 40 |

| 项目 | 要求 / 现状 |
|---|---|
| CUDA | Blackwell 代(计算能力 10.x 级)——CUDA 12.8+ 支持(公开口径) |
| 一致性内存 | NVLink-C2C 的统一内存编程模式——同 Grace 词条口径 |
| Arm 栈 | 主流 Linux Arm 版 + NVIDIA 全栈原生支持 |
| 盘点提醒 | 企业自研工具 Arm 版逐个确认(同 Grace 词条口径) |
GB200 超级芯片(托盘/单颗)采购的验收要点(三项):
GB200 超级芯片四步速查:
CPU+GPU 封装组合的产品形态:GB200=2×B200+1×Grace——封装内 C2C 互连让「跨设备拷贝」变成「一致性内存访问」(同 Grace 词条口径)。
NVL72 机柜的积木块:每托 2 颗 GB200 超级芯片(4 B200 + 2 Grace)——18 托盘组成机柜的 72-GPU 域;托盘级流通是二级市场的主要颗粒度。
4 GPU 的 MGX 服务器形态:GB200 超级芯片的小颗粒整机落地——比 NVL72 机柜门槛低一档的 Blackwell 部署选项。
GB200 显存的两个官方口径:现行 372GB(2×186GB)与发布期 384GB(2×192GB)——两份官方文档并存,采购合同写明口径与产品线。
GB200 超级芯片以托盘级与 MGX 整机流通,显存口径与配套完整性让价差大——本库诚实原则:不做行情带,价格以货主实际报价为准(机柜级随 GB200 NVL72 词条口径)。
在售检索:萬安算交所大厅 ›(0 佣金撮合、数据因此中立)。
积木块与成品的关系:超级芯片(2 B200+1 Grace)是 NVL72 机柜的封装单元——18 颗超芯片+9 NVSwitch 托盘组成一台 NVL72。单颗/托盘流通时脱离机柜配套,NVLink 域价值要重新评估。
规模与工程分界:托盘/单颗级适合有自建能力的团队与 MGX 形态;整柜适合 AI 工厂级一步到位。中间档看 NVL4 MGX 整机。
两个官方口径并存:现行 372GB(2×186GB)与发布期 384GB(2×192GB)——合同写明口径与产品线,到货实测核对。
四步:双识别(Grace 72 核+2×B200)→ C2C 带宽抽查 → NVFP4 基准(≥80% 合格,推算口径)→ 按功耗档烤机。Arm 软件栈盘点前置。