算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA GB300

Blackwell Ultra单超级芯片——1颗72核Grace+2颗Blackwell Ultra双die GPU(288GB HBM3e/8TBs每GPU),超级芯片口径FP4稠密30 PFLOPS+约1TB统一内存,是GB300 NVL72机柜(K哥锚点1.1-1.3亿那台)的最小计算单元,也是HGX B300 8卡机的芯片本体;对B200代:稠密FP4 1.5x/显存+50%/功耗1200→1400W,代价是INT8与FP64大幅缩水(纯推理工厂取向);2025下半年出货、2026年进入现货流通的Ultra世代,二手/现货询价按超级芯片口径对齐本卡|口径:单超级芯片=1 Grace CPU+2 Blackwell Ultra GPU封装,区别于 GB300 NVL72 整机柜与 HGX B300 8卡板级

概述

GB300是NVIDIA基于Blackwell Ultra架构的超级芯片,由1颗Grace CPU与2颗Blackwell Ultra GPU封装组成,每颗GPU集成160个SM、640个第五代Tensor Core,采用台积电4NP工艺、2080亿晶体管规模,配备288GB HBM3e显存,超级芯片合计576GB,并可通过LPDDR5X组成约1TB统一内存。在NVFP4精度下,单超级芯片稠密算力达30 PFLOPS、稀疏40 PFLOPS,单GPU TGP最高1400W。它是GB300 NVL72整机柜与HGX B300八卡板级系统的芯片本体,定位于大规模AI推理为主的算力基础设施。

核心规格

架构NVIDIA Blackwell Ultra(GB300超级芯片=1 Grace CPU+2 Blackwell Ultra GPU,官方开发者博客直证'couples one Grace CPU with two Blackwell Ultra GPUs';每颗Blackwell Ultra GPU为TSMC 4NP工艺/2080亿晶体管/双die合体2.5D封装,开发者博客直证'TSMC 4NP and features 208B transistors'+'Dies per GPU: 2';机柜=36颗超级芯片即72 GPU+36 CPU,官方页直证)
显存288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存)
显存类型HBM3e(GPU侧)+LPDDR5X(Grace CPU侧),官方页直证
显存位宽未收录(官方现行页/博客/新闻稿均未单列Blackwell Ultra显存位宽,宁缺勿编)
显存带宽8TB/s每GPU(官方开发者博客直证'8 TB/s per GPU';机柜'Up to 576 TB/s'÷72=8TB/s互证);超级芯片双GPU合计16TB/s(推导)
算力单超级芯片口径(主值):FP4(NVFP4) TC 40 PFLOPS稀疏|30 PFLOPS稠密(官方开发者博客直证'up to 30 PFLOPS dense, and 40 PFLOPS sparse';与机柜1440|1080÷36完全互证)。单GPU口径:FP4 20稀疏|15稠密(机柜÷72;博客稠密15直证'Ultra pushes that to 15 petaFLOPS');FP8/FP6 TC 10稀疏|5稠密(博客直证'5 | 10 PetaFLOPS'+机柜720÷72互证);INT8 TC约333 TOPS稀疏(机柜24 POPS÷72;HGX板级3 POPS÷8=375,对B200单卡9000 TOPS为代际性大砍);FP16/BF16 TC 5稀疏|2.5稠密(机柜360÷72;HGX板级36÷8=4.5);TF32 TC 2.5稀疏(机柜180÷72;HGX 18÷8=2.25);FP32约83 TFLOPS(机柜6 PFLOPS÷72;HGX 600÷8=75);FP64/FP64 TC约1.39 TFLOPS(机柜100 TFLOPS÷72;HGX 10÷8=1.25,对B200单卡37为~30倍砍——Ultra把算力让位给FP4稠密)。HGX B300板级8卡口径:FP4 144|108·FP8 72·INT8 3 POPS·FP16 36·TF32 18·FP32 600 TFLOPS·FP64 10 TFLOPS(官方页直证;低功耗SKU,不与超级芯片混写)
功耗TGP 最高 1400W(单GPU,官方博客直证)
互联NVLink第5代 1.8TB/s双向每GPU(官方开发者博客直证'1.8 TB/s bidirectional (18 links x 100 GB/s)'+HGX B300列'GPU-to-GPU 1.8 TB/s'直证;机柜130TB/s÷72≈1.81互证);超级芯片内2 GPU经NVLink+NVLink域延伸至机柜72 GPU全互联(130TB/s aggregate官方页直证);网络:ConnectX-8 SuperNIC每GPU 800Gb/s(官方页直证,Quantum-X800 IB或Spectrum-X以太)
发布年2025(2025-03-18 GTC发布,官方新闻稿直证;'second half of 2025'出货车官方原文直证;官方HGX页脚注与机柜页'Available Now'证实现货世代)
CPU部分Grace CPU每超级芯片1颗,72个Arm Neoverse V2核(机柜官方页'2,592 Arm Neoverse V2 cores'÷36颗直推,官方未单列单颗原文);CPU内存LPDDR5X每颗约480GB(机柜17TB÷36=472GB推导),带宽14TB/s(机柜官方页直证);GPU+CPU合计约1TB统一内存(开发者博客直证表述)
SM与CUDA核单Blackwell Ultra GPU:160 SM/640个第五代Tensor Core(官方开发者博客直证'160 Streaming Multiprocessors (SMs) across two dies, providing 640 fifth-generation Tensor Cores');CUDA核20,480个(160 SMx每SM 128核,博客两要素直证,乘积为推导;对初代Blackwell 160 vs 144 SM为+11%)
L2缓存未收录(官方现行信源未单列Blackwell Ultra L2容量,宁缺勿编)
机密计算未收录(本次实抓信源未及Blackwell Ultra保密计算条目,宁缺勿编;Blackwell代际支持保密计算为B200卡已证,供厚词条另核)
编解码器未收录(官方页/博客/新闻稿均未见GB300编解码器数量条目,宁缺勿编)
MIG切片未收录(本次实抓信源未见GB300 MIG实例数官方条目,宁缺勿编)
形态超级芯片(GB300 Grace Blackwell Ultra Superchip)——部署形态:GB300 NVL72机柜36颗超级芯片全液冷单机柜(官方页'fully liquid-cooled, rack-scale'直证,即库里1.1-1.3亿锚点那台的最小计算单元)/HGX B300 NVL16 8卡板级(风冷或液冷,OEM整机厂出货形态)/DGX B300 8卡整机14.5kW;另有GB300桌面超级芯片变体(单Grace+单Blackwell Ultra,DGX Station口径,仅注记不混入本卡)
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA T4 对比16GB GDDR6 with ECC (默认开启)70W (Total board power, 默认)
NVIDIA A100 对比40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECCSXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA GeForce RTX 4090 对比24GB GDDR6X450W TGP (平均游戏315W, 建议系统电源850W)
NVIDIA RTX PRO 6000 Blackwell 对比96GB GDDR7 with ECC (单卡最大显存的专业工作站 GPU)600W Total board power (官方), 供电 1x PCIe CEM5 16-pin, 双贯穿式散热(Double-flow-through)
NVIDIA B200 (Blackwell 数据中心版, SXM单卡/OAM模组口径) 对比三口径如实并存——发布口径192GB HBM3e(旁证Wikipedia产品行'B200 SXM 192GB'+厚词条datasheet口径);HGX B200现行版180GB(官方DGX页'1,440 GB total'÷8直推+Lenovo LP2226标题+Supermicro直证);GB200版186GB(官方GB200 NVL72页超级芯片'372GB'÷2直推)——采购合同按产品线(HGX/GB200)写明口径单卡最高1000W(官方DGX B200用户指南直证:nvidia-smi单卡功耗上限5PSU供电档1,000W,4-3PSU档800W;Lenovo标1000W TGP,Supermicro按8x1000W设计);GB200机柜版另有1200W可配置上限口径(厚词条/GB200 datasheet口径记录,本次NVL72官方页未见wattage)

视频讲解 VIDEO

深度阅读:GB300 NVL72 机柜词条 · 厚词条GB200 超级芯片词条 · 厚词条

采购与验货要点

常见问题

GB300超级芯片和GB300 NVL72是什么关系?买整机还是买芯片?
GB300超级芯片是最小计算单元,由1颗Grace CPU与2颗Blackwell Ultra GPU封装组成;GB300 NVL72整机柜包含72颗GPU与36颗Grace CPU,即36颗超级芯片通过NVLink互联协同工作。HGX B300则是8颗Blackwell Ultra GPU的板级模块,属于较低功耗档的SKU。终端用户通常采购整机或板级服务器,超级芯片本体一般不单独流通,询价时务必先对齐口径。
GB300相比B200,显存和算力提升多少?有什么代价?
按官方口径,Blackwell Ultra将NVFP4稠密算力从此前的10 PFLOPS(单GPU)提升到15 PFLOPS,显存容量提升至288GB,较H100有数倍增长,单GPU TGP上限也从1200W提高到1400W。代价是Tensor Core面积向FP4倾斜,INT8与FP64算力较上一代大幅缩水,板级口径下降幅达数十倍,因此这一代明显偏向纯推理与低精度负载。
GB300适合跑FP64科学计算或INT8推理吗?
不适合作为主力。官方规格显示HGX B300板级INT8仅3 POPS、FP64仅10 TFLOPS,相对上一代HGX B200(INT8 72 POPS、FP64 296 TFLOPS)是数量级的缩减。如果业务以传统双精度HPC仿真或INT8量化推理为核心,建议评估上一代产品或CPU/GPU混合方案;GB300的价值集中在FP4/FP8低精度的大规模推理场景。
信源
采集 2026-10-10 · 侦察 C-侦察兵-GB300-1010夜 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品