算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA GH200 vs NVIDIA GB300

规格NVIDIA GH200NVIDIA GB300
架构GH200 Grace Hopper超级芯片=NVIDIA第一代CPU+GPU单封装超级芯片:1颗Grace CPU+1颗Hopper GPU经NVLink-C2C一致性互联合封(datasheet直证'the groundbreaking performance of the NVIDIA Hopper GPU with the versatility of the NVIDIA Grace CPU in a single superchip');GPU本体datasheet文字口径为'Hopper H100 GPU'(第九代数据中心GPU,第四代Tensor Core+Transformer Engine+MIG),现行官方页营销口径称'H200 GPU'——同一颗Hopper GPU两代官方命名,如实并记;风冷/液冷双形态(datasheet直证)NVIDIA Blackwell Ultra(GB300超级芯片=1 Grace CPU+2 Blackwell Ultra GPU,官方开发者博客直证'couples one Grace CPU with two Blackwell Ultra GPUs';每颗Blackwell Ultra GPU为TSMC 4NP工艺/2080亿晶体管/双die合体2.5D封装,开发者博客直证'TSMC 4NP and features 208B transistors'+'Dies per GPU: 2';机柜=36颗超级芯片即72 GPU+36 CPU,官方页直证)
显存96GB HBM3 或 144GB HBM3e(两代配置,4TB/s / 4.9TB/s)288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存)
显存类型HBM3(一代)/HBM3e(二代,全球首款HBM3e处理器)+LPDDR5X ECC(CPU侧),datasheet直证HBM3e(GPU侧)+LPDDR5X(Grace CPU侧),官方页直证
显存位宽未收录(GH200 datasheet/白皮书/现行官方页均未单列GPU显存位宽,宁缺勿编)未收录(官方现行页/博客/新闻稿均未单列Blackwell Ultra显存位宽,宁缺勿编)
显存带宽96GB HBM3版 Up to 4TB/s;144GB HBM3e版 Up to 4.9TB/s(datasheet全表直证;白皮书补充HBM3e'1.5X more bandwidth than an H100 80GB SXM';NVL2双芯片10TB/s=9.8TBs四舍五入,官方页口径)8TB/s每GPU(官方开发者博客直证'8 TB/s per GPU';机柜'Up to 576 TB/s'÷72=8TB/s互证);超级芯片双GPU合计16TB/s(推导)
算力单超级芯片口径(datasheet全表直证,*为With sparsity稀疏档):FP8 Tensor Core 3,958 TFLOPS*|1,979 TFLOPS稠密(官方页'4 petaFLOPS'即FP8稀疏档四舍五入);FP16 TC 1,979*|990;BF16 TC 1,979*|990;TF32 TC 989*|494;INT8 TC 3,958*|1,979 TOPS;FP64 34 TFLOPS/FP64 Tensor Core 67 TFLOPS/FP32 67 TFLOPS(HPC双修阵地);NVL2双芯片列:FP8 7,916*|3,958/FP64 68/FP64 TC 134(datasheet直证);DGX GH200系统级1 EFLOPS口径见厚词条单超级芯片口径(主值):FP4(NVFP4) TC 40 PFLOPS稀疏|30 PFLOPS稠密(官方开发者博客直证'up to 30 PFLOPS dense, and 40 PFLOPS sparse';与机柜1440|1080÷36完全互证)。单GPU口径:FP4 20稀疏|15稠密(机柜÷72;博客稠密15直证'Ultra pushes that to 15 petaFLOPS');FP8/FP6 TC 10稀疏|5稠密(博客直证'5 | 10 PetaFLOPS'+机柜720÷72互证);INT8 TC约333 TOPS稀疏(机柜24 POPS÷72;HGX板级3 POPS÷8=375,对B200单卡9000 TOPS为代际性大砍);FP16/BF16 TC 5稀疏|2.5稠密(机柜360÷72;HGX板级36÷8=4.5);TF32 TC 2.5稀疏(机柜180÷72;HGX 18÷8=2.25);FP32约83 TFLOPS(机柜6 PFLOPS÷72;HGX 600÷8=75);FP64/FP64 TC约1.39 TFLOPS(机柜100 TFLOPS÷72;HGX 10÷8=1.25,对B200单卡37为~30倍砍——Ultra把算力让位给FP4稠密)。HGX B300板级8卡口径:FP4 144|108·FP8 72·INT8 3 POPS·FP16 36·TF32 18·FP32 600 TFLOPS·FP64 10 TFLOPS(官方页直证;低功耗SKU,不与超级芯片混写)
功耗可配置 450-1000W(Memory+CPU+GPU 合计)TGP 最高 1400W(单GPU,官方博客直证)
互联NVLink-C2C 900GB/s总带宽=450GB/s每方向(datasheet'900GB/s'+白皮书Table 1'900GB/s total, 450GB/s per direction'直证;官方页'7X faster than PCIe Gen5';Jülich独立直证450GB/s每方向互证);对PCIe Gen5带宽7x/功耗降5x口径见官方新闻稿与厚词条;PCIe扩展:最高4x PCIe x16 Gen5(64 lanes,datasheet直证);NVL2双芯片C2C 1800GB/sNVLink第5代 1.8TB/s双向每GPU(官方开发者博客直证'1.8 TB/s bidirectional (18 links x 100 GB/s)'+HGX B300列'GPU-to-GPU 1.8 TB/s'直证;机柜130TB/s÷72≈1.81互证);超级芯片内2 GPU经NVLink+NVLink域延伸至机柜72 GPU全互联(130TB/s aggregate官方页直证);网络:ConnectX-8 SuperNIC每GPU 800Gb/s(官方页直证,Quantum-X800 IB或Spectrum-X以太)
发布年2022(2022-03-22 GTC官方新闻稿首发'Grace Hopper Superchip——an integrated module designed to serve giant-scale HPC and AI applications'直证);节奏:2023-05-28全面投产(官方稿,检索引文级)→2023-08-08 HBM3e版宣布(系统Q2 CY2024交付,官方稿直证)→2024-05-12 ISC 9台新超算/合计200 exaflops(官方稿直证)→现行官方页'GH200 is currently available'2025(2025-03-18 GTC发布,官方新闻稿直证;'second half of 2025'出货车官方原文直证;官方HGX页脚注与机柜页'Available Now'证实现货世代)
CPU部分Grace CPU:72核Arm Neoverse V2(datasheet直证);基频3.1GHz|全核SIMD 3.0GHz;L1 64KB i-cache+64KB d-cache/L2 1MB每核/L3 114MB(datasheet直证);LPDDR5X ECC最高480GB(另有120GB/240GB档,datasheet直证;JEDI/JUPITER实配120GB档,Jülich直证);CPU内存带宽datasheet表两档Up to 384GB/s|Up to 512GB/s并列,白皮书文字口径'up to 500GB/s'(档位映射官方未逐一标注,Jülich 120GB档标500GB/s)Grace CPU每超级芯片1颗,72个Arm Neoverse V2核(机柜官方页'2,592 Arm Neoverse V2 cores'÷36颗直推,官方未单列单颗原文);CPU内存LPDDR5X每颗约480GB(机柜17TB÷36=472GB推导),带宽14TB/s(机柜官方页直证);GPU+CPU合计约1TB统一内存(开发者博客直证表述)
SM与CUDA核未收录(GH200 datasheet MAR25版/39页架构白皮书/现行官方页均未单列GPU SM数与CUDA核数,宁缺勿编;GPU为Hopper H100/H200同代die,按H100 SXM对表132SM/16896核仅为旁推,不作为本卡数值)单Blackwell Ultra GPU:160 SM/640个第五代Tensor Core(官方开发者博客直证'160 Streaming Multiprocessors (SMs) across two dies, providing 640 fifth-generation Tensor Cores');CUDA核20,480个(160 SMx每SM 128核,博客两要素直证,乘积为推导;对初代Blackwell 160 vs 144 SM为+11%)
快存合计最高624GB(datasheet Key Features'Up to 624GB of fast-access memory'+官方页'up to 624GB of combined CPU and GPU fast memory'双直证;=480GB LPDDR5X+144GB HBM3e,datasheet配置直证;HBM3版为480+96=576GB,lambda等云上配置口径,推导注记);NVL2双芯片1.2TB(datasheet/官方页直证)—
机密计算未收录(本次实抓datasheet/白皮书/官方页未见GH200保密计算条目,宁缺勿编)未收录(本次实抓信源未及Blackwell Ultra保密计算条目,宁缺勿编;Blackwell代际支持保密计算为B200卡已证,供厚词条另核)
编解码器未收录(官方现行信源未见GH200编解码器数量条目,宁缺勿编)未收录(官方页/博客/新闻稿均未见GB300编解码器数量条目,宁缺勿编)
MIG切片支持MIG(datasheet直证'Secure Multi-Instance GPU (MIG) partitions the GPU into isolated, right-size instances');实例数官方未单列,宁缺勿编未收录(本次实抓信源未见GB300 MIG实例数官方条目,宁缺勿编)
形态单超级芯片模组(风冷/液冷,可上标准服务器,datasheet直证'GH200 can be easily deployed in standard servers');系统级形态:GH200 NVL2(2x超级芯片NVLink互联,datasheet全列直证)/DGX GH200(256x GH200 NVLink Switch System,厚词条已录)/MGX服务器变体超100种(2023-08-08官方稿直证)/JUPITER Booster 4芯片节点x5884(Jülich直证)超级芯片(GB300 Grace Blackwell Ultra Superchip)——部署形态:GB300 NVL72机柜36颗超级芯片全液冷单机柜(官方页'fully liquid-cooled, rack-scale'直证,即库里1.1-1.3亿锚点那台的最小计算单元)/HGX B300 NVL16 8卡板级(风冷或液冷,OEM整机厂出货形态)/DGX B300 8卡整机14.5kW;另有GB300桌面超级芯片变体(单Grace+单Blackwell Ultra,DGX Station口径,仅注记不混入本卡)
战绩Green500能效榜首JEDI(JUPITER开发机,TOP500口径,厚词条已录);ISC 2024全球9台新超算采用GH200合计200 exaflops能效AI算力(官方稿直证);JUPITER主体5884节点x4颗=23,536颗GH200,1 ExaFLOP/s FP64 HPL+大于70 ExaFLOP/s 8-bit稀疏(Jülich官方技术页直证)—
L2缓存—未收录(官方现行信源未单列Blackwell Ultra L2容量,宁缺勿编)
← NVIDIA GH200 身份卡 · NVIDIA GB300 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品