| 规格 | NVIDIA B200 (Blackwell 数据中心版, SXM单卡/OAM模组口径) | NVIDIA H20 |
|---|
| 架构 | NVIDIA Blackwell(GB100双die单封装:TSMC 4NP定制工艺,2080亿晶体管,双die经10TB/s NV-HBI片间互联合为单一GPU,官方新闻稿直证;CoWoS-L 2.5D封装为旁证Wikipedia口径) | NVIDIA Hopper(H100同架构合规裁剪版;VipraTech与腾讯新闻双源实抓) |
| 显存 | 三口径如实并存——发布口径192GB HBM3e(旁证Wikipedia产品行'B200 SXM 192GB'+厚词条datasheet口径);HGX B200现行版180GB(官方DGX页'1,440 GB total'÷8直推+Lenovo LP2226标题+Supermicro直证);GB200版186GB(官方GB200 NVL72页超级芯片'372GB'÷2直推)——采购合同按产品线(HGX/GB200)写明口径 | 96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致) |
| 显存类型 | HBM3e | — |
| 显存位宽 | 8192bit(旁证Wikipedia数据中心表) | — |
| 显存带宽 | 8TB/s(官方口径:GB200超级芯片16TB/s÷2直推+DGX B200页'64 TB/s'÷8直推,GB200版为官方直证);OEM现行规格档7.7TB/s(Lenovo LP2226)——8TB/s与7.7TB/s两口径并存,主值取官方8TB/s | 4.0TB/s(三源一致;显存位宽6144bit仅第三方数据库搜索摘要提及,未实抓双源,不录) |
| 算力 | 单卡口径:FP4 TC 18 PFLOPS稀疏/9稠密(HGX B200 8卡板级144|72官方直证÷8);FP8/FP6 TC 9稀疏/4.5稠密(板级72稀疏官方直证,官方脚注Dense=½Sparse);FP16/BF16 TC 4.5稀疏/2.25稠密(Lenovo OEM单卡直证,板级36);TF32 TC 2.25稀疏(板级18);INT8 TC 9 POPS稀疏(板级72);FP32 75 TFLOPS(板级600);FP64/FP64 Tensor Core 37 TFLOPS(板级296,现行官方口径);除FP4与FP16有OEM单卡直证外,单卡数均为官方板级数÷8推导,稀疏口径Dense减半 | FP8 Tensor Core 296 TFLOPS(密集)/592 TFLOPS(2:4稀疏,单源);FP16/BF16 Tensor Core 148 TFLOPS(密集,单源;稀疏口径未双源实抓);TF32 Tensor Core 74 TFLOPS;FP32 44 TFLOPS;FP64 1.0 TFLOPS(合规裁剪:H100 SXM同表FP8 3958/FP16 1979/FP64 34);INT8 296 TOPS/592 TOPS(单源) |
| 功耗 | 单卡最高1000W(官方DGX B200用户指南直证:nvidia-smi单卡功耗上限5PSU供电档1,000W,4-3PSU档800W;Lenovo标1000W TGP,Supermicro按8x1000W设计);GB200机柜版另有1200W可配置上限口径(厚词条/GB200 datasheet口径记录,本次NVL72官方页未见wattage) | 400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃) |
| 互联 | NVLink第5代 1.8TB/s双向/卡(官方新闻稿直证'1.8TB/s bidirectional throughput per GPU');HGX B200 8卡全互联NVLink合计14.4TB/s(官方页直证);PCIe Gen5(HGX/DGX整机口径;Wikipedia数据中心列标PCIe 6.0,存疑见裁决) | NVLink 900GB/s(VipraTech+腾讯新闻双源;第几代NVLink无实抓双源,不录代数)+PCIe Gen5 x16 128GB/s(VipraTech实抓,BurnCloud旁证Gen5) |
| 发布年 | 2024(2024-03-18 GTC发布,官方新闻稿直证;官方称2024年内合作伙伴出货;Wikipedia记载2024Q4上市/产品化2024-12;2025年放量量产爬坡为厚词条财报口径旁证级) | 2024(Flopper实抓Launch Year 2024;腾讯新闻2023-11-10首发报道'即将推出';具体发布日未实抓双源,不录) |
| SM与CUDA核 | 18,432 FP32 CUDA核/576 Tensor Core(旁证Wikipedia数据中心表;按Blackwell每SM 128核折算约144 SM——推导值,官方未单列) | — |
| L2缓存 | 存疑不采信:Wikipedia数据中心表标60MB(疑单die口径),业界常引双die合计126MB(TechPowerUp系),官方未单列——如实记录冲突,本卡不定值 | 60MB(单源VipraTech) |
| 机密计算 | 支持(官方GTC 2024新闻稿直证'Advanced confidential computing capabilities protect AI models and customer data';另载RAS专用引擎) | — |
| 编解码器 | 未收录(现行官方页与新闻稿均未见B200编解码器数量条目,宁缺勿编) | 7 NVDEC + 7 NVJPEG(单源VipraTech) |
| MIG切片 | 未收录(本次实抓信源未见B200 MIG实例数官方条目,宁缺勿编) | 最多7实例(VipraTech+腾讯新闻'7路MIG'双源) |
| 形态 | SXM模组(SXM6封装为旁证Wikipedia口径;部署形态:HGX B200 8卡基板风冷/液冷整机·DGX B200 10RU整机~14.3kW·GB200超级芯片机柜;OAM模组为国内整机厂常用形态口径) | HGX 8路SXM基板模组(Flopper'SXM'/VipraTech'8-way HGX'/腾讯新闻'HGX方案8路GPU配置+H20 SXM';同批L20/L2为PCIe形态) |
| CUDA核心 | — | 14,592 FP32 CUDA核心(单源VipraTech) |
| 出口合规背景 | — | 2022-10美国出口管制后对华合规特供卡:算力密度较H100大幅裁剪(FP8约为H100 SXM的7.5%),以显存96GB+NVLink900GB/s保推理场景(QQ:综合算力约H100的20%) |