算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA B300 (Blackwell Ultra GPU) vs NVIDIA H20

规格NVIDIA B300 (Blackwell Ultra GPU)NVIDIA H20
架构NVIDIA Blackwell Ultra(Blackwell架构Ultra代,纯GPU本体不含Grace CPU)——单颗B300为TSMC 4NP工艺/2080亿晶体管/双die合体单GPU(官方博客直证'TSMC 4NP and features 208B transistors'+'Dies per GPU: 2');每GPU最高160个SM组织为8个GPC,640个第五代Tensor Core(博客直证);注意力引擎10.7 TeraExponentials/s,官方称对Blackwell'2x higher attention performance'(博客Table 2+NVL72页直证)NVIDIA Hopper(H100同架构合规裁剪版;VipraTech与腾讯新闻双源实抓)
显存单封装288GB HBM3e(主值:官方博客Table 2'288 GB HBM3E'直证+DGX B300用户指南'8 x 288 GB = 2.3 TB total'直证);对B200两基准并存——对发布口径192GB为1.5x(博客Table 2并列'192 GB|288 GB'+NVL72页'1.5x larger HBM3E'直证),对HGX现行180GB为1.6x(Lenovo引文'288 GB...compared with 180 GB on the B200');HGX B300板级合计2.1TB(官方页直证,较DGX 2.3TB保守0.2TB);可用容量口径279GB(datasheet检索片段)/268GB(SemiAnalysis检索)旁证级注记96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致)
显存类型HBM3e(12-Hi堆栈;官方博客9/24/25修正注记'proper 12 HBM stacks instead of 8'——正文残留'Eight 12-Hi stacks'为已知不一致,按288GB=12x24GB/栈取修正后12栈)—
显存位宽8,192bit(官方博客HBM配置原文'16 × 512-bit controllers (8,192-bit total width)'直证)—
显存带宽8TB/s每GPU(官方博客直证'8 TB/s per GPU, 2.4x improvement over H100';机柜576TB/s÷72=8TB/s互证)4.0TB/s(三源一致;显存位宽6144bit仅第三方数据库搜索摘要提及,未实抓双源,不录)
算力单GPU满血档口径(主值):FP4(NVFP4) TC 20 PFLOPS稀疏|15 PFLOPS稠密(官方博客Table 2'15 | 20 PetaFLOPS'直证+机柜1440|1080÷72互证;稠密对Blackwell 10为1.5x,稀疏20持平);FP8/FP6 TC 10稀疏|5稠密(博客'5 | 10 PetaFLOPS'直证);INT8 TC约375 TOPS稀疏(HGX板级3 POPS÷8,对B200单卡9000 TOPS为24倍代际砍);FP16/BF16 TC 4.5稀疏|2.25稠密(HGX 36÷8);TF32 TC 2.25稀疏(HGX 18÷8);FP32 75 TFLOPS(HGX 600÷8);FP64/FP64 TC 1.25 TFLOPS(HGX 10÷8,对B200 37为~30倍砍——Ultra把Tensor Core面积让位给FP4稠密)。HGX B300板级低功耗档每GPU:FP4 18|13.5(144|108÷8官方直证),不与满血档混写FP8 Tensor Core 296 TFLOPS(密集)/592 TFLOPS(2:4稀疏,单源);FP16/BF16 Tensor Core 148 TFLOPS(密集,单源;稀疏口径未双源实抓);TF32 Tensor Core 74 TFLOPS;FP32 44 TFLOPS;FP64 1.0 TFLOPS(合规裁剪:H100 SXM同表FP8 3958/FP16 1979/FP64 34);INT8 296 TOPS/592 TOPS(单源)
功耗TGP最高1400W(官方博客Table 2直证'Max power (TGP): Up to 1,400W',对Blackwell 1200W/Hopper 700W);HGX B300为低功耗板级SKU另有约1100W部署档(IntuitionLabs/Lenovo SR680a V4检索引文级,非官方单卡直证,仅注记);DGX B300 8卡整机14.5kW(官方指南直证)400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃)
互联NVLink第5代 1.8TB/s双向每GPU(官方博客直证'1.8 TB/s bidirectional (18 links x 100 GB/s)'+HGX页'GPU-to-GPU 1.8 TB/s'直证);HGX B300 8卡全互联合计14.4TB/s(官方页直证),双板桥接成NVL16域;PCIe Gen6 x16双向256GB/s(博客Table 1'256 (Gen 6)'直证,对Hopper Gen5 128GB/s翻倍);网络面HGX B300配1.6TB/s(官方页直证),DGX B300配ConnectX-8每GPU 800Gb/sNVLink 900GB/s(VipraTech+腾讯新闻双源;第几代NVLink无实抓双源,不录代数)+PCIe Gen5 x16 128GB/s(VipraTech实抓,BurnCloud旁证Gen5)
发布年2025(2025-03-18 GTC发布,官方新闻稿直证;'expected to be available from partners starting from the second half of 2025'出货车官方原文直证;官方HGX页脚注'shipping now'+NVL72页'Available Now'证实现货世代)2024(Flopper实抓Launch Year 2024;腾讯新闻2023-11-10首发报道'即将推出';具体发布日未实抓双源,不录)
SM与CUDA核最高160 SM/640个第五代Tensor Core(官方博客直证'160 Streaming Multiprocessors (SMs) across two dies, providing 640 fifth-generation Tensor Cores',脚注'up to 160 SMs');每SM 128 CUDA核+4 Tensor Core+256KB TMEM(博客直证);CUDA核合计20,480个(160x128乘积为推导);SM数对初代Blackwell 144为+11%,对Hopper 132为+21%—
L2缓存未收录(官方博客/页/新闻稿均未单列B300 L2容量,宁缺勿编)60MB(单源VipraTech)
机密计算未收录(本次实抓B300信源未及保密计算条目,宁缺勿编;Blackwell代际保密计算已在B200卡GTC 2024新闻稿直证,供厚词条另核)—
编解码器未收录(官方现行信源未见B300编解码器数量条目,宁缺勿编)7 NVDEC + 7 NVJPEG(单源VipraTech)
MIG切片未收录(本次实抓信源未见B300 MIG实例数官方条目,宁缺勿编)最多7实例(VipraTech+腾讯新闻'7路MIG'双源)
形态SXM模组(Blackwell Ultra SXM,官方HGX页Form Factor直证)——部署形态:HGX B300 NVL16 8卡板级(风冷/液冷,OEM整机厂出货形态;本卡所在位置)/DGX B300 8卡整机14.5kW(官方指南直证)/GB300 NVL72机柜72卡全液冷(纯GPU视角;含Grace CPU的超级芯片口径归GB300卡)HGX 8路SXM基板模组(Flopper'SXM'/VipraTech'8-way HGX'/腾讯新闻'HGX方案8路GPU配置+H20 SXM';同批L20/L2为PCIe形态)
CUDA核心—14,592 FP32 CUDA核心(单源VipraTech)
出口合规背景—2022-10美国出口管制后对华合规特供卡:算力密度较H100大幅裁剪(FP8约为H100 SXM的7.5%),以显存96GB+NVLink900GB/s保推理场景(QQ:综合算力约H100的20%)
← NVIDIA B300 (Blackwell Ultra GPU) 身份卡 · NVIDIA H20 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品