算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA H200 SXM

H100同座的显存升级版——功耗档不变仍700W,显存翻到141GB HBM3e/4.8TB/s,大模型推理吞吐翻倍,HGX H200八卡机是推理集群新中坚;2026年对华出口松绑后放量,大显存现货市场的硬通货

概述

NVIDIA H200 SXM是基于Hopper架构的数据中心GPU,定位为H100的同座显存升级版。其最显著的变化是单卡显存提升至141GB HBM3e,官方称其为全球首款采用该容量HBM3e的GPU。在功耗档位与H100保持一致的情况下,官方数据表明其大语言模型推理吞吐可达约两倍。计算能力方面,H200 SXM支持FP64、FP32及各类Tensor Core精度,FP8算力达到4 petaFLOPS(含稀疏加速)。形态为SXM,可通过NVLink以900GB/s互联组成HGX H200四卡或八卡系统,广泛用于大模型推理与训练、高性能计算及视频解码负载,是大显存推理集群的主流选择。

核心规格

架构NVIDIA Hopper(GH100核心,TSMC 4N定制工艺,800亿晶体管,814mm²,与H100 SXM同颗GH100)
显存141GB HBM3e(6144bit总线/6.3Gbps引脚速率,官方称全球首款141GB HBM3e单卡)
显存类型HBM3e
显存位宽6144bit
显存带宽4.8TB/s(官方页+Datasheet+新闻稿+Wikipedia四源一致)
算力FP8 Tensor Core 3,958 TFLOPS(含稀疏,密集1,979);FP16/BF16 TC 1,979*;TF32 TC 989*;INT8 TC 3,958 TOPS*;FP64 TC 67;FP32 67;FP64 34(SXM口径,*=With sparsity)
功耗SXM最高700W(可配置);同座H100 SXM同为700W功耗档
互联NVLink 900GB/s+PCIe Gen5 128GB/s;经NVSwitch组HGX H200 4/8卡全互联(8卡FP8合计超32 PFLOPS,显存合计1.1TB)
发布年2024(2023-11-13 SC23宣布,官方口径2024 Q2起OEM交付;业界通行记载2024-06-04全面GA,旁证级)
SM与CUDA核132 SM / 16,896 FP32 CUDA核(GH100,与H100 SXM5同源;旁证Wikipedia Hopper表)
加速频率1,980MHz(旁证Wikipedia Hopper表,与H100 SXM行同列合并显示;NVIDIA官方未单列H200时钟,谨慎引用)
L2缓存50MB(架构级,旁证Wikipedia)
MIG切片最多7实例@18GB(每实例18GB,大于H200 NVL的16.5GB与H100的10GB)
编解码器7 NVDEC + 7 JPEG
机密计算Confidential Computing Supported
形态SXM模组(液冷/风冷由整机定,配HGX H200 4或8卡;AI Enterprise为Add-on另购)
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA T4 对比16GB GDDR6 with ECC (默认开启)70W (Total board power, 默认)
NVIDIA A100 对比40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECCSXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W
NVIDIA H20 对比96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致)400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃)
NVIDIA GB300 对比288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存)TGP 最高 1400W(单GPU,官方博客直证)
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA GeForce RTX 4090 对比24GB GDDR6X450W TGP (平均游戏315W, 建议系统电源850W)

视频讲解 VIDEO

深度阅读:H200 厚词条(20节深度版) · 厚词条H200 NVL 薄卡(PCIe 141GB) · 厚词条H100 SXM 薄卡 · 厚词条

采购与验货要点

常见问题

H200和H100有什么区别?
H200是H100的显存升级版:显存从H100的容量提升到141GB HBM3e,且功耗档位保持不变(最大700W,可配置)。官方口径下,H200的大语言模型推理吞吐约为H100的两倍。两者同属Hopper架构,计算能力与软件生态高度一致。
H200 SXM和H200 NVL该选哪个?
两者显存同为141GB,但差异明显:SXM为基板集成形态,依赖NVLink实现900GB/s互联,最大TDP为700W,适合HGX整机方案和高密度集群;NVL为PCIe双槽风冷卡,最大TDP为600W,通过NVLink桥接器实现2路或4路互联,算力档位也更低。自建高密度推理集群一般选SXM整机,已有PCIe服务器或空间受限环境可选NVL。
H200的显存能跑多大的模型?
单卡141GB显存可以完整加载多数主流开源大模型进行推理,或承载更长上下文窗口;通过NVLink组建HGX H200八卡系统后,显存合计达1.1TB,可支持千亿级参数模型的推理与训练。实际可部署规模还取决于模型量化精度、KV Cache长度和框架实现。
信源
采集 2026-10-10 · 侦察 C-侦察兵-H200SXM-1010夜 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品