算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA H200 NVL

141GB HBM3e+4.8TB/s单卡装下700亿参数全量,2/4路NVLink桥接900GB/s,600W内风冷可托管,大显存推理卡里的现货新贵
NVIDIA H200 NVL 厂商官方图
NVIDIA 厂商官方图

概述

NVIDIA H200 NVL是NVIDIA基于Hopper架构打造的数据中心GPU,采用PCIe双槽风冷形态,面向大显存推理与训练场景。其单卡搭载141GB HBM3e显存,是官方页面对外强调的核心特性,可在大容量模型场景下减少多卡拆分带来的复杂度。卡间可通过2路或4路NVLink桥接实现每GPU 900GB/s的互联带宽,也可走PCIe Gen5(128GB/s)与主机通信。该卡支持多实例GPU划分(最多7个实例,每个16.5GB)与机密计算,并附带NVIDIA AI Enterprise软件支持,典型用途包括大语言模型推理、多模态模型部署及视频解码类工作负载。

核心规格

架构NVIDIA Hopper
显存141GB
显存类型HBM3e
显存带宽4.8TB/s
FP64算力30 TFLOPS
FP64 Tensor Core60 TFLOPS
FP32算力60 TFLOPS
FP8算力3,341 TFLOPS
FP16算力1,671 TFLOPS
INT8算力3,341 TFLOPS
功耗TDPUp to 600W (configurable)
互联2- or 4-way NVIDIA NVLink bridge: 900GB/s per GPU | PCIe Gen5: 128GB/s
形态PCIe Dual-slot air-cooled
MIG切片Up to 7 MIGs @16.5GB each
编解码器7 NVDEC | 7 JPEG
机密计算Supported
规格已与官方基准快照对账(基准来源,采集 2026-10-09)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA L40 对比48 GB GDDR6 with ECC300W
NVIDIA H800 对比80 GB HBM2e350 W
NVIDIA H100 NVL 对比94GB350-400W (configurable)
NVIDIA A2 对比16 GB GDDR640–60W (configurable)
NVIDIA A16 对比4x 16GB GDDR6250W
深度阅读:H200 · 厚词条

采购与验货要点

常见问题

H200 NVL和H200 SXM有什么区别?
两者同属H200产品线、基于相同的Hopper架构,主要差异在形态与部署方式:H200 NVL为PCIe双槽风冷设计,便于在标准服务器中部署与后续扩容;H200 SXM为SXM模组形态,需搭配专用基板。互联方面,H200 NVL通过2路或4路NVLink桥接实现每GPU 900GB/s的卡间带宽,并可回退到PCIe Gen5(128GB/s)通信。
单卡141GB显存跑大模型还需要多卡吗?
取决于模型参数量、量化精度与并发批次大小。H200 NVL的141GB HBM3e显存可以在单卡内容纳较大规模模型的权重与KV缓存,减少张量并行带来的通信开销;若模型更大或需要更高吞吐,可通过2路或4路NVLink桥接扩展为多卡实例,卡间900GB/s的互联有助于降低多卡推理的延迟损失。建议以目标模型的实际显存占用测算后再决定卡数。
H200 NVL支持把一张卡分给多个用户或任务使用吗?
支持。该卡具备多实例GPU(MIG)能力,单卡最多可划分为7个实例,每个实例拥有16.5GB显存,各实例之间资源隔离,适合多租户推理、开发测试等需要细粒度分配的场景。此外,H200 NVL也支持机密计算,可满足对数据安全有合规要求的部署。
信源
采集 2026-10-09 · 侦察 侦察兵-自动小弟B2 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品