算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA H100 NVL

单卡94GB HBM3、双卡NVLink桥接188GB,70B级LLM推理专用卡,350-400W风冷双槽好托管,AI Enterprise随卡附赠,二手市场绕不开的准旗舰
NVIDIA H100 NVL 厂商官方图
NVIDIA 厂商官方图

概述

NVIDIA H100 NVL是NVIDIA基于Hopper架构推出的PCIe形态数据中心GPU,定位为大显存推理场景的准旗舰产品。单卡配备94GB HBM3显存,通过NVLink桥接可将两张卡组合为188GB的统一显存池,适合承载大参数量语言模型的推理负载。该卡采用双槽风冷设计,TDP可在一定范围内配置,便于在标准机架环境中部署;卡间通过NVLink提供双向600GB/s互联带宽,同时支持PCIe Gen5主机接口。随卡附带NVIDIA AI Enterprise软件套件,覆盖企业级AI推理与部署需求。

核心规格

架构NVIDIA Hopper
显存94GB
显存类型HBM3
显存带宽3.9TB/s
FP64算力30 teraFLOPs
FP64 Tensor Core60 teraFLOPs
FP32算力60 teraFLOPs
FP8算力3,341 teraFLOPS
FP16算力1,671 teraFLOPS
INT8算力3,341 TOPS
功耗TDP350-400W (configurable)
互联NVIDIA NVLink: 600GB/s | PCIe Gen5: 128GB/s
形态PCIe dual-slot air-cooled
MIG切片Up to 7 MIGS @ 12GB each
编解码器7 NVDEC | 7 JPEG
规格已与官方基准快照对账(基准来源,采集 2026-10-09)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA L40 对比48 GB GDDR6 with ECC300W
NVIDIA H200 NVL 对比141GBUp to 600W (configurable)
NVIDIA H800 对比80 GB HBM2e350 W
NVIDIA A2 对比16 GB GDDR640–60W (configurable)
NVIDIA A16 对比4x 16GB GDDR6250W
深度阅读:H100 · 厚词条

采购与验货要点

常见问题

H100 NVL和普通PCIe版H100有什么区别?
H100 NVL是PCIe形态的H100变体,主要差异在于配备了NVLink桥接能力,可将两张卡桥接为188GB的联合显存池,专为需要跨卡大显存的推理场景设计;而标准PCIe版通常不带出厂桥接方案。两者均基于Hopper架构。
单卡94GB够跑大模型吗?什么时候需要双卡桥接?
这取决于模型参数量与量化方案。若单卡显存不足以容纳模型权重加上KV Cache等运行时开销,可以通过NVLink桥接两张H100 NVL获得188GB联合显存。桥接后显存池由NVLink以600GB/s带宽连接,通信效率高于走PCIe Gen5的多卡方案。
H100 NVL适合出租或托管吗?MIG有什么用?
适合。该卡采用标准PCIe双槽风冷设计,可配置的TDP使其能够部署在常规机架服务器中,托管门槛相对较低。MIG功能可将单卡物理切分为多至7个独立实例,每个实例12GB显存,彼此隔离,适合云服务商或团队将一张卡分给多个租户或多个轻量推理任务使用。
信源
采集 2026-10-09 · 侦察 侦察兵-自动小弟B2 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品