
H100 NVL是 NVIDIA H100 的 PCIe 双槽风冷形态:94GB HBM3 单卡显存、FP8 3,341 TFLOPS、FP64 Tensor 60 TFLOPS,功耗 350-400W 可配置,NVLink 桥接 600GB/s(2/4-way)——不需要 HGX 基板整机,标准 x86 服务器直插即用(官方规格快照口径[1])。
它与 HGX H100 基板版(SXM)的关系:同芯不同形态——NVL 版是 PCIe 双槽风冷插卡,HGX 基板版是 SXM 液冷/风冷整机(8 卡 NVLink 全互联)。对采购方:PCIe 部署门槛低一档——不需要基板整机,标准 x86 服务器直插即用。94GB 显存对 H100 PCIe 的 80GB 提升 17.5%。
与 H200 NVL 对照:显存 94GB 对 141GB(-33%)、带宽 3.9TB/s 对 4.8TB/s、FP8 同为 3,341 TFLOPS——H200 NVL 是 H100 NVL 的显存直系升级(官方对照口径[1])。本词条不带行情带——价格以货主实际报价为准。
萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%。
2023 年,H100 NVL 发布:Hopper 世代的 PCIe 推理旗舰——94GB HBM3 显存较 H100 PCIe 的 80GB 提升 17.5%,FP8 Tensor Core 3,341 TFLOPS 同档(官方规格快照口径[1])。
2024-2025 年,推理走量:大模型在线推理需求爆发——PCIe 即插即用 + 94GB 大显存让 H100 NVL 成为推理侧走量主力之一(本库整理口径)。
2025-2026 年,Blackwell 接棒:RTX PRO 6000 Blackwell 与 B200/B300 系发布——H100 NVL 转入存量与并行流通(本库整理口径)。跨境流通政策仍在演进,本库表述为公开报道口径、不构成法律意见。
| 项目 | 规格(H100 NVL · 官方口径) |
|---|---|
| 架构 | NVIDIA Hopper |
| 单卡显存 | 94GB HBM3 |
| 显存带宽 | 3.9TB/s |
| FP8 / INT8 | 3,341 TFLOPS / 3,341 TOPS |
| FP16 | 1,671 TFLOPS |
| FP64 / FP64 Tensor | 30 / 60 TFLOPS |
| FP32 | 60 TFLOPS |
| 互联 | NVLink 600GB/s | PCIe Gen5:128GB/s |
| 编解码器 | 7 NVDEC | 7 JPEG |
| 功耗 | 350-400W(可配置) |
| 形态 | PCIe 双槽风冷 |
| MIG | 最多 7 实例 @ 12GB |
规格以 NVIDIA 官方快照为准(2026-10 口径[1],与本库薄卡逐条对账一致)。
| 项目 | H100 NVL(PCIe) | HGX H100 8卡(SXM) | H200 NVL(PCIe) |
|---|---|---|---|
| 显存 | 94GB HBM3 | 80GB HBM3 × 8 | 141GB HBM3e |
| 互联 | NVLink 桥接 600GB/s | NVLink 900GB/s 全互联 | NVLink 桥接 900GB/s |
| FP8 | 3,341 TFLOPS | 3,358 TFLOPS | 3,341 TFLOPS |
| 功耗 | 350-400W | 700W(可配置) | 600W(可配置) |
| 选型一句话 | 推理/单机直插 | 大规模训练集群 | 大显存推理升级 |
H100 家族按形态分档;NVL 版是 PCIe 推理旗舰:
H100 NVL 是 PCIe 双槽风冷插卡(350-400W 可配置)——标准 x86 服务器直插即用,不需要 HGX 基板整机(官方规格快照口径[1])。部署三对表:供电(400W 档需够额的 PSU 与 16-pin CEM5 供电线)、PCIe Gen5 直连(x16 直连 CPU,过 switch 吃带宽)、风道(400W 满载的双槽卡风道压力大于 300W 段——进风温度控制)。
多卡部署:2 卡 NVLink 桥接器可达 600GB/s 互联——推理吞吐扩展不需要 HGX 基板。4 卡桥接进一步扩展但需要专用桥接套件。部署密度:2U 服务器常见 2-4 卡配置(400W×4=1.6kW 的风道压力要认真算)。
| 模型 / 场景 | 显存需求(FP16 估算) | H100 NVL 部署口径 | 萬安指数 |
|---|---|---|---|
| 70B 级推理(INT8) | 约 70GB | 单卡 94GB 余量充足 + MIG 切分多租户 | 88 |
| 13B 级推理(FP16) | 约 26GB | 单卡轻松 + MIG 切分多实例 | 90 |
| 长上下文推理 | KV cache 随长度线性 | 94GB 的 KV cache 空间优于 80GB 桥 | 84 |
| 大模型训练 | — | PCIe 互联受限——大规模训练看 HGX SXM 系 | 62 |

| 项目 | 要求 / 现状 |
|---|---|
| CUDA | Hopper 代(计算能力 9.0)——CUDA 11.8 起支持 |
| 框架 | PyTorch / TensorFlow / vLLM / TensorRT 全支持 |
| MIG | 最多 7 实例 @ 12GB |
| 驱动 | NVIDIA 数据中心驱动线(与 HGX H100 共用) |
H100 NVL 采购的验货要点(三项):
H100 NVL 四步速查:
NVIDIA 产品里 NVL 后缀 = 带 NVLink 桥接的 PCIe 卡形态——H100 NVL 通过 2/4-way NVLink 桥接实现 600GB/s 卡间互联(非 SXM 基板全互联)。
H100 NVL 的显存规格:94GB HBM3(较 H100 PCIe 的 80GB HBM2e 提升 17.5%),3.9TB/s 带宽——大模型推理的显存天花板在 PCIe 形态里的重要提升。
NVLink Bridge:2 卡或 4 卡之间的物理桥接硬件——不经过 PCIe Switch,直接卡对卡 NVLink 互连。H100 NVL 的桥接带宽 600GB/s(对照 HGX 基板全互联 900GB/s)。
部署形态分界:PCIe 直插(标准 x86 服务器/塔式)选 NVL——HGX 基板整机(8 卡 NVLink 全互联)适合大规模训练集群。94GB 对 80GB 是显存升级。
显存直系升级:141GB 对 94GB(+50%)、带宽 4.8TB/s 对 3.9TB/s、FP8 算力同档——推理场景 H200 NVL 的单位显存成本更优。
PCIe 互联受限(600GB/s 桥接 vs HGX 900GB/s 全互联)——大规模训练看 HGX SXM 系,H100 NVL 的甜点位在推理与合规。
四步:身份识别(nvidia-smi 94GB/ECC)→ 400W 档满载烤机(温度/零 ECC 报错)→ FP8 算力基准(≥80% 合格,推算口径)→ MIG 7 实例切分实测。
H100 NVL 的对华管制状态同 H100——2022-10 起纳入许可管理。大陆正规渠道无新卡销售,流通属存量与灰色地带。合规风险前置评估,本库不构成法律意见。