算力百科COMPUTEPEDIA

算力百科 › 机型词条 › H100 NVL

NVIDIA 数据中心场景官方图(厂商图)
场景图 · 萬安算力百科(NVIDIA 官网)

H100 NVL

NVIDIA Hopper · 94GB HBM3 PCIe · 机型词条 #018

概述OVERVIEW

H100 NVL是 NVIDIA H100 的 PCIe 双槽风冷形态:94GB HBM3 单卡显存、FP8 3,341 TFLOPS、FP64 Tensor 60 TFLOPS,功耗 350-400W 可配置,NVLink 桥接 600GB/s(2/4-way)——不需要 HGX 基板整机,标准 x86 服务器直插即用(官方规格快照口径[1])。

它与 HGX H100 基板版(SXM)的关系:同芯不同形态——NVL 版是 PCIe 双槽风冷插卡,HGX 基板版是 SXM 液冷/风冷整机(8 卡 NVLink 全互联)。对采购方:PCIe 部署门槛低一档——不需要基板整机,标准 x86 服务器直插即用。94GB 显存对 H100 PCIe 的 80GB 提升 17.5%。

与 H200 NVL 对照:显存 94GB 对 141GB(-33%)、带宽 3.9TB/s 对 4.8TB/s、FP8 同为 3,341 TFLOPS——H200 NVL 是 H100 NVL 的显存直系升级(官方对照口径[1])。本词条不带行情带——价格以货主实际报价为准。

适用场景FIT

萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%。

大模型推理服务90萬安指数
94GB HBM3 单卡装 70B 级 INT8——大模型在线推理的主力 PCIe 卡(官方规格口径[1])。
推理扩展(多卡 NVLink 桥接)85萬安指数
NVLink 桥接 2/4 卡 600GB/s——推理吞吐扩展不用 HGX 基板(官方规格口径[1])。
视频转码 / 直播87萬安指数
7×NVDEC | 7×JPEG——视频转码与图像处理的大规模流水线底座。
大模型训练65萬安指数
PCIe 互联受限(600GB/s 桥接 vs HGX 900GB/s 全互联)——大规模训练看 HGX SXM 系。

沿革HISTORY

2023 年,H100 NVL 发布:Hopper 世代的 PCIe 推理旗舰——94GB HBM3 显存较 H100 PCIe 的 80GB 提升 17.5%,FP8 Tensor Core 3,341 TFLOPS 同档(官方规格快照口径[1])。

2024-2025 年,推理走量:大模型在线推理需求爆发——PCIe 即插即用 + 94GB 大显存让 H100 NVL 成为推理侧走量主力之一(本库整理口径)。

2025-2026 年,Blackwell 接棒:RTX PRO 6000 Blackwell 与 B200/B300 系发布——H100 NVL 转入存量与并行流通(本库整理口径)。跨境流通政策仍在演进,本库表述为公开报道口径、不构成法律意见。

技术规格SPECIFICATIONS

项目规格(H100 NVL · 官方口径)
架构NVIDIA Hopper
单卡显存94GB HBM3
显存带宽3.9TB/s
FP8 / INT83,341 TFLOPS / 3,341 TOPS
FP161,671 TFLOPS
FP64 / FP64 Tensor30 / 60 TFLOPS
FP3260 TFLOPS
互联NVLink 600GB/s | PCIe Gen5:128GB/s
编解码器7 NVDEC | 7 JPEG
功耗350-400W(可配置)
形态PCIe 双槽风冷
MIG最多 7 实例 @ 12GB

规格以 NVIDIA 官方快照为准(2026-10 口径[1],与本库薄卡逐条对账一致)。

H100 NVL · PCIe 双槽94GB HBM3 · 350-400W · 风冷 HGX H100 8卡 · SXM80GB HBM3 · 700W · 基板 H100 家族两形态对照(NVIDIA 官方口径)

H100 家族三形态对照THREE FORMS

项目H100 NVL(PCIe)HGX H100 8卡(SXM)H200 NVL(PCIe)
显存94GB HBM380GB HBM3 × 8141GB HBM3e
互联NVLink 桥接 600GB/sNVLink 900GB/s 全互联NVLink 桥接 900GB/s
FP83,341 TFLOPS3,358 TFLOPS3,341 TFLOPS
功耗350-400W700W(可配置)600W(可配置)
选型一句话推理/单机直插大规模训练集群大显存推理升级

家族成员FAMILY

H100 家族按形态分档;NVL 版是 PCIe 推理旗舰:

H100 NVL(94GB PCIe 双槽风冷 · 本词条)HGX H100 8 卡(SXM 基板 · NVLink 全互联)H100 PCIe(80GB · 原版 PCIe)H200 NVL(141GB HBM3e · 详见词条)

散热与部署COOLING

H100 NVL 是 PCIe 双槽风冷插卡(350-400W 可配置)——标准 x86 服务器直插即用,不需要 HGX 基板整机(官方规格快照口径[1])。部署三对表:供电(400W 档需够额的 PSU 与 16-pin CEM5 供电线)、PCIe Gen5 直连(x16 直连 CPU,过 switch 吃带宽)、风道(400W 满载的双槽卡风道压力大于 300W 段——进风温度控制)。

多卡部署:2 卡 NVLink 桥接器可达 600GB/s 互联——推理吞吐扩展不需要 HGX 基板。4 卡桥接进一步扩展但需要专用桥接套件。部署密度:2U 服务器常见 2-4 卡配置(400W×4=1.6kW 的风道压力要认真算)。

模型适配MODEL FIT

模型 / 场景显存需求(FP16 估算)H100 NVL 部署口径萬安指数
70B 级推理(INT8)约 70GB单卡 94GB 余量充足 + MIG 切分多租户88
13B 级推理(FP16)约 26GB单卡轻松 + MIG 切分多实例90
长上下文推理KV cache 随长度线性94GB 的 KV cache 空间优于 80GB 桥84
大模型训练—PCIe 互联受限——大规模训练看 HGX SXM 系62
NVIDIA 数据中心场景官方图
NVIDIA 数据中心场景(官方图 · NVIDIA 官网;H100 NVL 产品图待补)

软件与生态ECOSYSTEM

项目要求 / 现状
CUDAHopper 代(计算能力 9.0)——CUDA 11.8 起支持
框架PyTorch / TensorFlow / vLLM / TensorRT 全支持
MIG最多 7 实例 @ 12GB
驱动NVIDIA 数据中心驱动线(与 HGX H100 共用)

采购与验货PROCUREMENT

H100 NVL 采购的验货要点(三项):

1
显存容量核对
94GB HBM3——nvidia-smi 实测核对,94GB 对 80GB 价差大,混充是常见风险。
2
MIG 切分实测
7 实例切分功能实测——多租户推理场景的核心验收项。
3
编解码器实测
7×NVDEC 转码并发实测——视频场景的核心验收指标。

验收速查QUICK CHECK

H100 NVL 四步速查:

1
身份识别
nvidia-smi:H100 NVL 型号、94GB 显存、ECC 状态——与合同逐项对表。
2
满载烤机
400W 档满载:温度平稳、零 ECC 报错(判例框架口径)。
3
FP8 算力
FP8 基准实测(≥80% 合格,推算口径)——推理产线的实际吞吐锚点。
4
MIG 切分
7 实例切分功能实测——多租户场景的核心验收项。

运输与交付LOGISTICS

1
跨境流通合规
H100 NVL 的对华管制状态同 H100——跨境采购合规以专业意见为准,本库不构成法律意见。

术语卡GLOSSARY

NVL 命名

NVIDIA 产品里 NVL 后缀 = 带 NVLink 桥接的 PCIe 卡形态——H100 NVL 通过 2/4-way NVLink 桥接实现 600GB/s 卡间互联(非 SXM 基板全互联)。

94GB HBM3

H100 NVL 的显存规格:94GB HBM3(较 H100 PCIe 的 80GB HBM2e 提升 17.5%),3.9TB/s 带宽——大模型推理的显存天花板在 PCIe 形态里的重要提升。

NVLink 桥接器

NVLink Bridge:2 卡或 4 卡之间的物理桥接硬件——不经过 PCIe Switch,直接卡对卡 NVLink 互连。H100 NVL 的桥接带宽 600GB/s(对照 HGX 基板全互联 900GB/s)。

局限与争议LIMITS

  • PCIe 互联天花板:NVLink 桥接限 2/4 卡(600GB/s),大规模训练互联密度远低于 HGX SXM 基板(本库整理口径)。
  • FP64 非主打:FP64 30 TFLOPS——双精度 HPC 场景对照 A100(FP64 19.5 TFLOPS)虽高但非 Hopper 主打(公开报道口径)。
  • 训练 vs 推理定位:PCIe 形态+桥接互联——大规模训练看 HGX SXM 系,H100 NVL 的甜点位在推理与合规。
  • 功耗可配置的规划:350-400W 可配置——功耗档对机房供电与散热的弹性要求高,采购合同写明功耗档位。
  • 跨境流通政策变量:H100 NVL 的对华管制状态同 H100——跨境采购合规以专业意见为准,本库不构成法律意见。

行情说明MARKET NOTE

H100 NVL · 行情带暂未开通

H100 NVL 现货以原厂新品与整机拆机并行——本库诚实原则:不做行情带,价格以货主实际报价为准。

在售检索:萬安算交所大厅 ›(0 佣金撮合、数据因此中立)。

常见问题FAQ

H100 NVL 和 HGX H100 怎么选?

部署形态分界:PCIe 直插(标准 x86 服务器/塔式)选 NVL——HGX 基板整机(8 卡 NVLink 全互联)适合大规模训练集群。94GB 对 80GB 是显存升级。

H100 NVL 和 H200 NVL 怎么选?

显存直系升级:141GB 对 94GB(+50%)、带宽 4.8TB/s 对 3.9TB/s、FP8 算力同档——推理场景 H200 NVL 的单位显存成本更优。

H100 NVL 能用来训练吗?

PCIe 互联受限(600GB/s 桥接 vs HGX 900GB/s 全互联)——大规模训练看 HGX SXM 系,H100 NVL 的甜点位在推理与合规。

H100 NVL 验收测什么?

四步:身份识别(nvidia-smi 94GB/ECC)→ 400W 档满载烤机(温度/零 ECC 报错)→ FP8 算力基准(≥80% 合格,推算口径)→ MIG 7 实例切分实测。

H100 NVL 对华能买吗?

H100 NVL 的对华管制状态同 H100——2022-10 起纳入许可管理。大陆正规渠道无新卡销售,流通属存量与灰色地带。合规风险前置评估,本库不构成法律意见。

H100H100 NVL(薄卡)H200 NVLCUDAA100NVMe 全闪存储HGX H100NVLink 桥接器MIG 多实例vGPU

机型对比与选型COMPARE

参考资料REFERENCES

  1. NVIDIA 官方 — H100 NVL 规格快照(与本库薄卡逐条对账一致,2026-10 口径) https://www.nvidia.com/en-us/data-center/h100/
  2. NVIDIA 官网 — H100 产品线(家族对照口径) https://www.nvidia.com/en-us/data-center/h100/
  3. 在售检索 — 萬安算交所(0 佣金撮合;H100 NVL 暂无行情快照,价格以货主报价为准) https://www.aixx.vip/hall.html?model=H100%20NVL
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-10 · 版本 v1.0 · 历次改动均留痕可查。发现错误?欢迎通过勘误通道提交,核实后公开修正并记入版本史。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品