
H100(全称 NVIDIA H100,属「Hopper」系列)是 NVIDIA 于 2022 年 3 月 22 日在 GTC 发布、2022 年 9 月官宣量产(10 月起出货)的数据中心 GPU:Hopper 世代开山之作,首个搭载 Transformer Engine(FP8 精度首发)、首个配 HBM3 显存与 PCIe Gen5 的 GPU[1][2]。
它是「把大模型时代撬开」的那张卡:ChatGPT 引爆全球算力军备竞赛后,H100 一度成为全球最紧俏的 AI 算力单位,也因对华出口管制成为中美芯片博弈的标志机型(见「沿革」与「局限与争议」)。
2026 年的现货市场,H100 的角色是走量基盘:算力仍是 Hopper 满血、生态最成熟、租赁需求 2025-2026 反而回暖(公开指数口径[7][8]),但显存 80GB 的硬上限正被 H200(141GB)与 B300(288GB)逐代压价——买它之前,先确认自己的瓶颈不是显存。
萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%,按场景调权。90+ 旗舰级 · 75+ 优秀 · 60+ 可用 · 60 以下不适用。方法透明可复核,不构成性能承诺。
2022 年 3 月 22 日,GTC 发布 Hopper 架构与 H100:800 亿晶体管、TSMC 4N 定制工艺,Transformer Engine 让 FP8 首次进入 GPU 主精度序列,也是首个 HBM3 + PCIe Gen5 的 GPU[2][3]。
2022 年 9 月 20 日GTC 秋季 keynote 官宣量产、宣布 10 月起出货[4];2023 年 3 月 21 日DGX H100 量产可订、首台交付 OpenAI[5],随后一年 H100 成为全球 AI 算力扩张的绝对主力。
2022 年 10 月 7 日,美国出口管制将 H100 纳入对华许可管理;NVIDIA 先后推出 A800/H800 特供(2022 年末)、H20 特供线(2024 年出货)延续对华供给,又随 2023-10 管制升级与 2025-04 H20 许可管理几度中断[6]。H100 本体始终未回到对华获批清单——2025 年 12 月获批对华的是 H200[9]。
2025-2026 年,H100 进入「存量基盘」阶段:H200/B300 逐代上线分走新增采购,但推理需求把租赁价再次推高——租价指数 2025-12 至 2026-01 上涨约 10%[7],2026 年 4 月一年期合同租价突破 $2/GPU·时(公开分析口径[8]),现货市场仍是走量最大的 Hopper 机型。
| 项目 | 规格(H100 SXM · 官方口径) |
|---|---|
| GPU 核心 | NVIDIA Hopper GH100(SXM5) |
| 单卡显存 | 80GB HBM3 |
| 显存带宽 | 3.35TB/s / 卡 |
| FP8 Tensor Core | 3,958 TFLOPS(稀疏口径) |
| FP16 / BF16 Tensor Core | 1,979 TFLOPS(稀疏口径) |
| TF32 Tensor Core | 989 TFLOPS(稀疏口径) |
| FP64 / FP64 Tensor | 34 / 67 TFLOPS |
| 卡间互联 | NVLink 第四代 · 900GB/s + NVSwitch 全互联 |
| 单卡功耗 | 最高 700W(可配置;PCIe 版 350W / NVL 版 350-400W) |
| 主流整机形态 | HGX H100 8 卡基板(风冷 / 液冷)· DGX H100 |
| 上一代 / 对位产品 | A100 80GB(Ampere)/ H200、B300 |
规格以 NVIDIA 官方公开资料为准[1];全部 Tensor 算力为官方「含稀疏」口径,dense 口径减半;整机配置因 OEM 与批次存在差异。
| 项目 | A100 80GB | H100 80GB | H200 | B300 |
|---|---|---|---|---|
| 单卡显存 | 80GB HBM2e | 80GB HBM3 | 141GB HBM3e | 288GB HBM3e |
| 显存带宽 | 约 2TB/s | 3.35TB/s | 4.8TB/s | 约 8TB/s |
| 标志精度 | FP16 | FP8(Transformer Engine) | FP8 | FP4 |
| 卡间互联 | NVLink 3 · 600GB/s | NVLink 4 · 900GB/s | NVLink 4 · 900GB/s | NVLink 5 · 1.8TB/s |
| 选型一句话 | 存量延续 | 预算极限 · 生态最大 | 大显存 · 走量主力 | 旗舰新购 · 下一代 |
规格以 NVIDIA 官方公开资料为准;A100/H200/B300 列详见各自词条对照。
H100 家族按封装与形态分四支,大陆及全球现货以 HGX 8 卡整机为主力(本库在售即 Supermicro / Dell / H3C / Gigabyte 四家 HGX H100 8):
H100 主流为风冷 HGX 8 卡形态:700W 级 SXM5 散热塔方案成熟,存量机房即可部署,这也是它至今仍是「最低改造门槛算力」的原因之一。液冷变体 2023 年起随高密度项目铺开(如超微 SYS-821GE-TNHR 液冷整机[12]),H100 PCIe 版则为 350W 双槽风冷插卡、无基板全互联。


| 模型 / 场景 | 显存需求(FP8 估算) | H100 部署(8 卡 640GB) | 萬安指数 |
|---|---|---|---|
| DeepSeek R1 满血(671B) | 约 690GB | 八卡装不下——需 INT4 量化(约 350GB 可入)或跨机部署;满血单机请看 H200/B300 | 41 |
| R1-Distill 70B 级 | 约 70GB | 单卡 80GB 可部署,余量偏紧(KV cache 需精打) | 82 |
| 72B 级开源模型 | 约 72GB | 单卡临界,实操多采用双卡张量并行 | 75 |
| 7B-14B 级(含视频生成小模型) | 约 8-30GB | 单卡轻松,批量产线靠多卡堆并发 | 90 |
显存按 FP8 权重 ≈ 参数量 × 1 字节估算(推算口径,未含 KV cache 与激活余量);萬安指数为本库估算口径,随实测更新。70B 级单卡部署为临界工况,以实测为准。





实拍图随验货批次上架持续补充;AI 生成图不冒充实拍。
本片为压测判例通用片(六项判例口径与机型无关),H100 专属版视频已在排产队列,上线后替换本卡并配 H100 实锚封面。
| 项目 | 要求 / 现状 |
|---|---|
| CUDA | 11.8 起支持 Hopper(首发版本),现役 12.x 全覆盖 |
| 驱动 | 520 系起(首发),现役 550 系及以上 |
| 训练框架 | PyTorch / TensorFlow 官方支持 Hopper,生态最成熟 |
| 推理引擎 | vLLM / SGLang / TensorRT-LLM 均以 H100 为基准支持机型 |
| 网络配套 | ConnectX-7 400G 或同级互连方案 |
| 操作系统 | 主流 Linux 发行版(Ubuntu 22.04+ 等) |
Hopper 生态经三年多沉淀最成熟,绝大多数推理优化公开评测以 H100 为基准机型;软件栈版本随时间演进,以 NVIDIA 官方发布为准。
H100 采购的验货要点(三项):
完整六项压测判例(数值为 H100 实锚)见本词条「如何压测」节。
六项压测口径,数值判例全部按 H100 实锚:开箱识别 → 单卡烤机(700W 风冷塔,≤85℃ 零 ECC 合格)→ 全机满载 → 显存带宽(标称 3.35TB/s,≥85% 合格)→ 互联带宽(nccl-tests ≥750GB/s,标称 900GB/s)→ 推理吞吐(≥公开基准 80%)。
nvidia-smigpu-burn 3600 或 dcgmi diag -r 3 · 30–60 分钟bandwidthTest(CUDA 自带样例)nccl-tests all_reduce 基准vLLM 起真模型跑量口径说明:合格/优秀线为本库按工程通行口径整理(带宽按标称值占比、温度为数据中心通行上限),随验货报告实测数据积累逐步校准;本表不构成任何验收承诺,具体以合同约定为准。本库验货报告的实测项即按本表口径记录——NOT_EXECUTED 表示未执行该项,「没测」本身也是重要信息。
同一块 HGX H100 基板,各家整机差在形态、散热与服务——选型先看区别(本库在售覆盖其中四家):
| 整机厂 | 代表形态 | 差异点 | 适合谁 |
|---|---|---|---|
| Supermicro 超微 | HGX H100 8 整机(风冷 / 液冷双形态) | 走量主力,液冷机型有专业媒体完整评测[12] | 现货采购 · 看性价比 |
| Dell 戴尔 | PowerEdge 系(HGX H100 8) | 全球一线服务网络与企业级支持 | 跨国部署 · 要服务 |
| H3C 新华三 | HGX H100 8 整机 | 本土服务与交付网络,亚太项目常见 | 亚太渠道 · 本地服务 |
| Gigabyte 技嘉 | HGX H100 8 整机 | 配置灵活,亚太渠道强势 | 亚太渠道采购 |
| NVIDIA 官方 | DGX H100(8 卡整机) | 官方一体交付,全栈软件与原厂背书,首台交付 OpenAI[5] | 要开箱即训 · 要原厂支持 |
| 整机厂 | 安装简易 | 维护便利 | 性能密度 | 寿命预期 |
|---|---|---|---|---|
| Supermicro 超微 | 88 | 84 | 84 | 80 |
| Dell 戴尔 | 90 | 92 | 84 | 85 |
| H3C 新华三 | 86 | 84 | 83 | 82 |
| Gigabyte 技嘉 | 85 | 80 | 85 | 80 |
| NVIDIA 官方 | 92 | 88 | 82 | 85 |
整机厂信息来自各家官方发布与公开评测(如 ServeTheHome);萬安指数为本库估算口径(0–100,估分依据=公开形态、散热方案与服务网络差异),随实机验证更新,不构成采购承诺。具体型号以厂商官方发布为准。
堆叠在 GPU 旁的高带宽显存。H100 单卡 80GB HBM3、带宽 3.35TB/s——到 H200 一代才升级 HBM3e。显存容量是 H100 当前最大的选型短板。
第四代 NVLink,单卡 900GB/s 直连互联,配合 NVSwitch 让八颗 GPU 协同如一颗;H100 与 H200 同代同速。
GPU 直接焊在基板上(非插卡),HGX H100 8 卡基板即 SXM5 形态;验货需连基板一起核验。对位的插卡形态是 PCIe 版(350W、HBM2e)。
H100 首发的混合精度引擎,让 8 位浮点成为训练与推理主流精度;估算显存占用:FP8 权重 ≈ 参数量 × 1 字节。
H100 自 2022 年 10 月起被纳入美国对华出口管制,特供线(A800/H800/H20)均为管制衍生的调整型号;批次与报关路径影响保修与保值,验货必查。本库表述均为公开报道口径,不构成法律意见。
| 日期 | 口径 | 区域 | 参考价带 | 说明 |
|---|---|---|---|---|
| 2026-10-09 | 大厅实时 | 美国(USD) | $187万 – 187万 | 1 处报价 ›(整批要价口径) |
| 2026-10-09 | 大厅实时 | 中国大陆 | ¥5,024,118万 – 5,024,118万 | 1 处报价 ›(整批要价口径) |
| 2026-10-09 | 大厅实时 | 新加坡(SGD) | S$360万 – 414万 | 3 处报价(整批要价口径) |
| 2026-10-09 | 大厅实时 | 中东(AED) | AED 360万 – 360万 | 1 处报价(整批要价口径) |
| 2026-10-09 | 大厅实时 | 欧洲(EUR) | €291万 – 291万 | 1 处报价(整批要价口径) |
| 2026-10-09 | 大厅实时 | 日本(JPY) | JPY 373万 – 373万 | 1 处报价(整批要价口径) |
| 2026-10 | 渠道参考 | 全球 | 全新单卡约 $3.1 万 / 卡 | 公开报价聚合口径[10] · 在售整机 › |
| 2026-04 | 租赁市场 | 北美云 | 一年期合同 >$2 / GPU·时(+40%) | 公开分析口径[8] |
| 2026-01 | 租赁市场 | 全球 | 租价指数单月 +10% | Silicon Data 租赁指数[7] |
| 2026-10 | 政策口径 | 中国大陆 | 无获批公开销售 | H100 不在对华获批清单,现货流通属灰色渠道(公开报道口径,不构成法律意见) |
口径:北美为推算口径——2023 年出货初期锚公开报道整机价 $28-35 万/台回溯,2026-10 锚定当日在售实测 $187.4 万/台(1 处),中段缓升插值,逐日快照积累后逐点替换;中国大陆/新加坡/欧洲/日本/中东为在售实测快照(CNY 502.4 万/台 · 1 处 · SGD 360.4-414.2 万 · 3 处 · EUR 291.5 万 / JPY 373.4 万 / AED 360.1 万 各 1 处),均为原币种口径、互不折算。本库价格数据来源:萬安算交所(0 佣金撮合、不参与交易,不掌握亦不推测成交价,数据因此中立)。推算带仅供走势参考,实际以货主报价为准。
看瓶颈:预算敏感、70B 级以下推理与微调、HPC/FP64 场景,H100 仍是现货市场生态最大、存量最厚的走量基盘,2025-2026 租赁价还回暖了(公开指数口径)。但 80GB 显存对百亿级模型是硬上限——瓶颈在显存就直接看 H200。
算力持平,互联同代(NVLink 4 · 900GB/s),差全在显存:80GB HBM3 / 3.35TB/s 对 141GB HBM3e / 4.8TB/s;八卡合计 640GB 对 1.128TB——R1 满血 FP8(约 690GB)H100 装不下,H200 可单机部署。一句话:H200 卖的是显存,H100 卖的是预算。
H100 自 2022 年 10 月起被纳入美国对华出口管制,2025 年 12 月获批对华的是 H200,H100 不在获批之列;中国大陆正规渠道无公开销售,现货流通属灰色渠道。本条为公开报道口径,不构成法律意见,采购前请以主管部门政策与专业合规意见为准。
两代外观高度相似,仅凭照片不可靠:核对丝印与官方固件报告、序列号独立渠道验真,再用显存实测一锤定音——80GB 与 141GB 一测便知(见「采购与验货」与「如何压测」)。
SXM 版:700W、HBM3 3.35TB/s、NVSwitch 全互联,是 HGX 8 卡整机的主流形态;PCIe 版:350W、HBM2e 2TB/s、无双卡桥接则无高速互联。「低价 H100」多为 PCIe 版,报价与合同必须写明封装形态。