
H800是 NVIDIA H100 的对华合规衍生版:2023 年 3 月 21 日路透社首发报道其针对中国市场调整(路透社[2])——Hopper 世代核心架构保留(第四代 Tensor Core、14592 个 CUDA 核心、PCIe Gen5),核心差异是卡间互联从 H100 的 900GB/s 降到 400GB/s 以符合出口管制阈值(公开报道与 Lenovo 官方规格文档口径[1][2])。
它后来被证明是中国 AI 训练史上最重要的一张卡:2023-2024 年国产大模型的爆发式训练需求大部分跑在 H800 上——DeepSeek 等公开披露的训练算力即含 H800(公开报道口径);2023 年 10 月管制升级后 H800 一并纳管(CNBC 报道口径[3]),转入存量流通——2026 年的现货市场,H800 是最抢手的 Hopper 合规训练卡、价格最坚挺的硬通货之一(本库验货经验口径)。
H800 提供 80GB HBM2e(2TB/s)与 94GB HBM3(3.9TB/s)双版本(官方规格文档口径[1])。买 H800 的三件事:版本分清(双版本价差大,nvidia-smi 一验即知)、互联档位实测(400GB/s 身份特征,防货不对板)、批次合规文件(2023-10 纳管前后路径不同)。本词条不带行情带——价格以货主实际报价为准。
萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%,叠加存量状态修正。
2023 年 3 月 21 日,路透社首发报道:NVIDIA 针对中国市场调整旗舰 H100 推出 H800——Hopper 核心架构保留、互联降档以符合 2022-10 管制阈值(路透社[2];technical.city 渠道口径同年 3 月开卖[5])。
2023 年,国产大模型训练主力:H800 随大模型建设潮放量,成为公开披露的头部模型训练算力(DeepSeek 同款口径,公开报道);双版本(80GB HBM2e / 94GB HBM3)并行流通。
2023 年 10 月,管制升级:2023-10-25 联邦公报新规将 H800 与 A800 一并纳入许可管理(联邦公报[4];CNBC 2023-10-17 报道[3])——对华特供线全面收紧,H800 从新品转入存量硬通货。
2024-2026 年,存量硬通货期:H800 二手与存量渠道流通价格坚挺——「Hopper 训练力 + 合规身份 + DeepSeek 光环」三重加持;2025 年起 H20 等后续型号分流新增需求,但 H800 的存量训练集群仍在服役高峰(本库整理口径)。跨境流通政策仍在演进,本库表述为公开报道口径、不构成法律意见。
| 项目 | 规格(H800 · Lenovo 官方规格文档口径,双版本分列处已注明) |
|---|---|
| GPU 架构 | NVIDIA Hopper |
| 单卡显存 | 80GB HBM2e / 94GB HBM3 双版本 · ECC |
| 显存带宽 | 2TB/s(80GB 版)/ 3.9TB/s(94GB 版) |
| FP32 | 51 TFLOPS(双源一致口径;其余精度档算力行存信源错位嫌疑,本词条整组不采信、不作陈述) |
| Tensor Core | 456 个第四代 Tensor Core / GPU |
| CUDA 核心 | 14592 个 FP32 CUDA 核心 / GPU |
| 卡间互联 | NVLink 400GB/s(H100 为 900GB/s,公开报道口径[2]) |
| 主机接口 | PCIe Gen5 x16 |
| 形态 | PCIe 全高全长双槽 |
| 多实例切分 | MIG 最多 7 实例(80GB 版 10GB/实例 · 94GB 版 13GB/实例) |
| 功耗 / 散热 | 350W · 被动散热 |
| ECC | 支持 |
| 发布 | 2023 年(2023-03-21 路透社首发报道口径) |
规格以 Lenovo Press 官方规格文档为准(NVIDIA 授权伙伴,2026-10 实抓快照[1],technical.city 与路透社报道交叉[2][5]);「Tensor Core/CUDA 核心数」为 Lenovo 表口径。其余精度档算力因采集信源错位嫌疑已整组舍弃——宁缺勿错。
| 项目 | A800(2022) | H800(2023) | H20(2024) |
|---|---|---|---|
| 架构 | Ampere | Hopper | Hopper(裁剪版) |
| 显存 | 80GB HBM2e | 80GB HBM2e / 94GB HBM3 | 96GB HBM3 |
| 互联降档 | NVLink 400GB/s | NVLink 400GB/s | NVLink 裁剪 |
| 纳管时间 | 2023-10 | 2023-10 | 2025 起收紧(公开报道口径) |
| 选型一句话 | Ampere 存量主力 | 训练硬通货 | 推理向合规卡 |
A800 详见词条;H20 行为公开报道口径;管制状态以主管部门政策为准,不构成法律意见。
H800 按显存版本分两支(同卡双版本是 H800 特有的市场形态):
H800 为 PCIe 全高全长双槽被动卡(350W),依赖机箱强制风道——35 0W 功耗段的风道要求比 300W 段的 A800 PCIe 更高,部署前核机箱风冷能力与槽位间距。MIG 切分(最多 7 实例)是部署上的实用牌:94GB 版单实例 13GB、80GB 版 10GB,多租户推理池按实例粒度分配(官方规格文档口径[1])。
二手 H800 的部署前置检查:散热器原装性与导热垫状态(350W 段散热器差异直接影响满载温度)、PCIe Gen5 槽位直连拓扑(过 switch 吃带宽)、供电 8-pin 线缆规格(本库验货经验口径)。
| 模型 / 场景 | 显存需求(FP16 估算) | H800 部署口径 | 萬安指数 |
|---|---|---|---|
| DeepSeek R1 满血(671B) | FP16 约 1.3TB / FP8 约 690GB | 八卡装得下(FP8 口径)——94GB×8=752GB 或 80GB×8=640GB 需 FP8/INT8 量化路径,Hopper 第四代 Tensor Core 支持 FP8 | 82 |
| 70B 级开源模型 | FP16 约 140GB | 双卡张量并行;INT8 量化后单卡临界(94GB 版余量更足) | 82 |
| 7B-14B 级 | FP16 约 14-28GB | 单卡轻松,MIG 切片或多卡堆并发 | 88 |
| 万亿参 MoE 训练 | 跨机多集群 | NVLink 400GB/s 柜内 + IB fabric 跨柜——互联是大规模扩展的规划重点 | 74 |
显存按 FP16 权重 ≈ 参数量 × 2 字节估算(推算口径,未含 KV cache);FP8 支持 = Hopper 第四代 Tensor Core 架构能力(公开架构口径),实际部署精度策略随框架而定。

| 项目 | 要求 / 现状 |
|---|---|
| CUDA | 与 H100 同代(Hopper · 计算能力 9.0)——Hopper 生态全覆盖 |
| 驱动 | 与 H100 共用驱动线——现役驱动持续支持 |
| 框架 | PyTorch / TensorFlow / vLLM / TensorRT 全支持(Hopper 口径,含 FP8) |
| MIG 配套 | Kubernetes/容器编排多租户切片成熟 |
| 训练框架适配 | DeepSeek 等公开训练案例的验证度高——Hopper 训练栈成熟(公开报道口径) |
H800 软件生态与 H100 同代共享——框架兼容性是它成为训练硬通货的底层支撑;以 NVIDIA 官方发布为准。
H800 采购的验货要点(三项):
完整六项压测判例见本词条「如何压测」节。
六项压测口径,数值判例全部按 H800 实锚:开箱识别 → 单卡烤机(350W)→ 全机满载 → 显存带宽(80GB 版 2TB/s / 94GB 版 3.9TB/s,≥85% 合格)→ 互联带宽(NVLink 400GB/s 档实测)→ 推理吞吐。
H800 以 PCIe 插卡单路流通为主(无 SXM 整机公开方案,公开资料口径),授权伙伴对照:
| 渠道 | 代表方案 | 差异点 | 2026 年现状 |
|---|---|---|---|
| NVIDIA 原厂 PCIe | H800 80GB / 94GB PCIe | 现货流通唯二版本 | 二手与库存并行 |
| Lenovo | ThinkSystem H800 PCIe Gen5 集成方案(Lenovo Press 口径[1]) | 整机出厂集成、固件联保 | 拆机与项目流通 |
| 渠道交叉参照 | technical.city 规格口径[5] | 第三方规格数据库参照系 | 流通参照 |
渠道信息来自各家官方发布与公开资料[1][5];具体配置以厂商官方文档为准。
H800 特有的市场形态:80GB HBM2e(2TB/s)与 94GB HBM3(3.9TB/s)并行流通——94GB 版带宽近翻倍,大 KV cache 与长上下文场景优先;价差以货主实际报价为准。
H800 的合规身份特征:卡间互联从 H100 的 900GB/s 降到 400GB/s(公开报道口径)——实测档位是验货的双向甄别手段(防 H800 冒充 H100,也防 H100 尾货充 H800)。
Hopper 架构的 456 个第四代 Tensor Core 支持 FP8 精度——大模型训练/推理的吞吐引擎;H800 保留该能力(互联降档不动计算架构),FP8 路径是它扛训练大旗的技术底气。
DeepSeek 公开披露的训练算力含 H800(公开报道口径)——「公开验证过的训练卡」是 H800 二手市场溢价的市场心理基础;采购决策仍以实机压测为准。
2023-10-25 联邦公报新规将 H800 纳入许可管理——此后流通属存量与既有渠道(公开报道口径[3]);批次合规文件核验是二手交易底线,本库不构成法律意见。
H800 是存量市场最坚挺的硬通货之一,但版本(80/94GB)、成色、批次与渠道条件让价格离散度大——没有可复核的统一行情,本库诚实原则:不做行情带,价格以货主实际报价为准。
在售检索:萬安算交所大厅 ›(0 佣金撮合、不参与交易,数据因此中立)。行情快照积累充分后本节将切换为标准行情带。
核心差在互联:H800 的 NVLink 是 400GB/s(对华合规降档),H100 为 900GB/s——计算架构同代(第四代 Tensor Core/FP8 都在)。单卡推理差距小,多卡训练的集合通信效率差一档。
94GB HBM3 版带宽 3.9TB/s 约为 80GB 版两倍:长上下文、大 KV cache、大模型训练优先 94GB;80GB 版存量更大渠道更宽,预算敏感时性价比高——价差以货主实际报价为准。
H800 自 2023 年 10 月起纳入许可管理,正规新增供应收窄,现货属存量流通——它是二手市场最坚挺的 Hopper 硬通货之一。合规文件核验是底线,本库不构成法律意见。
FP8 口径可以:R1 满血 FP8 权重约 690GB,94GB 版八卡 752GB、80GB 版八卡 640GB——94GB 版余量足,80GB 版临界需精打量化与 KV cache 策略。第四代 Tensor Core 原生 FP8 是底气。
不是也不是问题所在:H800 无显示输出、不用于挖矿——真实风险是大模型训练 7×24 高负载老化。正确姿势:问机房负载史、导出 ECC 日志、走六项压测(显存带宽与互联档位实测是重点)。