规格词条 · 中卡 STANDARD CARD
NVIDIA A800
A100的中国特供同门(NVLink 600降到400GB/s的合规版),80GB HBM2e大显存安培训练主力,2023年10月禁售后转为存量/二手流通,是国内现货市场流通量最大、验货需求最刚性的AI训练卡之一
概述
NVIDIA A800 是基于 Ampere 架构的数据中心 GPU,可视为 A100 面向中国大陆市场的合规版本,主要差异在于 NVLink 互联速率由 A100 的规格下调至 400 GB/s。该卡配备 80 GB HBM2e 显存,搭载第三代 Tensor Core,支持 FP64、TF32、BF16、INT8 等多种精度,并提供 PCIe 与 SXM4 两种形态。其 MIG 功能最多可划分为 7 个实例。A800 长期作为国内大规模模型训练与推理的主力卡型,在相关出口管制生效后转入存量市场流通,目前二手与现货交易活跃,验货需求突出。
核心规格
| 架构 | NVIDIA Ampere |
| 显存 | 80 GB HBM2e |
| 显存带宽 | 1,935 GB/s |
| FP64算力 | 9.7 TFLOPS |
| FP64 Tensor Core | 19.5 TFLOPS |
| FP32算力 | 19.5 TFLOPS |
| TF32 Tensor Core | 156 TFLOPS |
| FP16算力 | 312 TFLOPS |
| INT8算力 | 624 TOPS |
| Tensor核心 | 512 third-generation Tensor Cores per GPU |
| CUDA核心 | 8192 FP32 CUDA Cores per GPU |
| 互联 | NVLink: 400 GB/s |
| 系统接口 | PCIe Gen 4, x16 lanes |
| 形态 | PCIe full height/length, double width |
| MIG切片 | Up to 7 GPU instances, 10GB each |
| 功耗TDP | 300 W |
| ECC | Yes |
| 发布年 | 2022 |
规格已与官方基准快照对账(
基准来源,采集 2026-10-09)· 价格以货主实际报价为准
适用场景
- 大语言模型的预训练与继续预训练,多卡通过 NVLink 组成训练集群
- 中等参数规模模型的微调、LoRA 微调与对齐训练
- 生成式 AI 与推荐系统的线上推理服务,可借助 MIG 切分提升利用率
- 科学计算与工程仿真,利用其 FP64 及 FP64 Tensor Core 能力
同族型号
采购与验货要点
- A800 分 PCIe 与 SXM4 两种形态:PCIe 版为全高全长双宽被动散热设计,必须部署在具备强制风冷风道的标准服务器内;SXM 版以模组形式集成于基板并依赖液冷整机,采购前需确认机房是否具备相应散热条件
- NVLink 速率是 A800 与 A100 的核心差异点,验货时应通过 nvidia-smi 与 nvlink topology 等工具确认卡型身份与 NVLink 桥接状态,避免以 A100 冒充或混批
- 该型号已无官方新增供应,市面以现货和二手为主,需重点核查显存健康状态、ECC 报错日志、卡体拆修痕迹与序列号一致性,SXM 版还应确认基板与整机的配套完整性
- 组机时注意 PCIe 版占用 Gen4 x16 插槽且为双宽位,机箱需预留足够槽位间距以保证风道
常见问题
A800 和 A100 到底差在哪里?
核心计算规格基本一致,最主要的官方差异是 NVLink 互联:A800 的 NVLink 带宽为 400 GB/s,低于 A100 的 600 GB/s。对单卡或少卡场景影响有限,但在大规模多机多卡训练中,互联带宽降低可能影响横向扩展效率。
A800 现在还能买到新卡吗?买二手要注意什么?
在出口管制生效后,A800 已无官方渠道的新增供应,市场流通以存量现货和二手为主。选购时应优先核查显存 ECC 报错记录、SN 序列号与标签一致性、是否经历过矿场或高负载机房使用、散热器与 NVLink 桥是否原装,并尽量选择可提供测试录像或质保期的卖家。
A800 适合跑大模型训练吗,多机互联性能够用吗?
A800 配备 80 GB HBM2 显存与完整的 Ampere Tensor Core 计算能力,是训练数十亿参数级模型的成熟选择,配合 MIG 还能切分资源跑推理。需要注意其 NVLink 为 400 GB/s,低于 A100,在超大集群的跨机通信密集型训练中可能成为瓶颈,可结合梯度压缩、通信优化等手段缓解。
采集 2026-10-09 · 侦察 龙龙(B4) · 升级厚词条走
编辑政策 流程