NVIDIA A100 是基于 Ampere 架构(GA100 核心)的数据中心 GPU,采用第三代 Tensor Core,提供 40GB HBM2 与 80GB HBM2e 两种显存配置,并均有 PCIe 与 SXM4 两种形态。其 FP64 与 Tensor Core 算力组合使其同时覆盖 AI 训练、推理与高性能计算场景,并支持 Multi-Instance GPU 将单卡切分为多个实例供多用户共享。凭借庞大的装机量与生态成熟度,该型号也是二手专业卡市场流通量最大的数据中心产品之一。
| 架构 | NVIDIA Ampere (GA100),第3代 Tensor Core |
| 显存 | 40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC |
| 显存带宽 | 40GB 版 1,555 GB/s(PCIe/SXM 同);80GB SXM4 版 2,039 GB/s / 80GB PCIe 版 1,935 GB/s(官方 datasheet 四列分列口径) |
| 显存位宽 | 5120bit |
| 算力 | FP32 19.5 / FP64 9.7 / FP64 Tensor 19.5 TFLOPS;TF32 156(312*) / BF16 312(624*) / FP16 312(624*) TFLOPS / INT8 624(1248*) TOPS——官方 datasheet 四形态(40G PCIe/80G PCIe/40G SXM/80G SXM)算力同口径,*为稀疏加速 |
| 功耗 | SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W |
| 互联 | SXM4 版:NVLink 3.0 12链路 600GB/s 双向 + PCIe Gen4 64GB/s;PCIe 版:NVLink Bridge 双卡互连 600GB/s + PCIe Gen4 64GB/s |
| 发布年 | 2020(40GB 版 2020-05-14 GTC 发布;80GB 版 2020-11-16 SC20 发布) |
| CUDA核心 | 6912 FP32 CUDA(108 SM)/ 第3代 Tensor Core |
| 工艺 | TSMC 7nm(N7 定制),54.2B 晶体管,826mm² |
| MIG | Multi-Instance GPU 最多 7 硬件隔离实例(40GB 版单实例最高 5GB / 80GB 版 10GB) |
| 形态 | SXM4 模组(HGX A100 4/8/16卡、DGX A100 8卡)/ PCIe 双槽 10.5英寸全长 |