| 规格 | NVIDIA A100 | NVIDIA V100 |
|---|
| 架构 | NVIDIA Ampere (GA100),第3代 Tensor Core | Volta (GV100) |
| 显存 | 40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC | 16GB / 32GB HBM2 (CoWoS) with ECC 双版本 |
| 显存带宽 | 40GB 版 1,555 GB/s(PCIe/SXM 同);80GB SXM4 版 2,039 GB/s / 80GB PCIe 版 1,935 GB/s(官方 datasheet 四列分列口径) | 900 GB/s(16GB/32GB标准版);V100S 32GB高主频PCIe版 1134 GB/s |
| 显存位宽 | 5120bit | 4096bit |
| 算力 | FP32 19.5 / FP64 9.7 / FP64 Tensor 19.5 TFLOPS;TF32 156(312*) / BF16 312(624*) / FP16 312(624*) TFLOPS / INT8 624(1248*) TOPS——官方 datasheet 四形态(40G PCIe/80G PCIe/40G SXM/80G SXM)算力同口径,*为稀疏加速 | FP32 15.7 / FP64 7.8 / Tensor 125 TFLOPS(SXM2@Boost口径);PCIe版官方页口径 14 / 7 / 112 |
| 功耗 | SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W | 300W (SXM2) / 250W (PCIe) |
| 互联 | SXM4 版:NVLink 3.0 12链路 600GB/s 双向 + PCIe Gen4 64GB/s;PCIe 版:NVLink Bridge 双卡互连 600GB/s + PCIe Gen4 64GB/s | NVLink 2.0 300GB/s 双向(SXM2, 最多6链路)/ PCIe Gen3 x16 32GB/s(PCIe版无NVLink) |
| 发布年 | 2020(40GB 版 2020-05-14 GTC 发布;80GB 版 2020-11-16 SC20 发布) | 2017(2017-05-10 GTC发布,SXM2 Q3 2017出货;32GB版2018年推出) |
| CUDA核心 | 6912 FP32 CUDA(108 SM)/ 第3代 Tensor Core | 5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560 |
| 工艺 | TSMC 7nm(N7 定制),54.2B 晶体管,826mm² | TSMC 12nm FFN,21.1B晶体管,815mm² |
| MIG | Multi-Instance GPU 最多 7 硬件隔离实例(40GB 版单实例最高 5GB / 80GB 版 10GB) | — |
| 形态 | SXM4 模组(HGX A100 4/8/16卡、DGX A100 8卡)/ PCIe 双槽 10.5英寸全长 | SXM2模组 / PCIe双槽全高全长被动散热 |
| 特色 | — | 首款Tensor Core GPU / 首破100 TFLOPS深度学习算力的数据中心GPU |