| 规格 | NVIDIA V100 | NVIDIA A30 |
|---|
| 架构 | Volta (GV100) | NVIDIA Ampere |
| 显存 | 16GB / 32GB HBM2 (CoWoS) with ECC 双版本 | 24 GB HBM2 |
| 显存带宽 | 900 GB/s(16GB/32GB标准版);V100S 32GB高主频PCIe版 1134 GB/s | 933 GB/s |
| 显存位宽 | 4096bit | — |
| 算力 | FP32 15.7 / FP64 7.8 / Tensor 125 TFLOPS(SXM2@Boost口径);PCIe版官方页口径 14 / 7 / 112 | — |
| CUDA核心 | 5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560 | — |
| 功耗 | 300W (SXM2) / 250W (PCIe) | — |
| 互联 | NVLink 2.0 300GB/s 双向(SXM2, 最多6链路)/ PCIe Gen3 x16 32GB/s(PCIe版无NVLink) | PCIe Gen4: 64GB/s / Third-gen NVLINK: 200GB/s |
| 发布年 | 2017(2017-05-10 GTC发布,SXM2 Q3 2017出货;32GB版2018年推出) | — |
| 工艺 | TSMC 12nm FFN,21.1B晶体管,815mm² | — |
| 形态 | SXM2模组 / PCIe双槽全高全长被动散热 | Dual-slot, full-height, full-length (FHFL) |
| 特色 | 首款Tensor Core GPU / 首破100 TFLOPS深度学习算力的数据中心GPU | — |
| FP32算力 | — | 10.3 teraFLOPS |
| FP64算力 | — | 5.2 teraFLOPS |
| TF32算力 | — | 82 teraFLOPS | 165 teraFLOPS |
| FP16算力 | — | 165 teraFLOPS | 330 teraFLOPS |
| INT8算力 | — | 330 TOPS | 661 TOPS |
| 功耗TDP | — | 165 W |
| MIG | — | 4 GPU instances @ 6GB each |