| 规格 | NVIDIA Tesla P40 | NVIDIA A30 |
|---|
| 架构 | Pascal (GP102), Compute Capability 6.1 | NVIDIA Ampere |
| 显存 | 24GB GDDR5(板载ECC,出厂默认启用,可经nvidia-smi关闭;非HBM2无NVLink配套) | 24 GB HBM2 |
| 显存带宽 | 346 GB/s(384-bit × 7.2Gbps等效;官方口径'up to 346GB/s') | 933 GB/s |
| 显存位宽 | 384bit | — |
| 算力 | FP32 12 TFLOPS / INT8(DP4A) 47 TOPS(Pascal一代无Tensor Core) | — |
| CUDA核心 | 3840(30 SM × 128,deviceQuery实测) | — |
| 功耗 | 250W(nvidia-smi默认=最大电源限制250.00W,min 125W;CPU 8-pin/EPS供电) | — |
| 互联 | PCIe Gen3 x16(实测Link Width 16x),无NVLink(GP102无NVLink,官方页与实机均无) | PCIe Gen4: 64GB/s / Third-gen NVLINK: 200GB/s |
| 发布年 | 2016(2016-09 GTC Europe发布·官方新闻稿落款2016-09-12;2016-10上市) | — |
| 形态 | 全高全长双槽被动散热(NVIDIA Form Factor 3.0,4.376英寸×10.5英寸 ≈ 111.15mm×266.7mm,无风扇无显示输出) | Dual-slot, full-height, full-length (FHFL) |
| 频率 | Boost 1531 MHz / 显存等效 7.2 Gbps(deviceQuery:3615 MHz) | — |
| 特色 | Pascal推理专用旗舰:INT8(DP4A)指令集47 TOPS推理吞吐,24GB单卡大显存为同期最大GDDR5配置 | — |
| FP32算力 | — | 10.3 teraFLOPS |
| FP64算力 | — | 5.2 teraFLOPS |
| TF32算力 | — | 82 teraFLOPS | 165 teraFLOPS |
| FP16算力 | — | 165 teraFLOPS | 330 teraFLOPS |
| INT8算力 | — | 330 TOPS | 661 TOPS |
| 功耗TDP | — | 165 W |
| MIG | — | 4 GPU instances @ 6GB each |