| 规格 | NVIDIA RTX PRO 5000 Blackwell | NVIDIA A100 |
|---|
| 架构 | NVIDIA Blackwell (GB202, TSMC 4nm 4N, 满血 92.2B 晶体管) | NVIDIA Ampere (GA100),第3代 Tensor Core |
| 显存 | 48GB GDDR7 with ECC (另有 72GB 版: RTX PRO 5000 72GB Blackwell, 2025-12-18 GA) | 40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC |
| 显存带宽 | 1344GB/s (datasheet 正文口径 1.3TB/s; 384-bit × 28Gbps ÷ 8 = 1344 自洽) | 40GB 版 1,555 GB/s(PCIe/SXM 同);80GB SXM4 版 2,039 GB/s / 80GB PCIe 版 1,935 GB/s(官方 datasheet 四列分列口径) |
| 显存位宽 | 384bit (GB202 满血 512-bit 的 3/4 配置) | 5120bit |
| 算力 | FP32 65 TFLOPS (Boost) / RT Core 196 TFLOPS / AI TOPS 2064 (注2: Effective FP4 TOPS with sparsity) | FP32 19.5 / FP64 9.7 / FP64 Tensor 19.5 TFLOPS;TF32 156(312*) / BF16 312(624*) / FP16 312(624*) TFLOPS / INT8 624(1248*) TOPS——官方 datasheet 四形态(40G PCIe/80G PCIe/40G SXM/80G SXM)算力同口径,*为稀疏加速 |
| CUDA核心 | 14080 (110 SM×128) / Tensor Cores 440 (第五代) / RT Cores 110 (第四代) | 6912 FP32 CUDA(108 SM)/ 第3代 Tensor Core |
| 功耗 | 总板功耗 300W (1x PCIe CEM5 16-pin 外接供电, 主动散热) | SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W |
| 互联 | PCIe 5.0 x16 (无 NVLink——官方 datasheet 全表未列 NVLink, MIG 取代多卡显存堆叠方案) | SXM4 版:NVLink 3.0 12链路 600GB/s 双向 + PCIe Gen4 64GB/s;PCIe 版:NVLink Bridge 双卡互连 600GB/s + PCIe Gen4 64GB/s |
| 发布年 | 2025 (GTC 2025-03-18 官宣, 2025 夏上市; 72GB 变体 2025-12-18 GA) | 2020(40GB 版 2020-05-14 GTC 发布;80GB 版 2020-11-16 SC20 发布) |
| 形态 | Dual-slot 双槽全高, 4.4" x 10.5" L, Active 主动散热 | SXM4 模组(HGX A100 4/8/16卡、DGX A100 8卡)/ PCIe 双槽 10.5英寸全长 |
| 显示输出 | 4x DisplayPort 2.1b (8K@240Hz / 16K@60Hz) | — |
| 编解码 | 3x NVENC (第九代) / 3x NVDEC (第六代, 支持 4:2:2) | — |
| MIG | 支持 (48GB 版: 最多 2x 24GB 或 1x 48GB; 72GB 版: 2x 36GB 或 1x 72GB) | Multi-Instance GPU 最多 7 硬件隔离实例(40GB 版单实例最高 5GB / 80GB 版 10GB) |
| API | DirectX 12 (Shader Model 6.6) / OpenGL 4.6 / Vulkan 1.3 / CUDA 12.8 / OpenCL 3.0 / DirectCompute | — |
| 工艺 | — | TSMC 7nm(N7 定制),54.2B 晶体管,826mm² |