| 规格 | NVIDIA V100 | NVIDIA L40 |
|---|
| 架构 | Volta (GV100) | NVIDIA Ada Lovelace Architecture |
| 显存 | 16GB / 32GB HBM2 (CoWoS) with ECC 双版本 | 48 GB GDDR6 with ECC |
| 显存带宽 | 900 GB/s(16GB/32GB标准版);V100S 32GB高主频PCIe版 1134 GB/s | 864GB/s |
| 显存位宽 | 4096bit | 384 Bit |
| 算力 | FP32 15.7 / FP64 7.8 / Tensor 125 TFLOPS(SXM2@Boost口径);PCIe版官方页口径 14 / 7 / 112 | — |
| CUDA核心 | 5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560 | 18176 |
| 功耗 | 300W (SXM2) / 250W (PCIe) | — |
| 互联 | NVLink 2.0 300GB/s 双向(SXM2, 最多6链路)/ PCIe Gen3 x16 32GB/s(PCIe版无NVLink) | PCI Express Gen 4 |
| 发布年 | 2017(2017-05-10 GTC发布,SXM2 Q3 2017出货;32GB版2018年推出) | 2022 |
| 工艺 | TSMC 12nm FFN,21.1B晶体管,815mm² | — |
| 形态 | SXM2模组 / PCIe双槽全高全长被动散热 | 4.4" (H) x 10.5" (L) Dual Slot |
| 特色 | 首款Tensor Core GPU / 首破100 TFLOPS深度学习算力的数据中心GPU | — |
| FP32算力 | — | 90.52 TFLOPS |
| 显示输出 | — | 4 x DP 1.4a |
| 编解码器 | — | 3x | 3x (Includes AV1 Encode & Decode) |
| 功耗TDP | — | 300W |
| 散热 | — | Passive |
| 供电接口 | — | 1x PCIe CEM5 16-pin |
| NEBS Ready | — | Yes / Level 3 |