| 规格 | NVIDIA V100 | NVIDIA H800 |
|---|
| 架构 | Volta (GV100) | NVIDIA Hopper |
| 显存 | 16GB / 32GB HBM2 (CoWoS) with ECC 双版本 | 80 GB HBM2e |
| 显存带宽 | 900 GB/s(16GB/32GB标准版);V100S 32GB高主频PCIe版 1134 GB/s | 2 TB/sec |
| 显存位宽 | 4096bit | — |
| 算力 | FP32 15.7 / FP64 7.8 / Tensor 125 TFLOPS(SXM2@Boost口径);PCIe版官方页口径 14 / 7 / 112 | — |
| CUDA核心 | 5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560 | 14592 FP32 CUDA Cores per GPU |
| 功耗 | 300W (SXM2) / 250W (PCIe) | — |
| 互联 | NVLink 2.0 300GB/s 双向(SXM2, 最多6链路)/ PCIe Gen3 x16 32GB/s(PCIe版无NVLink) | NVLink: 400 GB/s |
| 发布年 | 2017(2017-05-10 GTC发布,SXM2 Q3 2017出货;32GB版2018年推出) | 2023 |
| 工艺 | TSMC 12nm FFN,21.1B晶体管,815mm² | — |
| 形态 | SXM2模组 / PCIe双槽全高全长被动散热 | PCIe full height/length, dual slot |
| 特色 | 首款Tensor Core GPU / 首破100 TFLOPS深度学习算力的数据中心GPU | — |
| 显存(94GB版) | — | 94 GB HBM3 |
| 显存带宽(94GB版) | — | 3.9 TB/sec |
| FP32算力 | — | 51 TFLOPS |
| Tensor核心 | — | 456 fourth-generation Tensor Cores per GPU |
| 系统接口 | — | PCIe Gen 5, x16 lanes |
| MIG切片 | — | Up to 7 GPU instances |
| 功耗TDP | — | 350 W |
| ECC | — | Yes |