| 规格 | NVIDIA Tesla V100 SXM3 32GB | NVIDIA T4 |
|---|
| 架构 | Volta (GV100) | Turing (TU104-895) |
| 显存 | 32GB HBM2 (CoWoS) with ECC,4096bit(V100S 唯一容量;SXM3-32GB 为 DGX-2 专配同容量模组) | 16GB GDDR6 with ECC (默认开启) |
| 显存带宽 | V100S(官方口径)1134 GB/s;SXM3-32GB 模组官方表未单列,独立源归 900GB/s 级(Wikipedia 并行 0.9TB/s / technical.city 897GB/s / videocardz 1.8Gbps)——1134 官方只归属 V100S PCIe 列 | 320GB/s (早期一页版datasheet口径300GB/s) |
| 显存位宽 | 4096bit | 256bit |
| 算力 | V100S 官方口径:FP32 16.4 / FP64 8.2 / Tensor 130 TFLOPS;SXM3-32GB 官方无单列表,Wikipedia 并入 SXM2 行(15.7/7.8/125),16.4/130 官方不适用于 SXM3 | FP32 8.1 TFLOPS / FP16·FP32混合精度 65 TFLOPS / INT8 130 TOPS / INT4 260 TOPS |
| CUDA核心 | 5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560 | 2,560 (40 SM) / Tensor Core 320 / RT Core 40 (白皮书口径) |
| 功耗 | SXM3 模组 350W(Wikipedia TDP 表 + videocardz/gpuresource 词条口径);V100S PCIe 250W(官方 datasheet 实抓) | 70W (Total board power, 默认) |
| 互联 | V100S:PCIe Gen3 x16 32GB/s,无 NVLink;SXM3-32GB:NVLink 2.0 ×12 链路经 NVSwitch 全互联(DGX-2/HGX-2 专配,SXM3 插座与 SXM2 载板不通用) | PCIe Gen3 x16 (支持x8运行, Interconnect BW 32GB/s) |
| 发布年 | V100S:2019(2019-11-26 上市,发布时仅 PCIe 3 形态);SXM3-32GB 模组:2018-03-27 随 DGX-2 发布(早于 V100S) | 2018 (Product Brief v01 2018-10-24初版, Dec18版datasheet © 2018 NVIDIA) |
| 工艺 | TSMC 12nm FFN,21.1B 晶体管,815mm² | 12nm FFN, 136亿晶体管, 545mm2 (白皮书TU104口径) |
| 形态 | SXM3 mezzanine 模组(DGX-2 独占,16卡 NVSwitch 底板)/ V100S 为 PCIe 双槽全高全长被动散热 | 单槽半高半长 Low-Profile 6.6英寸(长169.53mm), 被动散热, 板重301g |
| 特色 | V100 同芯提频 S 后缀高性能版:带宽 900→1134GB/s、Tensor 125→130、FP32 15.7→16.4(官方仅 PCIe 形态兑现);SXM3 32GB 模组是 DGX-2/NVSwitch 全互联时代的开场卡,nvidia-smi 识别名 Tesla-V100-SXM3-32GB | — |
| 时钟 | — | Base 585MHz / Boost 1590MHz (Base为70W功耗墙下调校) |
| 媒体引擎 | — | 1080p30解码 H.264 32路 / HEVC 44路 / VP9 32路 (白皮书Table 2, 官方页称38路full-HD) |
| SR-IOV | — | Supported; 16 VF(支持) |
| Compute APIs | — | CUDA, NVIDIA TensorRT, ONNX |