| 规格 | NVIDIA Tesla V100 SXM3 32GB | NVIDIA H20 |
|---|
| 架构 | Volta (GV100) | NVIDIA Hopper(H100同架构合规裁剪版;VipraTech与腾讯新闻双源实抓) |
| 显存 | 32GB HBM2 (CoWoS) with ECC,4096bit(V100S 唯一容量;SXM3-32GB 为 DGX-2 专配同容量模组) | 96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致) |
| 显存带宽 | V100S(官方口径)1134 GB/s;SXM3-32GB 模组官方表未单列,独立源归 900GB/s 级(Wikipedia 并行 0.9TB/s / technical.city 897GB/s / videocardz 1.8Gbps)——1134 官方只归属 V100S PCIe 列 | 4.0TB/s(三源一致;显存位宽6144bit仅第三方数据库搜索摘要提及,未实抓双源,不录) |
| 显存位宽 | 4096bit | — |
| 算力 | V100S 官方口径:FP32 16.4 / FP64 8.2 / Tensor 130 TFLOPS;SXM3-32GB 官方无单列表,Wikipedia 并入 SXM2 行(15.7/7.8/125),16.4/130 官方不适用于 SXM3 | FP8 Tensor Core 296 TFLOPS(密集)/592 TFLOPS(2:4稀疏,单源);FP16/BF16 Tensor Core 148 TFLOPS(密集,单源;稀疏口径未双源实抓);TF32 Tensor Core 74 TFLOPS;FP32 44 TFLOPS;FP64 1.0 TFLOPS(合规裁剪:H100 SXM同表FP8 3958/FP16 1979/FP64 34);INT8 296 TOPS/592 TOPS(单源) |
| CUDA核心 | 5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560 | 14,592 FP32 CUDA核心(单源VipraTech) |
| 功耗 | SXM3 模组 350W(Wikipedia TDP 表 + videocardz/gpuresource 词条口径);V100S PCIe 250W(官方 datasheet 实抓) | 400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃) |
| 互联 | V100S:PCIe Gen3 x16 32GB/s,无 NVLink;SXM3-32GB:NVLink 2.0 ×12 链路经 NVSwitch 全互联(DGX-2/HGX-2 专配,SXM3 插座与 SXM2 载板不通用) | NVLink 900GB/s(VipraTech+腾讯新闻双源;第几代NVLink无实抓双源,不录代数)+PCIe Gen5 x16 128GB/s(VipraTech实抓,BurnCloud旁证Gen5) |
| 发布年 | V100S:2019(2019-11-26 上市,发布时仅 PCIe 3 形态);SXM3-32GB 模组:2018-03-27 随 DGX-2 发布(早于 V100S) | 2024(Flopper实抓Launch Year 2024;腾讯新闻2023-11-10首发报道'即将推出';具体发布日未实抓双源,不录) |
| 工艺 | TSMC 12nm FFN,21.1B 晶体管,815mm² | — |
| 形态 | SXM3 mezzanine 模组(DGX-2 独占,16卡 NVSwitch 底板)/ V100S 为 PCIe 双槽全高全长被动散热 | HGX 8路SXM基板模组(Flopper'SXM'/VipraTech'8-way HGX'/腾讯新闻'HGX方案8路GPU配置+H20 SXM';同批L20/L2为PCIe形态) |
| 特色 | V100 同芯提频 S 后缀高性能版:带宽 900→1134GB/s、Tensor 125→130、FP32 15.7→16.4(官方仅 PCIe 形态兑现);SXM3 32GB 模组是 DGX-2/NVSwitch 全互联时代的开场卡,nvidia-smi 识别名 Tesla-V100-SXM3-32GB | — |
| L2缓存 | — | 60MB(单源VipraTech) |
| MIG切片 | — | 最多7实例(VipraTech+腾讯新闻'7路MIG'双源) |
| 编解码器 | — | 7 NVDEC + 7 NVJPEG(单源VipraTech) |
| 出口合规背景 | — | 2022-10美国出口管制后对华合规特供卡:算力密度较H100大幅裁剪(FP8约为H100 SXM的7.5%),以显存96GB+NVLink900GB/s保推理场景(QQ:综合算力约H100的20%) |