| 规格 | NVIDIA H200 SXM | NVIDIA T4 |
|---|
| 架构 | NVIDIA Hopper(GH100核心,TSMC 4N定制工艺,800亿晶体管,814mm²,与H100 SXM同颗GH100) | Turing (TU104-895) |
| 显存 | 141GB HBM3e(6144bit总线/6.3Gbps引脚速率,官方称全球首款141GB HBM3e单卡) | 16GB GDDR6 with ECC (默认开启) |
| 显存类型 | HBM3e | — |
| 显存位宽 | 6144bit | 256bit |
| 显存带宽 | 4.8TB/s(官方页+Datasheet+新闻稿+Wikipedia四源一致) | 320GB/s (早期一页版datasheet口径300GB/s) |
| 算力 | FP8 Tensor Core 3,958 TFLOPS(含稀疏,密集1,979);FP16/BF16 TC 1,979*;TF32 TC 989*;INT8 TC 3,958 TOPS*;FP64 TC 67;FP32 67;FP64 34(SXM口径,*=With sparsity) | FP32 8.1 TFLOPS / FP16·FP32混合精度 65 TFLOPS / INT8 130 TOPS / INT4 260 TOPS |
| 功耗 | SXM最高700W(可配置);同座H100 SXM同为700W功耗档 | 70W (Total board power, 默认) |
| 互联 | NVLink 900GB/s+PCIe Gen5 128GB/s;经NVSwitch组HGX H200 4/8卡全互联(8卡FP8合计超32 PFLOPS,显存合计1.1TB) | PCIe Gen3 x16 (支持x8运行, Interconnect BW 32GB/s) |
| 发布年 | 2024(2023-11-13 SC23宣布,官方口径2024 Q2起OEM交付;业界通行记载2024-06-04全面GA,旁证级) | 2018 (Product Brief v01 2018-10-24初版, Dec18版datasheet © 2018 NVIDIA) |
| SM与CUDA核 | 132 SM / 16,896 FP32 CUDA核(GH100,与H100 SXM5同源;旁证Wikipedia Hopper表) | — |
| 加速频率 | 1,980MHz(旁证Wikipedia Hopper表,与H100 SXM行同列合并显示;NVIDIA官方未单列H200时钟,谨慎引用) | — |
| L2缓存 | 50MB(架构级,旁证Wikipedia) | — |
| MIG切片 | 最多7实例@18GB(每实例18GB,大于H200 NVL的16.5GB与H100的10GB) | — |
| 编解码器 | 7 NVDEC + 7 JPEG | — |
| 机密计算 | Confidential Computing Supported | — |
| 形态 | SXM模组(液冷/风冷由整机定,配HGX H200 4或8卡;AI Enterprise为Add-on另购) | 单槽半高半长 Low-Profile 6.6英寸(长169.53mm), 被动散热, 板重301g |
| CUDA核心 | — | 2,560 (40 SM) / Tensor Core 320 / RT Core 40 (白皮书口径) |
| 时钟 | — | Base 585MHz / Boost 1590MHz (Base为70W功耗墙下调校) |
| 媒体引擎 | — | 1080p30解码 H.264 32路 / HEVC 44路 / VP9 32路 (白皮书Table 2, 官方页称38路full-HD) |
| SR-IOV | — | Supported; 16 VF(支持) |
| 工艺 | — | 12nm FFN, 136亿晶体管, 545mm2 (白皮书TU104口径) |
| Compute APIs | — | CUDA, NVIDIA TensorRT, ONNX |