| 规格 | NVIDIA GeForce RTX 5080 | NVIDIA H20 |
|---|
| 架构 | NVIDIA Blackwell (GB203, 满血 84 SM 全部启用) | NVIDIA Hopper(H100同架构合规裁剪版;VipraTech与腾讯新闻双源实抓) |
| 显存 | 16GB GDDR7 (30Gbps 有效时钟, 消费级 GDDR7 第二代量产卡) | 96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致) |
| 显存带宽 | 960 GB/s (官方对比页原文 960 GB/sec; 30Gbps x 256bit / 8 = 960 算术自洽) | 4.0TB/s(三源一致;显存位宽6144bit仅第三方数据库搜索摘要提及,未实抓双源,不录) |
| 显存位宽 | 256bit | — |
| 算力 | FP32 56.3 TFLOPS (technical.city 实抓 56.28 = 10752 x 2 x 2.617GHz 算术自洽; 官方 50 系页不列 shader TFLOPS) / Tensor 第五代 1801 AI TOPS (官方口径, 未标精度) / RT 第四代 171 TFLOPS | FP8 Tensor Core 296 TFLOPS(密集)/592 TFLOPS(2:4稀疏,单源);FP16/BF16 Tensor Core 148 TFLOPS(密集,单源;稀疏口径未双源实抓);TF32 Tensor Core 74 TFLOPS;FP32 44 TFLOPS;FP64 1.0 TFLOPS(合规裁剪:H100 SXM同表FP8 3958/FP16 1979/FP64 34);INT8 296 TOPS/592 TOPS(单源) |
| CUDA核心 | 10752 (84 SM, GB203 满血) / Tensor Core 336 / RT Core 84 / TMU 336 / ROP 112 | 14,592 FP32 CUDA核心(单源VipraTech) |
| 功耗 | 360W TGP (建议系统电源 850W, 最高 GPU 温度 88°C) | 400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃) |
| 互联 | PCIe Gen 5 x16 (无 NVLink, 支持 Resizable BAR) | NVLink 900GB/s(VipraTech+腾讯新闻双源;第几代NVLink无实抓双源,不录代数)+PCIe Gen5 x16 128GB/s(VipraTech实抓,BurnCloud旁证Gen5) |
| 发布年 | 2025 (2025-01-06 CES 发布, 2025-01-30 开售, MSRP $999) | 2024(Flopper实抓Launch Year 2024;腾讯新闻2023-11-10首发报道'即将推出';具体发布日未实抓双源,不录) |
| 频率 | Base 2.30GHz / Boost 2.62GHz (精确值 2295/2617 MHz) | — |
| 工艺 | TSMC 4N (消费级定制节点), 456亿晶体管, 378mm² (GB203 满血 84SM, 5080 全部启用) | — |
| 媒体引擎 | 2x 第九代NVENC / 2x 第六代NVDEC, AV1 编解码 | — |
| 显示输出 | DisplayPort 2.1b (UHBR20) x3 + HDMI 2.1b x1, 4K480Hz/8K165Hz (DSC), 4 屏, HDCP 2.3 | — |
| 形态 | FE 双槽 304x137mm (SFF-Ready Enthusiast), 供电 3x8pin 转接 或 1x 450W+ PCIe Gen5 (12V-2x6) | HGX 8路SXM基板模组(Flopper'SXM'/VipraTech'8-way HGX'/腾讯新闻'HGX方案8路GPU配置+H20 SXM';同批L20/L2为PCIe形态) |
| CUDA算力等级 | Compute Capability 12.0 | — |
| L2缓存 | — | 60MB(单源VipraTech) |
| MIG切片 | — | 最多7实例(VipraTech+腾讯新闻'7路MIG'双源) |
| 编解码器 | — | 7 NVDEC + 7 NVJPEG(单源VipraTech) |
| 出口合规背景 | — | 2022-10美国出口管制后对华合规特供卡:算力密度较H100大幅裁剪(FP8约为H100 SXM的7.5%),以显存96GB+NVLink900GB/s保推理场景(QQ:综合算力约H100的20%) |