48GB 老旗舰渲染卡(Turing TU102 满血, 全球首代光追 GPU): 二手渲染农场/虚拟工作站(vGPU/vWS)市场流通量最大的 48GB 档卡之一, 2020 年底 Ampere RTX A6000 上市后大量转入二手市场, 是 A6000 的直系前任
NVIDIA Quadro RTX 8000 是基于 Turing 架构 TU102 核心的专业工作站显卡,采用满血设计,拥有 4608 个 CUDA 核心、576 个第二代 Tensor Core 与 72 个第一代 RT Core,是业界首批提供硬件级光线追踪加速的 GPU。它配备 48GB 带 ECC 的 GDDR6 显存,位宽 384-bit,单精度算力 16.3 TFLOPS,Tensor 性能 130.5 TFLOPS。通过 NVLink 可将两块卡互联组成 96GB 池化显存。其大显存与专业驱动定位使其广泛用于渲染农场、虚拟工作站(vGPU/vWS)等场景,在 RTX A6000 上市后大量转入二手市场,是 48GB 档流通量最大的卡型之一。
| 架构 | Turing (TU102, TSMC 12nm FFN, 18.6B 晶体管) |
| 显存 | 48GB GDDR6 with ECC |
| 显存带宽 | 672GB/s (GDDR6 14Gbps) |
| 显存位宽 | 384bit |
| 算力 | FP32 16.3 TFLOPS (Boost) / Tensor 130.5 TFLOPS / FP16 32.6 TFLOPS / INT8 206.1 TOPS / RTX-OPS 84T / FP64=FP32的1/32≈509GFLOPS |
| CUDA核心 | 4608 (72 SM) / Tensor Cores 576 (图灵二代) / RT Cores 72 (一代) |
| 功耗 | 总板功耗 295W / 图形功耗 260W (含 USB-C/VirtualLink 为 295W, PNY 口径) |
| 互联 | NVLink 100GB/s 双向 (TU102 双 x8 链路, 双卡拼 96GB, NVLink 售卖) / PCIe 3.0 x16 |
| 发布年 | 2018 (2018-08-13 SIGGRAPH 温哥华发布[媒体多记08-14], Q4 2018 上市, 预计市场价 $10,000) |
| 形态 | Dual-slot 全高, 4.4"H x 10.5"L, Active 主动散热, 1x 8-pin 外接供电 |
| 显示输出 | 4x DisplayPort 1.4 + VirtualLink (USB Type-C) |
| 编解码 | 1 Encode / 1 Decode |
| VR | Yes (VR Ready, 业界首个 VirtualLink 接口) |
| API | DirectX 12.0 (FL 12_1) / OpenGL 4.6 / Vulkan 1.1 / CUDA / OpenCL / DirectCompute |
| 型号 | 显存 | 功耗 |
|---|
| NVIDIA T4 对比 | 16GB GDDR6 with ECC (默认开启) | 70W (Total board power, 默认) |
| NVIDIA A100 对比 | 40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC | SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W |
| NVIDIA H20 对比 | 96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致) | 400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃) |
| NVIDIA GB300 对比 | 288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存) | TGP 最高 1400W(单GPU,官方博客直证) |
| NVIDIA A30 对比 | 24 GB HBM2 | 165 W |
| NVIDIA GeForce RTX 4090 对比 | 24GB GDDR6X | 450W TGP (平均游戏315W, 建议系统电源850W) |