24GB大显存边缘推理存量王:Pascal无Tensor Core时代的INT8推理旗舰,24GB单卡大显存+二手低价使其成为低预算INT8推理与小模型LLM部署的二手市场主力流通型号
NVIDIA Tesla P40是基于Pascal架构(GP102核心,Compute Capability 6.1)的数据中心推理加速卡,配备3840个CUDA核心,峰值FP32算力可达12 TFLOPS,峰值INT8算力(DP4A指令)可达47 TOPS。它拥有24 GB GDDR5显存,384-bit位宽,板载ECC出厂默认启用。Pascal一代不具备Tensor Core,其INT8加速能力依赖DP4A指令集。该卡为全高全长双槽被动散热形态,无显示输出,通过PCIe Gen3 x16与主机连接,不支持NVLink。典型用途包括INT8量化推理、图像识别与小规模语言模型部署,是二手低预算推理市场的主力型号之一。
| 架构 | Pascal (GP102), Compute Capability 6.1 |
| 显存 | 24GB GDDR5(板载ECC,出厂默认启用,可经nvidia-smi关闭;非HBM2无NVLink配套) |
| 显存带宽 | 346 GB/s(384-bit × 7.2Gbps等效;官方口径'up to 346GB/s') |
| 显存位宽 | 384bit |
| 算力 | FP32 12 TFLOPS / INT8(DP4A) 47 TOPS(Pascal一代无Tensor Core) |
| CUDA核心 | 3840(30 SM × 128,deviceQuery实测) |
| 功耗 | 250W(nvidia-smi默认=最大电源限制250.00W,min 125W;CPU 8-pin/EPS供电) |
| 互联 | PCIe Gen3 x16(实测Link Width 16x),无NVLink(GP102无NVLink,官方页与实机均无) |
| 发布年 | 2016(2016-09 GTC Europe发布·官方新闻稿落款2016-09-12;2016-10上市) |
| 形态 | 全高全长双槽被动散热(NVIDIA Form Factor 3.0,4.376英寸×10.5英寸 ≈ 111.15mm×266.7mm,无风扇无显示输出) |
| 频率 | Boost 1531 MHz / 显存等效 7.2 Gbps(deviceQuery:3615 MHz) |
| 特色 | Pascal推理专用旗舰:INT8(DP4A)指令集47 TOPS推理吞吐,24GB单卡大显存为同期最大GDDR5配置 |
| 型号 | 显存 | 功耗 |
|---|
| NVIDIA T4 对比 | 16GB GDDR6 with ECC (默认开启) | 70W (Total board power, 默认) |
| NVIDIA A100 对比 | 40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC | SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W |
| NVIDIA GB300 对比 | 288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存) | TGP 最高 1400W(单GPU,官方博客直证) |
| NVIDIA A30 对比 | 24 GB HBM2 | 165 W |
| NVIDIA GeForce RTX 4090 对比 | 24GB GDDR6X | 450W TGP (平均游戏315W, 建议系统电源850W) |
| NVIDIA RTX PRO 6000 Blackwell 对比 | 96GB GDDR7 with ECC (单卡最大显存的专业工作站 GPU) | 600W Total board power (官方), 供电 1x PCIe CEM5 16-pin, 双贯穿式散热(Double-flow-through) |