算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA Tesla P40 vs NVIDIA T4

规格NVIDIA Tesla P40NVIDIA T4
架构Pascal (GP102), Compute Capability 6.1Turing (TU104-895)
显存24GB GDDR5(板载ECC,出厂默认启用,可经nvidia-smi关闭;非HBM2无NVLink配套)16GB GDDR6 with ECC (默认开启)
显存带宽346 GB/s(384-bit × 7.2Gbps等效;官方口径'up to 346GB/s')320GB/s (早期一页版datasheet口径300GB/s)
显存位宽384bit256bit
算力FP32 12 TFLOPS / INT8(DP4A) 47 TOPS(Pascal一代无Tensor Core)FP32 8.1 TFLOPS / FP16·FP32混合精度 65 TFLOPS / INT8 130 TOPS / INT4 260 TOPS
CUDA核心3840(30 SM × 128,deviceQuery实测)2,560 (40 SM) / Tensor Core 320 / RT Core 40 (白皮书口径)
功耗250W(nvidia-smi默认=最大电源限制250.00W,min 125W;CPU 8-pin/EPS供电)70W (Total board power, 默认)
互联PCIe Gen3 x16(实测Link Width 16x),无NVLink(GP102无NVLink,官方页与实机均无)PCIe Gen3 x16 (支持x8运行, Interconnect BW 32GB/s)
发布年2016(2016-09 GTC Europe发布·官方新闻稿落款2016-09-12;2016-10上市)2018 (Product Brief v01 2018-10-24初版, Dec18版datasheet © 2018 NVIDIA)
形态全高全长双槽被动散热(NVIDIA Form Factor 3.0,4.376英寸×10.5英寸 ≈ 111.15mm×266.7mm,无风扇无显示输出)单槽半高半长 Low-Profile 6.6英寸(长169.53mm), 被动散热, 板重301g
频率Boost 1531 MHz / 显存等效 7.2 Gbps(deviceQuery:3615 MHz)—
特色Pascal推理专用旗舰:INT8(DP4A)指令集47 TOPS推理吞吐,24GB单卡大显存为同期最大GDDR5配置—
时钟—Base 585MHz / Boost 1590MHz (Base为70W功耗墙下调校)
媒体引擎—1080p30解码 H.264 32路 / HEVC 44路 / VP9 32路 (白皮书Table 2, 官方页称38路full-HD)
SR-IOV—Supported; 16 VF(支持)
工艺—12nm FFN, 136亿晶体管, 545mm2 (白皮书TU104口径)
Compute APIs—CUDA, NVIDIA TensorRT, ONNX
← NVIDIA Tesla P40 身份卡 · NVIDIA T4 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品