算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA Tesla P4

单槽半高75W无外供的推理/转码异类:Pascal INT8(DP4A)时代能量效率旗舰(官方口径60X vs CPU),半高单槽被动形态让它能进任何1U/2U服务器与NAS机箱,hyperscale视频AI(DeepStream 35路720p转码+推理并发)与自建NAS转码双场景部署量巨大;T4的前代同形兄弟,V100/T4世代后大量沉入二手市场(闲鱼500元级),是半高低功耗推理/转码二手流通的国民型号

概述

NVIDIA Tesla P4 是基于 Pascal 架构(GP104,Compute Capability 6.1)的数据中心推理与视频处理加速卡,配备 2560 个 CUDA 核心,单精度算力 5.5 TFLOPS,INT8 整数算力 22 TOPS,并支持 DP4A 四路整数点积指令。显存为 8 GB GDDR5,256-bit 位宽。整卡功耗 75 W,由 PCIe 插槽直接供电,无需外接辅助电源,采用单槽半高被动散热形态。其典型用途包括视频转码与推理并发的 hyperscale 视频分析(如 DeepStream 场景)、NAS 媒体转码以及 TensorRT INT8 推理部署。

核心规格

架构Pascal (GP104-895-A1), Compute Capability 6.1;20 SM × 128 CUDA(4 GPC × 5 SM)
显存8GB GDDR5(8 pcs 256M×32颗粒),板载ECC且出厂默认启用(官方brief:ECC Supported Enabled by default)
显存带宽192 GB/s(官方datasheet与brief同为'Up to 192 GBytes/s',全家族口径唯一无冲突)
显存位宽256bit
算力FP32 5.5 TFLOPS / INT8(DP4A) 22 TOPS(均标'* With Boost Clock Enabled';Pascal一代无Tensor Core;官方无INT4/FP64列,宁缺勿编)
CUDA核心2560(20 SM × 128,官方brief与新闻稿一致)
功耗75W(SKU 200,699-2G414-0200-100)/ 50W(SKU 201,699-2G414-0201-100);整卡全部由PCIe插槽供电,官方brief供电规格无任何外接辅助供电行(对照同场发布的P40用户指南明列CPU 8-pin)
互联PCIe Gen3 x16(brief:PCI Express 3.0 ×16,支持Lane and polarity reversal);无NVLink(官方brief/datasheet均无NVLink行;Pascal代NVLink为GP100/P100 SXM2专属)
发布年2016(官方新闻稿dateline BEIJING 2016-09-12,P4与P40同稿发布,即GTC China场合;2016-11上市;datasheet Sep16版;brief v01 2017-02-15)
形态单槽半高(Low-Profile)半长 6.6英寸被动卡:68.58mm(2.7in,高) × 167.64mm(6.6in,长),整卡240g(含螺丝挡板另计9.7g半高挡板/15.6g ATX挡板),被动散热需机箱风道(支持双向进风),无显示输出
时钟Base 885 MHz / Max Boost 1531 MHz(默认Boost 1113 MHz)/ Idle 405 MHz;显存时钟 Performance 2.8 GHz(brief Table 2原文)
媒体引擎1×解码引擎 + 2×编码引擎(datasheet:1x Decode Engine, 2x Encode Engine);官方口径35路HD(720p30) H.264实时转码+推理并发;官方15X低延迟vs上代M4/CPU、60X能效vs CPU(TensorRT+INT8场景)
视频转码定位史上部署量最大的视频转码/边缘推理卡:半高单槽75W使其可进1U/2U服务器与NAS机箱, hyperscale视频AI服务(DeepStream生态)与自建NAS转码双场景通吃
可靠性MTBF 1,677,428小时@35°C(非受控环境)/ 工作温度0-55°C / VBIOS 4Mbit EEPROM,UEFI Supported
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA T4 对比16GB GDDR6 with ECC (默认开启)70W (Total board power, 默认)
NVIDIA A100 对比40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECCSXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W
NVIDIA H20 对比96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致)400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃)
NVIDIA GB300 对比288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存)TGP 最高 1400W(单GPU,官方博客直证)
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA GeForce RTX 4090 对比24GB GDDR6X450W TGP (平均游戏315W, 建议系统电源850W)

视频讲解 VIDEO

采购与验货要点

常见问题

Tesla P4 能装进 NAS 或家用机箱吗?需要外接供电吗?
可以。P4 为单槽半高半长的被动散热卡,整卡 75 W 由 PCIe 插槽直接供电,不需要任何外接辅助电源。只要机箱有半高挡板位置、主板提供 PCIe ×16 插槽,并保证机箱内有基本风道吹过卡身(被动散热无自带风扇),即可安装使用,这也是它在 NAS 转码场景大量流通的原因。
Tesla P4 做视频转码和 INT8 推理表现如何?
官方数据显示其搭载 1 个解码引擎和 2 个编码引擎,可实现 35 路 HD(720p30)H.264 实时转码并与推理并发运行;INT8 算力为 22 TOPS(boost 频率下),借助 DP4A 指令在 TensorRT INT8 推理场景官方口径较 CPU 有约 60 倍的能效提升。需要注意它基于 Pascal 架构,无 Tensor Core,不适合以 FP16/Tensor Core 为前提的新型推理负载。
买二手 Tesla P4 要注意什么?
主要注意三点:一是确认是 75 W 的 SKU 200 还是 50 W 的 SKU 201,两者散热与性能上限不同;二是被动散热卡原厂多配服务器机箱风道,装入 NAS/塔式机箱后需自行保证气流,否则长时间高负载可能过热降频;三是核对显存(8 GB GDDR5)与 ECC 状态,跑分和显存测试排除矿场或机房高负载退役件的健康隐患。
信源
采集 2026-10-10 · 侦察 C-侦察兵-P4-1010夜 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品