算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA Tesla P100

深度学习过渡期分水岭旗舰:史上首块HBM2 GPU(16GB)+NVLink首发+DGX-1心脏,Pascal无Tensor Core时代用FP16 2:1硬扛训练的过渡主力;V100迭代后大量SXM2/PCIe存量沉入二手市场,16GB大显存低价卡至今是二手小模型/推理部署流通型号

概述

NVIDIA Tesla P100基于Pascal架构的GP100核心,采用16nm FinFET工艺制造,是NVIDIA首款采用HBM2高带宽显存的GPU,配备16GB CoWoS封装显存与4096-bit显存接口。该卡分为SXM2模组与PCIe两种形态:SXM2版本首次引入NVLink互连技术,为后续DGX系列整机奠定基础;PCIe版本面向标准服务器。计算能力6.0,无Tensor Core,支持FP16双倍吞吐。其典型用途为深度学习训练与推理、高性能计算以及需要较大显存容量的批处理任务,目前亦以二手存量形式流通于小模型部署场景。

核心规格

架构Pascal (GP100), Compute Capability 6.0;16nm FinFET、610mm²、153亿晶体管(GP100全配60 SM,P100用56 SM)
显存16GB CoWoS HBM2(四栈4-die,HBM2原生ECC无容量/带宽开销;PCIe版另有12GB@549GB/s变体)
显存带宽732 GB/s(官方datasheet口径;白皮书正文按栈180GB/s×4=720为粗算口径;12GB PCIe变体549 GB/s)
显存位宽4096bit(8×512-bit内存控制器,deviceQuery实机两版同)
算力双口径:SXM2版 FP32 10.6 / FP16 21.2 / FP64 5.3 TFLOPS;PCIe版 FP32 9.3 / FP16 18.7 / FP64 4.7 TFLOPS(Pascal一代无Tensor Core,FP16经GP100专用单元2:1吞吐)
CUDA核心3584(56 SM × 64,deviceQuery实机;FP64单元1792=32/SM)
功耗SXM2 300W(nvidia-smi默认=最大,min 150W)/ PCIe 250W(默认=最大,min 125W)
互联SXM2版NVLink 4 Link×40GB/s=160GB/s双向(全球首发)+PCIe Gen3;PCIe版无NVLink仅PCIe Gen3 x16
发布年2016(2016-04-05 GTC圣何塞发布,官方dev blog落款;SXM2随DGX-1先行,PCIe版2016-09起出货)
形态SXM2底板mezzanine(140mm×78mm,300W,件号900-2H403-0000-000)/ PCIe全高全长双槽被动(250W),均无风扇
频率SXM2:基础1328/Boost 1480 MHz(白皮书对比表);PCIe:应用1189/max 1328 MHz(nvidia-smi实测);显存715 MHz(等效1.43Gbps×2=732GB/s吻合)
特色史上第一块HBM2显存GPU+NVLink首发卡、Pascal数据中心旗舰;DGX-1八卡170 TFLOPS FP16的AI超算心脏;无Tensor Core时代深度学习过渡期主力,现存量大、二手流通活跃
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA T4 对比16GB GDDR6 with ECC (默认开启)70W (Total board power, 默认)
NVIDIA A100 对比40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECCSXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W
NVIDIA H20 对比96GB HBM3(Flopper/VipraTech/腾讯新闻三源一致)400W TDP(Flopper/VipraTech规格表/腾讯新闻'热设计功耗400W'三源;VipraTech正文另有350W矛盾口径已弃)
NVIDIA GB300 对比288GB HBM3e(单GPU封装;超级芯片576GB;HGX板级2.1TB/机柜20TB并存)TGP 最高 1400W(单GPU,官方博客直证)
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA GeForce RTX 4090 对比24GB GDDR6X450W TGP (平均游戏315W, 建议系统电源850W)

视频讲解 VIDEO

采购与验货要点

常见问题

Tesla P100的SXM2版和PCIe版有什么区别,该怎么选?
SXM2版为mezzanine底板模组,支持四链路NVLink互连,适合多卡并行的整机(如DGX-1)场景;PCIe版为标准Gen3 x16插卡,无NVLink,兼容普通服务器但多卡通信走PCIe总线。若目标是单卡推理或通用部署,PCIe版更易部署;追求多卡扩展性则需SXM2整机支持。
P100没有Tensor Core,跑深度学习还值得吗?
P100属于Tensor Core出现之前的架构,训练吞吐主要依赖FP16双倍速率与高显存带宽。对中小模型训练尚可胜任,但与现代带Tensor Core的卡相比效率差距明显。目前该卡更多用于小模型训练、推理部署等对吞吐要求不极端、且显存容量需求较大的场景,性价比是其主要优势。
二手Tesla P100需要注意什么?
首先确认显存版本(16GB或PCIe版12GB变体)与带宽规格差异;其次该卡为被动散热,必须装入有完善风道的服务器机箱,不能裸机使用;再次检查ECC是否正常启用、HBM2显存是否报错;最后注意SXM2版无法在普通主板上直接使用,需要专用底板或整机。
信源
采集 2026-10-10 · 侦察 C-侦察兵-P100-1010夜 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品