算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA Tesla P100 vs NVIDIA GeForce RTX 4090

规格NVIDIA Tesla P100NVIDIA GeForce RTX 4090
架构Pascal (GP100), Compute Capability 6.0;16nm FinFET、610mm²、153亿晶体管(GP100全配60 SM,P100用56 SM)Ada Lovelace (AD102-300, 128 SM)
显存16GB CoWoS HBM2(四栈4-die,HBM2原生ECC无容量/带宽开销;PCIe版另有12GB@549GB/s变体)24GB GDDR6X
显存带宽732 GB/s(官方datasheet口径;白皮书正文按栈180GB/s×4=720为粗算口径;12GB PCIe变体549 GB/s)1008GB/s (21Gbps x 384bit)
显存位宽4096bit(8×512-bit内存控制器,deviceQuery实机两版同)384bit
算力双口径:SXM2版 FP32 10.6 / FP16 21.2 / FP64 5.3 TFLOPS;PCIe版 FP32 9.3 / FP16 18.7 / FP64 4.7 TFLOPS(Pascal一代无Tensor Core,FP16经GP100专用单元2:1吞吐)FP32 82.6 TFLOPS (官方发布口径, 现页四舍五入标83) / Tensor 1321 AI TOPS (FP8稀疏) / RT 191 TFLOPS
CUDA核心3584(56 SM × 64,deviceQuery实机;FP64单元1792=32/SM)16384 (128 SM) / Tensor Core 512 (四代) / RT Core 128 (三代)
功耗SXM2 300W(nvidia-smi默认=最大,min 150W)/ PCIe 250W(默认=最大,min 125W)450W TGP (平均游戏315W, 建议系统电源850W)
互联SXM2版NVLink 4 Link×40GB/s=160GB/s双向(全球首发)+PCIe Gen3;PCIe版无NVLink仅PCIe Gen3 x16PCIe Gen4 x16 (不支持NVLink)
发布年2016(2016-04-05 GTC圣何塞发布,官方dev blog落款;SXM2随DGX-1先行,PCIe版2016-09起出货)2022 (2022-09-20 GTC发布, 2022-10-12开售, MSRP $1599)
形态SXM2底板mezzanine(140mm×78mm,300W,件号900-2H403-0000-000)/ PCIe全高全长双槽被动(250W),均无风扇FE三槽 304x137mm, 供电 3x8pin转接或12VHPWR(450W Gen5)
频率SXM2:基础1328/Boost 1480 MHz(白皮书对比表);PCIe:应用1189/max 1328 MHz(nvidia-smi实测);显存715 MHz(等效1.43Gbps×2=732GB/s吻合)Base 2.23GHz / Boost 2.52GHz
特色史上第一块HBM2显存GPU+NVLink首发卡、Pascal数据中心旗舰;DGX-1八卡170 TFLOPS FP16的AI超算心脏;无Tensor Core时代深度学习过渡期主力,现存量大、二手流通活跃—
工艺—TSMC 4N, 763亿晶体管, 608.5mm² (AD102 满血144SM, 4090启用128)
媒体引擎—2x 第八代NVENC / 1x 第五代NVDEC, AV1编解码
显示输出—HDMI 2.1a x1 + DisplayPort 1.4a x3, 4K240/8K60(DSC)
CUDA算力等级—Compute Capability 8.9
← NVIDIA Tesla P100 身份卡 · NVIDIA GeForce RTX 4090 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品