算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA Tesla P40 vs NVIDIA A100

规格NVIDIA Tesla P40NVIDIA A100
架构Pascal (GP102), Compute Capability 6.1NVIDIA Ampere (GA100),第3代 Tensor Core
显存24GB GDDR5(板载ECC,出厂默认启用,可经nvidia-smi关闭;非HBM2无NVLink配套)40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC
显存带宽346 GB/s(384-bit × 7.2Gbps等效;官方口径'up to 346GB/s')40GB 版 1,555 GB/s(PCIe/SXM 同);80GB SXM4 版 2,039 GB/s / 80GB PCIe 版 1,935 GB/s(官方 datasheet 四列分列口径)
显存位宽384bit5120bit
算力FP32 12 TFLOPS / INT8(DP4A) 47 TOPS(Pascal一代无Tensor Core)FP32 19.5 / FP64 9.7 / FP64 Tensor 19.5 TFLOPS;TF32 156(312*) / BF16 312(624*) / FP16 312(624*) TFLOPS / INT8 624(1248*) TOPS——官方 datasheet 四形态(40G PCIe/80G PCIe/40G SXM/80G SXM)算力同口径,*为稀疏加速
CUDA核心3840(30 SM × 128,deviceQuery实测)6912 FP32 CUDA(108 SM)/ 第3代 Tensor Core
功耗250W(nvidia-smi默认=最大电源限制250.00W,min 125W;CPU 8-pin/EPS供电)SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W
互联PCIe Gen3 x16(实测Link Width 16x),无NVLink(GP102无NVLink,官方页与实机均无)SXM4 版:NVLink 3.0 12链路 600GB/s 双向 + PCIe Gen4 64GB/s;PCIe 版:NVLink Bridge 双卡互连 600GB/s + PCIe Gen4 64GB/s
发布年2016(2016-09 GTC Europe发布·官方新闻稿落款2016-09-12;2016-10上市)2020(40GB 版 2020-05-14 GTC 发布;80GB 版 2020-11-16 SC20 发布)
形态全高全长双槽被动散热(NVIDIA Form Factor 3.0,4.376英寸×10.5英寸 ≈ 111.15mm×266.7mm,无风扇无显示输出)SXM4 模组(HGX A100 4/8/16卡、DGX A100 8卡)/ PCIe 双槽 10.5英寸全长
频率Boost 1531 MHz / 显存等效 7.2 Gbps(deviceQuery:3615 MHz)—
特色Pascal推理专用旗舰:INT8(DP4A)指令集47 TOPS推理吞吐,24GB单卡大显存为同期最大GDDR5配置—
工艺—TSMC 7nm(N7 定制),54.2B 晶体管,826mm²
MIG—Multi-Instance GPU 最多 7 硬件隔离实例(40GB 版单实例最高 5GB / 80GB 版 10GB)
← NVIDIA Tesla P40 身份卡 · NVIDIA A100 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品