算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA A40 vs NVIDIA T4

规格NVIDIA A40NVIDIA T4
架构Ampere (GA102)Turing (TU104-895)
显存48GB GDDR6 with ECC16GB GDDR6 with ECC (默认开启)
显存带宽696GB/s320GB/s (早期一页版datasheet口径300GB/s)
显存位宽384bit256bit
算力FP32 37.4 TFLOPS / TF32 74.8(149.6*) / FP16·BF16 149.7(299.4*) / INT8 299.3(598.6*) TOPS / INT4 598.7(1197.4*) TOPSFP32 8.1 TFLOPS / FP16·FP32混合精度 65 TFLOPS / INT8 130 TOPS / INT4 260 TOPS
CUDA核心10752 (84 SM) / Tensor Core 336 (三代) / RT Core 84 (二代)2,560 (40 SM) / Tensor Core 320 / RT Core 40 (白皮书口径)
功耗300W (被动散热, 8-pin CPU供电)70W (Total board power, 默认)
互联NVLink 112.5GB/s (双向, 双卡可拼96GB) / PCIe Gen4 x16 (64GB/s)PCIe Gen3 x16 (支持x8运行, Interconnect BW 32GB/s)
发布年2020 (2020-10-05 GTC发布)2018 (Product Brief v01 2018-10-24初版, Dec18版datasheet © 2018 NVIDIA)
形态Dual-slot, 4.4"(H) x 10.5"(L), Passive单槽半高半长 Low-Profile 6.6英寸(长169.53mm), 被动散热, 板重301g
媒体引擎1 Encode / 2 Decode (含AV1解码)1080p30解码 H.264 32路 / HEVC 44路 / VP9 32路 (白皮书Table 2, 官方页称38路full-HD)
显示输出3x DisplayPort 1.4 (出厂默认禁用, 可管理软件启用)—
MIG不支持—
RT Core性能73.1 TFLOPS—
时钟—Base 585MHz / Boost 1590MHz (Base为70W功耗墙下调校)
SR-IOV—Supported; 16 VF(支持)
工艺—12nm FFN, 136亿晶体管, 545mm2 (白皮书TU104口径)
Compute APIs—CUDA, NVIDIA TensorRT, ONNX
← NVIDIA A40 身份卡 · NVIDIA T4 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品