算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA A40 vs NVIDIA GeForce RTX 4090

规格NVIDIA A40NVIDIA GeForce RTX 4090
架构Ampere (GA102)Ada Lovelace (AD102-300, 128 SM)
显存48GB GDDR6 with ECC24GB GDDR6X
显存带宽696GB/s1008GB/s (21Gbps x 384bit)
显存位宽384bit384bit
算力FP32 37.4 TFLOPS / TF32 74.8(149.6*) / FP16·BF16 149.7(299.4*) / INT8 299.3(598.6*) TOPS / INT4 598.7(1197.4*) TOPSFP32 82.6 TFLOPS (官方发布口径, 现页四舍五入标83) / Tensor 1321 AI TOPS (FP8稀疏) / RT 191 TFLOPS
CUDA核心10752 (84 SM) / Tensor Core 336 (三代) / RT Core 84 (二代)16384 (128 SM) / Tensor Core 512 (四代) / RT Core 128 (三代)
功耗300W (被动散热, 8-pin CPU供电)450W TGP (平均游戏315W, 建议系统电源850W)
互联NVLink 112.5GB/s (双向, 双卡可拼96GB) / PCIe Gen4 x16 (64GB/s)PCIe Gen4 x16 (不支持NVLink)
发布年2020 (2020-10-05 GTC发布)2022 (2022-09-20 GTC发布, 2022-10-12开售, MSRP $1599)
形态Dual-slot, 4.4"(H) x 10.5"(L), PassiveFE三槽 304x137mm, 供电 3x8pin转接或12VHPWR(450W Gen5)
媒体引擎1 Encode / 2 Decode (含AV1解码)2x 第八代NVENC / 1x 第五代NVDEC, AV1编解码
显示输出3x DisplayPort 1.4 (出厂默认禁用, 可管理软件启用)HDMI 2.1a x1 + DisplayPort 1.4a x3, 4K240/8K60(DSC)
MIG不支持—
RT Core性能73.1 TFLOPS—
频率—Base 2.23GHz / Boost 2.52GHz
工艺—TSMC 4N, 763亿晶体管, 608.5mm² (AD102 满血144SM, 4090启用128)
CUDA算力等级—Compute Capability 8.9
← NVIDIA A40 身份卡 · NVIDIA GeForce RTX 4090 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品