算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA A100 vs NVIDIA GeForce RTX 4090

规格NVIDIA A100NVIDIA GeForce RTX 4090
架构NVIDIA Ampere (GA100),第3代 Tensor CoreAda Lovelace (AD102-300, 128 SM)
显存40GB HBM2 / 80GB HBM2e 双版本(80GB 版 2020-11-16 SC20 增发),带 ECC24GB GDDR6X
显存带宽40GB 版 1,555 GB/s(PCIe/SXM 同);80GB SXM4 版 2,039 GB/s / 80GB PCIe 版 1,935 GB/s(官方 datasheet 四列分列口径)1008GB/s (21Gbps x 384bit)
显存位宽5120bit384bit
算力FP32 19.5 / FP64 9.7 / FP64 Tensor 19.5 TFLOPS;TF32 156(312*) / BF16 312(624*) / FP16 312(624*) TFLOPS / INT8 624(1248*) TOPS——官方 datasheet 四形态(40G PCIe/80G PCIe/40G SXM/80G SXM)算力同口径,*为稀疏加速FP32 82.6 TFLOPS (官方发布口径, 现页四舍五入标83) / Tensor 1321 AI TOPS (FP8稀疏) / RT 191 TFLOPS
功耗SXM4 400W(40GB/80GB 同);PCIe 版 40GB 250W / 80GB 300W450W TGP (平均游戏315W, 建议系统电源850W)
互联SXM4 版:NVLink 3.0 12链路 600GB/s 双向 + PCIe Gen4 64GB/s;PCIe 版:NVLink Bridge 双卡互连 600GB/s + PCIe Gen4 64GB/sPCIe Gen4 x16 (不支持NVLink)
发布年2020(40GB 版 2020-05-14 GTC 发布;80GB 版 2020-11-16 SC20 发布)2022 (2022-09-20 GTC发布, 2022-10-12开售, MSRP $1599)
CUDA核心6912 FP32 CUDA(108 SM)/ 第3代 Tensor Core16384 (128 SM) / Tensor Core 512 (四代) / RT Core 128 (三代)
工艺TSMC 7nm(N7 定制),54.2B 晶体管,826mm²TSMC 4N, 763亿晶体管, 608.5mm² (AD102 满血144SM, 4090启用128)
MIGMulti-Instance GPU 最多 7 硬件隔离实例(40GB 版单实例最高 5GB / 80GB 版 10GB)—
形态SXM4 模组(HGX A100 4/8/16卡、DGX A100 8卡)/ PCIe 双槽 10.5英寸全长FE三槽 304x137mm, 供电 3x8pin转接或12VHPWR(450W Gen5)
频率—Base 2.23GHz / Boost 2.52GHz
媒体引擎—2x 第八代NVENC / 1x 第五代NVDEC, AV1编解码
显示输出—HDMI 2.1a x1 + DisplayPort 1.4a x3, 4K240/8K60(DSC)
CUDA算力等级—Compute Capability 8.9
← NVIDIA A100 身份卡 · NVIDIA GeForce RTX 4090 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品