算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA GeForce RTX 4090

消费旗舰: 24GB大显存+FP32 82.6 TFLOPS, 小模型推理与算力租赁场景流通量最大的单卡之一, 二手货源充足; 2023年10月曾纳入美国对华出口管制清单(后有中国特供版4090 D)

概述

GeForce RTX 4090是NVIDIA基于Ada Lovelace架构的消费级旗舰显卡,采用AD102核心与台积电4N制程,配备16384个CUDA核心与24GB GDDR6X显存,FP32算力约82.6 TFLOPS,第四代Tensor核心带来较强的AI推理能力。凭借大显存与高单精度吞吐,它成为小模型推理、本地部署与算力租赁场景中流通量最大的单卡之一,二手货源充足。该型号后来被纳入美国对华出口管制范围,随后出现了面向中国市场的特供版RTX 4090 D。

核心规格

架构Ada Lovelace (AD102-300, 128 SM)
显存24GB GDDR6X
显存带宽1008GB/s (21Gbps x 384bit)
显存位宽384bit
算力FP32 82.6 TFLOPS (官方发布口径, 现页四舍五入标83) / Tensor 1321 AI TOPS (FP8稀疏) / RT 191 TFLOPS
CUDA核心16384 (128 SM) / Tensor Core 512 (四代) / RT Core 128 (三代)
功耗450W TGP (平均游戏315W, 建议系统电源850W)
互联PCIe Gen4 x16 (不支持NVLink)
发布年2022 (2022-09-20 GTC发布, 2022-10-12开售, MSRP $1599)
频率Base 2.23GHz / Boost 2.52GHz
工艺TSMC 4N, 763亿晶体管, 608.5mm² (AD102 满血144SM, 4090启用128)
媒体引擎2x 第八代NVENC / 1x 第五代NVDEC, AV1编解码
显示输出HDMI 2.1a x1 + DisplayPort 1.4a x3, 4K240/8K60(DSC)
形态FE三槽 304x137mm, 供电 3x8pin转接或12VHPWR(450W Gen5)
CUDA算力等级Compute Capability 8.9
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA T4 对比16GB GDDR6 with ECC (默认开启)70W (Total board power, 默认)
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA L40 对比48 GB GDDR6 with ECC300W
NVIDIA V100 对比16GB / 32GB HBM2 (CoWoS) with ECC 双版本300W (SXM2) / 250W (PCIe)
NVIDIA H200 NVL 对比141GBUp to 600W (configurable)
NVIDIA H800 对比80 GB HBM2e350 W

视频讲解 VIDEO

采购与验货要点

常见问题

RTX 4090和RTX 4090 D有什么区别?
RTX 4090 D是出口管制后面向中国市场的特供版本,CUDA核心数量、整卡功耗与官方定价均低于标准版4090。两者外观相近,购买时应通过规格核对与包装标识区分,避免按标准版价格购入特供版。
RTX 4090能跑多大的模型?
在24GB显存限制下,可以较流畅地运行中等参数量的开源大语言模型推理,配合量化技术可支持更大参数量的模型;更大规模的模型则需要多卡或更换大显存专业卡。具体取决于模型架构、量化精度与上下文长度。
二手RTX 4090值得买吗,怎么避坑?
该型号二手流通量大,价格相对友好,但需重点检查供电接口有无烧蚀痕迹、显存与核心是否长期高负载使用、风扇噪音与温度表现是否正常,并核实保修是否可转。优先选择可当面测试或提供检测报告的渠道。
信源
采集 2026-10-10 · 侦察 C-侦察兵-4090-1010 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品