算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA V100 vs NVIDIA GeForce RTX 4090

规格NVIDIA V100NVIDIA GeForce RTX 4090
架构Volta (GV100)Ada Lovelace (AD102-300, 128 SM)
显存16GB / 32GB HBM2 (CoWoS) with ECC 双版本24GB GDDR6X
显存带宽900 GB/s(16GB/32GB标准版);V100S 32GB高主频PCIe版 1134 GB/s1008GB/s (21Gbps x 384bit)
显存位宽4096bit384bit
算力FP32 15.7 / FP64 7.8 / Tensor 125 TFLOPS(SXM2@Boost口径);PCIe版官方页口径 14 / 7 / 112FP32 82.6 TFLOPS (官方发布口径, 现页四舍五入标83) / Tensor 1321 AI TOPS (FP8稀疏) / RT 191 TFLOPS
CUDA核心5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 256016384 (128 SM) / Tensor Core 512 (四代) / RT Core 128 (三代)
功耗300W (SXM2) / 250W (PCIe)450W TGP (平均游戏315W, 建议系统电源850W)
互联NVLink 2.0 300GB/s 双向(SXM2, 最多6链路)/ PCIe Gen3 x16 32GB/s(PCIe版无NVLink)PCIe Gen4 x16 (不支持NVLink)
发布年2017(2017-05-10 GTC发布,SXM2 Q3 2017出货;32GB版2018年推出)2022 (2022-09-20 GTC发布, 2022-10-12开售, MSRP $1599)
工艺TSMC 12nm FFN,21.1B晶体管,815mm²TSMC 4N, 763亿晶体管, 608.5mm² (AD102 满血144SM, 4090启用128)
形态SXM2模组 / PCIe双槽全高全长被动散热FE三槽 304x137mm, 供电 3x8pin转接或12VHPWR(450W Gen5)
特色首款Tensor Core GPU / 首破100 TFLOPS深度学习算力的数据中心GPU—
频率—Base 2.23GHz / Boost 2.52GHz
媒体引擎—2x 第八代NVENC / 1x 第五代NVDEC, AV1编解码
显示输出—HDMI 2.1a x1 + DisplayPort 1.4a x3, 4K240/8K60(DSC)
CUDA算力等级—Compute Capability 8.9
← NVIDIA V100 身份卡 · NVIDIA GeForce RTX 4090 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品