算力百科COMPUTEPEDIA
规格对比 · COMPARE

NVIDIA A40 vs NVIDIA V100

规格NVIDIA A40NVIDIA V100
架构Ampere (GA102)Volta (GV100)
显存48GB GDDR6 with ECC16GB / 32GB HBM2 (CoWoS) with ECC 双版本
显存带宽696GB/s900 GB/s(16GB/32GB标准版);V100S 32GB高主频PCIe版 1134 GB/s
显存位宽384bit4096bit
算力FP32 37.4 TFLOPS / TF32 74.8(149.6*) / FP16·BF16 149.7(299.4*) / INT8 299.3(598.6*) TOPS / INT4 598.7(1197.4*) TOPSFP32 15.7 / FP64 7.8 / Tensor 125 TFLOPS(SXM2@Boost口径);PCIe版官方页口径 14 / 7 / 112
CUDA核心10752 (84 SM) / Tensor Core 336 (三代) / RT Core 84 (二代)5120 (80 SM) / Tensor Core 640 (初代) / FP64核心 2560
功耗300W (被动散热, 8-pin CPU供电)300W (SXM2) / 250W (PCIe)
互联NVLink 112.5GB/s (双向, 双卡可拼96GB) / PCIe Gen4 x16 (64GB/s)NVLink 2.0 300GB/s 双向(SXM2, 最多6链路)/ PCIe Gen3 x16 32GB/s(PCIe版无NVLink)
发布年2020 (2020-10-05 GTC发布)2017(2017-05-10 GTC发布,SXM2 Q3 2017出货;32GB版2018年推出)
形态Dual-slot, 4.4"(H) x 10.5"(L), PassiveSXM2模组 / PCIe双槽全高全长被动散热
媒体引擎1 Encode / 2 Decode (含AV1解码)—
显示输出3x DisplayPort 1.4 (出厂默认禁用, 可管理软件启用)—
MIG不支持—
RT Core性能73.1 TFLOPS—
工艺—TSMC 12nm FFN,21.1B晶体管,815mm²
特色—首款Tensor Core GPU / 首破100 TFLOPS深度学习算力的数据中心GPU
← NVIDIA A40 身份卡 · NVIDIA V100 身份卡
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品