规格词条 · 中卡 STANDARD CARD
NVIDIA A40
RTX A6000同芯GA102满血专业卡: 48GB GDDR6大显存+NVLink双卡拼96GB, 双槽300W被动风冷直上2U/4U服务器, 可视化渲染/虚拟工作站/AI推理三栖, OEM服务器保有量大故二手渠道货源充足, 是48GB档性价比价格锚点
概述
NVIDIA A40 是基于 Ampere 架构 GA102 的数据中心 GPU,配备 48GB GDDR6 显存(带 ECC)与 384bit 位宽,显存带宽 696GB/s。FP32 算力 37.4 TFLOPS,带稀疏加速的 BF16 可达 299.4 TFLOPS。被动散热双槽形态、300W 功耗,支持 NVLink 互联(112.5GB/s 双向,双卡可拼 96GB)。定位于渲染、视觉计算与推理一体的数据中心场景。
核心规格
| 架构 | Ampere (GA102) |
| 显存 | 48GB GDDR6 with ECC |
| 显存带宽 | 696GB/s |
| 显存位宽 | 384bit |
| 算力 | FP32 37.4 TFLOPS / TF32 74.8(149.6*) / FP16·BF16 149.7(299.4*) / INT8 299.3(598.6*) TOPS / INT4 598.7(1197.4*) TOPS |
| CUDA核心 | 10752 (84 SM) / Tensor Core 336 (三代) / RT Core 84 (二代) |
| 功耗 | 300W (被动散热, 8-pin CPU供电) |
| 互联 | NVLink 112.5GB/s (双向, 双卡可拼96GB) / PCIe Gen4 x16 (64GB/s) |
| 发布年 | 2020 (2020-10-05 GTC发布) |
| 形态 | Dual-slot, 4.4"(H) x 10.5"(L), Passive |
| 媒体引擎 | 1 Encode / 2 Decode (含AV1解码) |
| 显示输出 | 3x DisplayPort 1.4 (出厂默认禁用, 可管理软件启用) |
| MIG | 不支持 |
| RT Core性能 | 73.1 TFLOPS |
规格已与官方基准快照对账(
基准来源,采集 2026-10-10)· 价格以货主实际报价为准
适用场景
- 渲染农场与视觉计算:48GB 大显存承接大场景装配,AV1 解码辅助视频管线
- 中大规模模型推理:48GB 单卡承载量化后的大参数模型,NVLink 双卡拼接 96GB
- 虚拟工作站与云桌面:3 个 DisplayPort 1.4 输出(出厂禁用、管理软件可启用)
- 中小模型训练与微调:BF16 149.7 TFLOPS(稀疏 299.4)支撑小批量训练
同族型号
视频讲解 VIDEO
采购与验货要点
- 供电核对:A40 采用 8-pin CPU(EPS)供电接口,与常见 GPU 的 PCIe 8-pin 不同,装机前确认电源接口或备转接线
- 形态与散热:双槽被动散热(4.4" x 10.5"),必须安装在有机柜风道的服务器内,核对机箱深度与挡位
- 验货要点:NVLink 桥接器是否随卡、MIG 不支持(勿按支持 MIG 的型号口径报价)、显存 ECC 健康全检
常见问题
A40 为什么使用 8-pin CPU 供电接口?
A40 面向数据中心服务器设计,采用服务器电源体系常见的 8-pin CPU(EPS)供电接口,与消费级 GPU 的 PCIe 8-pin 不同;部署前需确认服务器电源配置或准备转接线。
A40 能否拆分多实例(MIG)?
不能。A40 不支持 MIG 多实例切分;需要按实例切分 GPU 资源时应选择支持 MIG 的数据中心型号。采购与报价时勿按 MIG 口径计算实例数。
A40 的显示输出为什么默认不可用?
A40 配备 3 个 DisplayPort 1.4 输出,出厂默认禁用,可通过 NVIDIA 管理软件启用;该设计面向虚拟工作站场景按需开启,不影响计算任务。
采集 2026-10-10 · 侦察 C-侦察兵-A40-1010 · 升级厚词条走
编辑政策 流程