规格词条 · 中卡 STANDARD CARD
NVIDIA A10
150W单槽FDH推理部署主力:云厂商保有量大(OCI/Azure NVads A10 v5/阿里云gn7i在列),24GB GDDR6+AV1解码兼顾AI推理、VDI虚拟工作站与视频处理,二手渠道量足性价比高
概述
NVIDIA A10是基于Ampere架构GA102核心的数据中心GPU,采用单槽全高全长(FHFL)设计,配备24GB GDDR6显存,通过PCIe Gen4 ×16与主机互联。其Tensor Core支持TF32、BF16、FP16及INT8/INT4等精度,FP32算力为31.2 teraFLOPS,同时集成第二代RT Core与含AV1解码在内的编解码引擎。该卡定位于AI推理、VDI虚拟桌面、虚拟工作站与视频处理等场景,广泛部署于OCI、Azure NVads A10 v5、阿里云gn7i等云实例,二手渠道流通量较大。
核心规格
| 架构 | Ampere (GA102) |
| 显存 | 24GB GDDR6 |
| 显存带宽 | 600GB/s |
| 显存位宽 | 384bit |
| 算力 | FP32 31.2 TFLOPS / TF32 62.5(125*) / FP16·BF16 125(250*) / INT8 250(500*) TOPS / INT4 500(1000*) TOPS |
| CUDA核心 | 72 SM : 9216 CUDA cores : 288 Tensor Cores |
| 功耗 | 150W |
| 互联 | PCIe Gen4 x16 (64GB/s) |
| 发布年 | 2021 (2021-04-12 GTC发布) |
| 形态 | Single-slot, full-height, full-length (FHFL) |
| 媒体引擎 | 1 Encode / 2 Decode / AV1 Decode |
规格已与官方基准快照对账(
基准来源,采集 2026-10-10)· 价格以货主实际报价为准
适用场景
- 中小规模AI推理部署:INT8量化后可达250 TOPS(稀疏翻倍至500 TOPS),适合在线服务中的视觉识别、NLP与推荐模型推理
- VDI与云桌面:借助编解码引擎与较大显存,支持多用户虚拟桌面与图形加速,是云厂商桌面实例的常见选择
- 虚拟工作站与轻度图形渲染:72个第二代RT Core可加速设计与可视化软件的实时光线追踪,满足远程图形工作站需求
- 视频处理与转码管线:双解码单元支持AV1解码,配合编码单元用于转码、审片与流媒体处理等视频工作流
同族型号
视频讲解 VIDEO
相关资讯
TSMC Sets 2030 for High-NA EUV Debut, With A10 or A11 Nodes in Line2026-09-10采购与验货要点
- 形态与机箱兼容:A10为单槽全高全长(FHFL)设计,采购前需确认服务器具备标准全长槽位与足够的后窗出风空间;单槽风冷意味着热量集中排出,机箱风道与前排进风量应能满足满载散热需求,避免邻近板卡受热。
- 互联与平台匹配:该卡依赖PCIe Gen4 ×16通道(合计64GB/s),若部署在仅支持PCIe Gen3的旧平台上,互联带宽将成为瓶颈,建议核对主板与CPU平台版本;多卡部署时应确认通道分配不因插槽拆分而降速。
- 二手采购验货:A10在二手市场流通量大,收货时应核实SN与原厂质保状态,检查散热器硅脂与风扇状态、PCIe金手指磨损与遮挡挡板是否为原装,上机后用官方工具核对设备ID、显存容量与ECC状态,并跑压力测试确认无掉卡与过热降频。
常见问题
NVIDIA A10适合跑大模型推理吗?
A10的24GB GDDR6显存可容纳中等参数量量化后的模型,配合INT8/INT4 Tensor Core算力,适合中小规模大模型推理与批量视觉、NLP推理服务。若需部署更大参数模型,通常需要多卡或更高显存档次的机型。
A10和T4比,升级点在哪里?
相比T4,A10基于Ampere架构,显存容量更大,新增TF32/BF16支持与第二代RT Core,并加入AV1解码能力,在推理吞吐、图形渲染与视频处理上均有代际提升,适合从T4升级的场景。
部署A10对服务器有什么要求?
A10为单槽全高全长卡,需要标准FHFL槽位;通过PCIe Gen4 ×16连接,建议搭配Gen4平台以获得完整互联带宽。由于采用单槽被动散热设计,服务器需提供额定风速的前进后出风道,部署前应确认供电接口与整机散热余量。
采集 2026-10-10 · 侦察 C-侦察兵-A10-1010 · 升级厚词条走
编辑政策 流程