规格词条 · 中卡 STANDARD CARD
NVIDIA L20
AD102中国特供推理卡,48GB GDDR6大显存+275W低功耗好托管,带AV1编解码,出口管制后国内现货市场AI推理与视频处理走量主力,H20的搭档
概述
NVIDIA L20 是一款面向中国市场的数据中心推理加速卡,基于 Ada Lovelace 架构的 AD102 核心。卡片配备 48 GB GDDR6 显存,通过 384 位显存接口提供大容量缓存空间,CUDA 核心数量为 11776,单精度算力为 59.35 TFLOPS,并内置 92 个光线追踪核心与 AV1 编解码单元。该卡采用双槽风冷形态与 PCIe 4.0 x16 接口,官方默认长度为 267 毫米,供电由单个 16-pin 接口提供。其定位偏向大模型推理、内容审核、视频转码等负载,常与 H20 在同一数据中心体系中分工部署。
核心规格
| 架构 | Ada Lovelace architecture |
| 核心芯片 | AD102 |
| 显存 | 48 GB GDDR6 |
| 显存位宽 | 384 Bit |
| 显存带宽 | 864.0 GB/s |
| 显存频率 | 2250 MHz |
| FP32算力 | 59.35 TFLOPS |
| CUDA核心 | 11776 |
| RT核心 | 92 |
| 互联 | PCIe 4.0 x16 |
| 形态 | dual-slot |
| 卡长 | 267 mm |
| 功耗TDP | 275 Watt |
| 发布年 | 2023 |
规格已与官方基准快照对账(
基准来源,采集 2026-10-09)· 价格以货主实际报价为准
适用场景
- 大语言模型与多模态模型的在线推理服务,48 GB 显存可容纳较大参数量的量化模型或较长上下文
- 视频转码与流媒体处理,利用 Ada 架构自带的 AV1 编解码能力进行大规模转码集群部署
- 图像生成、语音识别等生成式 AI 应用的批量推理任务
- 设计渲染与图形可视化类工作负载,借助光追核心承担部分离线渲染需求
同族型号
采购与验货要点
- 采购前确认机房对双槽风冷卡位的兼容性:该卡官方默认长度 267 毫米,需核对服务器机箱深度与气流走向,并确保供电方案匹配单个 16-pin 接口的线缆规格
- 注意区分 L20 与 H20 的定位差异:L20 侧重推理与视频处理,H20 侧重训练与更大显存带宽场景,混合部署时应按业务负载规划配比与拓扑
- 验货时核对显存容量、PCIe 4.0 x16 链路训练状态与驱动版本,现货市场渠道较多,建议要求提供序列号查询并确认官方质保范围
常见问题
L20 适合跑大模型推理吗,能跑多大的模型?
L20 配备 48 GB 显存,适合承担推理负载。具体可承载的模型规模取决于量化方式与上下文长度,例如对较大参数量模型进行低比特量化后通常可单卡或多卡部署,建议结合实际业务的长短句与并发需求做压测评估。
L20 和 H20 应该怎么选?
两者定位互补。L20 偏向在线推理、内容审核和视频编解码等场景,H20 在训练及需要更高互联与访存能力的场景中更有优势。预算有限且以推理为主的数据中心常以 L20 走量,再按需补充 H20。
L20 用的是主动散热还是被动散热,托管方便吗?
常见公开版本的 L20 为双槽卡形态,通过 PCIe 4.0 x16 接口安装。无论采用何种散热方案,都建议在托管前核对机箱风道、卡长 267 毫米以及 16-pin 供电线缆的兼容性,避免装机后出现空间或供电不匹配的问题。
采集 2026-10-09 · 侦察 龙龙(B4) · 升级厚词条走
编辑政策 流程