算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA L20

AD102中国特供推理卡,48GB GDDR6大显存+275W低功耗好托管,带AV1编解码,出口管制后国内现货市场AI推理与视频处理走量主力,H20的搭档

概述

NVIDIA L20 是一款面向中国市场的数据中心推理加速卡,基于 Ada Lovelace 架构的 AD102 核心。卡片配备 48 GB GDDR6 显存,通过 384 位显存接口提供大容量缓存空间,CUDA 核心数量为 11776,单精度算力为 59.35 TFLOPS,并内置 92 个光线追踪核心与 AV1 编解码单元。该卡采用双槽风冷形态与 PCIe 4.0 x16 接口,官方默认长度为 267 毫米,供电由单个 16-pin 接口提供。其定位偏向大模型推理、内容审核、视频转码等负载,常与 H20 在同一数据中心体系中分工部署。

核心规格

架构Ada Lovelace architecture
核心芯片AD102
显存48 GB GDDR6
显存位宽384 Bit
显存带宽864.0 GB/s
显存频率2250 MHz
FP32算力59.35 TFLOPS
CUDA核心11776
RT核心92
互联PCIe 4.0 x16
形态dual-slot
卡长267 mm
功耗TDP275 Watt
发布年2023
规格已与官方基准快照对账(基准来源,采集 2026-10-09)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA L40 对比48 GB GDDR6 with ECC300W
NVIDIA H200 NVL 对比141GBUp to 600W (configurable)
NVIDIA H800 对比80 GB HBM2e350 W
NVIDIA H100 NVL 对比94GB350-400W (configurable)
NVIDIA A2 对比16 GB GDDR640–60W (configurable)

采购与验货要点

常见问题

L20 适合跑大模型推理吗,能跑多大的模型?
L20 配备 48 GB 显存,适合承担推理负载。具体可承载的模型规模取决于量化方式与上下文长度,例如对较大参数量模型进行低比特量化后通常可单卡或多卡部署,建议结合实际业务的长短句与并发需求做压测评估。
L20 和 H20 应该怎么选?
两者定位互补。L20 偏向在线推理、内容审核和视频编解码等场景,H20 在训练及需要更高互联与访存能力的场景中更有优势。预算有限且以推理为主的数据中心常以 L20 走量,再按需补充 H20。
L20 用的是主动散热还是被动散热,托管方便吗?
常见公开版本的 L20 为双槽卡形态,通过 PCIe 4.0 x16 接口安装。无论采用何种散热方案,都建议在托管前核对机箱风道、卡长 267 毫米以及 16-pin 供电线缆的兼容性,避免装机后出现空间或供电不匹配的问题。
信源
采集 2026-10-09 · 侦察 龙龙(B4) · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品