算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

NVIDIA L4

推理侧主力低功耗卡,国内现货流通量大,B卡长尾代表
NVIDIA L4 厂商官方图
NVIDIA 厂商官方图

实拍

NVIDIA L4 实拍NVIDIA L4 实拍
实拍图

概述

NVIDIA L4 是一款面向推理场景的低功耗数据中心 GPU,基于 AD104 芯片,采用 PCIe 接口的单槽低剖面(low-profile)形态。它配备 24GB 显存,显存带宽为 300GB/s,FP32 算力为 30.3 teraFLOPs,FP8 Tensor Core 算力可达 485 teraFLOPS。其 TDP 仅为 72W,可在常规服务器环境中大规模部署,常用于大语言模型推理、图像与视频处理等对能效比较为敏感的工作负载。

核心规格

显存24 GB GDDR6
显存带宽300 GB/s
FP32算力30.3 teraFLOPS
FP8算力485 teraFLOPS
功耗TDP72 W
互联PCIe Gen4 x16
形态1-slot low-profile
编解码器NVENC 2 | NVDEC 4 | JPEG 4
规格已与官方基准快照对账(基准来源,采集 2026-10-09)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
NVIDIA A30 对比24 GB HBM2165 W
NVIDIA L40 对比48 GB GDDR6 with ECC300W
NVIDIA H200 NVL 对比141GBUp to 600W (configurable)
NVIDIA H800 对比80 GB HBM2e350 W
NVIDIA H100 NVL 对比94GB350-400W (configurable)
NVIDIA A2 对比16 GB GDDR640–60W (configurable)

采购与验货要点

常见问题

NVIDIA L4 适合跑多大的大模型推理?
L4 配备 24GB 显存,可完整容纳多数参数量在几十亿级别的模型,或通过量化(如 FP8/INT8)承载更大参数量的模型。对于超大模型,通常需要借助张量并行切分到多卡,但 L4 采用 PCIe Gen4 x16 互联(64GB/s),多卡协同的通信带宽低于 NVLink 方案,需评估实际推理延迟。
L4 只有 72W 功耗,性能会不会不够用?
72W 的 TDP 意味着它定位为能效优先的推理卡而非训练卡。其 FP8 Tensor Core 算力可达 485 teraFLOPS,INT8 可达 485 TOPs,配合低功耗可在通用服务器中高密度部署。适合推理和视频处理负载,但不宜用于大规模训练。
L4 可以装在普通 1U/2U 服务器里吗?
可以。L4 采用 1-slot low-profile 单槽低剖面设计,通过 PCIe 接口供电和通信,不需要外接供电线,对机箱兼容性要求较低。部署时主要需注意该槽位的散热风道,以及主板是否提供 PCIe Gen4 x16 插槽以跑满 64GB/s 的接口带宽。
信源
采集 2026-10-09 · 侦察 龙龙(pilot) · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品