规格词条 · 中卡 STANDARD CARD
NVIDIA L40
L40S同门的Ada渲染推理双能卡,48GB GDDR6+AV1编解码+300W,渲染/Omniverse/视频流处理场景性价比之选,国内现货流通量大的48GB Ada卡之一
概述
NVIDIA L40是基于NVIDIA Ada Lovelace架构的专业数据中心GPU,搭载48 GB GDDR6带ECC显存,显存位宽384 bit,CUDA核心数量18176,单精度浮点算力约90.52 TFLOPS。该卡于2022年发布,采用双槽被动散热设计,支持PCI Express Gen 4,并配备3路NVENC与3路NVDEC编解码引擎,包含AV1编解码能力。L40定位渲染与推理兼顾的双能卡,常见于3D渲染、Omniverse、视频流处理与AI推理等负载,也是国内现货流通量较大的48GB Ada架构卡之一。
核心规格
| 架构 | NVIDIA Ada Lovelace Architecture |
| 显存 | 48 GB GDDR6 with ECC |
| 显存带宽 | 864GB/s |
| 显存位宽 | 384 Bit |
| FP32算力 | 90.52 TFLOPS |
| CUDA核心 | 18176 |
| 互联 | PCI Express Gen 4 |
| 显示输出 | 4 x DP 1.4a |
| 编解码器 | 3x | 3x (Includes AV1 Encode & Decode) |
| 形态 | 4.4" (H) x 10.5" (L) Dual Slot |
| 功耗TDP | 300W |
| 散热 | Passive |
| 供电接口 | 1x PCIe CEM5 16-pin |
| NEBS Ready | Yes / Level 3 |
| 发布年 | 2022 |
规格已与官方基准快照对账(
基准来源,采集 2026-10-09)· 价格以货主实际报价为准
适用场景
- 3D渲染与虚拟协作:借助Ada架构的RT Core与Shader能力,适合DCC内容创作、离线渲染及Omniverse等数字孪生/虚拟协作平台。
- 视频流处理与转码:3路NVENC与3路NVDEC支持AV1编解码,适合云游戏、直播、点播转码等大规模视频流水线。
- AI推理:48 GB GDDR6显存可容纳较大模型,适合生成式AI、推荐系统等推理服务的规模化部署。
- 虚拟工作站(VDI):支持NVIDIA vPC/vApps与RTX Virtual Workstation(vWS),可面向虚拟桌面与远程图形办公交付GPU能力。
同族型号
采购与验货要点
- 确认整机散热与机箱形态:L40为双槽被动散热卡,依赖服务器强制风道散热,采购前需确认机箱风冷能力与风道设计,不适合普通桌面或无风扇强制风冷的封闭机箱。
- 核对供电与转接线:该卡采用1个PCIe CEM5 16-pin供电接口,需确认目标服务器电源与主板平台支持该接口,或备好合规的转接方案;同时确认平台支持PCIe Gen 4以获得完整带宽。
- 验货与合规检查:确认卡为带Root of Trust的安全启动版本,检查是否需要NEBS Level 3合规认证;核对vGPU授权类型(vPC/vApps或vWS)与使用场景匹配,并确认渠道保修与SN可验证。
常见问题
NVIDIA L40和L40S有什么区别?
两者同属Ada架构的48GB双槽被动散热数据中心卡,L40S定位更高、面向更重的AI训练与推理负载,而L40更侧重渲染、视频处理与推理等场景。具体选型应结合实际负载类型与预算综合评估,本文仅覆盖L40的官方规格。
L40适合跑大模型推理吗?
L40具备48 GB GDDR6 ECC显存和PCIe Gen 4高带宽主机互联,可承载较大参数量的推理模型,适合生成式AI等推理服务部署。是否满足具体模型需求,取决于模型的显存占用、并发量与性能目标。
L40可以用在虚拟桌面(VDI)环境吗?
可以。L40支持NVIDIA vPC、vApps以及RTX Virtual Workstation(vWS)等vGPU软件方案,能够按用户授权切分给多个虚拟机使用,适合图形办公、应用虚拟化与远程工作站等场景。
采集 2026-10-09 · 侦察 龙龙(B4) · 升级厚词条走
编辑政策 流程