算力百科COMPUTEPEDIA

算力百科 › 机型词条 › L40S

NVIDIA L40S 官方图(厂商图)
厂商图 · 萬安算力百科(NVIDIA 官网)

L40S

NVIDIA Ada Lovelace · 48GB 推理/渲染双能 · 机型词条 #011

概述OVERVIEW

L40S是 NVIDIA Ada Lovelace 架构的PCIe 双槽数据中心 GPU:48GB GDDR6 ECC、FP8 Tensor Core 1,466 TFLOPS(稀疏口径)、FP32 91.6 TFLOPS,350W 双槽被动形态——官方给它的定位是「渲染与推理兼顾的双能卡」:图形(3×NVENC/3×NVDEC 含 AV1、RT Core 212 TFLOPS)与 AI 推理(FP8/INT8)一台机器全包(NVIDIA 官方规格口径[1])。

它在国内现货市场的走红逻辑很朴素:48GB 大显存 + PCIe 即插即用 + 不占 NVLink 资源——不需要 HGX 基板、不需要整机定制,普通 2U 服务器插上就能跑 70B 级量化推理与 SD/视频生成管线。它是 2024-2026 年推理侧走量最大的数据中心卡之一(本库验货经验口径),也是「AI 推理 + 渲染农场 + 视频转码」混合业务的最优解之一。

买 L40S 的三件事:与 L40/L40S 的价差核对(差 2 TFLOPS 的 FP32 与 50W 功耗,价差要对得上)、16-pin 供电转接(老电源要合规转接线)、Secure Boot 与 NEBS 认证状态(企业合规场景的硬指标,官方规格口径[1])。本词条不带行情带——价格以货主实际报价为准。

适用场景FIT

萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%,按场景调权。

AI 推理服务88萬安指数
48GB + FP8 1,466 TFLOPS:70B 级量化推理、SD/视频生成管线的性价比主力——PCIe 即插即用是部署最大优势。
视频转码 / 直播90萬安指数
3×NVENC + 3×NVDEC 含 AV1 编解码——云游戏、直播、点播转码大规模流水线的算力底座。
3D 渲染 / Omniverse88萬安指数
RT Core 212 TFLOPS + 第四代 Tensor Core——DCC 内容创作、离线渲染与数字孪生兼顾(官方定位口径[1])。
大模型训练45萬安指数
无 NVLink、无 MIG——训练侧既缺互联又缺切分能力,L40S 的定位不在训练,选型别错位。

沿革HISTORY

2023 年,L40S 发布:Ada Lovelace 架构的 L40 升级版——FP32 91.6 TFLOPS(L40 为 90.5)、同款 48GB GDDR6 与 3×NVENC/3×NVDEC,主攻「生成式 AI 推理+图形」双能定位(NVIDIA 官方规格与产品线口径[1][2])。

2024 年,推理走量期:生成式 AI 推理需求爆发,L40S 以「48GB + PCIe 即插即用」的组合成为推理侧走量主力——视频生成管线(SD/可灵类)、大模型量化推理、转码农场三线并进(本库整理口径)。

2025-2026 年,现货主力地位延续:更新的 RTX 6000 Ada(工作站线)与 L40(原版)并行流通,L40S 凭借 FP8 与 NEBS 认证保持推理侧性价比甜点位。后续 Ada 后继产品线随 NVIDIA 公开路线图演进。跨境流通政策仍在演进,采购时以主管部门政策与专业意见为准(公开报道口径)。

技术规格SPECIFICATIONS

项目规格(NVIDIA L40S · 官方口径)
GPU 架构NVIDIA Ada Lovelace
单卡显存48GB GDDR6 with ECC
显存带宽864GB/s
CUDA / Tensor / RT 核心18,176 CUDA · 568 个第四代 Tensor Core · 142 个第三代 RT Core(RT 性能 212 TFLOPS)
FP3291.6 TFLOPS
TF32 Tensor183 TFLOPS(稀疏 366)
BF16 / FP16 Tensor362.05 TFLOPS(稀疏 733)
FP8 / INT8 Tensor733 TFLOPS(稀疏 1,466)
编解码器3× NVENC | 3× NVDEC(含 AV1 编解码)
主机接口PCIe Gen4 x16(双向 64GB/s)
功耗 / 供电350W · 1× 16-pin
形态4.4"(H) × 10.5"(L) 双槽 · 被动散热
显示输出4× DisplayPort 1.4a
安全 / 认证Secure Boot with Root of Trust · NEBS Ready Level 3
MIG / NVLink不支持 MIG · 不支持 NVLink(PCIe 独立卡定位)

规格以 NVIDIA 官方快照为准(2026-10 口径[1],与本库薄卡逐条对账一致);「稀疏」为官方以星号标注口径,dense 减半。

FP32 91.6 FP16 733* FP8 1,466*TFLOPS(稀疏口径) L40S 精度算力阶梯(NVIDIA 官方口径,*为稀疏)

L40 家族对照L40 FAMILY

项目L40L40S(本词条)L40S vs L40 一句话
FP3290.5 TFLOPS91.6 TFLOPSFP32 差 1 档、功耗差 50W、价差要匹配——推理优先选 L40S,纯渲染预算敏感看 L40
功耗300W350W
显存48GB GDDR6 ECC48GB GDDR6 ECC

L40 对照为本库薄卡同款官方快照口径;L40S 的 FP8/INT8 提升来自频率与供电强化(同架构)。

家族成员FAMILY

Ada Lovelace 数据中心卡家族按定位分档;L40S 是推理/图形双能档:

L40S(48GB · FP8 双能旗舰 · 本词条)L40(48GB · 原版 · 渲染侧重)L4(24GB · 1U 低功耗推理 · 详见薄卡)RTX 6000 Ada(48GB 工作站线 · 显示输出完整)

散热与部署COOLING

L40S 是 4.4 英寸高 × 10.5 英寸长的双槽被动卡(350W、1× 16-pin 供电)——被动散热依赖服务器强制风道,普通塔式工作站插卡要加涡轮风扇方案。部署三对表:供电(16-pin 接口,老电源用合规转接线,350W 满载线材规格核好)、PCIe Gen4 槽位直连(x16 直连 CPU,过 switch 吃带宽)、风道(双槽被动卡对机箱风道敏感,满载 350W 的进风温度要控制)。

多卡部署:2U 服务器常见 2-4 卡配置,4 卡满载 1.4kW 的风道压力要认真算——L40S 无 NVLink 意味着多卡是「并列算力」而非「互联域」,推理与渲染场景正好,训练场景不适用。

模型适配MODEL FIT

模型 / 场景显存需求(FP16 估算)L40S 部署口径萬安指数
70B 级量化推理INT4/FP8 约 35-40GB单卡 48GB 临界可跑(KV cache 精打),双卡余量舒适84
SD / 视频生成管线FP16 8-24GB单卡多并发,FP8 加速管线流畅88
视频转码农场—(编解码器负载)3×NVENC/3×NVDEC 含 AV1,转码密度行业标杆90
大模型训练—无 NVLink/无 MIG——训练场景不适用(对照 A100/H100 词条)45

显存按 FP16 权重 ≈ 参数量 × 2 字节估算(推算口径,未含 KV cache);量化部署的精度策略随框架而定。

NVIDIA L40S 官方图(厂商图)
NVIDIA L40S · 官方图(NVIDIA 官网)

软件与生态ECOSYSTEM

项目要求 / 现状
CUDAAda 架构(计算能力 8.9)——CUDA 11.8 起完整支持,现役 12.x 全覆盖
框架PyTorch / TensorFlow / vLLM 全支持(推理侧生态成熟)
图形栈Omniverse / DCC 全支持——4×DP 1.4a 直连显示器(数据中心卡少见)
虚拟化vGPU 支持(RTX vWS/vPC 授权口径)——VDI 与云工作站方案成熟
驱动NVIDIA 数据中心驱动线(与 A/H 系共用)

Ada 生态与 Ampere 共享 CUDA 主线;vGPU 授权类型按使用场景采购(官方口径)。软件版本随时间演进,以 NVIDIA 官方发布为准。

采购与验货PROCUREMENT

L40S 采购的验货要点(三项):

1
L40 冒充 L40S 甄别
nvidia-smi 一验型号与 FP32 档(91.6 对 90.5 差一档)、功耗档(350W 对 300W)——两者外观几乎一致,软件甄别是唯一可靠手段。
2
供电与转接线核验
16-pin 接口的老电源转接线是易损件:转接线原装性、插接发热(满载时段测温)都要验——转接线故障是 L40S 返修的常见原因(本库验货经验口径)。
3
编解码器实测
转码场景采购必测:NVENC 并发路数与 AV1 编码实测(ffmpeg 系工具)——编解码器是 L40S 的核心卖点之一,不测等于白买。

完整六项压测判例见本词条「如何压测」节。

如何压测BENCH TEST

六项压测口径,数值判例全部按 L40S 实锚:开箱识别 → 单卡烤机(350W)→ FP8/INT8 算力 → 编解码并发 → 图形渲染 → 长稳烤机。

1
开箱识别
nvidia-smi:L40S 型号、48GB 显存、350W 档——与 L40(90.5/300W)软件级区分;丝印与 Part Number 交叉核对。
2
单卡烤机
350W 满载烤机:温度 ≤85℃、零 ECC 报错为合格(判例框架口径)——双槽被动卡对风道敏感,按部署姿态测。
3
FP8/INT8 算力
Tensor 基准实测:FP8 稠密 733 TFLOPS 档(≥80% 合格,推算口径)——推理产线的实际吞吐锚点。
4
编解码并发
ffmpeg 多路并发转码实测:NVENC 并发路数与 AV1 编码性能——转码场景的核心验收项。
5
图形渲染
RT Core 场景基准(Omniverse/专业渲染软件):渲染帧率与稳定性达标——图形采购场景必测。
6
长稳烤机
满载持续 ≥2 小时(判例框架口径):温度平稳、错误计数零增长——转码农场 7×24 服役前必测。

运输与交付LOGISTICS

1
防静电与金手指
防静电袋+缓冲包装;双槽卡较重(散热器大),金手指磨损与固定件状态到货目检。
2
跨境流通合规
L40S 的跨境流通受出口管制政策影响(Ada 架构数据中心卡在管制清单语境内,公开报道口径)——跨境采购合规以专业意见为准,本库不构成法律意见。

术语卡GLOSSARY

双能卡(渲染+AI)

L40S 的产品定位:RT Core 图形能力 + FP8 AI 推理能力同卡兼备——渲染农场白天渲染、夜里跑推理,一台机器两用(官方定位口径)。

AV1 编解码

新一代视频编码标准(同画质码率比 H.264 省约 30-50%,行业口径):L40S 的 3×NVENC/3×NVDEC 均含 AV1——流媒体与云游戏场景的带宽成本利器。

NEBS Level 3

电信级设备认证(Network Equipment-Building System):抗震、散热、可靠性达电信机房标准——L40S 的 NEBS Ready 认证让它能进运营商级机房(官方规格口径)。

Secure Boot with Root of Trust

硬件信任根安全启动:固件签名校验防篡改——企业合规与政企采购的安全底线项(官方规格口径),验货时安全启动状态列入检查。

16-pin 供电

新一代 PCIe 供电接口(CEM5 规格系):单接口供 350W+——老电源需要合规转接线,转接线质量是 L40S 稳定运行的隐性变量。

局限与争议LIMITS

  • 无 NVLink 无 MIG:多卡是并列算力而非互联域,且不能切分多租户——训练场景不适用、多租户池化不如 A/H 系(官方规格口径[1]),选型别错位。
  • PCIe Gen4 的带宽天花板:Gen4 x16 双向 64GB/s——数据吞吐密集的推理负载(大 KV cache 流转)受主机带宽约束,Gen5 平台才能解放(本库整理口径)。
  • 转接线是隐性故障源:16-pin 供电的老电源转接线质量参差,满载发热与松动是返修常见原因(本库验货经验口径)——原装线与合规转接是底线。
  • 显存代差:GDDR6 864GB/s 对 H 系 HBM3e 的数 TB/s 带宽——大模型训练与超大 KV cache 场景差距明显,L40S 的甜点位在推理与图形而非训练。
  • 跨境流通政策变量:Ada 架构数据中心卡在出口管制的清单语境内(公开报道口径)——跨境采购合规以专业意见为准,本库不构成法律意见。

行情说明MARKET NOTE

L40S · 行情带暂未开通

L40S 现货以原厂新品与整机拆机并行,成色与渠道让价差存在——暂无可复核的统一行情快照,本库诚实原则:不做行情带,价格以货主实际报价为准。

在售检索:萬安算交所大厅 ›(0 佣金撮合、不参与交易,数据因此中立)。行情快照积累充分后本节将切换为标准行情带。

常见问题FAQ

L40S 和 L40 怎么选?

推理与 AI 场景选 L40S:FP8/INT8 算力翻倍(733/1,466 对 L40 的 362/733 稀疏口径)、功耗 350W 对 300W——推理吞吐的差距大于价差;纯渲染预算敏感看 L40。

L40S 能跑 70B 模型吗?

量化后可以:INT4/FP8 约 35-40GB 对 48GB 显存临界可跑(KV cache 精打),双卡余量舒适;FP16 原版 140GB 装不下——量化部署是 L40S 的主流姿势。

L40S 能用来训练吗?

不建议:无 NVLink(多卡无互联)、无 MIG(不能切分)——训练场景既缺互联又缺切分能力。L40S 的定位在推理、转码与图形,训练看 A100/H100/B300 词条。

二手 L40S 怎么验货?

三件:nvidia-smi 甄别 L40 冒充(FP32 91.6 对 90.5、350W 对 300W)、16-pin 供电与转接线状态(返修常见原因)、NVENC/AV1 编解码实测(转码场景核心卖点)。金手指与散热器原装性目检。

L40S 插普通工作站能用吗?

要加涡轮风扇:L40S 是双槽被动卡(无风扇),塔式工作站风道推不动 350W 被动散热——主动散热转接架或机架式服务器是正确姿势;另外 16-pin 供电与 Gen4 x16 槽位也要核。

机型对比与选型COMPARE

参考资料REFERENCES

  1. NVIDIA 官方 — L40S 规格快照(与本库薄卡逐条对账一致,2026-10 口径) https://www.nvidia.com/en-us/data-center/l40s/
  2. NVIDIA 官网 — L40 产品页(家族对照口径) https://www.nvidia.com/en-us/data-center/l40/
  3. 在售检索 — 萬安算交所(0 佣金撮合;L40S 暂无行情快照,价格以货主报价为准) https://www.aixx.vip/hall.html?model=L40S
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-10 · 版本 v1.0 · 历次改动均留痕可查。发现错误?欢迎通过勘误通道提交,核实后公开修正并记入版本史。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品