NVSwitch 是 NVIDIA 的 NVLink 交换芯片:把多颗 GPU 的 NVLink 链路汇到交换芯片上,让「谁跟谁都直通」的全互联(All-to-All)矩阵可以越做越大。2018 年随 DGX-2 系统首次亮相,把 16 颗 V100 连成一个 NVLink 域(NVIDIA 开发者博客「NVSwitch Accelerates NVIDIA DGX-2」);到第五代(配 Blackwell),单个 NVLink 域可扩到 72 颗 GPU,域内 NVLink 交换合计 130TB/s(NVIDIA NVLink 官方页与 GB200 NVL72 官方页)。
在 AI 算力机柜里的角色:八卡机(HGX/DGX NVL8)的基板上焊有 NVSwitch,把八颗 GPU 连成全互联域;GB200/GB300 NVL72 这类整柜方案则用独立的 NVLink 交换托盘——18 个计算托盘加 9 个交换托盘、共 18 颗 NVSwitch 芯片(Supermicro GB200 NVL72 规格页与 SemiAnalysis 硬件拆解)。「NVL8 / NVL72」里的 NV 即指这种 NVSwitch 全互联形态。
| 项目 | 数值 / 口径 |
|---|---|
| 角色 | NVLink 域内全互联的汇流交换芯片 |
| 第五代单 GPU NVLink | 1800GB/s(NVIDIA NVLink 官方页) |
| NVLink5 交换域 | 8 或 72 颗 GPU · NVL72 域内合计 130TB/s(NVIDIA 官方页) |
| 上一代(NVLink4)对照 | 单 GPU 900GB/s · 域内 8 颗 · 交换合计 7.2TB/s |
B300 八卡机的互联全靠基板上的 NVSwitch:DGX B300 官方标称 NVLink 合计 14.4TB/s——即 8 颗卡各 1800GB/s 汇总(NVIDIA DGX B300 官方页)。大模型训练的张量并行会把一个模型切到多颗卡上、卡间通信量巨大,NVSwitch 域内不丢带宽,八颗卡才能像一颗一样协同。
买家视角:NVSwitch 在基板上、卡也焊在基板上——验货不能只看卡,要整机实测 NVLink 域(点对点带宽与 all-reduce 集合通信压测);基板与交换芯片的维修史只能靠验货报告追溯。整柜级(NVL72 形态)买家还要留意 9 个交换托盘同样走液冷,机房配套要一并谈。