算力百科 › 网络设备词条 › Quantum-2 QM9700

Quantum-2 QM9700(NVIDIA Quantum-2 QM9700 系列 1U NDR 交换机)是 NVIDIA 的 400G InfiniBand 旗舰交换机:1U 机身里塞下 64 个 400Gb/s NDR 端口(32 个 OSFP 笼位、每笼双口),聚合双向吞吐 51.2Tb/s、包转发率超每秒 66.5 亿包,核心是 Quantum-2 交换芯片(交换容量 25.6Tbps,官方规格页口径[2])。
它是这一代 AI 集群织网的核心设备:与 ConnectX-7 网卡同场发布(2021,NVIDIA 新闻稿[1]),H100/H200/B300 世代的百卡千卡集群基本都跑在 QM9700 织出的 NDR fabric 上;SHARP 网内聚合与自适应路由让集合通信的流量在交换网里就地消化,是 NCCL 跑满带宽的网络侧前提(ServeTheHome 现场报道[3])。
2026 年的现货市场,QM9700 是流通量最大的 NDR 交换机:集群扩建拆出的余量、项目整批与渠道库存三路并存。采购的核心变量是配件完整性与通电时长——OSFP 笼位模块、管理模块、电源风扇是否原装齐套,机房负载史直接决定残值。本词条不带行情带——价格以货主实际报价为准。
萬安指数(0–100):本库按公开规格加权估算——容量 40% + 组网角色 30% + 生态 30%。90+ 旗舰级 · 75+ 优秀 · 60+ 可用 · 60 以下不适用。
2021 年 4 月,NVIDIA 在 GTC 发布第七代 Mellanox InfiniBand(NDR 400G)与 Quantum-2 平台:QM9700 作为该平台旗舰交换机披露,单口 400G 较上代 HDR 200G 翻倍,In-Network Computing(含 SHARP 网内聚合)成为平台标配(NVIDIA 新闻稿[1])。
2021 年秋,GTC Fall 现场 QM9700 与 ConnectX-7、BlueField-3 同台,400G 接入-交换-DPU 三件套成型(ServeTheHome 报道[3])。此后随 H100 世代集群在全球铺开,QM9700 成为 AI 训练 fabric 的代名词。
2023-2025 年,规模部署期:Supercomputer 公开榜单上的大型 IB 集群大量采用 Quantum-2 织网;国内智算中心建设潮把 NDR 方案带成标配,QM9700 与 CX-7 网卡的配套流通量同步放大(公开报道口径)。
2026 年,现货定位成型:下一代 Quantum-X800(144×800G)已在 NVIDIA 公开路线图与产品页亮相(Quantum-2 平台页口径[4]),QM9700 转入存量与现货并行流通——400G NDR 仍是当前在营集群的主流织网。高端网络设备的跨境流通政策仍在演进,采购时以主管部门政策与专业意见为准(公开报道口径)。
| 项目 | 规格(Quantum-2 QM9700 · 官方口径) |
|---|---|
| 端口配置 | 64 个 400Gb/s NDR 端口(32 个 OSFP 笼位 × 每笼 2 口),无阻塞 |
| 聚合吞吐 | 51.2Tb/s(双向聚合) |
| 交换芯片 | NVIDIA Quantum-2 IC · 交换容量 25.6Tbps |
| 包转发率 | 超过每秒 66.5 亿包 |
| 网内计算 | SHARP(集合通信网内聚合)· 自适应路由 · RDMA |
| 管理 | QM9700 带 Intel Core i3(Coffee Lake)管理主机;QM9790 为无管理主机变体[2] |
| 形态 | 1U 机架式 |
| 同代变体 | QM9700 / QM9790 系列(管理与散热配置差异,详见官方文档) |
规格以 NVIDIA 官方规格页与用户手册为准(2026-10 口径)[2][5];整机功耗、电源规格等细目以对应型号 datasheet 为准,本表未列=未实抓,不编。
| 角色 | ConnectX-7 | QM9700 | BlueField-3 |
|---|---|---|---|
| 身份 | 400G 接入网卡 | 64×400G IB 交换机 | DPU(数据处理器) |
| 带宽 | 单卡 400G | 聚合 51.2Tb/s(双向) | 400GbE / NDR 400G |
| 干什么 | 服务器进 fabric 的门 | 节点间无阻塞交换 | 网络/存储/安全卸载 |
| 选型一句话 | 集群接入标配 | NDR 织网核心 | 基础设施卸载专用 |
三件套同场发布于 2021(NVIDIA 发布稿[1]口径);CX-7/BlueField-3 详见各自词条。
Quantum 家族按速率世代分档;QM9700 是 NDR 400G 世代旗舰,家族成员如下:
QM9700 是 1U 机架设备,前后风道强制散热——1U 塞下 64×400G,OSFP 光模块的发热是大头,满配光模块时整机功耗显著高于空配(具体功耗以所配模块与电源配置为准,官方文档口径)。部署前要对表三件事:机柜电力(满配 NDR 光模块的 1U 交换机要按整机电源额定复核机柜供电)、风道方向(前后风道与冷热通道规划一致,反风道机型要提前挑对)、OSFP 模块清单(笼位模块分 SR/DR/FR/2xFR 等传输距离档,混合布线时清单管理是日常运维的功课)。
管理侧:QM9700 带 i3 管理主机(QM9790 无),MLNX-OS 网络操作系统跑在管理主机上——二手采购时管理模块的登录状态与授权状态要列入验收(本库验货经验口径)。
| 集群规模 | 典型拓扑 | QM9700 用量与角色 | 萬安指数 |
|---|---|---|---|
| 8-64 卡单机柜 | 1 台 QM9700 单层 | 1 台即全互联(64 口富余),后续扩机柜留口 | 88 |
| 百卡级 2-8 机柜 | leaf-spine 两层 | leaf+spine 各 2-8 台,无阻塞配比按 1:1 规划 | 94 |
| 千卡级 | 多平面 spine-leaf + 光互连 | 数十台量级,光模块数量按平面数×端口数估算 | 92 |
| 以太网集群 | 不适用 | QM9700 是 IB 交换机——以太网集群请看 Spectrum-4 SN5600 词条 | — |
规模档位为本库按公开 fabric 拓扑口径的整理(推算口径);千卡级光模块预算常超过交换机本体(整理口径)。

实拍图随验货批次上架持续补充;AI 生成图不冒充实拍。
| 项目 | 要求 / 现状 |
|---|---|
| 网络操作系统 | NVIDIA MLNX-OS(管理主机内置) |
| 网内计算 | SHARP 需交换机与网卡(CX-7)协同开启,NCCL 侧自动受益 |
| 路由 | 自适应路由(Adaptive Routing)——链路故障与拥塞下的自愈能力 |
| 监控 | perfquery / ibdiagnet 等 IB 诊断工具链(OpenSM 生态) |
| 配套网卡 | ConnectX-7(NDR 接入标配);向下兼容 HDR/NDR200 接入 |
| 运维口径 | fabric 级健康检查(ibdiagnet 全网扫描)是集群例行功课 |
InfiniBand 生态经二十余年沉淀,大型集群运维工具链成熟;软件版本随时间演进,以 NVIDIA 官方发布为准。
QM9700 采购的验货要点(三项):
完整六项压测判例见本词条「如何压测」节。
六项压测口径,数值判例全部按 QM9700 实锚:开箱识别 → 管理主机 → 端口带宽抽测 → SHARP/自适应路由功能 → 长稳烤机 → 配件与固件清点。
QM9700 以 NVIDIA 原厂整机为主流流通形态,家族变体与同代对照:
| 变体 | 差异 | 适用场景 | 2026 年现状 |
|---|---|---|---|
| QM9700 | 带 i3 管理主机(官方规格页口径[2]) | 独立 fabric 管理的集群 | 现货主流 |
| QM9790 | 无管理主机变体 | 集中控制器管理的超大 fabric | 项目流通 |
| Quantum-X800 | 144×800G(下一代) | X800 世代新集群 | 新品路线图(平台页口径[4]) |
| 上代 QM8700 | HDR 200G(Quantum-1) | 存量 HDR 集群扩容 | 存量流通 |
变体信息来自 NVIDIA 官方规格页与产品页[2][4];具体配置以官方文档为准。
NDR(Next Data Rate)是 InfiniBand 第五代速率规范:单口 400Gb/s;Quantum-2 是承载 NDR 的交换芯片与平台代号。上代 HDR 200G 对应 Quantum-1(QM8700),下一代 XDR 800G 对应 Quantum-X800。
QM9700 的 64 个 400G 端口物理上是 32 个 OSFP 笼位——每个 OSFP 笼位可插双口模块(2×400G)。OSFP 体积大散热好,是 NDR 交换机侧的主流笼位标准,与网卡侧常见的 QSFP112 不可互插。
集合通信的归约操作(如 AllReduce)在交换网内就地完成,数据不用全量到端点——NDR 世代大模型训练的效率引擎,需要交换机(QM9700)与网卡(CX-7)协同开启。
InfiniBand 的经典能力:链路拥塞或故障时流量自动绕行,fabric 自愈不中断——区别于以太网生成树协议的秒级收敛,IB 的自愈是微秒级的。
两级 Clos 拓扑:接入层(leaf)连服务器,核心层(spine)连 leaf,任意两卡之间等跳数等带宽——无阻塞 AI fabric 的标准结构,QM9700 的 64 口在两层结构里怎么分配是 fabric 设计的核心题。
QM9700 现货以集群扩建余量、项目整批与渠道库存三路并行,配件齐套度、负载史与固件授权状态让价差显著——暂无可复核的统一行情快照,本库诚实原则:不做行情带,价格以货主实际报价为准。
在售检索:萬安算交所大厅 ›(0 佣金撮合、不参与交易,不掌握亦不推测成交价,数据因此中立)。行情快照积累充分后本节将切换为标准行情带。
先选 fabric 路线再选设备:InfiniBand(QM9700+CX-7)开箱即用、延迟最低、SHARP/自适应路由自带;以太网(SN5600+Spectrum-X)生态通用、云管理成熟,但无损网络要调优。两者都是 2026 年 AI 集群主流方案,按团队运维经验与既有 fabric 定。
可以:NDR 交换机端口向下协商兼容 HDR 200G/NDR200 接入,老集群扩容不必一刀切换卡;但混速布线的模块清单管理复杂度上升,新集群建议统一 400G 档。
三步:配件齐套清点(笼位模块/电源/风扇)→ 上电验管理主机与 MLNX-OS → 配 CX-7 双机对打抽测端口带宽(≥8 口,判例框架口径)。机房退役机要加看「负载史三看」:上电时长、风扇噪音、灰尘堆积。
同代同芯片的兄弟型号:QM9700 内置 i3 管理主机(MLNX-OS 跑在本机),QM9790 无管理主机、靠集中控制器管理——小中型集群选 QM9700 省心,超大 fabric 集中管理选 QM9790(官方规格页口径)。
光模块/线缆是大头:32 笼位×双口的满配成本远超裸机;机柜电力按满配功耗复核;配套的 CX-7 网卡按节点数配齐。预算按「交换机+模块+网卡」全链路算,别只看裸机价。