AI 工厂(AI Factory)是 NVIDIA 对超大规模 AI 基础设施的战略叙事:不是「一台服务器」或「一个集群」,而是「一个以数据为原料、以 GPU 为产线、以智能为产品的工厂」——包含计算(GPU 机柜)、网络(NVLink+fabric)、存储(数据管线)、软件(训练/推理平台)、电力与散热的全栈设计。
对采购方的意义:AI 工厂的概念把采购颗粒度从「买服务器」提升到「规划产线」——机柜排布、网络拓扑、存储吞吐、电力容量、散热方案、运维平台全部纳入整体设计。GB200/GB300 NVL72 是 AI 工厂的「产线单元」,Spectrum-X800/Quantum-X800 是「物流系统」,NVMe 全闪是「原料仓库」。
| 项目 | 数值 / 口径 |
|---|---|
| NVIDIA 定义 | 计算+网络+存储+软件+电力+散热的全栈 |
| 核心 KPI | Token 吞吐 / 模型训练时间 / GPU 利用率 |
| 产线单元 | GB200/GB300 NVL72 机柜 |
| 物流系统 | Quantum-X800 / Spectrum-X800 fabric |
B300/GB300 NVL72 是 AI 工厂的产线单元——AI 工厂的概念把采购视角从「买设备」提升到「建产线」:同样预算下,「 GPU 利用率最大化」比「GPU 数量最大化」更有价值——fabric 设计、存储吞吐、散热效率都是利用率的影响因子。