
B300(全称 NVIDIA B300,属「Blackwell Ultra」系列)是 NVIDIA 于 2025 年发布的 数据中心 GPU[1],为 2024 年 B200 的增强版本。单卡显存 288GB HBM3e,较上一代 H100(80GB)提升逾三倍,FP4 推理算力约 1.1 PFLOPS(稠密),单卡功耗 1100W[1]。
B300 以整机和基板形态销售为主:8 卡风冷整机(NVL8)、16 卡液冷基板(NVL16)、以及与 Grace CPU 组合的超级芯片形态(GB300 系列)[2]。其中 8 卡风冷整机因无需液冷机房改造,成为中国大陆现货流通量最大的 Blackwell Ultra 机型。
自 2025 年下半年起,B300 在中国大陆处于供不应求状态:产能被头部云厂商与大客户预订,公开渠道无标准定价,现货价格显著高于北美渠道标价(行情数据见本词条「行情带」模块)[3]。
萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%,按场景调权。90+ 旗舰级 · 75+ 优秀 · 60+ 可用 · 60 以下不适用。方法透明可复核,不构成性能承诺。
2022 — 前代 Hopper 架构 H100 发布,长年占据数据中心 GPU 主力位置。[1]
2024 — Blackwell 架构发布,B200 量产;GB200 NVL72 超节点方案推出。
2025-03 — NVIDIA 于 GTC 发布「Blackwell Ultra」即 B300,宣布 2025 下半年出货[1]。
2025 下半年 — B300 整机陆续交付,中国大陆现货渠道开始流通,价格黑箱化。
2026 — B300 NVL8 风冷整机成为中国大陆现货市场交易量最大的高端算力机型之一;供不应求延续。
| 项目 | 规格 |
|---|---|
| GPU 核心 | NVIDIA B300「Blackwell Ultra」SXM |
| 单卡显存 | 288GB HBM3e(八卡合计 2.3TB) |
| FP4 推理算力 | 约 1.1 PFLOPS(稠密)/ 单卡 |
| 卡间互联 | NVLink 第五代 · 1.8TB/s |
| 单卡功耗 | 1100W |
| 主流整机形态 | 8 卡风冷(NVL8)· 16 卡液冷(NVL16)· GB300 超级芯片系列 |
| 上一代 / 对位产品 | HGX H100 8 / HGX H200 8(Hopper 架构) |
规格以 NVIDIA 官方公开资料为准[1];整机配置因 OEM 与批次存在差异。
基于 B300 的整机与系统形态:
同为 B300 平台,风冷与液冷是两条部署路线——差异不在算力,在机房。


| 维度 | B300 NVL8 风冷 | HGX B300 NVL16 液冷 |
|---|---|---|
| 散热方式 | 全风冷(机箱风扇墙) | 冷板液冷(需 CDU 与管路) |
| 机房要求 | 现有机房即可,10kW 级供电 | 需液冷管路 / CDU 配套与承重评估 |
| 部署周期 | 天级(到电即上架) | 周至月级(含机房改造) |
| 卡间互联规模 | 8 卡 NVLink 全互联 | 16 卡 NVLink 全互联 |
| 适合谁 | 存量机房、分批采购、快速上线 | 自建液冷机房、高密度训练集群 |
| 指数(0–100) | 风冷 NVL8 | 液冷 NVL16 |
|---|---|---|
| 安装简易度 | 95 | 55 |
| 维护便利 | 90 | 72 |
| 性能密度 | 70 | 95 |
| 寿命预期 | 82 | 88 |
浅金底=两形态核心差异项。指数为本库估算口径(方法见「关于本库」),随用途权重变化——综合萬安指数因场景而异,参见「适用场景」。
这张表回答一个问题:这台机器能喂多大模型。显存占用为估算口径(权重≈参数量×每参字节数,FP8≈1B/参、INT4≈0.5B/参,另需为 KV 缓存与激活预留余量),实际部署以实测为准。
| 模型 | 参数规模 | FP8 权重估算 | 2.3TB 装得下吗 | 萬安指数 | 一句话 |
|---|---|---|---|---|---|
| DeepSeek R1 | 671B MoE(37B 激活) | ≈690GB | 可满血单机部署,余量充裕 | 95 | 大模型推理首选载体之一 |
| Kimi K2 | 1T MoE | ≈1.0TB | 可装,余量支撑高并发 | 93 | 超大 MoE 的运力级载具 |
| Qwen3 235B | 235B MoE | ≈235GB | 轻松,可多实例并行 | 96 | 高并发生产主力 |
| Llama 3 70B 级 | 70B 稠密 | ≈70GB | 单卡即可承载 | 88 | 多卡主要用于并发扩容 |
| 开源视频模型 | 10–20B 级 | ≈10–20GB | 单卡即可 | 72 | 按吞吐需求配卡,性能冗余大 |
模型规格迭代快,本表按 2026-10 公开资料整理;MoE 模型显存按全部参数落卡估算。分档:90+ 旗舰级 · 75+ 优秀 · 60+ 可用 · 60 以下不适用。发现过时?欢迎经勘误通道指正。






买完卡的第一公里:驱动、框架与互联网络。
| 项目 | 要求 / 现状 |
|---|---|
| CUDA | 12.8 及以上(Blackwell 代的最低要求) |
| 驱动 | NVIDIA 570 系及以上 |
| 训练框架 | PyTorch / TensorFlow 官方支持 Blackwell 架构 |
| 推理引擎 | vLLM / SGLang / TensorRT-LLM 均已适配 |
| 网络配套 | 8 卡整机需 800G 互联:ConnectX-8 网卡 + Quantum-800 / Spectrum-X 交换 |
| 操作系统 | 主流 Linux 发行版(Ubuntu 22.04+ 等) |
软件栈版本随时间演进,以 NVIDIA 官方发布为准;驱动与 CUDA 版本匹配是最常见的第一公里踩坑点。
高值设备的验货环节,行业惯例是把这七个问题问在前面:
高值设备采购建议引入第三方验货,核验报告与序列号的一致性。
现货市场的「全新」必须有实测背书。工具全部免费公开:驱动自带 nvidia-smi、NVIDIA 官方诊断套件 DCGM、开源烤机 gpu-burn、互联测试 nccl-tests、CUDA 自带样例 bandwidthTest。下面六张判例卡,每张给齐「用什么 / 盯哪个数 / 多少算合格·优秀·翻车」:
nvidia-smigpu-burn 3600 或 dcgmi diag -r 3 · 30–60 分钟bandwidthTest(CUDA 自带样例)nccl-tests all_reduce 基准vLLM 起真模型跑量口径说明:合格/优秀线为本库按工程通行口径整理(带宽按标称值占比、温度为数据中心通行上限),随验货报告实测数据积累逐步校准;本表不构成任何验收承诺,具体以合同约定为准。本库验货报告的实测项即按本表口径记录——NOT_EXECUTED 表示未执行该项,「没测」本身也是重要信息。
| 环节 | 要点 |
|---|---|
| 形态与重量 | 8 卡整机约 8U,整机重量通常 100–170kg(视 OEM 与配置,估算口径) |
| 包装 | 原厂木箱与防震托架,防潮防倾倒标识 |
| 跨境合规 | 出口管制标的:合规报关与进口资质是前置条件,转运第三地属高风险行为 |
| 保险 | 按货值全额投保为行业惯例 |
| 到货顺序 | 先验外观与封条,核对序列号,再上电——通电前的核验不可省略 |
同一块 HGX B300 基板,各家整机差在形态、散热、密度与服务——选型先看区别:
| 整机厂 | 代表形态 | 差异点 | 适合谁 |
|---|---|---|---|
| NVIDIA 官方 | DGX B300 | 官方一体交付,全栈软件与企业级支持 | 要开箱即训、要原厂背书 |
| Supermicro 超微 | 8U 风冷 / 4U 液冷双形态 | 形态最全,货期与性价比强,渠道质保 | 自建机房、看性价比 |
| Gigabyte 技嘉 | G893 系(8U 风冷 / 4U 液冷) | 单机柜可上 32 卡,密度取向,按单配置 | 追求单柜密度 |
| Dell 戴尔 | PowerEdge XE9712(机架级液冷) | 机架级 NVL72 架构 + 全球一线服务网 | 跨国部署、要服务网络 |
| HPE / Lenovo | 企业产品线集成(液冷为主) | 企业服务与金融方案成熟,形态保守 | 企业客户、运维外包 |
| 整机厂 | 安装简易 | 维护便利 | 性能密度 | 寿命预期 |
|---|---|---|---|---|
| NVIDIA 官方 | 95 | 90 | 80 | 85 |
| Supermicro 超微 | 88 | 82 | 85 | 82 |
| Gigabyte 技嘉 | 85 | 80 | 92 | 80 |
| Dell 戴尔 | 90 | 92 | 88 | 86 |
| HPE / Lenovo | 86 | 90 | 84 | 85 |
指数为本库估算口径(0–100,维度与「适用场景」的部署四维一致),估分依据=各厂公开的形态、散热方案与服务网络差异,随实机验证与批次数据更新,不构成采购承诺。具体型号以各厂官方发布为准。
堆叠在 GPU 旁的高带宽显存,是 AI 训练的"粮仓"。B300 单卡 288GB,八卡合计 2.3TB。
卡与卡之间的专用高速通道(第五代 1.8TB/s),让八颗 GPU 像一颗一样协同。
SXM 是 GPU 板载直连封装(非插卡);NVL8 指八卡全互联基板形态,是 HGX 服务器的计算核心。
冷板贴着芯片吸热,冷却液经管路带走热量,CDU(分液单元)负责分配与循环——液冷机房的核心配套。
8 位浮点数格式,AI 推理与训练的主流精度;估算模型显存占用时,权重≈参数量×1 字节。
"稀疏激活"的大模型架构:总参数量大(如 DeepSeek R1 的 671B),但每次推理只激活一部分(37B)。部署时全部参数仍需落卡。
| 日期 | 口径 | 区域 | 参考价带 | 说明 |
|---|---|---|---|---|
| 2026-10-09 | 本库行情带 | 中国大陆 | ¥1,101万 – 1,597万 | 在售报价区间(50 处) |
| 2026-10-04 | 锚定价 | 中国大陆 | ¥1,580万 – 1,700万 | A/B 两款配置 |
| 2026-10-05 | 海外渠道标价 | 北美 | $496,728 起 | 渠道商公开起售价[3] |
| 2026-10 | 市场了解区间 | 中国大陆 | ¥1,500万 – 1,700万 | 渠道了解,未经本库验证 |
| 市场 | 实时带 | 大厅直达 |
|---|---|---|
| 欧洲(EUR) | 64万 – 399万 | 62 处报价 › |
| 日本(JPY) | 14,109万 – 87,139万 | 50 处报价 › |
| 新加坡(SGD) | 134万 – 782万 | 50 处报价 › |
| 中国大陆(CNY) | 1,101万 – 1,597万 | 49 处报价 › |
| 美元区(USD) | 44万 – 283万 | 49 处报价 › |
| 中东(AED) | 309万 – 1,840万 | 48 处报价 › |
各市场实时在售带(币种原价口径,随页面加载实时刷新);点「N 处报价」直达交易大厅,地区已自动选好。
口径:2025-06 起为推算带(自 B300 正式入市节奏回溯推演,带宽=成色/配置浮动),2026-10 起为实测快照逐日记录(见上表);北美为渠道标价折算人民币、推算带按入市至当下现货稀缺涨幅回溯(约翻倍),2026-10 锚定渠道标价 $496,728。本库价格数据来源:萬安算交所(0 佣金撮合、不参与交易,不掌握亦不推测成交价,数据因此中立)。其余市场推算带按自上市至今约翻倍回溯,终点锚定当日在售实测快照。参考价带仅供走势参考,不构成任何交易要约,实际以货主报价为准。
可以。FP8 权重约 690GB,2.3TB 总显存可满血单机部署且余量充裕(见「模型适配」)。
风冷 NVL8 形态就是为存量机房设计的,10kW 级供电即可;液冷形态需机房配套(见「散热形态对比」)。
核对丝印与官方固件报告,序列号经独立渠道交叉验真;两代外观高度相似,仅凭照片不可靠(见「采购实务与避坑」)。
一是需求远大于供——巨头排队抢货、产能优先头部用户、散客需漫长排队;二是美国政府对华颁布极其严苛的禁止法案,正规渠道买不到;三是英伟达一家独大、技术断层领先(华为等仍有很高追赶空间)。三重叠加,现货价差超过 4 倍(见「局限与争议」与行情带,2026-10 口径)。
在产且供不应求:产能优先供应头部客户,中小买家排队周期以年计。