
MI350X / MI355X是 AMD Instinct 系的CDNA4 架构旗舰(2025 年 6 月 12 日发布):288GB HBM3E 单卡显存、8TB/s 带宽、185 亿晶体管 3nm 制程——双型号同芯差异化在散热与功耗:MI350X 1000W 风冷(Passive OAM)、MI355X 1400W 支持液冷,MXFP4 算力分别 9.2/10.1 PFLOPS(AMD 官方双页规格表口径[1])。
它是 MI325X 的直系接棒:显存同为 288GB 档但带宽 8TB/s(MI325X 为 6TB/s)、架构从 CDNA3 升 CDNA4、FP4/FP6 新精度原生支持——「一年一代」显存与架构双升级的兑现之作(AMD 官方世代口径[2])。官方对标 B200 用的显存口径是现行 180GB/7.7TB/s 档——288GB 的容量差是 AMD 阵营的旗舰卖点(官方对比基准口径,同本库 B200 词条)。
2026 年的现货市场,MI350 系以 8 卡 OAM 整机流通、放量爬坡中:ROCm 6.x+ 对 CDNA4 的支持矩阵成熟度、与 MI300X/MI325X 存量的价差关系是采购三问的核心。本词条不带行情带——价格以货主实际报价为准。
萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%。
2025 年 6 月 12 日,MI350X/MI355X 正式发布(官方 Launch Date 口径[1]):CDNA4 架构、3nm、185 亿晶体管、288GB HBM3E/8TB/s——显存与带宽较 MI325X(256GB/6TB/s)再上台阶,MXFP4/FP6 新精度原生加入。
2025-2026 年,双型号分化交付:MI355X 液冷形态(1400W/2400MHz)进液冷机房与头部云厂,MI350X 风冷 OAM(1000W/2200MHz)覆盖风冷智算中心——双线并行覆盖不同机房条件(官方双页规格口径[1])。
2026 年,现货爬坡:8 卡 OAM 整机放量流通,ROCm 6.x+ 对 CDNA4 的支持矩阵持续成熟——MI350 系成为 AMD 阵营的现役旗舰(对照 NVIDIA B300 世代)。跨境流通政策仍在演进,采购时以主管部门政策与专业意见为准(公开报道口径)。
| 项目 | MI350X | MI355X |
|---|---|---|
| 架构 / 制程 | CDNA4 · TSMC 3nm · 185 亿晶体管 | |
| 显存 | 288GB HBM3E · 8TB/s(双型号同) | |
| 峰值时钟 | 2200 MHz | 2400 MHz |
| MXFP4 算力 | 9.2 PFLOPS | 10.1 PFLOPS |
| 功耗(TBP) | 1000W | 1400W |
| 冷却 | Passive OAM(风冷) | Passive & Active(支持液冷) |
| 共同规格 | Infinity Fabric 8 链路 · PCIe Gen5 · OAM 模组 · SR-IOV | |
规格以 AMD 官方双页规格表为准(2026-10 实抓快照[1],C5/C6 两代侦察兵交叉核验);Launch Date 6/12/2025 为官方标注。
| 项目 | MI300X | MI325X | MI350X/MI355X |
|---|---|---|---|
| 架构 | CDNA3 | CDNA3(微调) | CDNA4 |
| 显存 | 192GB HBM3 | 256GB HBM3E | 288GB HBM3E |
| 带宽 | 5.3TB/s | 6TB/s | 8TB/s |
| 新精度 | FP8 | FP8 | MXFP4 / FP6 |
| 功耗 | 750W | 1000W | 1000W / 1400W |
| 选型一句话 | 存量性价比 | 过渡档 | 现役旗舰 |
三代对照为各自官方快照口径(MI300X/MI325X 详见各自词条);CDNA4 的 MXFP4/FP6 为新精度代际能力。
Instinct 家族按世代分档;MI350 系是 CDNA4 现役旗舰:
MI350 系的部署分界在散热形态:MI350X 为 Passive OAM 风冷(1000W),风冷智算中心可落地;MI355X 支持液冷(1400W),液冷机房的密度优选。8 卡 OAM 整机(UBB 基板)是标准交付形态——1000W/1400W×8=8-11kW 级的机柜散热与供电(54V 母排)要整体规划(官方双页规格口径[1])。
与 MI325X(同为 OAM)的部署差异:CDNA4 的功耗密度上探让液冷从可选项变成 MI355X 的必备项——风冷机房选 MI350X,液冷机房按密度选 MI355X——「先定机房条件再定型 号」的选型顺序不变(本库整理口径)。
| 模型 / 场景 | 显存需求 | MI350 系部署口径 | 萬安指数 |
|---|---|---|---|
| DeepSeek R1 满血(671B) | FP8 约 690GB | 8 卡 2.3TB 装得下且余量充足——MXFP4 推理路径随 ROCm 框架支持 | 88 |
| 超长上下文推理 | KV cache 随长度线性 | 288GB 单卡的 KV cache 空间为 MI 系之最 | 91 |
| 大模型训练 / 微调 | 8 卡 IF 组网 | CDNA4 训练栈随 ROCm 成熟——调优人力成本计入 | 82 |
| FP64 HPC | 以官方快照为准 | CDNA4 的 FP64 口径以官方规格表为准——本表未列=未实抓 | — |
显存按 FP16 权重 ≈ 参数量 × 2 字节估算(推算口径);FP4/FP6 路径以 ROCm 框架实际支持为准(官方口径[1])。

| 项目 | 要求 / 现状 |
|---|---|
| 软件栈 | ROCm 6.x+(CDNA4 支持矩阵以官方文档为准,同 ROCm 词条口径) |
| 框架 | PyTorch ROCm 版 / vLLM / SGLang——MI350 系支持随版本成熟 |
| 虚拟化 | SR-IOV 支持(官方规格快照口径[1]) |
| 观测 | rocm-smi / amd-smi |
| 对照 | CUDA 生态对照详见 ROCm 词条迁移框架 |
生态信息为公开口径整理;版本随时间演进,以 AMD 官方发布为准。
MI350 系采购的验货要点(三项):
MI350 系四步速查:
AMD 第四代数据中心架构:新增 MXFP4/FP6 微缩浮点精度——大模型推理的显存与带宽成本再降档(对照 NVIDIA 的 FP4 路线),是 CDNA4 对 CDNA3 的代际能力差。
同芯双型号:MI350X 1000W 风冷 OAM(2200MHz/MXFP4 9.2PF),MI355X 1400W 液冷支持(2400MHz/MXFP4 10.1PF)——显存同 288GB/8TB/s,按机房散热条件与密度需求选型(官方双页口径[1])。
MI350 系的显存规格:单卡 288GB、全系统带宽 8TB/s——MI 系「显存军备」路线的现役顶点(对照 MI325X 256GB/6TB/s、MI300X 192GB/5.3TB/s)。
OAM 模组 + UBB 基板的 8 卡整机是 MI350 系的标准交付形态——54V 供电母排与 IF 互连的载体;脱离基板的「散模组」无法独立使用。
MI350 系以 8 卡 OAM 整机流通为主,双型号+散热形态差异让价格离散度大——暂无可复核的统一行情快照,本库诚实原则:不做行情带,价格以货主实际报价为准。
在售检索:萬安算交所大厅 ›(0 佣金撮合、数据因此中立)。
机房散热条件定型号:风冷智算中心选 MI350X(1000W 风冷 OAM);液冷机房或高密度需求选 MI355X(1400W 液冷、时钟与 MXFP4 算力更高)——显存同 288GB/8TB/s。
新购预算充足选 MI350 系:架构代差(CDNA4 的 MXFP4/FP6)+显存带宽(8TB/s 对 6TB/s);MI325X 存量价差友好但无新精度——训练产线建议直接 CDNA4。
FP8 口径可以:R1 满血 FP8 约 690GB,8 卡 2.3TB 显存装得下且余量充足——推理栈 vLLM/SGLang 的 ROCm 版,部署前先跑基准验证。
四步:rocm-smi 身份识别(型号/288GB/序列号)→ 8TB/s 显存带宽实测 → 8 卡 rccl-tests 互联 → 按功耗档满载烤机(MI355X 液冷按液冷流程)。ROCm 支持矩阵核对是采购前置项。
生态与容量的两难:MI350 系 288GB 显存对 B200 的 192GB 级(现行口径)占优,但 B200 背靠 CUDA 生态——开源栈新产线可评估 MI350 系,CUDA 存量产线迁移按总账(ROCm 词条框架)。