算力百科COMPUTEPEDIA

算力百科 › 机型词条 › MI325X

AMD Instinct MI325X 官方图(厂商图)
厂商图 · 萬安算力百科(AMD 官网)

MI325X

AMD CDNA3 · 256GB HBM3E · 机型词条 #012

概述OVERVIEW

MI325X是 AMD Instinct 系的大显存新旗舰:2024 年 10 月发布——256GB HBM3E 单卡显存、6TB/s 带宽(较 MI300X 的 192GB/5.3TB/s 双双提升),FP8/INT8 算力 2.61 PFLOPS 与 MI300X 同档,OAM 模组、1000W 峰值功耗、8 条 Infinity Fabric 链路组网(AMD 官方规格快照口径[1])。

它的市场叙事是「显存军备竞赛」的 AMD 应手:大模型推理的 KV cache 与长上下文把显存需求一路推高,MI325X 的 256GB 单卡显存对 NVIDIA H200(141GB)形成容量差——配合 ROCm 生态的持续成熟,成为 2025-2026 年 AMD 阵营在推理侧的旗舰答卷(AMD 产品页口径[2])。

2026 年的现货市场,MI325X 随整机方案放量流通:8 卡 OAM 整机是主流交付形态。买它的核心三问:ROCm 版本对卡的支持矩阵、整机方案(UBB 基板+1000W 供电散热)配套、与 MI300X 的价差是否匹配 33% 的显存提升。本词条不带行情带——价格以货主实际报价为准。

适用场景FIT

萬安指数(0–100):本库按公开规格加权估算——显存 40% + 互联 30% + 生态 30%。

超大模型推理90萬安指数
256GB 单卡 + 6TB/s:千亿参模型单卡承载、超长上下文 KV cache——显存敏感推理的天花板级配置。
大模型训练 / 微调80萬安指数
8 条 IF 链路 1000W OAM 方案组 8 卡系统——ROCm 训练栈可用,调优人力成本要计入。
HPC / FP6478萬安指数
FP64 81.7 TFLOPS——科学计算场景 MI 系的传统阵地。
CUDA 存量产线45萬安指数
深度绑定 CUDA 专有组件的产线迁移成本高——按总账评估(见 ROCm 词条迁移框架)。

沿革HISTORY

2024 年 6 月,AMD 在 Advancing AI 大会预告 MI325X:256GB HBM3E、6TB/s 带宽——「一年一代」的显存军备节奏首次明牌(AMD 发布口径[2])。

2024 年 10 月 10 日,MI325X 正式发布并进入量产节奏:与 MI300X 同芯(CDNA3 架构微调)、显存代际升级——256GB 对 192GB 提升 33%,带宽 6TB/s 对 5.3TB/s(AMD 官方规格快照口径[1])。

2025-2026 年,放量流通:8 卡 OAM 整机方案(UBB 基板 1000W 供电散热)随云与智算中心项目落地,ROCm 6.x 对 MI325X 的支持矩阵成熟——AMD 阵营的推理旗舰进入现货市场(本库整理口径)。跨境流通政策仍在演进,采购时以主管部门政策与专业意见为准(公开报道口径)。

技术规格SPECIFICATIONS

项目规格(AMD Instinct MI325X · 官方口径)
GPU 架构AMD CDNA3(TSMC 5nm | 6nm FinFET)
单卡显存256GB HBM3E
显存带宽6TB/s(8192-bit)
FP8 / INT82.61 PFLOPS / 2.6 POPs
FP161.3 PFLOPS
FP32 / FP64163.4 TFLOPS / 81.7 TFLOPS
流处理器 / LLC19,456 / 256MB
卡间互联Infinity Fabric 8 链路 · 单链路 128GB/s
主机接口PCIe Gen5 x16
形态 / 散热OAM 模组 · 被动散热
功耗1000W Peak
发布2024-10-10(Advancing AI 口径)

规格以 AMD 官方快照为准(2026-10 口径[1],与本库薄卡逐条对账一致)。

MI300X · 192GB HBM35.3TB/s 带宽 MI325X · 256GB HBM3E6TB/s 带宽 显存容量与带宽世代对照(AMD 官方口径)

AMD 旗舰两代对照TWO GEN

项目MI300XMI325X(本词条)
显存192GB HBM3256GB HBM3E
带宽5.3TB/s6TB/s
FP82.61 PFLOPS2.61 PFLOPS
功耗750W Peak1000W Peak
选型一句话存量性价比显存优先新购

MI300X 详见词条;算力同档、显存与功耗升级是 MI325X 的升级主轴(各自官方快照口径)。

家族成员FAMILY

Instinct 家族按世代与定位分档;MI325X 是现役显存旗舰:

MI325X(256GB HBM3E · 现役显存旗舰 · 本词条)MI300X(192GB HBM3 · 上代旗舰 · 详见词条)MI300A(CPU+GPU APU · El Capitan 超算核心)MI210(64GB HBM2e · 上代)MI350 系(下一代,AMD 公开路线图口径)

散热与部署COOLING

MI325X 是 OAM 模组 + 被动散热 + 1000W Peak——散热形态只有整机方案一条路:8 卡 UBB 基板整机、机柜级风道或液冷配套,1000W×8=8kW 级的机柜散热与供电(母排 54V UBB 方案)要整体规划(薄卡官方快照口径[1])。普通 PCIe 工位插卡不存在的——买 MI325X 就是买整机方案。

部署前置三对表:供电(8kW 级 GPU 合计+系统 overhead,机柜电力按整机额定复核)、散热(1000W 单卡的风道或液冷配套)、ROCm 版本(6.x 对 MI325X 的支持矩阵,框架兼容性核对,同 ROCm 词条口径)。

模型适配MODEL FIT

模型 / 场景显存需求(FP16 估算)MI325X 部署口径萬安指数
70B 级推理(FP16)约 140GB单卡 256GB 直装 + 大 KV cache 余量90
DeepSeek R1 满血(671B)FP8 约 690GB8 卡 2TB 装得下且余量充足(FP8 路径随 ROCm 框架支持)86
超长上下文推理KV cache 随长度线性256GB 的 KV cache 空间是 MI 系的看家本领90
大模型训练跨机多集群8 卡 IF 组网可训,调优人力成本计入(ROCm 词条口径)78

显存按 FP16 权重 ≈ 参数量 × 2 字节估算(推算口径);FP8 路径以 ROCm 框架实际支持为准。

AMD Instinct MI325X 官方图(厂商图)
AMD Instinct MI325X · 官方图(AMD 官网)

软件与生态ECOSYSTEM

项目要求 / 现状
软件栈ROCm 6.x(支持矩阵以官方文档为准,同 ROCm 词条口径)
框架PyTorch ROCm 版 / vLLM / SGLang——推理生态可用(MI300X 系案例外溢)
虚拟化SR-IOV 支持(官方规格快照口径[1])
观测工具rocm-smi / amd-smi
对照CUDA 生态对照详见 ROCm 词条迁移框架

生态信息为公开口径整理;版本随时间演进,以 AMD 官方发布为准。

采购与验货PROCUREMENT

MI325X 采购的验货要点(三项):

1
整机方案配套确认
OAM 模组脱离 UBB 基板无法独立使用——整机方案的基板、散热、供电配套逐项确认,「单卡便宜卖」要警惕模组来源。
2
显存与算力实测
rocm-smi 识别 256GB 显存;rocBLAS 基准实测 FP8/FP16 档(≥标称 80% 合格,推算口径);8 卡 IF 链路连通性测试。
3
ROCm 状态与支持矩阵
驱动与 ROCm 版本导出、目标框架的 ROCm 版实跑——MI325X 较新,ROCm 版本支持矩阵核对是采购前置项(ROCm 词条口径)。

验收速查QUICK CHECK

MI325X 四步速查:

1
身份识别
rocm-smi:MI325X 型号、256GB 显存、序列号——与随货文件对表。
2
显存带宽
rocminfo/带宽基准实测 6TB/s 档(≥85% 合格,推算口径)——HBM3E 状态是二手第一关。
3
IF 互联
8 卡系统 rccl-tests 总线带宽——IF 链路连通性与带宽是 OAM 方案的核心验收项。
4
满载烤机
1000W Peak 满载:温度平稳、ECC 零增长(判例框架口径)——散热配套的实测验收。

运输与交付LOGISTICS

1
整机交付与合规
MI325X 以 8 卡 OAM 整机流通:整机运输防震+防静电;跨境流通的合规状态以专业意见为准,本库表述为公开报道口径、不构成法律意见。

术语卡GLOSSARY

HBM3E

第三代高带宽内存的增强版:MI325X 单卡 256GB HBM3E、6TB/s——「一年一代」显存升级节奏的 AMD 应手(对照 MI300X 的 192GB HBM3)。

OAM 模组

OCP Accelerator Module:开放计算的加速卡模组标准——MI325X 的 OAM 形态决定它必须随 UBB 基板整机交付,脱离基板无法独立工作。

1000W Peak

MI325X 的板级功耗峰值:较 MI300X 的 750W 大幅提升——单机 8 卡 8kW 级的散热与供电是机房规划的硬指标(官方快照口径)。

UBB 基板

Universal Baseboard:8 卡 OAM 模组的统一基板——54V 供电母排与 IF 互连的载体,MI325X 整机方案的物理底盘。

局限与争议LIMITS

  • ROCm 生态的迁移账:CUDA 存量产线迁移按人月算总账(同 ROCm 词条框架)——MI325X 的显存优势要压过迁移成本才值得动(本库整理口径)。
  • 1000W 功耗的机房门槛:8 卡整机 8kW 级 GPU 功耗+系统 overhead——风冷机柜的密度上限与液冷改造预算要前置规划(本库整理口径)。
  • 算力同档显存升级的定位:FP8 算力与 MI300X 同档(2.61 PFLOPS)——纯算力需求场景 MI300X 存量更便宜,显存敏感场景才选 MI325X(各自快照口径对照)。
  • 二手流通尚早:MI325X 2024 年末才铺货,二手市场标尺未成型——显存健康度与 IF 链路状态是验货重点(本库验货经验口径)。
  • 跨境流通政策变量:AMD 高端卡同样在管制语境下(公开报道口径)——跨境采购合规以专业意见为准,本库不构成法律意见。

行情说明MARKET NOTE

MI325X · 行情带暂未开通

MI325X 以 8 卡 OAM 整机流通为主,成色与渠道让价差存在——暂无可复核的统一行情快照,本库诚实原则:不做行情带,价格以货主实际报价为准。

在售检索:萬安算交所大厅 ›(0 佣金撮合、数据因此中立)。

常见问题FAQ

MI325X 和 MI300X 怎么选?

显存敏感场景(超长上下文/大 KV cache)选 MI325X:256GB 对 192GB 提升 33%、带宽 6TB/s;预算敏感的存量场景 MI300X 更便宜且算力同档(FP8 均 2.61 PFLOPS)——注意 MI325X 功耗 1000W 对 750W,机房配套要跟上。

MI325X 能跑 DeepSeek R1 满血吗?

FP8 口径可以:R1 满血 FP8 约 690GB,8 卡 MI325X 合计 2TB 显存装得下且余量充足——推理栈用 vLLM/SGLang 的 ROCm 版,部署前先跑基准验证。

MI325X 散卡能买吗?

不能独立使用:OAM 模组脱离 UBB 基板无法工作——MI325X 以 8 卡整机方案流通,「散卡便宜卖」要高度警惕模组来源与配套完整性。

MI325X 验收测什么?

四步:rocm-smi 身份识别(256GB/序列号)→ 显存带宽实测(6TB/s 档 ≥85% 合格,推算口径)→ 8 卡 rccl-tests 互联 → 1000W 满载烤机温度与 ECC。ROCm 版本支持矩阵核对是采购前置项。

MI325X 和 H200 怎么选?

显存与生态的两难:MI325X 256GB 对 H200 141GB 显存占优,但 H200 背靠 CUDA 生态且 NVLink 900GB/s 互联更强——开源栈新产线可评估 MI325X,CUDA 存量产线 H200 迁移成本为零。

MI300XMI325X(薄卡)ROCmMI210(薄卡)液冷 CDUNVMe 全闪存储MI350 系(下一代)UBB 基板El Capitan 超算

机型对比与选型COMPARE

参考资料REFERENCES

  1. AMD 官网 — Instinct MI325X 产品页(规格主档,官方快照与本库薄卡对账一致,2026-10) https://www.amd.com/en/products/accelerators/instinct/mi300/…
  2. AMD Newsroom — MI325X 发布相关口径(Advancing AI) https://www.amd.com/en/newsroom.html
  3. AMD 官方文档 — ROCm 文档站(支持矩阵口径) https://rocm.docs.amd.com/
  4. 在售检索 — 萬安算交所(0 佣金撮合;MI325X 暂无行情快照,价格以货主报价为准) https://www.aixx.vip/hall.html?model=MI325X
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-10 · 版本 v1.0 · 历次改动均留痕可查。发现错误?欢迎通过勘误通道提交,核实后公开修正并记入版本史。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品