规格词条 · 中卡 STANDARD CARD
AMD Instinct MI325X
256GB HBM3E+6TB/s,MI300X同芯加大杯,单卡塞满700亿参数模型还有余量,1TB级功耗需机房专门供电,新一代大显存推理主力

AMD 厂商官方图
概述
AMD Instinct MI325X是AMD基于CDNA3架构的数据中心加速器,是MI300X家族的显存扩容升级款:同样采用台积电5nm+6nm混合制程与19,456个流处理器,显存升级为256GB HBM3E,配合8192-bit位宽提供6TB/s显存带宽(上代MI300X为192GB HBM3、5.3TB/s),FP8峰值算力2.61 PFLOPs保持同档。该卡采用OAM模组形态,板级功耗峰值1000W,提供8条Infinity Fabric链路(单链路128GB/s)用于多卡组网,通过PCIe 5.0 x16与主机连接,定位于超大显存容量的大模型推理与训练场景。
核心规格
| 架构 | CDNA3 |
| 显存 | 256 GB |
| 显存类型 | HBM3E |
| 显存位宽 | 8192-bit |
| 显存带宽 | 6 TB/s |
| FP8算力 | 2.61 PFLOPs |
| FP16算力 | 1.3 PFLOPs |
| FP32算力 | 163.4 TFLOPs |
| FP64算力 | 81.7 TFLOPs |
| INT8算力 | 2.6 POPs |
| 功耗TBP | 1000W Peak |
| 互联 | PCIe® 5.0 x16 |
| Infinity Fabric Links | 8 |
| Infinity Fabric带宽 | 128 GB/s |
| 流处理器 | 19,456 |
| 形态 | OAM Module |
| 末级缓存LLC | 256 MB |
| 制程 | TSMC 5nm | 6nm FinFET |
规格已与官方基准快照对账(
基准来源,采集 2026-10-09)· 价格以货主实际报价为准
适用场景
- 超大参数模型单卡承载:256GB HBM3E可在单卡内装载数百亿参数级大语言模型权重,并为超长上下文预留充足KV缓存空间,减少多卡张量并行的通信开销
- 大模型在线推理服务:FP8算力2.61 PFLOPs提供高吞吐推理能力,配合6TB/s显存带宽可缓解大批量并发下的解码瓶颈,适合搭建生产级推理服务
- 多卡训练与集群扩展:8条Infinity Fabric链路支持多卡高速组网,可在OAM基板方案下组成8卡系统,承载大模型训练与微调任务
- 高性能计算:提供81.7 TFLOPs FP64双精度能力,可用于计算流体力学、气象模拟等传统HPC负载
同族型号
采购与验货要点
- 确认整机形态:MI325X为OAM模组、被动散热设计,依赖UBB基板与机箱强制风道,无法直接插入普通PCIe风冷工位,采购前需确认服务器整机方案的兼容性
- 核算供电散热余量:板级功耗峰值达1000W(高于上代MI300X的750W),单机多卡部署时需逐项核算机柜供电、母排与散热能力
- 验收软件与互联状态:核实ROCm驱动版本对该型号的支持范围、显存ECC日志有无异常记录,并要求卖家提供Infinity Fabric链路连通性与满载稳定性测试报告
常见问题
MI325X单卡能跑多大的模型?
256GB HBM3E显存可在单卡内完整装载数百亿参数级大语言模型权重,并预留长上下文推理所需的KV缓存空间;更大模型可通过8条Infinity Fabric链路做多卡张量并行切分。
MI325X与MI300X的主要区别是什么?
两者核心算力规格相同(FP8均为2.61 PFLOPs),差异集中在显存:MI325X配备256GB HBM3E、带宽6TB/s,MI300X为192GB HBM3、带宽5.3TB/s;MI325X板级功耗峰值也从750W提升至1000W。简单说:算力同档,显存更大。
采购现货MI325X要注意什么?
该型号以整机/基板方案流通为主,采购时需确认OAM模组与UBB基板的匹配性、供电方案满足1000W峰值功耗,核实ROCm软件栈版本与显存ECC记录,并索取多卡互联与满载烤机测试记录。
采集 2026-10-09 · 侦察 侦察兵-自动小弟B2 · 升级厚词条走
编辑政策 流程