规格词条 · 中卡 STANDARD CARD
AMD Instinct MI250X
全球首台E级超算Frontier与欧洲LUMI的绝对主力GPU(Top500实证), AMD HPC旗舰双die大显存封装, HPC/科学计算场景二手流通型号
概述
AMD Instinct MI250X是AMD基于CDNA2架构打造的HPC旗舰加速卡,采用TSMC 6nm制程,集成220个计算单元、14080个流处理器,双GCD(GPU Compute Die)封装设计。配备128 GB HBM2e显存,支持全芯片ECC,通过Infinity Fabric实现片间互联。该卡以OAM模组形态出货,采用被动散热,主要面向高性能计算、科学计算与大规模AI训练场景。作为全球首台E级超算Frontier及欧洲LUMI超算的主力GPU加速器,其大规模集群能力已经过Top500榜单的实证,目前亦存在于二手流通市场,是HPC领域具有代表性的型号之一。
核心规格
| 架构 | CDNA2 (双GCD双die封装, TSMC 6nm FinFET) |
| 显存 | 128GB HBM2e (Full-Chip ECC, 双die合计) |
| 显存带宽 | 3.2 TB/s (1.6TB/s×双GCD) |
| 显存位宽 | 8192bit (双die合计) |
| 算力 | FP64 47.9 / FP64 Matrix 95.7 / FP32 47.9 / FP16·BF16 383 / INT8·INT4 383 TOPS (TFLOPS, 双die合计, Peak Engine Clock 1700MHz) |
| 计算单元 | 220 CU / 14080 流处理器 (双GCD合计) |
| 功耗 | 500W (TDP) | 560W Peak |
| 互联 | Infinity Fabric 8链 (峰值100GB/s/链) / PCIe 4.0 x16 |
| 发布年 | 2021 (官方Launch Date 11/08/21) |
| 形态 | OAM Module, Passive OAM (被动散热) |
规格已与官方基准快照对账(
基准来源,采集 2026-10-10)· 价格以货主实际报价为准
适用场景
- 大型超级计算机集群部署,尤其是以FP64双精度为核心的科学计算负载
- 计算流体力学、分子动力学、气候模拟等传统HPC仿真任务
- 大规模深度学习训练,利用FP16与bfloat16矩阵加速能力
- 混合精度科学AI场景,兼顾双精度求解与低精度张量运算
同族型号
视频讲解 VIDEO
采购与验货要点
- MI250X为OAM模组形态、被动散热设计,TDP较高(标称500W,峰值560W),采购前须确认机房供电容量、OAM基板兼容性以及配套的高风量散热方案,不能按普通PCIe卡部署
- 该卡通过8条Infinity Fabric链路实现多卡互联,采购多卡系统时应确认基板与整机厂商的互联拓扑设计,以获得预期的集群通信性能
- 作为二手流通型号,验收时应重点核查ECC与RAS功能记录(含Page Retirement历史)、ROCm软件栈兼容版本、OAM模组的物理状态与散热硅脂/导热垫情况,并要求供应商提供规格核验报告
常见问题
MI250X和MI250有什么区别?
MI250为MI250X的同架构衍生版本,主要差异在于部分计算单元被屏蔽,双精度向量和显存带宽规格有所降低。具体而言,MI250每个GCD的活跃CU数量少于MI250X的满血规格,双精度矩阵性能也相应下调。选购时应根据软件栈对FP64峰值的要求确认具体型号。
MI250X适合跑AI训练还是科学计算?
两者均可胜任。该卡的双精度矩阵性能与单精度矩阵性能峰值相同,对传统HPC双精度求解器非常友好;同时FP16、bfloat16和INT8/INT4均提供较高峰值吞吐,适合大规模AI训练。其定位偏向HPC与科学计算为主、AI训练为辅的混合负载场景。
二手MI250X能否用于自己的工作站?
不建议直接在普通工作站使用。该卡采用OAM模组形态和被动散热,需要专用OAM基板、机箱风道和高功率供电支持,并非标准PCIe插卡形态,PCIe 4.0 x16仅作为主机接口。个人用户若不具备相应机箱与散热条件,部署难度较大。
采集 2026-10-10 · 侦察 C-侦察兵-MI250X-1010 · 升级厚词条走
编辑政策 流程