算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

AMD Radeon Instinct MI50

民间大显存推理圈仍活跃流通的传奇卡:16/32GB HBM2大显存+PCIe4.0,全球首批7nm数据中心GPU(Next Horizon 2018-11-06),也是AMD GCN5.1/Vega20末代旗舰。官方已撤产品页/停止ROCm官方支持(ROCm 6.x起gfx906出官方支持矩阵),但GitHub实证llama.cpp/Ollama/vLLM/ComfyUI的gfx906改版生态2025-2026持续活跃(Qwen3.8-27B实测19→48 tok/s、ROCm 7.2优化镜像、改装扇/集流罩开源件),二手32GB版曾跌至约150-200美元档成为"穷人HBM2"入口。收录视角:HBM2大显存平价推理流通型号,与P40/V100同为民间推理圈三大传奇老卡序列

概述

AMD Radeon Instinct MI50是AMD于2018年11月发布的数据中心加速卡,采用Vega 20核心(GCN 5.1架构,ROCm口径gfx906),是全球首批采用台积电7nm工艺的数据中心GPU,也是Vega 20家族的末代旗舰。它配备60个计算单元、3,840个流处理器,提供16GB或32GB两种容量的HBM2显存,支持全芯片ECC,总线为PCIe 4.0 x16,并具备双Infinity Fabric链路用于多卡互联。凭借大容量HBM2显存,它在本地大语言模型推理社区中长期保持活跃,至今仍有大量用户在llama.cpp、Ollama、vLLM等框架上持续使用。

核心规格

架构GCN 5.1 (Vega 20, gfx906, TSMC 7nm FinFET)——非CDNA,CDNA自MI100起
显存16GB 或 32GB HBM2 (Full-Chip ECC, 双版本)
显存带宽1 TB/s (1024 GB/s, 4096bit × 1GHz DDR)
显存位宽4096bit (4栈HBM2×1024bit)
算力FP64 6.6 / FP32 13.3 / FP16 26.5 / INT8 53 TOPs (峰值引擎时钟 1725 MHz)
计算单元60 CU / 3840 流处理器
功耗300W Peak TDP (2x8-Pin 外部供电)
互联Infinity Fabric 2链 (92GB/s/链, 合计184GB/s) / PCIe 4.0 x16 (兼容3.0 x16)
发布年2018 (Next Horizon 大会 2018-11-06 发布, 全球首批7nm数据中心GPU)
形态PCIe Add-in Card, 全高双槽 10.5" (267mm), 主动散热
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
AMD Radeon PRO W7900 对比48GB GDDR6 with ECC + Infinity Cache 96MB295W (Total Board Power官方页+datasheet+Wikipedia三方一致) | 2×8pin | 推荐PSU 750W
AMD Instinct MI100 对比32GB HBM2 (Full-Chip ECC, 4 stacks)300W Peak (TDP, 被动散热)
AMD Instinct MI300X 对比192 GB750W Peak
AMD Instinct MI325X 对比256 GB1000W Peak
AMD Instinct MI250X 对比128GB HBM2e (Full-Chip ECC, 双die合计)500W (TDP) | 560W Peak
AMD Instinct MI308X 对比192GB HBM3/HBM3e(容量三源一致:Supermicro 渠道双家 192GB OAM + Moreh『与 MI300X 相同容量』即 192GB;类型写法冲突:MI300X 官方为 HBM3,Moreh 行文写 HBM3e、渠道行销文写 HBM3E,官方未裁决按冲突并记)官方未公开(渠道有 750W 级 OAM 说法,与 MI300X OAM 同壳,未达双源实抓门槛不录)

视频讲解 VIDEO

深度阅读:AMD Instinct MI250X · 厚词条AMD Instinct MI100 · 厚词条NVIDIA Tesla V100 · 厚词条NVIDIA Tesla P40 · 厚词条

采购与验货要点

常见问题

MI50 32GB版现在还值得买来做大模型推理吗?
如果预算有限且能接受使用社区维护的软件栈,它仍是入门HBM2大显存推理的常见选择。大容量显存可容纳较大的模型,且llama.cpp、Ollama、vLLM、ComfyUI等框架的gfx906改版社区在持续更新。但需注意官方ROCm支持已终止,依赖自建环境与社区方案。
ROCm已经不支持gfx906了,MI50还能正常用吗?
可以。gfx906自ROCm 6.x起移出官方支持矩阵,但社区改版生态仍然活跃,包括针对该架构的优化镜像和补丁,推理框架层面也有持续的实证优化记录。使用上建议锁定经社区验证的ROCm版本组合。
MI50 16GB和32GB版本怎么选?
以本地大语言模型推理为主要用途时,32GB版本的显存容量优势明显,能承载更大参数量的模型或更长的上下文;16GB版本适合预算更紧或模型规模较小的场景。两者架构与算力规格一致,差异主要在显存容量与价格。
信源
采集 2026-10-10 · 侦察 C-侦察兵-MI50-1010夜 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品