算力百科COMPUTEPEDIA

算力百科 › 技术概念 › MIG 多实例 GPU

MIG 多实例 GPU

MULTI-INSTANCE GPU · 技术概念词条

概述OVERVIEW

MIG(Multi-Instance GPU)是 NVIDIA Ampere 架构引入的 GPU 切分技术:把一颗物理 GPU 切成最多 7 个独立实例——每个实例有专属的 SM 核心、L2 缓存、显存分区和带宽,实例间硬件级隔离(不是虚拟化共享)。

MIG 解决的是「一颗大卡跑多个小任务」的问题:推理服务(多个小模型各占一个实例)、开发/测试环境(多人共享一张大卡)、多租户 GPU 池化——单卡利用率从「跑一个大任务 100%」变成「多个小任务各分一块」。MIG 对数据中心运营商的价值是把「一颗 H100 141GB」切成 7 份卖给 7 个客户。

关键数字KEY NUMBERS

项目数值 / 口径
H200 NVL最多 7 实例 @ 16.5GB
H100最多 7 实例 @ 12GB
A100 80GB最多 7 实例 @ 10GB
L40S不支持 MIG

在 B300 上的意义ON B300

B300 系的 MIG 切分粒度更细(Blackwell 架构支持更多实例数和更灵活的分区比例)——但 MIG 切分的核心价值不变:把一颗大卡切给多个小用户/小任务。注意 MIG 不等于 vGPU:MIG 是硬件隔离(性能可预期),vGPU 是软件调度(灵活性高但性能波动)——两者定位不同。

边界与注意LIMITS

  • MIG 切分后不能动态调整:切好 7 份就是 7 份——要改分区比例需要停服重切(不是热操作)。
  • 并非所有卡都支持:消费卡(RTX 4090 等)不支持 MIG——MIG 是数据中心卡(Tesla/Instinct 系)的专属能力。
  • 切分后总显存不变:7 实例分的是同一块显存——不是变出 7 倍显存。

参考资料REFERENCES

  1. NVIDIA 官网 — Blackwell Ultra / HGX B300 产品页 https://www.nvidia.com/en-us/data-center/hgx/
  2. 行情与在售数据:萬安算交所(本库行情带)
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-10 · 版本 v1.0 · 历次改动均留痕可查。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品