算力百科COMPUTEPEDIA
规格词条 · 中卡 STANDARD CARD

Intel Data Center GPU Max 1550

Intel 数据中心 GPU 旗舰(Gaudi 3 之外的 GPU 产品线),Aurora 首台百亿亿次超算主力加速卡(63,744 张全球最大单卡部署),47-tile 五工艺节点 Foveros+EMIB 多片封装代表作

概述

Intel Data Center GPU Max 1550 是英特尔数据中心 GPU 产品线的旗舰型号,内部代号为 Ponte Vecchio,采用 Foveros 3D 封装与 EMIB 桥接技术,将十六个台积电五纳米计算 tile、多个 Intel7 工艺的 Rambo 缓存 tile、HBM2e 显存 tile 以及 SerDes tile 封装在一起,功能 tile 总数达四十七个,跨越五个工艺节点,晶体管规模超过一千亿。芯片配备一百二十八个 Xe-core、一千余个 XMX 矩阵引擎与一百二十八 GB HBM2e 显存,通过 PCIe Gen 5 与主机连接,并提供 Xe Link 高速互联。该型号是 Aurora 超算的主力加速卡,面向大规模科学计算、人工智能训练与高性能数据分析等数据中心工作负载。

核心规格

架构Xe-HPC 微架构,代号 Ponte Vecchio(PVC),2×Xe-Stack(每 Stack 64 Xe-core)Foveros 3D+EMIB 2D 双技术多片封装:47 functional tiles 五种工艺节点(16 计算tile TSMC N5 + 8 RAMBO 缓存tile + 2 base die Intel 7 + 8 HBM2E + 2 SerDes tile TSMC N7,11 EMIB),>1000亿晶体管
显存128GB HBM2e(每 Xe-Stack 挂独立 HBM2e stacks;Aurora 单卡 STREAM 实测 2.1TB/s)
显存位宽1024 bit(ARK 官方 Graphics Memory Interface 口径)
显存带宽3276.8 GB/s(ARK/Intel 系列页一致;Hot Chips 官方slide记 3.2TB/s 峰值)
算力官方峰值(Hot Chips 34, 2-Stack):FP64 52 / FP32 52 / XMX TF32 419 / XMX BF16 839 / XMX FP16 839 TFLOPS / XMX INT8 1678 TOPS;Aurora 全机队单卡实测 GEMM 中位数(官方论文 Table 3):FP64 29.2 / FP32 44.0 / TF32 212.8 / BF16 420.3 / FP16 421.6 TF/s、INT8 854.3 TOPS(架构口径 32,768 FP64 FLOPs/时钟 × 最高1.6GHz,与两表自洽)
计算引擎128 Xe-cores(含 1024 XMX 矩阵引擎 + 1024 Xe Vector 引擎,XMX 4096bit 宽,向量 512bit 双发射 FP64 FMA),Register File 64MB / L1 64MB / L2(Rambo) 408MB
功耗600W TDP(ARK 官方;Aurora ECP 实配为 CPU/GPU 4kW 均衡下 GPU 持续 500W 档)
互联Xe Link 高速互联 fabric(ARK: Xe Link Max Frequency 53 Gbps;Aurora 实配双 Stack all-to-all 双平面、每链理论 28GB/s)+ PCIe Gen5 x16 主机接口(64 GB/s 设计带宽)
形态OAM 加速器模组(OAM 支持 4/8-GPU all-to-all 拓扑);Aurora 单刀片 2×Xeon CPU Max + 6×Max 1550
发布年2023(ARK Launch Date Q1'23;架构于 2022-02 ISSCC / 2022-08 Hot Chips 34 官方披露)
晶体管>1000亿(47 functional tiles 五种工艺)
规格已与官方基准快照对账(基准来源,采集 2026-10-10)· 价格以货主实际报价为准

适用场景

同族型号

型号显存功耗
Intel Gaudi 3 对比128GB HBM2e (8×16GB stacks, 3.6GHz, 双die统一寻址)OAM HL-325L: 900W TDP (被动散热; 液冷亦900W) | PCIe HL-338卡: 600W TDP (被动散热)

视频讲解 VIDEO

采购与验货要点

常见问题

Intel Data Center GPU Max 1550 和 Gaudi 系列有什么区别?
两者同属英特尔数据中心加速产品,但定位不同。Max 1550 是基于 Xe 架构的通用 GPU,配备完整图形与计算管线、大容量 HBM2e 显存和 Xe Link 互联,兼顾 HPC 科学计算与 AI 训练推理;Gaudi 系列则是面向深度学习训练与推理的专用 ASIC 加速器。需要通用 GPU 编程模型(如 SYCL、oneAPI 及既有 GPU 生态)与混合 HPC/AI 负载的场景通常选择 Max 1550。
Max 1550 在 Aurora 超算中的部署规模有多大?
Aurora 超算部署了六万三千七百四十四张 Intel Data Center GPU Max 1550,配合两万余颗 Xeon CPU Max 处理器,分布在一万余个刀片节点上,是迄今为止单一系统内最大规模的单型号 GPU 部署之一,理论峰值算力超过两百 EFLOPS 量级(以混合精度口径计)。
Max 1550 支持哪些精度和数据类型?
该卡支持 FP64、FP32 双精度与单精度向量计算,并通过 XMX 矩阵引擎支持 TF32、BF16、FP16 以及 INT8、INT4 等低精度数据类型。不同精度对应不同峰值吞吐,AI 训练通常使用 BF16/FP16,推理可采用 INT8/INT4,传统 HPC 仿真则以 FP64 为主。软件层面通过 oneAPI 与 SYCL 编程模型进行开发。
信源
采集 2026-10-10 · 侦察 C-侦察兵-MAX1550-1010 · 升级厚词条走 编辑政策 流程
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品