| 规格 | Intel Data Center GPU Max 1100 | Intel Data Center GPU Max 1550 |
|---|
| 架构 | Xe-HPC 微架构,代号 Ponte Vecchio(PVC);56 Xe-cores=全配 128 核的削减档(STH 实拍判断:封装外观与 1550 OAM 同尺寸、chip 为削减版;官方未单列 stack 数——推算:单 Xe-Stack 域 3×16GB HBM2e,与 1228.8GB/s 带宽精确自洽(3×409.6,与 1550 八栈同速率同栈带宽),推算口径已标注非官方) | Xe-HPC 微架构,代号 Ponte Vecchio(PVC),2×Xe-Stack(每 Stack 64 Xe-core)Foveros 3D+EMIB 2D 双技术多片封装:47 functional tiles 五种工艺节点(16 计算tile TSMC N5 + 8 RAMBO 缓存tile + 2 base die Intel 7 + 8 HBM2E + 2 SerDes tile TSMC N7,11 EMIB),>1000亿晶体管 |
| 显存 | 48GB HBM2e(ARK 官方;SURF 节点配置记 'Max 1100 48G XeLink') | 128GB HBM2e(每 Xe-Stack 挂独立 HBM2e stacks;Aurora 单卡 STREAM 实测 2.1TB/s) |
| 显存位宽 | 1024 bit(ARK 官方 Graphics Memory Interface 口径,与 1550 ARK 写法同口径;第三方 TechPowerUp 称物理总线 8192bit——两口径并存如实记录,ARK 为准) | 1024 bit(ARK 官方 Graphics Memory Interface 口径) |
| 显存带宽 | 1228.8 GB/s(ARK 官方;与 1550 的 3276.8GB/s 精确成 3:8 比例,同 409.6GB/s/栈速率,算术自洽) | 3276.8 GB/s(ARK/Intel 系列页一致;Hot Chips 官方slide记 3.2TB/s 峰值) |
| 算力 | Intel 官方未单列本卡 TFLOPS(ARK 无算力字段;Hot Chips 34 峰值表为 2-Stack=Max 1550 全配口径,不适用)。架构速率推导(按 ARK 最大动态时钟 1.55GHz):FP64≈FP32≈22.2 TFLOPS(56 核×256 FLOPs/clk/核×1.55GHz;每核速率取自 Aurora 论文 128核=32,768 FLOPs/clk 官方口径),XMX FP16/BF16≈355 TFLOPS、TF32≈178 TFLOPS、INT8≈711 TOPS(448 XMX×512/256/1024 ops/clk/引擎,HC34 速率口径);第三方 TechPowerUp FP64/FP32 22.22 TFLOPS 与推导吻合(搜索转引未实抓,仅作旁证) | 官方峰值(Hot Chips 34, 2-Stack):FP64 52 / FP32 52 / XMX TF32 419 / XMX BF16 839 / XMX FP16 839 TFLOPS / XMX INT8 1678 TOPS;Aurora 全机队单卡实测 GEMM 中位数(官方论文 Table 3):FP64 29.2 / FP32 44.0 / TF32 212.8 / BF16 420.3 / FP16 421.6 TF/s、INT8 854.3 TOPS(架构口径 32,768 FP64 FLOPs/时钟 × 最高1.6GHz,与两表自洽) |
| 计算引擎 | 56 Xe-cores(含 448 XMX 矩阵引擎 + 448 Xe Vector 引擎 + 56 光线追踪单元,ARK 官方;每核 8 XMX+8 Vector 与全配 PVC 同构) | 128 Xe-cores(含 1024 XMX 矩阵引擎 + 1024 Xe Vector 引擎,XMX 4096bit 宽,向量 512bit 双发射 FP64 FMA),Register File 64MB / L1 64MB / L2(Rambo) 408MB |
| 功耗 | 300W TDP(ARK 官方;STH 实拍报道两处独立确认 300W——任务卡'450W?'假设被实抓推翻,Max 1100 无 450W 档) | 600W TDP(ARK 官方;Aurora ECP 实配为 CPU/GPU 4kW 均衡下 GPU 持续 500W 档) |
| 互联 | Xe Link 高速互联(卡顶连接器+官方桥接器最多挂 4 卡,STH 实拍;SURF 实配 2 卡 XeLink 互连节点;注意:1100 ARK 页无 Xe Link 频率字段,1550 页为 53Gbps——官方未给 1100 频率数,宁缺勿编)+ PCIe Gen5 x16 主机接口(ARK 官方;SURF 节点表同证 PCIe 5.0 x16) | Xe Link 高速互联 fabric(ARK: Xe Link Max Frequency 53 Gbps;Aurora 实配双 Stack all-to-all 双平面、每链理论 28GB/s)+ PCIe Gen5 x16 主机接口(64 GB/s 设计带宽) |
| 形态 | PCIe 5.0 x16 全高双槽无源散热卡(STH SC22 2022-11 实拍;与旗舰 Max 1550 的 OAM 模组形成产品线两形态——1100 是标准服务器直插档;SURF 实配 Intel D50DNP 双卡节点) | OAM 加速器模组(OAM 支持 4/8-GPU all-to-all 拓扑);Aurora 单刀片 2×Xeon CPU Max + 6×Max 1550 |
| 发布年 | 2023(ARK Launch Date Q2'23;卡型 2022-11 SC22 现场首秀,STH 实报'recently announced') | 2023(ARK Launch Date Q1'23;架构于 2022-02 ISSCC / 2022-08 Hot Chips 34 官方披露) |
| 晶体管 | 官方未单列(全配 Ponte Vecchio die >1000亿晶体管/47 tiles 五工艺节点;本卡为同封装削减档,关闭部分 tiles/核,实际规模低于全配值——不照抄全配数) | >1000亿(47 functional tiles 五种工艺) |