风冷 350W
在 Hot Chips 2026 大会上,英特尔公布了其新一代数据中心 GPU —— Crescent Island 的详细技术规格。这款产品基于全新的 Xe3P 图形架构打造,是英特尔首款为 AI 推理和智能体 AI 工作负载专门优化的 GPU 加速卡。
Crescent Island 采用风冷设计,额定功耗为 350W,通过 PCIe Gen5 x16 接口与服务器连接。其核心计算单元包含 32 个 Xe 核心(4096 个 ALU 算术逻辑单元)和 32MB 的统一 L2 缓存。在内存配置上,英特尔自家的品牌参考卡将搭载 160GB LPDDR5X 内存,而合作伙伴则可以打造最高 480GB LPDDR5X 内存的定制版本。作为对比,AMD 的 Instinct MI450X 最高搭载 432GB HBM4,NVIDIA Vera Rubin 最高为 288GB HBM4。
Crescent Island 背后的 Xe3P 架构是此次公布的真正亮点。作为英特尔的第三代 Xe 图形架构,其定位在用于 Panther Lake 处理器的 Xe3 架构之后,旨在覆盖 PC、数据中心、边缘计算和工作站等多个领域。Xe3P 架构为 AI 处理进行了大量针对性增强,包括:
增强的 XMX 单元:将每个 Xe 核心中的 XMX(Xe 矩阵扩展)单元从 Xe2 和 Xe3 的四层深度收缩阵列设计,扩展到 16 层深度设计。
新增数据格式支持:新增支持 FP8 和 FP4 精度运算,以优化大语言模型的执行效率。
扩大关键缓存:将每个 Xe 核心的通用寄存器文件(GRF)扩大到 1MB,本地 L1/SLM 内存提升至每核心 512KB。
在内部设计上,Crescent Island 完全专注于计算任务。它由四个计算切片组成,每个切片包含 8 个核心。每个 Xe 核心包含 8 个矢量引擎和 8 个 XMX 引擎,整张 GPU 共计 256 个矢量引擎和 256 个 XMX 引擎。
Crescent Island 的策略是专注于内存容量、能效和对大型 AI 模型的支持。它去除了传统 GPU 中的图形渲染、3D 和光线追踪硬件,将芯片面积全部用于 AI 处理。480GB 的大容量 LPDDR5X 内存旨在支持长上下文 AI 工作负载、KV 缓存存储和运行更多并发推理会话。英特尔表示,LPDDR5X 方案在显著降低功耗和成本的同时,还支持高密度通道设计,具备 ECC 保护和 PCIe 高级错误报告等可靠性特性。
此外,英特尔为 Crescent Island 构建了开放且完整的 AI 软件栈,支持 vLLM、SGLang 以及英伟达 Dynamo 等多种框架。
需要注意的是,此次公布更像是前瞻架构细节,并不代表产品已经量产交付。新的 Crescent Island 作为英特尔在 AI 推理领域的重要产品,也展示了英特尔在 AI 加速器市场的挑战决心。


登录后才可以发布评论哦
打开小程序可以发布评论哦