英特尔CrescentIsland加速卡发布,32核Xe3P架构配480GB内存,专为AI推理设计

在2026年8月举行的Hot Chips 2026大会上,英特尔正式发布了其新一代AI加速卡——代号'Crescent Island'(新月岛)。这款产品采用全新的Xe3P GPU架构,专为高性能人工...

人工智能

在2026年8月举行的Hot Chips 2026大会上,英特尔正式发布了其新一代AI加速卡——代号'Crescent Island'(新月岛)。这款产品采用全新的Xe3P GPU架构,专为高性能人工智能推理工作负载优化,是英特尔在数据中心AI硬件领域的重要布局。

Crescent Island加速卡采用标准的350W风冷PCIe扩展卡形态,配备32个Xe3P计算核心,每个核心包含8个矢量引擎和8个XMX加速引擎,总计256个矢量引擎和256个XMX单元。该芯片由四个计算切片组成,每个切片包含8个核心,所有计算切片通过大容量L2缓存互联。与传统GPU不同,Crescent Island完全去除了图形渲染、视频输出等通用显卡功能,将全部硅片面积用于AI加速模块,实现了算力资源的最大化利用。

在内存配置方面,Crescent Island采用了与NVIDIA和AMD截然不同的策略。后两者的数据中心方案普遍采用高端HBM内存,而Crescent Island则选择了LPDDR5x内存,最高容量可达480GB。英特尔自有品牌公版参考设计标配160GB LPDDR5x内存,同时允许ODM合作伙伴根据需求定制最高480GB版本。这种设计不仅显著降低了功耗和成本,还支持高密度通道设计,带来可观的带宽提升,并具备ECC保护和PCIe高级错误报告等可靠性特性。

Xe3P架构相较于前代Xe3架构实现了多项关键升级。首先,XMX加速引擎从四层深度收缩阵列设计扩展到16层深度设计,计算吞吐效率大幅提升。其次,新增了FP4超低精度数据格式支持,并完整兼容FP8等主流高精度算力格式,兼顾极致算力密度与多场景精度适配需求。此外,每个Xe3P核心均配备了1MB超大寄存器文件和512KB L1高速缓存,有效降低数据调度延迟,提升连续AI任务的处理效率。

软件生态方面,英特尔为Crescent Island构建了开放且完整的AI软件栈,涵盖编译器、库工具与AI运行时,支持Triton、oneDNN、OpenCL、PyTorch、OpenVINO、SYCL等主流框架。该产品还支持KV缓存感知路由与卸载,以实现可扩展推理;并可与vLLM、SGLang、llm-d及NVIDIA Dynamo等框架协同工作,实现跨异构基础设施的智能体编排,无需修改智能体代码。

英特尔表示,Crescent Island GPU预计将于2026年下半年向客户送样。这款产品的推出,使得英特尔在AI推理专用硬件领域实现了关键突破,为本地大模型推理场景提供了全新的解决方案。通过超高容量的本地内存设计,单张或少量顶配显卡即可独立运行大规模开源大模型,大幅降低模型部署对外部存储资源的依赖,规避了复杂的模型切分、分片加载流程,有效简化本地大模型部署流程。

图片 图片 图片