快科技8月25日消息,在Hot Chips 2026大會上,英特爾展示了面向智能體AI及企業級工作負載的三款架構,包括適用於以更高性能去調度與協同的Diamond Rapids處理器、支持高效推理的Crescent Island GPU,以及用於智能客戶端與邊緣計算的Wildcat Lake SoC。
其中代號Crescent Island(新月島)的全新GPU加速器,是一款專為AI推理與智能體工作負載打造的低功耗、易部署GPU,不再兼顧傳統的圖形渲染性能。
Crescent Island採用標準PCIe 5.0 x16規格,整卡TDP功耗350W,配套成熟風冷散熱方案,企業可以直接在現有風冷服務器上架部署,無需改造昂貴的液冷基礎設施,通過合作伙伴的定製方案,其容量最高可擴展至480GB。

架構層面,Crescent Island首發搭載第三代Xe架構增強版本Xe3P,Xe3P是Panther Lake處理器內置Xe3架構的迭代增強版本,按照英特爾路線規劃,這套架構未來將落地PC客戶端、數據中心、邊緣計算、工作站多條產品線,具備很高的通用性與拓展潛力。
為拔高AI推理能效,英特爾還對Xe3P核心做了大規模改造,AI矩陣計算XMX單元,從Xe2、初代Xe3的4層深度脈動陣列升級到16層,原生新增支持FP4、FP8低精度AI計算,同時完整覆蓋FP16、FP32直至FP64全精度。

單Xe核心寄存器堆容量直接翻倍至1MB,L1緩存與SLM共享局部緩存提升到512KB,減少數據讀寫延遲,提升大模型吞吐能力。
芯片設計上,Crescent Island貫徹去圖形化思路,完全移除3D渲染、光線追蹤全套硬件模塊,把節約下來的全部晶體管資源投入Xe計算核心與AI加速單元。

整卡內部劃分4組Compute Slice計算塊,集成32個Xe3P核心,合計擁有256個矢量引擎、256個XMX矩陣AI引擎,全部算力資源服務AI推理任務。
軟件生態上,該加速器原生適配vLLM、SGLang、PyTorch等當下主流AI推理框架,降低企業落地大模型的適配成本。