会懂网AI资讯获悉,9月3日,英特尔在Hot Chips上揭晓面向企业数据中心的AI推理专用GPU——Crescent Island的软硬件全栈细节。作为标准PCIe形态加速卡,整卡典型功耗350W、风冷散热,标配160GB LPDDR5X显存,开放给ODM最高可拓展至480GB,支持FP4到FP64全精度,覆盖AI推理到高性能计算。

该芯片基于Xe3P架构,核心由3个Xe通用核心与256个第三代XMX引擎组成,XMX升级为三路并发FP4指令,完整兼容FP64双精度;16深度脉动阵列减少访存、提升单元利用率。片上32MB统一二级缓存配合每核内置寄存器与一级缓存,把高频数据尽量留在片内,围绕“减少访存、提升并发”做能效优化。
面向Agentic AI长会话场景,Crescent Island内置硬件级KV缓存加速,支持超长上下文、多会话并发的压缩推理;集成4路编解码媒体引擎承载多模态负载;对外PCIe5.0 x16配合开放交换架构支持多卡横向扩展,可灵活搭建推理集群。
会懂网认为,英特尔把这张卡定位为“数据中心级推理旗舰”,直指Agentic AI兴起带来的长上下文、高并发推理新需求。其卖点不是峰值训练力,而是每瓦Token与超大显存——后者对跑大模型推理尤为关键。
当然,英特尔GPU的生态与软件栈仍是硬仗。会懂网会关注它能否在CUDA主导的市场里,凭显存与能效撕开企业推理的口子。
480GB显存的配置,指向的显然是大模型推理而非图形渲染。会懂网认为,英特尔选择从推理侧切入,是一种务实的差异化策略:训练市场已被英伟达牢牢占据,而推理场景对成本与部署规模更为敏感,留给新架构的空间也更大。当然,硬件参数只是入场券,真正的考验在于软件栈与开发者生态,能否让客户以较低成本完成迁移,才是决定成败的地方。






















暂无评论内容