
一 | 具体支持指令包括:AVX512F、AVX512DQ、AVX512IFMA、AVX512CD、AVX512BW、AVX512VL、AVX512BF16、AVX512VBMI、AVX512VBMI2、GFNI、AVX512VNNI、AVX512BITALG、AVX512VPOPCNTDQ。即将在年底发布的同样Zen4架构的下一代霄龙9004系列,同样会为AMD的服务器、数据中心方案带来AVX-512指令集。值得一提的是,同样是AVX-512指令集,Intel是完整的512-bit通道,AMD则砍到了256-bit,因此在执行512-bit的指令就需要拆分成两个256-bit指令,官方称这可以节省芯片面积,避免发热过大、性能降低。诸多新指令中,VNNI、BF16是面向AI加速的,官方号称FP32浮点推理多线程性能可提升1.31倍,VNNI INT8整数推理多线程性能可提升2.47倍!。 8 月 25 日消息,科技媒体 videocardz 昨日(8 月 24 日)发布博文,报道称在 Hot Chips 2026 活动中,英特尔详细介绍了 Crescent Island GPU,采用 Xe3P 架构,主要面向 AI 推理和智能体 AI 工作负载。Crescent Island 采用风冷设计,额定功耗为 350W,使用 PCIe Gen5 x16 接口。该 GPU 配备 32 个 Xe 核心和 32MB 统一 L2 缓存。

二 | 英特尔自有版本配备 160GB LPDDR5X 内存,合作伙伴版本最高支持 480GB。Crescent Island 采用 Xe3P 架构,该架构将覆盖 PC、数据中心、边缘计算和工作站产品,将每个 Xe 核心中的 XMX 单元从 Xe2 和 Xe3 的四层深度收缩阵列设计(4-deep systolic design),扩展到 16 层深度设计。

三 | 该架构新增支持 FP8 和 FP4,将每个 Xe 核心的通用寄存器文件扩大到 1MB,并把本地 L1/SLM 内存提升至每核心 512KB。英特尔表示,Crescent Island GPU 专为计算任务打造,因此移除了 3D 和光线追踪硬件,把更多芯片面积用于 Xe 核心和 AI 处理。Crescent Island GPU 的 32 个 Xe 核心各包含 8 个 Vector Engine(矢量引擎)和 8 个 XMX Engine(XMX 引擎),整张 GPU 共配备 256 个矢量引擎和 256 个 XMX 引擎。附上相关图片如下:。
Current article:http://6iw.cheshenzhuaduanza.buzz/news/20260826_722.html
Published on:09:44:30
推荐阅读
相关报道
高梨沙羅 五輪期間の必需品は体重計と… 上田晋也「くっせぇ時ある?」に苦笑い
“Gemini,谁啊?”谷歌前沿AI模型迟迟未发布,竞争对手“群嘲”
समाज को एकजुट करने और देशभक्ति को बढ़ावा देने का RSS का दृष्टिकोण, जानें मोहन भागवत ने क्या कहा
三星再获约2000万块iPhone14系列面板订单_苹果_炬光
Mysteel解读:消费端视角下的猪价走势预判
Nginx开启Brotli压缩:流量省20%的正确姿势
ED Raid: सौरभ भारद्वाज के पुश्तैनी घर पर 12 घंटे तक खंगाले घोटाले के सबूत, ईडी के हाथ क्या लगा?
阳泉市推动主导产业迈向高端化、智能化、绿色化、融合化