Arm发布CSS for Mobile 2:双SME2引擎加持神经加速GPU

资讯 驱动中国 周野 301次阅读
分享 Q
AI摘要
由 AI 生成 · 仅供参考

Arm正式发布第二代移动终端计算子系统CSS for Mobile 2,新架构支持双SME2引擎,并集成具备神经加速能力的GPU,显著提升旗舰手机的AI算力与能效表现,为端侧大模型应用奠定基础。

驱动中国9月8日消息,Arm今日正式发布第二代移动终端计算子系统CSS for Mobile 2。作为面向旗舰移动平台的一体化解决方案,新子系统支持双SME2引擎,并配备带神经加速能力的GPU,标志着Arm在移动端AI算力布局上迈出关键一步。

所谓计算子系统(Compute Subsystem),可以理解为Arm面向移动SoC设计提供的“预制建筑套件”。它不是单一IP,而是将CPU、GPU、系统互连以及相关的软件栈预先集成、验证和优化,让客户基于此快速开发芯片。对于Arm而言,CSS系列的迭代正是为了顺应智能手机对性能、能效和AI能力不断攀升的需求。

CSS for Mobile 2的核心看点之一,是支持双SME2引擎。SME2(Scalable Matrix Extension 2)是Arm架构中面向矩阵运算与AI工作负载的扩展指令集,可以高效地处理矩阵乘加等算子,在图像识别、语音理解以及端侧大模型推理等场景中扮演重要角色。双引擎配置意味着系统可以更灵活地调度计算资源,在并行处理两条人工智能任务时减少等待,从而提升单位功耗下的AI吞吐量。

与CPU侧强化并行能力相配合,新的GPU也集成了神经处理能力。这并非单纯将NPU作为独立模块挂在总线上,而是让GPU本身具备执行神经网络运算的能力,与CPU、NPU组成异构计算矩阵。如此设计可在图形渲染与AI计算之间动态分配资源,尤其适合AI超分、实时渲染降噪、手势追踪等需要同时消耗图形和计算性能的场景。

从市场趋势看,移动端生成式AI正在从云端走向本地部署。隐私保护、低延迟和离线可用性的需求,促使手机厂商将大模型搬进终端。而大模型对内存带宽、矩阵算力以及能效都提出了极高要求。Arm选择在CSS for Mobile 2中同时加强双SME2引擎与GPU的神经处理能力,显然是为了让下一代旗舰手机能在有限的功耗框架内承载更多AI创新。

对产业链而言,CSS for Mobile 2的发布缩短了芯片厂商从IP授权到流片验证的周期。预集成方案意味着中下游厂商无需从零解决系统级兼容问题,可以把更多精力投入到差异化功能开发上。这种“搭积木”式的交付逻辑,正在改变传统IP授权模式中客户各取所需的局面,也让Arm与终端生态之间的联系变得更加紧密。

随着第二代计算子系统的落地,Arm在移动计算领域的战略轮廓更加清晰:不再只是提供指令集和IP,而是提供一套经过验证的系统级方案。未来搭载CSS for Mobile 2架构的移动芯片将如何表现,值得外界持续关注。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com
本文价值 成为第一个评分的人
登录后为本文打分
网友评论0 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友