Arm在9月8日举行的Arm Everywhere China 2026大会上发布新一代手机计算子系统CSS for Mobile 2。CPU通过SME2技术推动端侧AI普及,Mali GPU首次在原生架构中加入神经网络加速器,移动端NPU的差异化创新继续由芯片合作伙伴主导。

CPU部分的升级围绕SME2展开。Arm称,目前几乎所有安卓和iOS旗舰手机均已采用SME2技术,这使CPU既可以运行轻量模型,也能承担个人智能体工具调用与任务编排。新一代C2 Ultra单线程性能和网页浏览性能较上一代提升15%,应用启动和多线程性能分别提升12%;配备增强SME2的C2 CPU集群在特定AI模型上的执行性能为上一代的1.7倍。C2集群最高可配置14个核心,按负载搭配C2 Ultra与C2 Pro,并配备私有L2和共享L3缓存。Arm边缘AI CPU产品管理总监Daniel Lu说,CPU更适合低延迟应用和本地算力预算内的小模型,持续的高计算负载应交给GPU或NPU。

GPU是这次更新中更引人注目的一环。Mali G2-Ultra NX首次在Mali GPU中原生集成神经网络加速器。Arm的演示显示,相邻三帧画面中,第一帧和第三帧只有四分之一像素采用传统方式渲染,中间帧完全由AI重建,综合下来约八分之七像素由AI重建。该方案的核心是先以较低分辨率渲染,再由神经网络重建高分辨率细节、去除光线追踪噪声或插入中间帧。Arm称,神经图形技术使新GPU的帧率与能效最高达到上一代的4倍,DRAM流量最高降低70%,光追场景的DRAM带宽需求可降低约13%。不调用神经图形功能时,新GPU的综合游戏基准性能较上一代平均提升20%,同频游戏实测最高提升14%。

CPU推动AI普及、GPU借助AI更新渲染方式,但CSS for Mobile 2没有放入Arm自研NPU。Arm边缘AI智能终端计算副总裁James McNiven解释,移动领域的NPU技术创新一贯交由合作伙伴主导,Arm聚焦CPU、GPU和软件系统。手机芯片厂通常有自研NPU架构,并围绕自身系统深度优化;对需要跨品牌的第三方开发者来说,相对标准的CPU、GPU编程环境更容易充当应用的共同底座。

CSS平台因此保留灵活配置空间,并把软件生态放在关键位置。C2 CPU集群允许厂商搭配C2 Ultra与C2 Pro核心,Mali GPU则可配置着色器核心与NX单元数量;KleidiAI把SME2优化内核接入常见AI框架,Arm开放神经图形模型以及SDK和游戏引擎插件,并与腾讯游戏、Unity中国等推进适配。开发者由此可以沿用现有工具链获得硬件加速,不必为不同芯片重写应用。