Arm 发布 CSS for Mobile 2,首搭双 SME2 引擎

Arm 发布 CSS for Mobile 2,首搭双 SME2 引擎

Arm 于 9 月 8 日在上海举办年度旗舰活动 Arm Everywhere China,并在会上发布第二代移动终端计算子系统 CSS for Mobile 2。该平台面向智能体 AI 与 AI 原生图形,集成了 Arm C2 CPU 集群、Mali G2-Ultra NX GPU 以及 SI L2 系统互连,同时把系统 IP、软件与开发者工具整合为完整平台。

C2 CPU 集群:双 SME2 引擎

CPU 部分,C2 CPU 集群融合了 C2-Ultra、C2-Pro 两档核心与第二代可伸缩矩阵扩展(SME2)技术。官方数据显示,该集群在最新 AI 模型上的性能最高提升达 1.7 倍,单线程性能最高提升 15%,网页浏览速度提升 15%,应用启动速度提升 12%,集群级多线程性能提升 12%,可支持知识检索、模型准备与应用执行等任务并行处理。

相比上一代配置,新一代集群集成双 SME2 引擎,SME2 能力翻倍。在语音转文本环节,搭载 SME2 的 C2-Ultra 运行 Moonshine、Parakeet 模型时,相比 C1-Ultra 延迟降低 40%;记忆阶段的信息检索与搜索性能提升 41%;推理阶段小语言模型结合检索上下文生成结构化指令的平均速度提升 25%。在涵盖语音、记忆、推理、执行与浏览的端到端测试中,C2-Ultra 配置整体性能提升 24%。

Arm 同时介绍了工作流的核心编排层,负责维护任务状态、整合上下文,并决定每个阶段由本地应用、端侧模型、其他计算资源或云端服务中的哪一方执行,CPU 则统一协调权限管理与任务进程。

Mali G2-Ultra NX:神经网络加速器进入 GPU

GPU 部分,Mali G2-Ultra NX 是 Arm 首款 AI 原生 Mali GPU,核心变化是将专用神经网络加速器直接嵌入 GPU 着色器核心,使神经图形负载能与图形和计算任务并行运行,并复用 GPU 的内存系统与一致性缓存。该 GPU 结合全新执行引擎与第三代光线追踪单元(RTUv3),支持神经超级采样(NSS)、神经帧率提升(NFRU)与神经超分降噪(NSSD)三项技术。

在与 Sumo Digital 基于虚幻引擎联合打造的演示《光影新生》中,NFRU 与 NSSD 方案相比传统渲染实现最高 4 倍的性能效率提升,外部内存流量降低多达 70%,使虚幻引擎 MegaLights 等技术得以落地移动设备;该 GPU 可支持最高 120 帧每秒的稳定运行。其执行引擎是 Arm Mali 过去七代产品中规模最大的指令集架构升级。基准测试性能最高提升 24%,非 AI 游戏性能提升 14%;借助不透明度微贴图(OMM)硬件支持,帧率可提升 30%、光线追踪负载最多降低 70%。作为背景,Arm Mali GPU 累计出货量已超过 140 亿颗。

软件生态与落地

软件层面,CSS for Mobile 2 依托全球超过 2200 万的 Arm 开发者社区,通过 KleidiAI 与主流 AI 框架深度集成,为 Arm CPU 提供优化执行路径,开发者无需改变现有流程即可利用 SME2 等底层能力。Arm AI Portal 在统一平台汇聚经过优化和验证的模型、性能与准确性数据、代码示例及部署资源,Arm MCP 服务器则把这些能力引入智能体 AI 开发环境。

CSS for Mobile 2 为芯片合作伙伴提供了可灵活配置的基础平台,其后续在终端芯片与整机产品上的落地进展值得关注。