全球动态2026.09.08

Arm 发布第二代移动计算子系统 CSS for Mobile 2,CPU 集成双 SME2 引擎

Arm 在上海发布 CSS for Mobile 2,集成 C2 CPU 集群、Mali G2-Ultra NX GPU 与 SI L2 互连,CPU 端集成双 SME2 引擎使 AI 性能最高提升 1.7 倍,GPU 端将神经网络加速器直接嵌入着色器核心。

朋克君
发布者朋克君
预计阅读 3 分钟
我要投稿
AI 摘要
约 1 分钟

快速了解本文

01

Arm 发布第二代移动计算子系统 CSS for Mobile 2,集成 C2 CPU 集群与 Mali G2-Ultra NX GPU。

02

C2 CPU 集群集成双 SME2 引擎,在智能体 AI 工作流中整体性能提升 24%。

03

Mali G2-Ultra NX 是首款 AI 原生 Mali GPU,支持神经超级采样等加速技术。

本摘要由 AI 辅助整理,请以正文内容为准。

数智朋克讯 2026 年 9 月 8 日,Arm 在上海举办的 Arm Everywhere China 活动上发布第二代移动终端计算子系统 CSS for Mobile 2。该平台面向智能体 AI 与 AI 原生图形场景,集成 Arm C2 CPU 集群、Mali G2-Ultra NX GPU 以及 SI L2 系统互连三大核心组件。

01C2 CPU 集群:双 SME2 引擎驱动端侧 AI

C2 CPU 集群融合 C2-Ultra CPU、C2-Pro CPU 以及第二代 Arm 可伸缩矩阵扩展(SME2)技术,集成双 SME2 引擎,SME2 能力较上一代翻倍。

在最新 AI 模型上,C2 CPU 集群性能最高提升达 1.7 倍,单线程性能最高提升 15%,网页浏览速度提升 15%,应用启动速度提升 12%,集群级多线程性能提升 12%。

在智能体 AI 工作流中,运行 Moonshine 和 Parakeet 语音转文本模型时,搭载 SME2 的 C2-Ultra 相比 C1-Ultra 延迟降低 40%;记忆阶段内存信息检索与搜索性能提升 41%;推理阶段小语言模型生成结构化指令平均速度提升 25%。在涵盖语音处理、记忆检索、推理、应用执行和网页浏览等环节的端到端测试中,C2-Ultra 配置相比上一代实现了 24% 的整体性能提升。

02Mali G2-Ultra NX:首款 AI 原生 Mali GPU

Mali G2-Ultra NX 是 Arm 首款 AI 原生 Mali GPU,将专用神经网络加速器直接嵌入 GPU 着色器核心,使神经图形工作负载能够与图形和计算任务并行运行。该 GPU 支持神经超级采样(NSS)、神经帧率提升(NFRU)、神经超级采样与降噪(NSSD)三项神经网络加速技术。

在 Arm 与 Sumo Digital 基于虚幻引擎联合打造的演示游戏《光影新生》中,NFRU 与 NSSD 方案与传统渲染相比实现了最高 4 倍的性能效率提升,外部内存流量降低多达 70%。Mali G2-Ultra NX 面向持续高帧率体验设计,可支持最高 120 帧每秒的稳定运行。

与上一代产品相比,Mali G2-Ultra NX 基准测试性能最高提升 24%,非 AI 游戏性能提升 14%。光线追踪方面,新架构在主流光线追踪基准测试中可将 DRAM 流量最多降低 13%,并对不透明度微贴图(OMM)提供硬件级支持;使用 OMM 可使帧率提升 30%,光线追踪工作负载最多降低 70%。Arm Mali GPU 的累计出货量已超过 140 亿颗。

03软件生态:KleidiAI 与 Arm AI Portal

软件层面,CSS for Mobile 2 通过 KleidiAI 与主流 AI 框架深度集成,为 Arm CPU 提供优化的软件执行路径;Arm AI Portal 汇聚经过优化和验证的模型、性能与准确性数据、代码示例及部署资源;Arm MCP 服务器将这些能力引入智能体 AI 开发环境。

ARTICLE RECORD

转载说明

转载请注明文章出处。

TOPICS · 05

文章标签