随着AI从单一功能逐步演进为持续运行的智能体AI体验,AI正驱动着移动设备的工作负载发生深刻的变化。智能体不仅需要执行推理任务,还需要保持上下文状态、运行应用程序、协调不同模型与服务,并在用户授权下自主完成任务,而这一切都必须在智能手机的功耗和散热约束下实现。与此同时,AI原生图形技术也为移动体验带来了巨大创新空间,有望突破用户对移动设备图形能力的既有认知。面对这一全新时代,移动设备需要一个专为新一代AI工作负载打造的计算平台,以更紧密地整合CPU、GPU和系统IP,让开发者能够更便捷地开发和部署下一代AI应用。作为移动生态系统的核心力量,Arm具备打造这一平台的独特优势。

9月8日,在Arm Everywhere China的年度大会上,Arm正式推出第二代移动终端计算子系统(CSS for Mobile 2),在单一计算平台中实现对智能体AI和AI原生图形技术的全面支持。Arm CSS for Mobile 2集成全新Arm Mali G2-Ultra NX GPU、搭载 SME2的Arm C2 CPU集群、增强型系统IP、物理实现方案以及开发者就绪的软件生态系统,并针对下一代移动设备进行了全面优化。对于芯片合作伙伴而言,这意味着能够更快速地打造差异化产品;对于开发者而言,则能够基于统一平台规模化开发和部署AI应用;对于终端用户而言,则可获得更灵敏、更个性化且更丰富的视觉体验。
AI原生图形技术正式登陆Arm Mali GPU
神经网络技术正在为移动图形带来全新的发展路径。它不再完全依赖传统渲染流程,而是能够通过重建、增强和生成视觉细节来呈现画面,从而为提升性能和视觉质量开辟新的空间。这一变革在游戏领域尤为明显。如今,玩家期待在移动设备上获得更丰富的游戏世界、更具电影感的光影效果,以及更流畅、更高分辨率的游戏体验。作为全球领先的移动GPU技术提供商,Arm正将AI原生图形能力引入数十亿GPU芯片。
Arm Mali G2-Ultra NX是首款集成专用神经网络加速器的Mali GPU,可将神经网络计算与传统图形处理紧密融合,实现更高的能效和响应速度。图形处理与神经网络计算可在同一处理管线中协同运行,使相关工作负载直接在GPU内完成,这为开发者在性能、能效与视觉质量之间进行权衡和优化提供了全新的方式。同时,该GPU还引入了全新的执行引擎(ExecutionEngine,EE)和第三代光线追踪单元(Ray Tracing Unit v3,RTUv3),专为日益复杂的图形工作负载以及现代游戏引擎功能而设计。
结合Arm神经网络技术,Mali G2-UltraNX在神经网络处理场景下可实现最高4倍的“每瓦性能”提升。这一跨越式的能效进步,为更加丰富、更高保真度和更复杂的图形体验释放了更大的性能空间。
与此同时,Arm也持续推进传统图形性能的发展。与上一代产品相比,Mali G2-Ultra NX在现有游戏内容中可实现高达14%的性能提升。
vivo表示:“通过与Arm的合作,我们将Arm神经网络技术引入基于Arm最新计算平台打造的vivo最新旗舰手机,为移动游戏解锁更多可能。通过将Arm最新的计算与图形技术与vivo的终端优化能力相结合,我们希望加速神经网络技术的普及,为用户带来更加沉浸的移动游戏体验。”
由Arm与Sumo Digital联合开发的《光影新生》展示了Mali G2-Ultra NX所能带来的全新图形体验。同时,多家领先游戏引擎和平台已将Arm神经网络技术集成到开发流程中,包括腾讯游戏公共技术线的Magic Dawn和Unity中国团结引擎。该技术也正加速迈向实际游戏应用。网易《燕云十六声》计划于今年向玩家推出支持神经超级采样(Neural Super Sampling,NSS)的版本;此外,Arm还联合腾讯游戏《暗区突围:无限》开展神经超级采样与降噪(Neural Super Sampling and Denoising,NSSD)技术演示,并与叠纸游戏《无限暖暖》推进NSS技术集成。
网易《燕云十六声》引擎团队负责人周克利表示:“依托与Arm的合作,我们将Arm神经网络技术集成到弥赛亚引擎,并落地到实际游戏开发之中。《燕云十六声》将成为首批搭载Arm神经网络技术的游戏之一,实现该技术从引擎层适配到产品落地的重要突破。我们双方的紧密协作,将助力更多开发者采用Arm神经网络技术,加速这项技术在更广泛游戏生态中的普及。”
腾讯游戏公共技术线负责人陈冬表示:“神经图形技术正在为下一代移动游戏开发打开全新的创新空间。我们正与Arm携手,将Arm神经网络技术,集成到腾讯游戏由AI驱动的游戏中台——MagicDawn中,并进一步联合《暗区突围:无限》游戏进行NSSD演示的共研开发。通过连接底层技术创新、开发者与真实内容场景,我们正在共同构建更完善的产业生态,加速先进图形技术在移动游戏中的应用落地,让更多玩家享受到新一代图形体验带来的价值。”
Unity中国首席执行官张俊波表示:“我们与Arm的合作不仅仅是将新技术引入引擎,更重要的是赋能更广泛的开发者生态,推动技术真正落地应用。通过将Arm神经网络技术原生集成到团结引擎中,开发者能够“开箱即用”地获得先进的神经图形能力,将技术创新转化为实际游戏体验,加速该技术在中国游戏生态中的广泛应用。”
CPU是智能体AI的核心
AI同时也在改变设备的思考与运行方式。随着AI从执行单一任务逐步演进为管理日益复杂的工作流,CPU正成为整个系统的编排引擎。它负责维护上下文、调度工作负载,并协调更广泛计算系统中的各类任务,确保AI智能体在推理、规划和执行过程中始终保持高响应性。

全新的Arm C2 CPU集群结合了Arm性能最强大的移动CPU——C2-Ultra、面向能效优化的C2-Pro CPU,以及双SME2单元。这一设计使AI工作负载能够直接在CPU上实现高响应、低延迟处理,同时与各类AI加速器无缝协同工作。C2 CPU集群配置了翻倍的SME2计算能力,可使最新小语言模型的运行速度提升高达70%,进一步增强CPU对AI工作负载的加速能力。与上一代C1-Ultra相比,C2-Ultra可实现:
• 高达1.7倍的AI性能提升
• 高达15%的单线程性能提升
• 在相同性能下,高达38%的功耗降低
与此同时,SME2正获得越来越广泛的行业采用,多款旗舰Android和iOS智能手机中均已启用此技术。围绕SME2构建的生态系统也在不断壮大,其中包括支付宝、Google AI Edge Gallery、OPPO和vivo等。
阿里巴巴通义千问表示:“语音正成为AI时代日益重要的交互方式。通过与Arm的合作,我们展示了最新的Qwen-Audio家族如何借助Arm CPU和SME2技术在端侧高效运行,为高质量、富有表现力的语音生成提供所需的性能与精度。这也展现了AI on CPU如何为先进语音AI功能提供高效的运行路径,并将这些体验带给更广泛生态中的开发者和用户。”
开发者可即刻上手
只有当开发者能够通过熟悉的工具和框架轻松访问新硬件时,新硬件的价值才能真正释放出来。CSS for Mobile 2建立在Arm持续投入AI软件生态系统的基础之上,从KleidiAI到Arm神经图形开发套件(Arm Neural Graphics Development Kit),为开发者提供构建这些全新能力所需的软件和开放接口。全新的AI Portal为开发者和智能体提供单一入口,用于发现、评估和使用经过优化的模型、代码和工具。

CSS for Mobile 2:面向下一代边缘AI的计算平台
智能体AI和神经图形技术正在重塑移动设备的能力需求,而AI原生的CSS for Mobile 2正是Arm针对这一趋势打造的新一代计算平台。下一代移动AI体验将不再由单一加速器来定义,而是通过在统一优化的系统中融合各类AI能力,共同打造全新的移动体验。
本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。
评论列表