算力「芯」动向 | 高通下一代Adreno GPU架构披露:移动GPU的范式转移?当图形管线开始内置AI......

🐆:高通新Adreno GPU在图形管线嵌入矩阵核心与18MB片上缓存,将端侧AI从NPU独担扩展为CPU-GPU-NPU异构协同,标志移动GPU从渲染引擎向AI融合计算平台范式转移。

图片
高通的下一代Adreno GPU披露了一个值得细品的架构细节。它首次在图形处理管线中嵌入了专用的矩阵核心(Matrix Cores),并配备了18MB的片上高性能缓存(HPM)。这不是一次常规的频率拉升或制程红利释放,而是移动SoC设计哲学的一次显性转向。
01
从渲染专用到融合计算

过去十年,移动GPU的演进路径相对清晰。

更多的ALU、更高的填充率、更先进的制程。

这一次,高通在三分片架构的每个切片末端都放置了矩阵核心,让GPU在传统的光栅化与着色任务之外,具备了原生的AI推理能力

这种设计的本质是把端侧AI的算力分布从NPU独担推向了CPU-GPU-NPU的异构协同。

一年前,高通在CPU中引入了SME矩阵扩展。如今,同样的思路被延伸至GPU。数据不再需要频繁地在不同计算单元之间搬运。

矩阵核心直接在图形管线内部运行AI模型,迁移开销被压缩到最低。

图片

更关键的是那18MB的HPM缓存。在移动设备上,功耗的很大一部分并非来自计算本身,而是数据往返于DDR内存的搬运过程。

高通将这18MB作为可配置的图形工作区,让渲染目标、深度缓冲区、中间纹理尽可能留在片内。官方给出的数字是约12%的功耗改善,但这背后的信号比数字本身更重要。

图片

移动芯片设计正在从堆算力转向优化数据局部性。

02
神经渲染的移动化落地
图片

Adreno Neural Fusion技术的推出,让AI超分与帧生成这个在PC端由DLSS、FSR、XeSS主导的技术路线正式获得了移动端的原生硬件支撑。

高通给出的对比是鲜明的。在开启Neural Fusion后,画面闪烁与重影减少,功耗最多可降低40%

Unity和虚幻引擎的原生支持,则意味着开发者无需从零搭建推理管线,接入门槛被大幅拉低。首批支持该技术的游戏预计今年内商业化落地。

这指向了一个明确的行业趋势。

移动端的游戏画质竞争,正在从原生分辨率加原生帧率的 brute-force 模式,转向智能渲染加AI重建的能效比模式。对于机身空间与散热能力都极为有限的智能手机而言,这种转变不是锦上添花,而是刚需。

图片
03
竞争格局中的攻防逻辑

把视野拉远,这次架构升级也折射出高通在高端移动芯片市场的双重压力。

  • 一方面,是苹果自研GPU的持续紧逼Apple Silicon的GPU在能效比与峰值性能上长期领先,高通需要在架构层面拿出差异化方案,而非仅仅依赖制程追赶。矩阵核心加HPM的组合,正是高通试图在AI与图形融合这一新维度上建立壁垒的尝试。

  • 另一方面,是端侧AI对算力载体的重新定义联发科的天玑平台同样在强调NPU算力,但高通的选择是把AI能力溶解到GPU的渲染流程中,而非仅仅堆砌独立的NPU TOPS数字。这种路线差异没有绝对的对错,但反映了两种不同的产品哲学。前者追求峰值AI算力的可宣传性,后者追求实际图形场景中的能效比与集成度。

04
频率与功耗的再平衡

新GPU的频率从1.2GHz提升至1.45GHz,同时宣称能效提升12%

这组数据放在一起看,说明高通对制程进步和架构优化的协同效应有一定信心。

但真正的考验在于持续性能

1.45GHz的峰值频率在短时间Benchmark中不难实现,能否在原神或崩坏星穹铁道级别的负载下维持,仍取决于终端厂商的散热设计与高通的功耗调度策略。

此外,18MB片上缓存与3个矩阵核心带来的晶体管面积开销,最终都会转化为芯片成本与功耗基线。

这些隐性代价在官方宣传中往往被轻描淡写,却是决定这一代平台能否大规模铺货的关键变量。

结语

下一代Adreno GPU的披露,表面上是高通的一次产品预热,实质上是整个移动芯片行业计算范式变迁的缩影。

当GPU开始内置AI核心、当片上缓存成为比频率更关键的性能杠杆、当游戏引擎原生支持神经渲染。移动SoC的竞争维度已经从谁跑分更高转向了谁能在有限的功耗预算内,更智能地分配与执行计算任务。

这一转变的深远影响或许要到2025年首批搭载该平台的终端大规模上市后才能真正显现。但至少在架构层面,高通已经亮明了底牌。

未来的移动GPU,必须同时是图形引擎和AI推理引擎



算力“芯”动向 · 专注AI与算力产业观察

今日参考阅读文章:

(1)高通披露新一代 Adreno GPU 细节:矩阵核心强化 AI 算力,有望进一步改善画面升频效果

(链接:https://www.ithome.com/0/997/663.htm)

(2)高通公布新一代GPU:矩阵核心强化AI算力、更高频率更低功耗

(链接:https://news.mydrivers.com/1/1148/1148292.htm)

(3)高通新一代Adreno GPU配备Adreno矩阵核心和专用的18MB HPM缓存

(链接:https://www.chinaflashmarket.com/newsflash/38752)

本文若有歧义欢迎读者分享指正。

图片

·END·

本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。

赞 ()

相关推荐

发表回复

评论列表

点击查看更多

    联系我们

    微信:百易小助手

    邮件:contact@doit.com.cn

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信