差友们,一年一度的骁龙峰会,它来了!
出乎意料啊,这次高通没按往年只发一颗年度旗舰芯片的套路走,而是一口气端上来两款旗舰 —— 第六代骁龙 8 至尊版,以及定位更高、名字听着也更唬人的第六代骁龙 8 超级至尊版。

当然,名字分出了高低,两颗芯片的定位也确实不太一样。
按照高通给的说法,第六代骁龙 8 至尊版更像是全能型选手,性能、AI、影像、游戏,旗舰机该有的体验它全都拉到第一梯队,各方面都做到足够均衡,也更适合覆盖大多数的高端安卓机型。
到了第六代骁龙 8 超级至尊版,高通明显就更激进了,它不只是继续往上堆性能,而是把更多的升级都围绕智能体来做,相当于从硬件底层,就为接下来手机厂商打造智能体手机铺好了路。

过去十几年,咱们用手机的逻辑其实一直没怎么变,都是人在操作手机,但在智能体时代,这事开始反过来,你告诉它想干嘛,后面的理解、规划、调用 APP、具体执行,都能让智能体自己来。

过去你得自己在相册、微信,待办来回切;到了智能体这边,这一连串操作它理论上都能自己做完,你负责提需求,它负责跑流程,而且这不是画饼,现在市面上已经有不少这样的产品。
小米、荣耀、OPPO、vivo 也没闲着,如今各家都在自家手机上落地这套能力,高通 CEO 安蒙把这个趋势概括成了一句话 —— 叫「从应用走向意图」,还直接把 2026 年称作「智能体之年」。

以前的 AI,很多时候跑一个模型、处理一个任务就够了;智能体不是。它可能得一直听着你、记住上下文,同时调用好几个模型、切好几个任务,中间还得不断规划、执行、再判断下一步干嘛。
任务一复杂,内存、带宽、功耗全都会跟着往上涨。
所以到了这代骁龙 8 超级至尊版,高通没打算让 NPU 揽下所有的活,而是对 CPU、GPU、NPU 重新做了分工,说白了,它明面上的性能提升只是开胃菜,真正的重头戏,其实全在底层变化里。

什么概念?这是移动 CPU 历史上第一次站上 5GHz,而且不只是超级内核猛,它的性能内核也冲到了 4GHz —— 搁早几年前,这可是桌面处理器才有的水平,现在高通愣是把它塞进了手机里。。。

高通这次做的,是把骁龙 8 超级至尊版的 CPU 主频和 IPC 一起往上抬,打开 APP、加载网页和切换任务时,响应速度可以更快;运行游戏、视频编辑这类重活,CPU 也能发挥更高的性能上限。

官方宣称,第六代骁龙 8 超级至尊版 CPU 性能提升了 13%,能效提升 37%,响应速度也快了 15%,咱们也在峰会现场拿工程机跑了下,它的安兔兔成绩来到了 560w+ 分,表现确实有点猛吼。

于是高通还给这代 Oryon CPU,专门设计了一套名为 FlexCache 的全新缓存架构。

过去这部分缓存,是按核心或者核心簇提前分好的,比如超大核用一块,大核用另外一块,彼此各用各的,没法借用,而新缓存架构把它做成了一个共享缓存池,让不同类型的 CPU 核心都能访问。

放到智能体这种多任务并发、频繁调度的场景里,好处就很直接:数据搬得更少,延迟和功耗都能往下压,连续处理复杂任务时也不容易被内存拖后腿。
光 CPU 这一块大伙儿就能看出来,高通这回是真奔着智能体手机下功夫了,主频、IPC、缓存架构,都是冲着智能体多任务并行、频繁调度的需求去的。
不过 CPU 更擅长的是整套任务的调度和统筹,到了理解需求、结合上下文做推理这些环节,大量 AI 计算主要还是得交给 NPU。

高通的解决办法,是在新一代 Hexagon NPU 里加入了一个叫 Element Accelerator 的硬件加速单元,专门针对大模型里的核心计算做加速。
简单来说,就是把这部分重活交给专门的硬件来干,让端侧大模型跑得更快,同时把功耗压下来。

如果托尼没记错,上一代第五代骁龙 8 至尊版 NPU 高速片上内存大约是 8MB,按这次 50% 的增幅来算,这一代理论上就是 12MB。

根据官方给到的数据,这代 NPU 性能提升了 35%,每瓦特性能也提升了 33%,这个提升幅度可以说非常夸张了。。。

怎么理解呢?传统的稠密模型,每一步推理基本都要让模型的大部分参数参与计算,算力、带宽全拉满。而混合专家模型更像一个专家团队,模型里有各路专家,每次干活只需叫醒其中一部分。

结果就是,模型总参数量虽然还是 300 亿,但每一步真正需要算的部分少了很多,对算力和内存带宽的压力也能跟着降下来,这下以前得扔给云端的大模型能力,现在在手机本地也能跑起来。

这东西说白了,就是大模型跑起来的时候,不用所有计算都必须用同一个精度硬跑,对精度没那么敏感的部分,就用低精度,少占内存、少吃算力;对结果要求更高的部分,再把精度往上提。

按照高通给到的数据,在部分模型上,这代 NPU 的预填充性能最高可以提升 80%,简单理解就是,你把问题甩给 AI 之后,它思考过程的那个阶段,速度能快近八成,响应明显快了不少。
看得出来,高通这次已经不太满足于单纯把峰值算力往上堆,而是在想办法让更大的模型,真的能长期放在手机本地跑,毕竟以后智能体真要替你干活,不可能每一步都等着联网、上云。

先说大家最关心的游戏性能,这一代 GPU 的性能和能效提升,是近几年步子迈得最大的一次。
一方面,高通把 Adreno GPU 频率从上代的 1.2GHz 拉到了 1.45GHz,基础渲染能力本身就更强,按照官方给出的数据,这代 GPU 性能提升了 44%,能效提升了 40%,提升幅度相当离谱。。。

而在这基础上,高通还第一次给 Adreno GPU 加上了专门处理 AI 图形计算的 Matrix Cores。

现在不一样了,AI 可以直接参与图形渲染,超分、补帧这些在 GPU 里就能干完,体验理论上可以堪比原生。
而且这项技术已经适配了 Unity 和虚幻两大主流游戏引擎,官方还给了现成的文档和插件,开发者直接拿来就能用,目前已经有 20+ 款游戏在做适配,后面大家换新手机,相信很快就能体验到。

新一代 Spectra ISP 视频吞吐能力直接提升到了前代的 2 倍,最高已经能支持 8K 60fps 视频,以及 4K 240fps 超级慢动作,单看录制规格,这个规格就已经很顶了,搁以前,只有专业相机才有。

换句话说,AI 不用等照片和视频拍完了再进来处理,而是在拍摄过程中,就参与对画面内容和场景细节的理解,后面的 HDR、降噪和色彩处理自然也能处理得更细,画面细节和质感都会更到位。
聊到这儿,差友们应该也看出来了,这代骁龙真正有意思的地方,其实已经不只是 CPU、GPU,NPU 又涨了多少性能,而是高通开始明显按照智能体的工作方式,重新安排整颗芯片怎么分工。

以前稍微大一点的模型,得把你说的话、你的资料传到云端;现在不少活手机自己就能干,反应更快、不那么依赖网络还在其次,更重要的是,你的习惯和各种私人信息,能更多地留在自己这台设备。
而且智能体要做到真正好用,迟早得越来越了解你。
在你授权的前提下,本地模型可以结合手机里的个人数据和使用习惯,输出更适配你的结果,同时又尽量把这些信息留在设备上,相比所有任务都丢给云端,这条路显然更适合做能长期用的个人智能体。
当然,高通只是把底层能力给到位,最后能做成什么样,还得看手机厂商各自的本事。

至于打算换手机的朋友,我的建议还是那句:先别急着下单,再等等,这波新旗舰潮马上就到,手里这台再撑一两个月,不亏 ~
撰文:胖虎
编辑:米罗 & 面线
美编:素描
图片、资料来源:
2026 骁龙峰会


