关于ZAKER Skills GEO服务 合作
智东西 13小时前

刚刚,高通 2nm 双旗舰来了,为智能体 AI 重造架构,手机能跑 300 亿参数大模型

智东西

作者 | ZeR0

编辑 | 漠影

刚刚,高通最强手机芯片来了!

智东西夏威夷毛伊岛 9 月 22 日现场报道,在骁龙峰会 2026 上,高通一口气推出两款采用 2nm 制程的旗舰芯片——第六代骁龙 8 超级至尊版和第六代骁龙 8 至尊版。

这是高通首次在旗舰产品线同时推出两款骁龙 8 至尊版平台,也是骁龙平台首次采用 2nm 制程。

下一代 AI 智能体设备会是什么样子?高通展示了荣耀 Robot Phone阿里原生智能体电脑 Qwen Book努比亚 NaviX Ultra 上的豆包手机助手等全球最早一批智能体设备,使用骁龙移动平台实现的全新智能体体验。

高通总裁兼 CEO 安蒙在演讲中说,我们刚刚进入智能体时代的开端,智能体需要全新系统架构,而骁龙正是为这个时代打造的平台。

连高通为数据中心 AI 芯片设计的全新计算引擎 HBC(高带宽计算)技术未来也将被带到智能手机,以显著提升效率。

HBC 将作为骁龙平台的协处理器,把内存和 AI 处理单元放得更近,提供下一代 AI 智能手机所需要的速度、能效和性能。

高通还会将这个技术带入整个边缘计算体系,包括笔记本电脑、智能眼镜和汽车。

全新第六代骁龙 8 超级至尊版围绕智能体,将 CPU、GPU、NPU、ISP 和整个系统架构全面优化,使更多智能在更靠近处理器侧运行,性能、能效、AI 能力和影像表现都显著增强。

尤其在让内存更靠近处理器这件事上,高通做了多重优化,包括CPU 的可扩展先进缓存架构 FlexCacheGPU 的高性能内存(HPM)NPU 的大容量共享内存

面向模型及智能体推理,第六代骁龙 8 超级至尊版端侧可支持300 亿参数级别的 MoE 混合专家模型,并配备Element Accelerator来改善 Transformer 工作负载。

面向游戏体验,该处理器搭载Adreno Neural Fusion,配合Matrix Cores,支持 AI 帧生成、AI 超分、在图形管线内部直接进行神经引擎运算。

面向摄影,第六代骁龙 8 超级至尊版通过智能像素控制、支持 3DLUT 的Elite Color Engine智能防抖Motion Intelligence等提升移动影像体验。

面向专业内容创作,其支持影视级视频能力,包括APV8K 60fps 视频拍摄4K 240fps 超高清超慢动作视频拍摄,并支持新视频编码标准 VVC

连接上,新移动平台搭载全球首款面向 3GPP Release 19 就绪的调制解调器及射频系统——高通 X105 5G 调制解调器及射频系统,为 6G 奠定基础。

小米集团高级副总裁兼国际业务部总裁曾学忠现场宣布,今天,小米将首发搭载第六代骁龙 8 双旗舰平台的新机。

小米澎湃 OS 4 和高通第六代骁龙至尊版在整体任务调度、内存管理、运行时等系统层面联合优化,进一步改善 IPC 性能、缓存命中率及系统能效,并在一个高负载开放世界手游中实现单帧功耗大降38%

搭载第六代骁龙 8 超级至尊版的小米 18 Pro Max,进一步追求峰值性能,带来更强 AI 性能和散热系统。

新一轮安卓旗舰大战,总算正式开打。

一、第六代骁龙 8 超级至尊版:移动 CPU 冲到 5GHz,GPU 首搭 AI 专用核

第六代骁龙 8 超级至尊版是高通迄今性能最强的移动平台,不仅面向智能体重新设计整个架构,而且将 AI、通用计算、游戏、影像性能全面升级。

高通给 CPU、GPU、NPU 通通改造,通过缩短数据传输路径及多种创新技术,实现更低的时延、更高的能效、更稳定持久的智能体、游戏和摄影体验。

1、Oryon CPU:8 核,5GHz,引入新缓存架构

CPU 搭载高通定制 Oryon CPU 内核,采用8 核架构(2 个超级内核、6 个性能内核),主频最高达到 5GHz,性能内核主频最高达到 4GHz。这是业界首个主频突破 5GHz 的移动 CPU。

当然,仅仅有高主频是不够的,先进指令集、IPC 优化、Oryon 架构和 FlexCache 缓存架构缺一不可。先进指令集和更高的 IPC 协同能更快完成计算任务;Oryon CPU 架构采用异构设计,使不同内核能高效访问数据。

高通还引入了全新缓存架构 FlexCache,可动态分配缓存池,让所有内核可访问一个共享 L2 缓存池,并根据不同核心的实际需求动态分配资源,实现更高效的任务切换。

智能体通常会频繁迁移线程,调用跑在不同核心上的工具。这种设计则可以让智能体在运行高负载任务时,不会降低响应速度。

不止是 AI,对于游戏、视频编辑、多任务处理及各种短时性能爆发场景,FlexCache 也能带来更好的表现。

2、传感器中枢:让智能体持续感知

全新高通传感器中枢使系统保持持续感知,无需唤醒主应用处理器,以超低功耗处理语音、活动及个人上下文信息。

其搭载新一代双 Micro NPU架构,性能提升高达 85%,能效提升 20%,可支持拥有 2 亿参数的模型,并升级了个人记录功能。

个人记录有助于从用户选择保留的信息、参与的对话和关注的重要内容中不断学习,持续积累私密安全的个人知识库,为智能体提供越来越丰富的上下文。

3、Hexagon NPU:300 亿参数模型跑在手机上

NPU 有两大关键创新。

一是全新 Element Accelerator,专为 Transformer 工作负载打造,结合向量计算单元和标量计算单元,支持最高32k token上下文窗口,可加速大模型运算,帮助智能体更快地响应、更高效地推理。

二是将共享内存扩容 50%,能大幅减少访问外部 DDR 的次数,将更多上下文和 KV cache 数据保留在 NPU 内部,降低时延,省出更多宝贵的内存带宽。

在部分模型上,新一代 NPU 的预填充性能最高提升80%

高通联手阶跃、无量火与江波龙,基于第六代骁龙 8 超级至尊版,率先将阶跃StepEdgeOmni 300 亿参数级混合专家(MoE)模型完整部署于端侧,打造具备全链路智能体 AI 能力的端侧智能助手,可在不牺牲推理精度的情况下,将内存需求降低超过 50%

通用闪存存储 UFS 5.0支持从闪存中动态流式加载模型参数,让设备能够使用更大的 AI 模型,突破传统移动设备内存容量的限制。

4、Adreno GPU:第一次引入 AI 专用核心

Adreno GPU 实现了44%的性能提升和14%的能效提升,有四大亮点:

(1)图形性能和能效均实现代际提升,基于三切片架构,将每个切片的频率提升了 250MHz。

(2)搭配 18MB 第二代 Adreno 高性能内存(HPM),让内存更靠近 IP 模块,减少 DDR 数据读取,实现功耗降低 12%,支持开发者按需分配内存资源。

(3)首次引入 GPU 专用核心 Matrix Cores,该核心是专用用于 AI 的 GPU 核心,将 AI 工作负载保留在图形管线里,可降低功耗、延迟并增强图形体验。至此,高通 NPU、CPU、GPU 核心引擎均已加持矩阵加速能力。

(4)部署 Matrix Cores 的直接成果是 Adreno Neural Fusion,将 AI 超分、AI 帧生成、神经网络处理结合到一起,能实现 AI 和图形处理之间更紧密地结合,神经网络计算无需离开图形渲染管线即可完成,改变移动游戏渲染方式,实现更流畅的游戏体验、更高的图像质量及更好的能效。

这些技术协同运作,支撑智能体 AI 丝滑运行:传感器中枢始终保持环境语音感知,CPU 负责指挥、编排、调度整个工作流程,NPU 和 GPU 可共同支持 AI 推理。

5、Spectra ISP:给 AI 提供 " 视觉上下文 "

ISP 可帮助智能体构建记忆和个性化能力。Spectra ISP 已成为一个多模态引擎,能理解摄像头看到的内容,并把图像和视频转化成有意义的上下文信息。

第二代 AI ISP 与 NPU 协同,在拍摄的同时做智能处理,由此将视频吞吐量提升至 2 倍,使用户首次能在商用终端上拍摄 8K 60fps 的视频;超级慢动作视频的分辨率进一步提升,支持 4K 240fps 拍摄。

新一代 ISP 引入智能像素控制,能为每个像素分配16 位AI 数据,信息精细度是前代的 256 倍。因此,Spectra ISP 能更好地理解场景中的每个细节。

每个像素能够读取和保存更多数据,意味着能跨帧持续追踪一个拍摄对象,或者获得更丰富的语义分割内容。

6、连接:5G 基带及射频 +WiFi 8

新平台搭载高通 X105 5G 调制解调器及射频系统FastConnect 8800 芯片,为蜂窝网络和无线连接提供 AI 增强能力,助力迈向 6G。

高通 X105 5G 调制解调器及射频系统支持 5G 卫星(NR-NTN),采用 6nm 射频收发器,是全球首款面向 3GPP Release 19 标准就绪的调制解调器。

FastConnect 8800 是高通推出的 Wi-Fi 8 解决方案。这款 4 合 1 集成芯片支持最新 Thread,是首款采用 4×4 Wi-Fi 射频配置的移动解决方案,支持超宽带及长距离覆盖,让用户的手机能够成为智能家庭中枢。

这种系统级设计思路也延伸到芯片的物理封装。

高通在超级至尊版中开发了一种新的散热设计方法Offset Package-on-Package,重新设计了内存与芯片在封装内部的排列方式,可形成一条效率更高的散热路径,更快将热量从处理器中到处,还支持更高集成度的设备设计。

这种设计能帮助设备进一步扩大可用的散热空间和热设计余量,也能给 OEM 厂商更大的设计灵活性,使其能优化整机设计并探索新的产品形态。

最终其在高工作负载下,峰值性能的持续时间可达到此前的2 倍以上。

二、第六代骁龙 8 至尊版:把新架构带到更广泛的旗舰手机

第六代骁龙 8 超级至尊版专为最先进的 AI 工作负载和定义智能体时代的全新体验而设计,旨在打造覆盖 AI、游戏、视频、影像等各项技术领域的顶尖旗舰体验。

而第六代骁龙 8 至尊版旨在面向更广泛的终端打造旗舰体验,在性能和智能之间实现平衡。

AI:通过高通 Hexagon NPU 的升级,在旗舰智能手机上实现智能、灵敏且高效的 AI 体验。

性能:高通定制 Oryon CPU 可提供快速、灵敏的旗舰级性能,兼顾高端性能、智能能力与能效。

游戏:实现先进图形能力、灵敏流畅的游戏操控和持续稳定的性能,带来旗舰级移动游戏体验。

影像:通过智能像素控制、Elite Color Engine 增强、智能防抖和 Motion Intelligence 等功能,为旗舰智能手机带来先进的拍摄与视频能力。

连接:搭载高通 X105 5G 调制解调器及射频系统和 FastConnect 8800,提供 AI 增强的蜂窝网络与无线连接能力。

三、手机成个人智能体起点,需要全新系统架构设计

在骁龙峰会 2026 上,高通总裁兼 CEO 安蒙发表演讲,谈到我们正从以手机为中心的模式过渡到以智能体为中心的新体验模式,智能体将成为整个体验的中心,这将改变思考智能手机角色的方式。

" 我认为,我们终于走到了一个可以看清楚「AI 智能手机究竟是什么」的阶段。" 安蒙说," 我们正在从 app 和助手,走向智能体。"

AI 进步飞速,混合专家模型(MoE)、编排器、新模型、MCP 协议等快速发展,智能体开始长出各种 " 技能(skill)"。这些技术共同推动手机向 AI 智能手机转型。

安蒙分享了三大重要观点:

其一,AI 正从 " 应用驱动 " 转向 " 意图驱动 "。

过去二十年里,从智能手机诞生之初开始,整个智能手机体验一直都是围绕 app 组织起来的。

而在智能体时代,智能体是通过理解你的意图,替你完成各种事情。这种特性与手机高度个性化和定制、持续在线、多模态感知的能力天然适配。

这是 " 属于你的智能体 ",所以权限和控制权会变得非常重要,这些权力必须掌握在用户手中。

其二,智能手机是个人智能体时代的起点。

智能手机是个人智能体首要载体,是最了解你的设备,始终伴你左右,并能够感知你所处情境。

未来的体验会越来越少地围绕 " 打开和操作 app" 展开,而会越来越多地围绕 " 替你完成任务 " 展开,智能体将要求设备承担远远超过 " 执行命令 " 的工作。

个人智能体不止在手机,而会伴随用户在手机、PC、汽车、智能手表、智能眼镜、智能吊坠、智能胸针及其他设备间流转,整个体验无缝,且能持续跨设备延续。而手机将成为整个个人 AI 系统的计算、记忆与连接枢纽。

工作负载会根据每项任务的具体需求,在云端及所有可用的计算资源之间进行分配。

其三,智能体需要一套全新系统架构。

智能体必须能感知正在发生什么,理解你的意图和上下文,进行推理、规划和记忆,并代表你采取行动。

手机上会开始出现一些全新功能,比如访问你的个人知识,安全地获得你愿意授予的权限,以及智能体代表你采取行动的能力。

这创造了系统级设计新机会,涉及混合 AI、跨设备智能、任务编排与异构计算。

无论智能体直接运行在设备上,还是被集成到操作系统中,它都必须在模型、app、服务和数据之间完成大量协同,才能提供这些体验所需要的性能、能效和响应速度。

因此,需要重新思考计算引擎应该如何设计:智能体编排需要更高的 CPU 性能,NPU 加速器能够提供高能效的 AI 推理能力,GPU 则会负责 AI 中并行计算任务,在完成这些 AI 工作的同时,还需保持全天候的电池续航。

结语:个人智能体竞赛开场,高通先把基础设施铺好了

围绕智能体工作方式,高通重新设计旗舰手机芯片,从系统层面处理智能体的 AI、计算、连接、内存、感知、安全和功耗效率协同运作。

通过优化 CPU 缓存架构、在 GPU 中加入 AI 专用核心和搭配独立高速显存、在 NPU 增加 Transformer 加速器和扩容内存、传感器中枢里的低功耗感知,新一代骁龙双旗舰移动平台,让手机在有限的功耗预算内能够完成更复杂的连续智能任务。

个人智能体的竞赛才刚刚开始。高通从底层带来适应未来个人智能体发展的基础设施。

接下来,就看终端厂商与软件开发者们如何发挥创意,借助随时在线的个人智能体和更快、更无缝、更流畅的移动体验,将 AI 更好地转换成用户每天使用的生产力。

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容