高通这代骁龙换了目标:手机芯片开始为 Agent 重新设计

智能体时代,算力的比法正在换。

北京时间 9 月 23 日,2026 骁龙峰会开场。高通 CEO 安蒙上台,主题只有一句:整个平台要为 Agent 重新设计。

手机上的 AI对话,大家早就用惯了。真正难的一步,是让助手替人把活干完。

2026 骁龙峰会开场动图

同场两款新旗舰 SoC 落地。第六代骁龙 8 超级至尊版,还有第六代骁龙 8 至尊版。

两款骁龙 8 Elite Gen 6 芯片标识图

升级方向很集中。端侧智能体推理和内存架构,被排在最前面。

以后手机上的 AI工具,不必事事都往云端跑。

一、芯片能力,整体倒向智能体

今年的旗舰芯片竞争很凶。骁龙是最后一家发布。

两款芯片都用上台积电 2nm 工艺。核心是高通自研的 Oryon,8 核配置。两颗主核主频顶到 5GHz。另外六颗跑到 4GHz。手机处理器主频上 5GHz,这是头一回。

峰值性能想撑久一点,封装就得动。新的偏移式堆叠封装改了布局。处理器和内存不再上下叠放,改成左右错开。这样能给芯片让出一条更直的散热通道。高通说,高负载下维持峰值的时间能翻倍还多。

偏移式堆叠封装结构示意图

缓存也加了一档。新东西叫 Oryon FlexCache,专门对着智能体工作流和视频剪辑这类负载。它给处理器配了 16MB 共享二级缓存。老办法是把缓存固定切给某一类核心。这套不这么干,所有核心共用一个池子。谁在跑大任务,谁就多拿一点。外部内存也少跑几趟。

这个思路很有指向性。过去处理器在计算里常打辅助。如今智能体要管整个任务的编排和调度。位置自然往上提。

图形这边,新 Adreno 装了专为模型计算准备的矩阵核心。同时还有一套渲染技术,叫 Adreno Neural Fusion。它把神经网络计算、画面超分和帧生成并进同一条管线。游戏先用低分辨率画,再由模型把画面补回高清。中间的帧也一样,由模型生成。高通给出的数据是,支持的游戏里最高省 40% 功耗。Unity 和虚幻引擎都已经站队。

Adreno Neural Fusion 特性与功耗对比图

真正的大头在算力单元。这一代 Hexagon 不只提性能。它还专门为 Transformer 架构调了结构,大规模 MoE 模型也照顾到了。共享内存比上代多 50%。超级至尊版因此能在手机上跑起 30B 参数的模型。现场落地的那个叫 StepEdge-Omni。这是高通拉上阶跃星辰、无量火和江波龙一起做出来的。

功耗这块也有安排。传感器中枢换成了双 NPU 架构,性能最高提升 85%。它能在低功耗状态下一直听着传感器和麦克风。配套的个人记录功能可以整理语音信息。用久了,用户的情境资料就攒出来了。

两款芯片的差别不在核心。制程和核心相同,不同集中在图形与缓存上。内存和算力单元的共享内存也不一样。

第六代骁龙 8 与上代性能提升对比表

新能力会先落在日常场景里。手机收到一封会议邀请,助手自己读懂邮件。时间和地点理出来,航班信息也一并归拢。这些动作都在授权前提下进行。

二、计算架构,要围着 Agent 转了

手机的定义一直在变。最早它只是让拍照更好看。去年高通讲的是「以用户为中心的生态」。到了今年,几个词凑到了一起。混合专家模型、Agent 和技能插件,还有 MCP。安蒙认为,端侧设备的形态终于清晰了。

昨天的主场演讲,题目就叫「面向智能体时代的骁龙」。安蒙把话说得很直。个人计算正在从「手机为中心」转向「以 Agent 为中心」。

2026 骁龙峰会现场画面

他把未来的设备摊开来讲。二代豆包手机、荣耀的机器人手机,还有千问尚未发布的智能体电脑。

演讲中展示的新形态设备画面

这些能力会大量渗到旗舰机上。会答题的助手只是起点。能听懂需求、替人把事办完的 Agent,才是新的分水岭。往后评价一部手机,标准可能就一条。它能帮你干多少活。

这也意味着,手机不能只塞一个大模型进去。它得记住长期上下文。它要会做任务规划,能跨应用调工具。还得在授权下真的动手。

手机的角色也在变。既然由 Agent 去驱动各种应用,手机就不再只是人手里的那块屏。它可以变成信息和计算的节点。由它再去指挥别的设备。

三、要普及,先得比人自己动手更简单

安蒙给了两个维度。一个维度是人直接用手机。发指令、拍照片,也能看视频玩游戏。另一个维度是 Agent 替人用。它持续感知环境,理解意图。该推理时推理,该规划时规划。

这就要求端侧助手具备一串能力。比如拿到授权的个人资料。还有持续的记忆,安全的权限机制。跨模态的理解也算一项。不同设备之间的体验还要接得上。

问题也跟着来。用户不动手的时候,它仍可能在后台吃算力。所以未来的手机不能只靠更大的算力单元硬顶。内存和能效的分量会更重。

他给出一条普及标准。比用户自己动手更简单。

他拿个人计算的历史做例子。电商交易原本在电脑上完成,后来都搬进了手机。原因就是手机办同一件事更省事。Agent 想成为新的入口,也得先把操作门槛降下来。

所以别再拿电脑上那套用法套它。复杂的提示词,反复纠正,一步步确认,都不该出现在端侧。好用的助手只做一件事。让交互变简单,能自如调用各类工具,也能自己对接云服务和模型。

后台要协调的东西,自然也更多。高通打算把数据中心里的高带宽计算搬到骁龙平台上。它还准备了专门的协处理器,让内存和算力单元挨得更近。这样能少在搬运数据上费电。具体方案要留到下一届 MWC。

Qualcomm HBC 高带宽计算架构图

再往后看,个人 AI 的形态是流动的。手机和电脑是一种入口。眼镜、手表和车是另一种。任务在哪台设备上跑,按当时的情况分。

为此高通在软件侧也铺了路。今年 7 月,它收下了跨硬件编译器公司 Modular。昨天安蒙宣布,把语言 Mojo 和推理引擎 Max 开源出来。这套东西可以理解成一层中立的编译底座。作用有点像游戏圈的 CUDA。

结语

高通过去卖的是处理器、通信和多媒体能力。现在它想卖的是分布在不同设备上的算力怎么协同。芯片只是其中一环。

AI 手机问世几年,真正难的还是那些老问题。跨设备、跨生态的统一体验,至今没几家公司交卷。这一代骁龙把方向摆明了。处理器、图形和算力单元都要为智能体重新设计。内存和连接决定 Agent 能不能一直跑下去。软件与平台的统一,则决定它能不能走出去。

个人计算的竞争,翻页了。