高通第六代骁龙8双旗舰发布:2nm 制程,手机本地跑 300 亿参数大模型

骁龙峰会 2026 的现场在美国夏威夷毛伊岛。高通一口气端出两款 2nm 旗舰芯片。一款是第六代骁龙8超级至尊版。另一款是第六代骁龙8至尊版。

变化很大。

这是高通第一次在旗舰产品线上同时发两款骁龙8平台。也是骁龙平台第一次用上 2nm 制程。

过去两年,AI工具的主战场一直在云端。这一次,战场被搬进了手机。

骁龙峰会 2026 现场

比参数更值得看的,是高通摆出来的那一排设备。荣耀一台会自己动的手机在列。阿里那台原生智能体电脑在列。努比亚旗舰上跑的豆包手机助手也在列。这不是概念机。

高通说,这是全球最早一批智能体设备。它们全部基于骁龙移动平台。

高通展示的智能体设备

高通总裁兼CEO安蒙在演讲里给了一句判断。「我们刚刚进入智能体时代的开端。智能体需要全新的系统架构。骁龙正是为这个时代打造的平台。」

智能体演示界面

有一个细节容易被忽略。高通在数据中心 AI 芯片上做的「高带宽计算」技术,未来也要搬到手机上。

它的角色是协处理器。做法是把内存和 AI 运算单元放得更近。这样能换来更高的速度,也能换来更好的能效。

高通说,这项技术还会走进整个边缘计算体系,覆盖笔记本、智能眼镜和汽车。思路很直接。

高带宽计算技术

第六代骁龙8超级至尊版是这次的主角。高通围绕智能体重做了一遍架构。处理器和图形单元都改了。AI 加速单元和影像处理器也改了。改动很彻底。

更多智能被推到离处理器更近的位置。性能抬了,能效抬了,AI 能力和影像表现也一起抬了。

第六代骁龙8超级至尊版

关键是内存。让内存更靠近处理器,高通做了三手准备。处理器的缓存可以动态扩展。图形处理器有自己独占的高速内存。AI 加速单元的共享内存也扩容了。想让端侧模型跑得动,宁可多留一点缓存,也别老去翻外部内存。

面向模型推理,这套平台在手机本地就能跑 300 亿参数级别的混合专家模型。

也就是说,以后你手机上的AI对话,很多不用再绕一圈云端。高通还专门配了一个加速大模型运算的单元。

端侧 300 亿参数模型

游戏这边,新平台能靠 AI 插帧,也能靠 AI 超分。神经网络运算直接在图形管线内部完成,不用来回搬数据。玩法变了。

影像这边,智能像素控制上了,专业色彩引擎上了,智能防抖也上了。入口也变了。

内容创作这边,它支持 8K 60 帧视频拍摄。也能拍 4K 240 帧的超级慢动作。

连接这边,它带了全球首款面向新一代蜂窝标准的调制解调器。这一手是为 6G 打底。

小米集团高级副总裁兼国际业务部总裁曾学忠在台上宣布,小米将首发搭载第六代骁龙8双旗舰平台的新机。

小米 18 Pro Max

小米澎湃 OS 4 和这颗平台在任务调度、内存管理上做了联合优化。缓存命中率更高了。系统能效更好了。在一个高负载开放世界手游里,单帧功耗降了 38%。

搭载超级至尊版的小米 18 Pro Max 会进一步压榨峰值性能。算力上了,散热也上了。

新一轮安卓旗舰大战,从这里开打。

一、超级至尊版:处理器主频冲到 5GHz

第六代骁龙8超级至尊版是高通目前为止最强的移动平台。它不是简单堆参数。它把架构为智能体重做了一遍。

处理器一共八个核心,分两档。两个超级内核,六个性能内核。主频最高到 5GHz。这是业界第一个主频突破 5GHz 的移动处理器。

光有高主频还不够。缓存架构和指令调度也得跟上。原因在这儿。

高通把缓存池做成了共享的。所有内核都能访问同一个二级缓存池。系统按每个核心的实际需求动态分配。平时闲置的缓存,别的核心可以拿去用。

智能体有个典型动作。它频繁迁移线程,还要调用跑在不同核心上的工具。共享缓存池能让它在跑重活时不掉响应速度。道理不难懂。

游戏和视频剪辑这类短时爆发场景,也能吃到它的好处。

5GHz 的移动处理器

高通还换了一颗新的传感器中枢。它一直保持环境感知,不用唤醒主处理器。语音和活动状态这些信息,它用极低功耗就能处理。

它内部是双 AI 微核架构。性能提升 85%,能效提升 20%,能跑 2 亿参数的模型。

它能从你愿意保留的信息里慢慢学。这些记录攒成一个私密的个人知识库。智能体拿到的上下文因此越来越厚。省电是重点。

传感器中枢

AI 加速单元这次有两处关键改动。

第一处是一个新的加速器。它专为大模型里那类矩阵运算打造。它把向量计算和标量计算结合起来,支持最高 3.2 万字的上下文窗口。

大模型加速器

第二处是共享内存扩容 50%。访问外部内存的次数少了,更多上下文和键值缓存留在单元内部。时延降了下来。内存带宽也省了出来。

共享内存扩容

在部分模型上,新一代单元的预填充性能最高提升 80%。

高通还拉上阶跃、无量火和江波龙,把阶跃的 300 亿参数混合专家模型完整搬到了端侧。这套端侧助手的内存需求降了超过一半。推理精度没有牺牲。

新一代通用闪存支持从闪存里动态流式加载模型参数。设备能跑更大的模型。内存容量不再卡住它。门槛降了。

闪存动态加载模型

图形处理器这次提升 44% 的性能,能效也涨了 14%。它身上有四个亮点。

图形性能提升

第一,图形架构换成三切片设计,每一片的频率提了 250MHz。

第二,配了 18MB 的第二代独占高速内存。数据读取次数少了,功耗降 12%。开发者还能按需分配。

独占高速内存

第三,第一次在图形处理器里塞进了 AI 专用的矩阵计算核心。AI 负载不用离开图形管线就能算完。至此,AI 加速单元、处理器和图形处理器都有了矩阵加速能力。

矩阵计算核心

第四,这些矩阵核心带来一套神经融合方案。AI 超分、AI 插帧和神经网络处理被拧到了一起。神经网络计算不离开渲染管线就能完成。手游的帧率和画质都能受益。变化看得见。

神经融合方案

这些技术协同起来是这样一幅画面。传感器中枢保持语音感知,处理器负责调度编排,AI 加速单元和图形处理器一起顶推理。

影像处理器正在变成一个多模态引擎。它能看懂摄像头拍到的东西,把画面变成有用的上下文。

第二代影像处理器和 AI 加速单元配合,拍摄的同时就把处理做完。视频吞吐量翻倍。商用终端第一次能拍 8K 60 帧视频。超级慢动作也升到了 4K 240 帧。

视频吞吐量翻倍

它还能给每个像素分配 16 位数据。信息精细度是上一代的 256 倍。它因此更能读懂场景里的细节。细节更清楚了。

每个像素读到的数据更多,意味着跨帧追踪一个目标更容易。语义分割也更细腻。

影像处理器协同

新平台配了高通 X105 调制解调器和一套新的无线连接方案。蜂窝和无线连接都有了 AI 增强,为 6G 铺路。

X105 支持 5G 卫星通信。它用的是 6nm 射频收发器,也是全球首款面向新一代蜂窝标准就绪的调制解调器。

无线方案是一颗四合一的集成芯片。它是第一个用 4×4 天线配置的移动方案。它还支持新一代智能家居协议。

这种系统级思路还延伸到了封装。高通做了一种错位的堆叠设计,重新排布内存和芯片在封装里的位置。热量能更快排出去。峰值性能的持续时间也更长。

错位堆叠封装

二、第六代骁龙8至尊版:把新架构给更多旗舰机

超级至尊版是为最重的 AI 负载准备的。至尊版则面向更广的旗舰机型。它在性能和智能之间找平衡。

它的 AI 能力来自升级后的加速单元。处理器沿用高通自研架构,图形表现保持旗舰水准。影像和连接部分与超级至尊版同源。

三、手机是个人智能体的起点

安蒙在演讲里把话讲得更远。他说,我们正在从以手机为中心,过渡到以智能体为中心。

「我认为,我们终于走到了一个可以看清 AI 手机究竟是什么的阶段。」他说,「我们正在从应用和助手,走向智能体。」

他给了三个判断。

第一个判断,AI 正在从应用驱动转向意图驱动。

过去二十年,手机体验一直是围绕一个个应用组织起来的。智能体时代不一样。它先理解你的意图,再替你把事办完。这件事恰好对上了手机的特点。高度个人化,一直在线,还能多模态感知。

个人知识与权限

「这是属于你的智能体。」安蒙强调,权限和控制权必须握在用户手里。

第二个判断,手机是个人智能体的起点。

手机是最了解你的设备,也一直在你身边。未来的体验会越来越少谈打开应用。更多是谈替你把事办完。

个人智能体不会只待在手机里。它会在电脑和汽车之间流转。手表和眼镜也一样。体验是连贯的,不会断。手机是这套个人 AI 系统的算力枢纽,也是记忆枢纽和连接枢纽。

第三个判断,智能体需要一套全新的系统架构。

智能体得知道正在发生什么,得理解你的意图,还得替你行动。它会像装上一批技能插件那样,长出各种新本事。这会带来系统级设计的新机会,涉及混合 AI、跨设备智能和任务编排。图省事把智能体全丢云端,代价是隐私和延迟。

整个计算引擎因此都要重想一遍。智能体编排吃处理器的性能。AI 加速单元负责高能效推理。图形处理器接管并行计算。同时还得保住一整天的续航。

混合 AI 与跨设备智能

个人智能体的竞赛才刚刚开始。高通这次把地基先铺好了。

从缓存架构到图形处理器里的 AI 专用核心,从加速单元的扩容到传感器中枢的低功耗感知,新一代骁龙双旗舰平台把智能体的连续任务塞进了手机的功耗预算里。

接下来就看终端厂商和开发者怎么用。个人智能体能不能变成每天真用得上的生产力,答案在他们手里。