端侧智能体不再只是演示,高通用两颗新旗舰把链路跑通了

北京时间9月23日凌晨,高通在夏威夷召开的2026骁龙峰会上,正式发布第六代骁龙8超级至尊版移动平台和第六代骁龙8至尊版移动平台。这是骁龙8系历史上第一次在旗舰产品线同时推出两款至尊版平台,其中第六代骁龙8超级至尊版被官方称为「全球最快移动CPU」。

在我们看来,这次发布最值得关注的不是某个单项参数,而是高通的整套打法——创新架构、全球最快CPU、全核心引擎AI加速,两款平台从设计之初就是奔着智能体AI去的。高通公司总裁兼CEO安蒙在峰会上的一句话可以视作注脚:“智能体时代所承诺的并不是让AI替我们包办一切,而是让技术变得更实用、更直观、更契合人们的需求。”

双旗舰同台,一颗守基本盘,一颗探上限

先回答大家最关心的问题,为什么是两颗?

官方的定位表述很清晰。第六代骁龙8至尊版面向更广泛的旗舰终端,在旗舰级性能和先进智能能力之间实现平衡;第六代骁龙8超级至尊版则专为最先进的AI工作负载和定义智能体时代的全新体验而打造。

翻译成产品逻辑就是,至尊版负责把新一代旗舰体验铺到更多机型上,超级至尊版负责把AI、游戏、影像的能力上限继续往上推。一颗守基本盘,一颗探上限,这在以往的骁龙8系列迭代中是没有过的打法。

两款平台基于同一套旗舰底座,包括2nm制程工艺、最高5GHz的定制Qualcomm Oryon CPU、高通X105 5G调制解调器及射频系统和FastConnect 8800移动连接系统,差异主要体现在AI与图形能力的上限上。

有意思的是,这个双旗舰策略本质上是一次精准的分层。高通技术公司高级副总裁兼手机业务总经理Chris Patrick表示,多旗舰策略有助于扩展移动体验的边界,将最新的AI创新技术引入更广泛的旗舰终端中。换句话说,高通既想保住旗舰出货的基本盘,又不想让「至尊版」这三个字的天花板停在原地。

全球最快移动CPU,5GHz是面子,FlexCache才是里子

第六代骁龙8超级至尊版搭载2个最高5GHz的超级内核和6个最高4GHz的性能内核,其Qualcomm Oryon CPU是首个最高主频达到5GHz的移动CPU。官方数据显示,CPU性能提升13%、能效提升37%、响应速度提升15%。

5GHz当然是里程碑,但我们认为这代CPU真正的灵魂是全新的Qualcomm Oryon FlexCache缓存架构。超级内核与性能内核可以访问同一个异构缓存池,高负载任务在需要时几乎能调用整个缓存池,同时保持超低时延。

为什么这项创新比主频更值得展开?因为智能体AI的多步任务会在不同核心之间频繁迁移线程、调用工具,数据如果跟着任务来回搬运,响应速度必然打折。FlexCache让数据始终留在同一个大缓存池里,无论任务迁移到哪类核心,都能就近取用。可以说,移动芯片的竞争正在从「谁的频率高」转向「谁的数据调度更聪明」,游戏、视频编辑、多任务这些短时性能爆发场景,都是这套逻辑的受益者。

高主频难免让人担心功耗,高通的解法是一整套组合拳。新平台是高通首款2nm移动平台,官方仿真数据显示持续极限性能达到2倍、整体能效提升10%,并支持LPDDR6内存与UFS 5.0。第六代骁龙8超级至尊版还采用了更先进的Offset PoP封装,把封装内存移到一侧,为专用散热路径创造空间。制程、封装、缓存三管齐下,压的就是高负载下的持续性能这条线。

所有核心引擎的AI加速,才是「为智能体而生」的本体

如果说CPU决定平台的下限,那么这一代真正拉开差距的是AI架构的整体思路。传感器中枢处理不间断的环境语音,Oryon CPU负责指挥、规划、推理和调度路由,Hexagon NPU与Adreno GPU协同支撑多模型并发的端侧推理。每个模块各司其职,这样的完整拼图在移动平台上并不多见。

先看Hexagon NPU。全新的Element Accelerator专为智能体AI的Transformer工作负载打造,大容量共享内存扩容50%,把上下文和KV-cache数据留在NPU内部,减少访问外部DDR的次数。官方数据为NPU速度提升35%、每瓦性能提升33%,3B参数模型预填充速度提升80%,并可支持300亿以上参数的混合专家模型。

300亿参数模型端侧运行,听上去很「发布会」,但这次有实锤。高通携手阶跃、无量火与江波龙,将阶跃StepEdge-Omni 30B-MoE模型完整部署于端侧,这是目前市面上最大的手机端侧模型。模型运行内存需求相比行业常规方案降低超50%,预填充吞吐超过330 Token/s,解码吞吐超过28 Token/s,首个词元生成速率达到毫秒级,从邮件理解到行程规划的智能体办公全程本地完成,无需调用云端。我们认为这次合作的意义在于,它证明了端侧智能体不再是演示视频里的概念,而是一套算力、推理引擎、存储协同跑通的完整链路。

容易被忽略但同样关键的是传感器中枢。两个Micro NPU,性能提升高达85%、能效提升高达20%,支持2亿参数模型常开运行,配合升级的个人记录(Personal Scribe)功能构建持续积累的个人上下文层。智能体要「懂你」,前提是这个常开感知层永远在线又不耗电,这块拼图补上了,全天候智能体才有讨论的基础。

GPU的AI化则是我们眼中这一代最大的架构看点。Adreno GPU首次引入专为AI负载打造的Matrix Cores,神经网络计算不再需要离开图形渲染管线,至此平台从NPU、CPU到GPU的每个核心引擎都具备了Matrix加速能力。GPU从单纯的图形单元变成了通用AI算力的一部分,这个转变的意义不亚于当年GPU引入光追。

基于Matrix Cores的Adreno Neural Fusion,在同一条图形管线中整合神经处理、AI超级分辨率和帧生成。说人话就是,这相当于移动游戏迎来了自己的「DLSS时刻」——不必始终以最高分辨率渲染,AI负责恢复细节和生成额外帧,画质、帧率、功耗三者终于可以兼得。它已在Unity和虚幻引擎5提供插件支持,峰会现场演示的移动端虚幻引擎5 MegaLights每帧超过3100个动态光源,目前高通已与20多家游戏合作伙伴展开合作。

剩下的,是把能力变成体验

影像的思路同样是AI前置。全新20-bit Qualcomm Spectra ISP与NPU紧密结合,在拍摄瞬间即应用智能处理而非拍后补救,视频吞吐量提升至原来的四倍,首次在商用终端支持8K 60fps视频拍摄,超级慢动作也升级至4K 240fps,并支持高级专业视频编解码器(APV)。智能像素控制技术让NPU为每个像素分配16位AI数据,信息量达到前代的256倍,可以跨帧持续追踪拍摄对象。

连接方面,高通X105是全球首款面向3GPP Release 19就绪的调制解调器及射频系统,为6G奠定基础,5G下行峰值速率达14.8Gbps;FastConnect 8800是首款采用4x4 Wi-Fi射频配置的Wi-Fi 8移动方案,峰值速率达11.6Gbps,手机可以借此成为智能家庭中枢。

纸上谈兵终觉浅,我们在工程机上也经过了一番实测,均获得了比较不错的成绩。其中,安兔兔V12总分约568万;Geekbench 7单核3636分、多核12349分;3DMark Wild Life Extreme跑出9980分,Steel Nomad Light为4390分,这样的成绩放在当前的移动平台里是实打实的第一梯队领跑水平。当然,这些成绩来自参考设计工程机,量产终端的调校空间还很大,最终表现以厂商机型为准。

终端落地的速度也超出以往。小米、vivo、红魔、REDMI、OPPO、一加、Motorola、iQOO、荣耀等品牌将率先在旗舰产品中采用两款新平台,首批名单几乎覆盖了国产旗舰的全阵容。其中vivo确认iQOO 16和iQOO Pad Ultra首批搭载第六代骁龙8超级至尊版,红魔12 Pro+官宣搭载,Motorola首次在旗舰系列采用超级至尊版,荣耀则宣布凭借YOYO智能体并首次把ARRI电影工作流引入智能手机。厂商如此整齐地跟进,本身就说明双旗舰策略戳中了终端品牌的分层需求。

写在最后

第六代骁龙8双旗舰的发布,标志着端侧AI竞争的焦点正在迁移——从「能不能跑大模型」,转向「智能体能不能常驻、并发、低时延地干活」,缓存架构、内存带宽、封装散热这些底层功夫重新成为胜负手。创新架构、全球最快CPU、全核心引擎AI加速的组合,让第六代骁龙8超级至尊版成为当下为智能体AI准备最充分的移动平台,而至尊版的存在,则让智能体AI体验不再专属于最贵的手机。随着iQOO 16、红魔12 Pro+等首批终端官宣在途,这套平台的成色很快就会接受市场检验,届时我们也会带来新机的全面体验,值得持续关注。

本文来自大风号,仅代表大风号自媒体观点。