高通All in 智能体!CEO安蒙:我们已处在智能体时代的开端

鱼羊 发自 夏威夷

量子位 | 公众号 QbitAI

高通要引领安卓阵营,All in智能体了。

今年的骁龙峰会,不讲“下一代手机”,全篇尽是“智能体时代已至”。

刚刚呈上的一连串新品发布,句句不离智能体体验:

手机全新旗舰芯片,不仅开启2nm时代,更惹眼的是CPU、GPU、NPU全套升级思路完全围绕智能体展开。

PC端的骁龙X系列,干脆直接联手Gemini Intelligence,打造跨品牌的Googlebook。

还有新的第二代骁龙音频平台至尊版,在AI能力方面实现2倍提升,合作厂商基于骁龙平台的智能耳机、眼镜……纷纷现场亮相。

高通公司总裁兼CEO安蒙,更是旗帜鲜明做出论断:

移动行业,正在从“以App为中心”的时代,迈入“以智能体为中心”的时代。

现在,我们已处在智能体时代的开端。

AI is the new UI.

现在,不止于手机芯片,甚至不止于PC、可穿戴设备,围绕“智能体时代”这个全新的趋势和挑战,高通依然“激进”——

透过这一场骁龙峰会,智能体时代几乎所有个人终端的全新基础设施布局,已然浮出水面……

All in智能体

事实上,整体梳理一遍今年的高通新品发布,就会发现All in智能体的具体布局,都在产品细节里了。

旗舰双芯:为智能体时代而生

最重磅的,当然还是第六代骁龙8至尊版和第六代骁龙8超级至尊版这两颗移动新旗舰。

双旗舰均采用2nm制程工艺,第六代骁龙8超级至尊版定位高通“性能最强移动平台”,搭载“全球最快移动CPU”。至尊版则旨在把同一套2nm、Oryon CPU、Adreno GPU、Hexagon NPU架构下放到更广的高端旗舰。

关键是,从CPU、GPU到NPU,新一代旗舰移动平台的升级,都旨在“让智能更贴近处理器”。

具体来说,新一代Qualcomm Oryon CPU是首个最高主频达到5GHz的移动CPU。相比前代,其性能提升13%、能效提升37%、响应速度提升15%。

更值得关注的是,这颗CPU现在成为了智能体的总调度器:编排、工具调用和不同计算资源的调度……一整套工作流都跑在CPU上。

为此,高通给新Oryon CPU端上了全新缓存架构Oryon FlexCache。

它本质上是在重新处理缓存资源的分配方式:过去缓存容量和核心之间的关系相对固定,FlexCache则把缓存做成一个可以动态分配的缓存池。当某颗超级内核突然承担高负载任务时,它能够按需求使用“几乎整个缓存池”,同时仍维持低时延。

对于智能体而言,这也就意味着,在执行复杂任务进行频繁调度、突然拉高负载的情况下,响应速度仍能尽量得到保证。

GPU方面,新一代Adreno GPU性能提升44%,能效提升40%。

此次,高通在Adreno GPU内加入专门面向AI工作负载的Matrix Cores,让神经网络计算能够直接留在图形渲染管线内部完成,不用再把数据搬出去交给其他计算单元处理。

从智能体的角度来看,这意味着,手机上的AI任务不一定全靠NPU,而是CPU、GPU、NPU都能根据任务特征参与进来一起干活。

NPU方面,新一代Hexagon NPU重要的新组件是Element Accelerator。

相比于早期移动端的AI应用,智能体要面对的是长上下文、多轮推理、工具调用、多模型调度、持续运行等更为复杂的情境。

Element Accelerator专为Transformer工作负载设计,能与原有的向量计算单元、标量计算单元配合,专门加速大模型里的关键运算。

同时,新一代Hexagon NPU还将大容量共享内存(Large Shared Memory)进一步扩容达50%。这能将上下文和KV-cache数据保留在NPU内部,同样可以减少访问DDR的次数,降低内存读取和时延,并为其他工作负载释放宝贵的内存带宽。

也就是说,即使端侧模型要处理更长的上下文窗口、更复杂的推理、更多的工具调用以及并发任务,智能体体验也能及时响应。

可以说,过去的NPU是通用AI加速器,而现在,高通开始明确将其定位为面向智能体应用的重要基础。

值得关注的一点是,从CPU,到GPU,再到NPU,高通一条明显的技术思路是,给Agent解决“内存墙”问题。

无论是CPU侧的FlexCache,GPU侧的18MB Adreno HPM,还是NPU上大容量共享内存扩容50%,本质上都是一个思路:

数据在哪里计算,就尽量留在哪里。

在骁龙峰会现场,安蒙还提到,高通将把用于数据中心的高带宽计算技术(High-Bandwidth Compute,HBC)作为协处理器,拓展到智能手机平台等骁龙平台,为下一代AI智能手机带来更快的AI推理响应速度、更优秀的能效和更强大的性能。

具体发布留待明年3月的MWC(世界移动通信大会)揭晓。

最好的AI是个人AI

如果说旗舰双芯反映的是高通的技术思路,全新发布的第二代骁龙音频平台至尊版、骁龙X系列在智能体AI PC方面的生态拓展等,则更具象化了何为“个人AI”——

个人AI不专属于某一台设备,而是以智能体为核心,可以在不同的终端入口自由流转。

具体来说,第二代骁龙音频平台至尊版的定位不再是“AI加持的旗舰音频SoC”,而是集优质音频、语音技术、终端侧AI、连接能力于一体,专为个人AI打造的音频平台。

与前代平台相比,第二代骁龙音频平台至尊版实现了音频可穿戴设备终端侧AI能力的显著提升。

其AI算力最高可达128GOPS,较之前代最高提升2倍,支持多种智能体验同时运行。与此同时,功耗降低40%,尺寸缩小30%,还集成了低功率Wi-Fi 6E,支持设备直连云端AI,让可穿戴设备能脱离手机使用。

在这些能力的支持下,甚至耳机也可以多模态了。

高通就和耳机厂商Cleer合作,展示了基于第二代骁龙音频平台至尊版的概念产品,让耳机搭载感知环境的摄像头,同时获得声音+视觉+环境上下文,再交给AI做理解。

PC方面,骁龙生态进一步围绕智能体拓展。在骁龙峰会上,高通和谷歌就宣布携手,将骁龙X Elite平台引入专为Gemini Intelligence打造的Googlebook笔记本电脑。

就是说,Googlebook把Gemini做进了系统层,而骁龙X系列芯片,就是其端侧AI算力底座。

另外,骁龙X2系列还宣布即将支持Linux,以为智能体时代的开发者和用户带来更多选择。

可以说,这一次骁龙峰会,高通在芯片里塞进的每一项新能力,几乎都是在为智能体加码。

一切连点成线,正在构筑出终端智能体时代的初步图景。

高通转型:智能体AI全栈解决方案公司

移动互联网时代,智能手机的体验围绕App来展开。

而现在,随着模型能力的飞速进步,当智能体开始在Coding领域展现出AGI的潜力,手机的智能体时代,也迎来了启幕时刻。

站在普通消费者的角度,甚至可以说,智能体向终端的迁移,才是智能体时代真正的开始。

高通CEO安蒙认为,智能体真正有价值的标准,是“比你自己动手更简单”。

比如去看演唱会,需要查日程、买票、做计划。表面上是一个简单任务,如果人来手动做这件事,可能需要调动日历、买票软件、天气……多个App、云服务和模型来完成。

而现在,你只需要跟智能体说“我要去看演唱会”,它已经能做到全自动一站式完成这些工作。

这样的背景之下,高通的叙事逻辑实际上也有了明确的转变。

不再是传统的CPU → GPU → NPU → 跑分,而是一条更AI、更Agent的路线:

芯片 → 端侧Agent → 多设备协同 → 个人AI。

不止于硬件,在铺开智能体生态不可缺少的软件侧,高通也已迅速出手。

7月底,高通已完成对AI Infra创企Modular的收购。

Modular在做的是AI时代的统一计算软件层:同一套模型/代码,不用针对NVIDIA GPU、AMD GPU、CPU、NPU乃至不同ASIC重新写一遍,就能部署到不同硬件上。

现在,Modular的完整软件平台将部署到高通的全系列产品中。

也就是说,高通补上了冲刺智能体时代非常关键的一块拼图:一套能够打通手机、PC、边缘和云端不同算力的统一AI计算层。

说到这里,智能终端的新趋势已经明朗:智能体正在削弱设备的边界,让AI可以从应用驱动,真正转向意图驱动。

ChatGPT引领的模力时代启幕之初,高通就已经判断,混合AI是AI的未来。而现在,落地的路径有了更为明确的方向:

从“芯片如何支持设备”,到“以Agent为核心,让AI更贴近人的意图”,甚至更进一步,让这种意图驱动的AI能力,跨设备流转。

这一次,高通再次凭借其终端优势和一贯的技术前瞻性,快速转身。

从手机、PC,到可穿戴设备,再到汽车、边缘物联网和云端数据中心,构筑智能体AI全栈解决方案的能力,正在成为高通在新时代中新的生态护城河。

真正的智能体时代,或许手机不再只是手机,PC不再只是PC。

它们开始成为同一个个人智能系统的不同节点。

这或许才是今年骁龙峰会真正值得关注的变化——

如安蒙所说,设备仍然存在,但边界正在变得越来越不重要。

过去,我们要先找到一台设备,再找到一个App,最后完成自己的目的。现在,Agent正在把这个顺序倒过来:

计算,开始围绕意图而展开。

一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的想法!

— 完 —

🌟 点亮星标 🌟

科技前沿进展每日见

本文来自大风号,仅代表大风号自媒体观点。