桃子桃子快讯
返回首页
产品功能

高通骁龙双旗舰亮相,重塑智能体时代移动架构

高通在2026骁龙峰会发布两款2nm旗舰移动平台,专为端侧智能体AI设计,可支持300亿参数MoE模型,已获多家中国手机…

2026.09.24 · 周四4 分钟阅读

2026年9月23日,2026骁龙峰会在夏威夷茂宜岛开幕。高通正式推出第六代骁龙8至尊版与第六代骁龙8超级至尊版两款旗舰移动平台,均采用2纳米制程,被官方称为「全球最快的移动SoC」。整场峰会以智能体AI为主线,高通公司总裁兼CEO安蒙在主题演讲中提出,设备将进入「两个用户」时代——人类用户之外,智能体将成为持续运行的「第二个用户」,推动智能手机迎来十多年来最深刻的架构变化。

智能体为何要重塑手机架构

高通给出的判断是:对话式AI单次交互约消耗1万token,推理式AI每项任务约10万token,而能自主执行多步操作的智能体AI单项任务已达100万token,并且仍在增长。与此同时,加州大学伯克利分校研究团队的数据显示,大模型参数规模约每两年增长410倍,而单颗GPU内存容量每两年仅增长约2倍,「内存墙」成为端侧智能体体验的隐形瓶颈。

在安蒙看来,手机之所以是智能体最自然的起点,是因为它高度个性化、始终伴随用户,并能感知用户所处情境。高通估算全球约有60亿部手机,存量居各类终端之首。要让智能体全天候运行、跨应用穿梭协作,底层的AI、计算、连接、内存、感知、安全与功耗效率必须协同重构。

双旗舰齐发:CPU、NPU、GPU全面进化

两款新平台均围绕智能体负载进行系统级设计,关键升级包括:

  • CPU:全新Qualcomm Oryon由2颗最高5GHz超级内核与6颗最高4GHz性能内核组成,是首款主频达5GHz的移动CPU;相比上一代性能提升13%,能效提升37%。全新Oryon FlexCache让不同核心共享可动态调配的缓存池,应对智能体多线程迁移与跨核调度的计算接力。
  • NPU:重新设计的高通Hexagon NPU引入Hexagon Element Accelerator,融合向量与标量单元;共享内存扩容50%,KV-cache与上下文更多保留在NPU内部。相比上一代,NPU性能提升35%,每瓦特性能提升33%,30亿参数模型预填充速度提升80%。
  • 模型支持:第六代骁龙8超级至尊版可支持300亿以上参数的混合专家(MoE)模型。以300亿参数MoE为例,每生成一个token仅激活约30亿路由参数,专家模块存放在闪存中,按需调入内存。
  • GPU:新一代Adreno GPU首次引入Adreno Matrix Cores与AI驱动的Adreno Neural Fusion图形架构,神经渲染直接嵌入图形管线,降低功耗与时延,让主机级画质、稳定高帧率与持久续航三者兼顾。
  • 传感器中枢:搭载两颗Micro NPU,性能提升85%,能效提升20%,可本地支持高达2亿参数的模型;即使SoC其余模块空闲,也能以极低功耗全天候感知环境语音,为智能体持续积累个人上下文。

高通技术公司高级副总裁兼手机业务总经理Chris Patrick表示,多旗舰策略有助于把最新AI创新技术引入更广泛的旗舰终端,为OEM厂商提供更丰富的选择。

从芯片到口袋:四方合作落地端侧智能体

小米、vivo、红魔、REDMI、OPPO、一加、Motorola、iQOO、荣耀等品牌将率先在旗舰产品中采用两款新平台,其中iQOO 16、红魔12Pro+已确认搭载第六代骁龙8超级至尊版。

更具示范意义的合作发生在高通、阶跃、无量火与江波龙四方之间。基于第六代骁龙8超级至尊版,阶跃StepEdge-Omni 30B-MoE模型率先完成完整端侧部署:无量火推理引擎将模型运行内存需求降低超过50%,江波龙存储方案则让模型权重从闪存高效加载。峰会现场基于高通参考设计演示了复杂的端侧智能体AI工作流,验证了端侧部署多步推理任务的可行性。

安蒙强调,高通不生产手机,也不运营消费级应用或助手,因而能在智能体时代同时支持不同手机厂商和模型公司,维持产业中立。他将这一定位比作PC时代的Windows与移动时代的安卓,并表示「我们或许正在迎来一个Android时刻,甚至还有一个Linux时刻」。

面向更远的产品形态,高通在峰会上反复强调,个人AI将在手机、PC、汽车、眼镜和耳机之间无缝协同,让智能跟着用户走、体验保持连贯。随着更多终端成为智能体执行推理的节点,开放生态正在成为下一阶段竞争的关键变量。

信源