你的AI,有龙则灵:第六代骁龙8超级至尊版把智能体AI做进了芯片里

你的AI,有龙则灵:第六代骁龙8超级至尊版把智能体AI做进了芯片里

2026-10-04 19:10:38 0点赞 0收藏 0评论

高通第六代骁龙8超级至尊版正式发布,英文名称是Snapdragon 8 Elite Extreme Gen 6。此前,网上传闻这颗芯片会叫“Snapdragon 8 Elite Gen 6 Pro”,显然是一种错误的猜测了。其实是Pro并不属于骁龙移动平台的命名体系,而Extreme这个后缀对高通而言才是一脉相承。早在2025年9月,高通发布的笔记本计算平台就叫骁龙X2 Elite Extreme,就是标准Elite之上的新级别。虽然名称没猜对,但从正式发布前业内对Snapdragon 8 Elite Extreme Gen 6的猜测和争论,也足以看出市场对这款芯片的关注度非常之高,作为一款分量十足的芯片,能引发广泛的讨论也是芯片自身的价值所在。

除了名称和大家提前猜测的不同之外,骁龙8 Elite Extreme Gen 6真正让人意外的,是高通不再把AI当一个添头,而是主角。这次骁龙峰会的Slogan——“你的AI,有龙则灵”,确实很实在。那Snapdragon 8 Elite Extreme Gen 6的AI到底有怎样的过人之处呢?

你的AI,有龙则灵:第六代骁龙8超级至尊版把智能体AI做进了芯片里

一颗芯片的“分工哲学”

智能体AI和以前的语音助手有啥本质区别?以前的助手是“你问我答”,你说一句它答一句。而智能体是持续运行的“感知—记忆—推理—行动”循环,系统需要同时处理多个任务,在本地与云端之间动态调度,还要在功耗散热约束下保持灵敏响应。

这对芯片设计提出了一个很现实的问题:光靠NPU一家干所有活,根本忙不过来。高通的思路很清晰——让每个模块各司其职。传感器中枢负责“听”,CPU负责调度,NPU和GPU负责计算。从上到下,整颗芯片都在为智能体服务。这就像一个团队,有人负责盯梢,有人负责传话,有人负责干活。各干各的,但配合默契。

传感器中枢:让智能体听见和记住你

智能体要真正懂你,前提是它能记住你。而“记住你”这件事,靠的不是NPU,是传感器中枢。骁龙8 Elite Extreme Gen 6的新一代传感器中枢采用双Micro NPU设计,性能较上代提升约85%,能效提升约20%。它以超低功耗持续捕捉位置、活动、设备使用模式与周围环境,在设备内积累用户偏好、习惯与交互记录。

配合Personal Scribe功能,它在用户授权下为对话建立索引、区分发言者,把关键信息写入专属的知识网络。所有数据处理都在设备内完成,数据不会离开设备,用户可以按时间线或关系图查看累积的记忆,也可以随时删除不想保留的内容。

CPU:智能体的“调度中枢”

传感器中枢负责感知和记忆,接下来就需要有人把这些信息转化成行动。这个角色,落在Oryon CPU身上。

全新Qualcomm Oryon CPU由2颗最高5.0GHz的Prime超级内核和6颗最高4.0GHz的Performance性能内核组成。CPU性能相比上一代提升13%,能效提升37%。这是智能手机处理器历史上首次突破5GHz频率门槛。

但5GHz只是表面。真正关键的是CPU在智能体工作流中的角色——它负责AI智能体的规划、推理与协调。智能体表面上执行一个任务,实际上一个任务会拆成好几步,交给不同核心来处理。

你的AI,有龙则灵:第六代骁龙8超级至尊版把智能体AI做进了芯片里

NPU:智能体的“大脑”

CPU负责调度,但真正“动脑子”的事情,交给NPU。

骁龙8 Elite Extreme Gen 6的Hexagon NPU面向智能体AI的Transformer工作负载引入Element Accelerator,并将大容量共享内存扩容50%,NPU性能提升35%,每瓦性能提升33%。

Element Accelerator到底是啥?简单说,它就是NPU内部的一个专用加速器,专门为智能体这种“多轮次、长上下文”的工作负载设计的。它坐在标量、向量和张量单元旁边,专门加速Transformer推理。

带来的效果很直接:NPU的共享内存扩容50%后,能让最多32K的“聊天记忆”储存在NPU旁边,不需要老是到DDR内存里去找。不只是时延更低、上下文更不容易忘,还能减少读取内存的次数,占用更低的内存带宽。Element Accelerator和更大的共享内存强强联合,让智能体面对更复杂的推理任务、调用更多工具、处理更长的上下文时,都能更加游刃有余。

300亿参数,塞进手机里

至于端侧模型能力,这次高通带来了一个很实在的东西。高通携手阶跃、无量火与江波龙开展四方合作,将阶跃StepEdge-Omni 30B-MoE模型面向端侧进行深度适配与推理优化。

当然,不是说300亿参数全部投入每次推理。这次引入的是MoE混合专家模型,在NPU上每生成一个Token,只需激活约30亿参数。参数总量摆在这儿,但计算负载和内存占用低了很多。

无量火的自研Ember推理引擎,在不修改模型结构、不损失推理精度的前提下,使运行内存需求较行业常规方案降低超50%。

你的AI,有龙则灵:第六代骁龙8超级至尊版把智能体AI做进了芯片里

智能体时代真正的底色

高通给智能体体验定了三条标准:可信、毫不费力、情境化。可信意味着安全和用户控制权始终在用户手中;毫不费力意味着使用智能体必须比自己动手更简单;情境化则要求体验个性化、主动服务而非打扰。骁龙8 Elite Extreme Gen 6的AI架构,就是按照这三条来设计的。它记住你,但不窥探你;它主动服务,但不替你做主;它足够强大,但让你感觉不到它的存在。

这才是智能体时代真正的底色,也是骁龙“你的 AI,有龙则灵”的最佳注脚。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松