第六代骁龙8超级至尊版登场,跑分小超玄戒O3!首次5GHz反而是我最不在意的

一年一度,芯硬件如约迎来夏威夷茂宜岛,见证了高通第六代骁龙8至尊版系列旗舰移动平台的正式登场。
这是2018年以来,鄙人连续第7次来到夏威夷参加高通骁龙技术峰会。


今年最大的不同,就是高通首次打造了“双旗舰”,同时推出两款产品,分别叫做第六代骁龙8至尊版(Snapdragon 8 Elite Gen6)、第六代骁龙8超级至尊版(Snapdragon 8 Elite Extreme Gen6),编号分别为SM8950、SM8975。
其中,超级至尊版的图标为金色描边,整体风格更加明亮。
二者在CPU、内存、存储、连接、显示、安全、定位等方面基本保持一致,区别主要体现在整体能效、GPU游戏与图形能力、AI能力、影像等方面。
官方解释这么做是为客户提供更大的差异化和灵活性,同时将骁龙旗舰体验带到更多终端产品上。



在芯硬件看来,其中也少不了成本方面的考虑,既有SoC本身的因素,也有内存、存储的影响,毕竟如今在一台高端手机中,单单是内存的成本就超过了SoC,占整体的三分之一还要多,这是从未有过的。
有了“双旗舰”,终端厂商确实可以更灵活地选择:
超级至尊版用于不计成本和价格的顶级旗舰,不但提供极致的性能和体验,还是专为智能体时代打造,可以高效运行最先进的AI工作负载。
至尊版用于常规旗舰,尽可能控制成本和价格的同时,在旗舰级性能和先进AI能力之间取得平衡,满足更多消费者对旗舰体验的需求。

第六代骁龙8至尊版系列进行了全方位升级,Oryon CPU、Adreno GPU、Hexagon NPU、Spectra ISP、Sensing Hub传感中心、基带、连接、音频等各个模块都焕然一新。
如今任何新的芯片发布,无论PC、数据中心还是手机处理器,都绕不开一个共同的话题“智能体AI”,高通当然也不例外。
毕竟,手机是日常接触最为频繁的交互终端,而高通骁龙是全世界最大的移动平台。
高通强调,在智能体AI时代,骁龙处理器的不同模块可以各司其职、密切协同。
Oryon CPU负责指挥、规划、推理,并协调整个工作流程,还可以在调用云端API时快速进行恰当的路由调度。
Hexagon NPU或Adreno GPU可以共同支持AI推理,尤其是端侧同时运行多种模型的混合场景中。
传感器中枢则负责处理环境语音,而且始终在线,因为环境语音是从不间断的。
高通还强调,第六代骁龙8至尊版系列的核心追求之一,就是让更多AI能力可以在靠近SoC的端侧运行,让AI体验更快速、响应更灵活。
当然,最佳的AI体验必然来自端云结合,不过智能手机、平板机因为独特的移动性,很多时候无法过于依赖云端,因此更需要随时在本地端侧拥有充足的AI能力,这正是第六代骁龙8至尊版系列的设计初衷。
接下来芯硬件为大家逐一介绍第六代骁龙8至尊版系列的各个模块,以至尊版为主,标准版的区别在括号内备注,之后会详细对比两个版本的区别。
【CPU:标准版也能飙到5GHz】


第六代骁龙8至尊版系列的制造工艺一如苹果A20 Pro、联发科天玑9600 Pro,都是台积电N2 2nm级,晶体管数量依然不公开。
第六代骁龙8超级至尊版采用了全新的Offset PoP偏移式堆叠封装。
这一次,SoC和内存既不是垂直堆放,也不是水平并排,而是将SoC中发热量最大的CPU、GPU部分做物理偏移,不再被内存覆盖,而是可以直接接触上方的均热板、石墨烯等散热材料。
这样,热传导效率可以得到显著提升,从而保证更持久的峰值性能释放,在游戏、AI渲染等高负载场景下优势突出。
第六代骁龙8至尊版则依然是传统的PoP堆叠封装,内存置于SoC之上。


CPU依然采用高通自研的Oryon架构,现已进化到第四代,拥有完整的定制化设计。
布局依然是两个超级核心(Prime Core)、六个性能核心(Performance Core)组成的八核心,最高主频达到了史无前例的5GHz!
当然,只有两个超级核心的最高频率可以达到5GHz,六个性能核心最高则是4GHz,对比上代都提升了400MHz,而对比发哥领先了450MHz,对比苹果也领先近100MHz。
需要指出的是,5GHz的频率注定不可能持久,高通也强调,高频率并不是决定性能的唯一因素,更重要的是与先进的指令集、更高的IPC(每时钟周期指令数)结合起来,才能真正更快地完成计算任务。
无论超级版还是标准版,CPU频率是一致的,峰值都是5GHz。
高通宣称,新一代CPU性能提升最多13%(标准版10%),能效则大幅提升最多37%。
这次,高通还打造了全新的缓存架构“FlexCache”,容量达16MB。
它拓展了构建内存层级架构的方式,支持动态分配缓存池,也就是异构计算核心可以访问相同的缓存池,并可根据工作负载,动态调整分配缓存资源。
同时,它还有着超低的时延,使得运行在超级核心上的高负载工作可以在需要时利用几乎整个缓存池。
高通称,这种动态缓存技术,在游戏、视频编辑、多任务处理以及各种需要瞬时极致性能的场景中,可以带来出色表现,因为可以让更大的工作集驻留在缓存中,无需频繁回写至系统内存。
在内存短缺、价格昂贵的行情下,这种设计无疑更具价值。
另外,FlexCache可以为智能体AI提供强大的算力引擎,因为智能体会频繁迁移线程,调用运行在不同CPU核心上的工具,FlexCache就能让智能体在运行高负载任务的同时,保持足够高的响应速度。
内存支持都是LPDDR5X、LPDDR6,最高频率5300MHz,最大容量24GB,存储则都支持新一代UFS 5.0。
USB接口速率均为USB 3.1 Gen2 10Gbps。
【GPU:全新的ANF超分、帧生成】


新一代Adreno GPU号称整个架构都进行了重大突破,图形性能、能效均带来了极大的代际跃升。
其中,超级版的是Adreno 850,标准版则是Adreno 845。
架构上,还是熟悉的Slice切片设计,还是熟悉的三组,频率达到了1.45GHz,再次提升250MHz,幅度还是可以的,远大于上代提升的100MHz。
还是熟悉的独立高速显存(HPM),还是熟悉的18MB容量(标准版12MB)。
API方面,Vulkan 1.3升级为Vulkan 1.4(Android 17 Profiles),同时继续支持OpenCL 3.0 FP、OpenGL ES 3.2。

随着手游越来越庞大、复杂,开发者需要更快速、更智能地访问内存,HPM就让内存更靠近IP模块,减少内存数据读取。
HPM可直接为GPU提供大容量、高速度、低延迟的存储,保存图形渲染目标、帧缓冲、深度和颜色缓冲、前序渲染阶段生成的纹理,以及其他中间数据,让它们全部留在图形子系统内部,无需反复访问系统内存。
更少的数据传输,意味着更低的时延、更高的能效、更持久的游戏续航。
高通称,凭借HPM可以降低12%的功耗。
另外在驱动层面,这一代GPU具备更精细的动态时钟电压缩放(DCVS),支持更多档位的频率调节、更出色的卡顿检测与反馈机制,并优化了多GPU任务并发场景下的响应速度。

高通称,新一代GPU的性能提升了最多44%(标准版35%),能效则提升了最多40%。
为何规模没变、频率小幅增加,性能进步却如此之猛?
秘诀就在于全新的AI能力。

这一代Adreno GPU最大变化,就是首次引入了“Matrix Core”(矩阵核心),共有三个,每组切片一个,但是仅限超级版。
Matrix Core是针对AI负载打造的GPU专用模块,可以在图形管线内直接运行先进AI模型,进一步提升性能和能效。
高通称,这是AI路线图上的重要里程碑,由此骁龙平台的每个核心引擎,包括CPU、NPU、GPU,都具备矩阵加速能力。

有了矩阵核心,最直接的好处就是,神经网络计算不再需要离开图形渲染管线即可完成。
基于此,高通打造了全新的“Adreno Neural Fusion”(神经网络计算融合),简称ANF,当然也是仅限超级版。
ANF将AI和图形处理更紧密地结合在一起,在统一的图形管线内实现神经网络处理、AI超级分辨率、AI帧生成。
根据之前曝料,ANF技术有两种运行模式,一是超分模式。
结合运动矢量、深度缓冲、低分辨率色彩缓冲与上一帧渲染画面,将输出画面超分至1080p或1440p。
二是插帧模式或者叫帧生成模式。
通过结合当前帧与上一帧的运动矢量和光流重投影,在两帧之间生成一帧全新画面,从而实现性能翻倍。
这两种模式都是通过Matrix Core搭配GPU图形缓存来提升运行效率,意味着渲染负载不会完全由GPU承担,从而在不显著增加功耗的前提下提升性能。



在开发者层面,ANF是首个在主流手游引擎上落地的AI超分技术,已提供Unreal、Unity、Messiah等引擎的文档与插件支持,可轻松集成与部署。
同时,新GPU已全面支持UE5引擎的Megalights光影技术、Lumen全局光照技术(实时硬件光追)、Nanite虚拟几何技术,单个帧画面支持超过3100个动态粒子。


高通称,ANF不但可以提供卓越的画质、维持峰值的性能,还可以大大减少伪影、提升帧率稳定性,并降低功耗、延长续航。
相比于原生渲染方案,ANF超分可以将能效提升最多达80%,而相比其他同类方案也能高出最多40%。
在实际游戏中,《洛克王国》功耗可以降低最多达37%,《崩坏:星穹铁道》最多22%,《白银之城》最多19.5%,《永劫无间》最多11%。


目前,高通正与20多款手游合作,落地ANF,其中包括多款国产手游:
《Aaero 2》《无限大》《暗区突围》《暗黑破坏神:不朽》《模拟农场26》《崩坏:星穹铁道》《诡秘之主》《代号:对决》《怪物猎人:旅人》《永劫无间手游》《异环》《洛克王国》《黑道圣徒3:重制版》《绝晓》《Project Silent Whispers》《银白古堡》《望月》《战争雷霆手游》《燕云十六声》。
值得一提的是,就在数日前的预沟通会上,高通给出的数字还是18款,可见ANF的普及速度相当之快,《黑道圣徒3:重制版》就是新加入的。
【NPU:本地跑300亿参数模型】


Hexagon NPU可以说是专用AI引擎,这一代同样进行了全新设计。
新NPU现在可运行30B(300亿)以上参数规模的MoE(混合专家)模型,支持INT2、INT4、INT8、FP8、FP16等数据精度。
对于INT4精度、3B级参数模型,预填充速度可提升最多达80%,还有更快的解码吞吐速度、增强的推测解码。
整体而言,新一代NPU的性能提升了最多35%(标准版14%),AI能效则提升最多33%(标准版20%)。

它还有两大关键新特性。
一是“Element Accelerator”(元素加速器),专门面向智能体AI的Transformer工作负载。
它与12个Scalar标量计算单元、8个Vector向量计算单元、1个Tensor张量计算单元相结合,可以加速大模型中最关键的运算,帮助智能体更快响应、更高效推理,还有高能效。


二是共享内存容量扩大50%(仅限超级版),可以将上下文、KV Cache缓存数据都保留在NPU内部。
这样就可以大幅减少对外部内存的访问次数,降低时延,从而为其他工作负载释放宝贵的内存带宽。
现在,NPU可以专注于AI推理,更快速、更高效地输出结果。
随着端侧模型处理的上下文窗口越来越长、工具调用和并发任务越来越多,新设计的NPU可以保证及时的响应。

同时,超级版的Sensing Hub传感中心也全面翻新,内置两个Micro NPU微核心,号称性能提升85%,功耗降低20%。
它可以在超低功耗下,持续在线,不需要唤醒CPU、GPU、NPU即可随时处理语音输入和个人上下文,对于智能体AI任务执行和保持续航都至关重要。
传感中心可以在本地运行最高2亿参数的小型模型,无需连接云端。
这里还有一项新功能“Personal Scribe”,可以索引对话、识别不同参与者,将重要信息整理成个人知识图谱,随着时间的推移会越来越个性化。
【ISP:首次支持8K60录像、H.266解码】


Spectra ISP如今不再只是影像处理单元,联合CPU、GPU、NPU共同帮助用户拍摄,还会特别与NPU紧密结合,在拍照、录像的同时就进行智能处理,而不是等待拍摄之后,再进行智能处理。
这次乍一看还是三组20-bit AI ISP,但都经过了全新设计,视频录制吞吐量提升到了原来的4倍,首次支持录制8K60视频、4K240/1080p960超级慢动作视频(标准版为8K30、4K120/1080p960),还支持高级专业视频格式APV(标准版无)。
不过,支持的摄像头像素、规模没有变化。

同时,随着Hexagon NPU链路的升级,现在可以为每个画面像素分配16位AI数据,信息量是前代的256倍,帮助ISP充分理解场景中的每个细节。
同时,支持4K60格式的增强AI视频语义分割、实时AI皮肤和天空色调调整。

视频播放首次支持VVC H.266硬件解码加速,和天玑9600 Pro一样,因此相关视频播放功耗可降低足足95%。
【连接:5G继续提速,首次支持Wi-Fi 8】

5G基带升级为全新的骁龙X105,下行速度从12.5Gbps提高到14.8Gbps,上行速度从3.7Gbps提高到4.2Gbps,分别提速18.4%、13.5%,继续遥遥领先。
射频收发器升级到台积电N6RF 6nm工艺制造,与苹果C1相同,而之前一直是三星14nm,功耗因此降低30%。
另外还支持3GPP Release R19,支持Sub-6GHz 4x6 MIMO和六载波聚合、毫米波2x2 MIMO,完整集成支持NB-NTN、NR-NTN卫星直连。
无线连接芯片升级为FastConnect 8800系列,重新设计的4x4架构,已经为尚未形成正式标准的Wi-Fi 8(802.11bn)做好了准备,峰值下行速度11.6Gbps,同时支持蓝牙6.0。
【小米18 Pro系列首发】



每一年,小米都是新骁龙的首发伙伴,今年也不例外。
今天晚上就会正式发布的小米18 Pro系列,就会全面搭载第六代骁龙8至尊版系列。
其中,小米18 Pro首发搭载第六代骁龙8至尊版,小米18 Pro Max则是首发搭载第六代骁龙8超级至尊版。
操作系统预装澎湃OS 4,针对新平台进行了系统性优化,包括负载精准调度、内存预载入、应用运行时环境等。
发布会现场,曾学忠首次亮出了小米18 Pro Max的真机。
值得一提的是,小米18 Pro系列还会在今年晚些时候登陆全球市场。


摩托罗拉的Signature 27,也会首批搭载第六代骁龙8超级至尊版。
【区别:没那么大,但也不小】
从目前的资料看,第六代骁龙8超级至尊版、第六代骁龙8至尊版的差异并没有预想中那么大,CPU、内存、存储、连接规格都没什么明显差异,5G基带和Wi-Fi无线规格也是一样的。
区别主要体现在整体能效、GPU游戏与图形能力、AI能力、影像等方面。
比较特殊的是,CPU频率都可以加速到最高5GHz,但是标称性能提升幅度不同,显然实际运行频率还是有所不同的,比如加速时间。
CPU:
性能提升超级版13%、标准版10%(能效提升都是37%)。
GPU:
超级版名为Adreno 850,标准版名为Adreno 845。
性能提升超级版44%、标准版35%(能效提升都是40%)。
HPM显存容量超级版18MB、标准版12MB。
超级版还独享Matrix Core、Adreno Neural Fusion(ANF)、AI超分和AI帧生成。
NPU:
性能提升超级版35%、标准版14%。
能效提升超级版33%、标准版20%。
共享内存容量超级版扩大50%、标准版不变。
传感中心超级版全新设计、标准版不变。
ISP:
视频拍摄超级版8K60、标准版8K30。
超级慢动作视频拍摄超级版4K240/1080p960、标准版4K120/1080p960。
超级版支持高级专业视频格式APV,标准版没有。

【跑分:小超玄戒O3】
说了半天,第六代骁龙8超级至尊版的性能到底如何?
在发布会现场,芯硬件在常温环境下跑了几个测试,其中安兔兔最高接近560万,略高于小米玄戒O3,大幅领先联发科天玑9600 Pro。
GeekBench 6.3单核心可以接近4300,多核心接近12700。


【图赏】
最后欣赏一下现场实拍的第六代骁龙8超级至尊版,注意看背面封装与以往截然不同。










