256核却只有256线程:英特尔亲手砍掉自己发明的超线程,陈立武认错、2028年又请回来——AMD的512线程对台、E核战略的败局旧账和消费端要等到2029年的账全对完,谁该守住14代酷睿、谁该转投对面、谁该躺平等,说清楚了

源自154位全网作者

00:51

这两天知乎上有个问题重新被顶了起来:英特尔下一代至强,最大核心数干到256,但规格表角落里有一行不显眼的注脚——没有超线程。不是BIOS里给你留个开关那种"取消",是Panther Cove核心里压根没有第二套架构寄存器,硬件层面不做这件事。知乎

超线程是英特尔2002年在奔腾4上首次商用的技术,当年宣传口径是"花一份钱买两份算力",后来几乎成了x86服务器的标配。结果在核心数最多、晶体管最富裕的一代至强上,它被亲手砍掉了。更戏剧性的是:英特尔已经官宣,2028年的Coral Rapids会把超线程加回来。砍掉再恢复,中间隔着一代256核旗舰,这里面的账值得对一对。知乎

一、先把至强7(Diamond Rapids)的家底摆出来

Hot Chips 2026上英特尔公开的资料,加上此前ES样品在SiSoftware的露脸,这颗芯片的轮廓已经比较完整了:

项目

Diamond Rapids(至强7)

上一代 Granite Rapids(至强6)

最大核心/线程

256核 / 256线程(无SMT)

128核P核 / 256线程

L3缓存

1.28GB

最高288MB(6730P)

裸片数量

22颗(16计算芯粒+4基础模块+2内存I/O中枢)

计算die+I/O die

内存

16通道 DDR5-8000,MRDIMM-12800

12通道 DDR5-6400,MCR DIMM 8800

峰值带宽

约1.6TB/s

约0.6TB/s

I/O

PCIe 6.0(128条)、CXL 3.x

PCIe 5.0、CXL 2.0

工艺

核心芯粒18A-P,Base Tile用Intel 3-T,Fabric Hub用Intel 3

Intel 3

平台/功耗

LGA 9324(Oak Stream),650W量级(公开报道口径,官方未证实)

上市

2027年年中

已上市

256核却只有256线程:英特尔亲手砍掉自己发明的超线程,陈立武认错、2028年又请回来——AMD的512线程对台、E核战略的败局旧账和消费端要等到2029年的账全对完,谁该守住14代酷睿、谁该转投对面、谁该躺平等,说清楚了

封装是这一代变化最大的地方:每4颗16核的计算芯粒叠在一块放着缓存的Base Tile上,构成一个计算模块,一共4个模块,再加2颗集成内存控制器、I/O和安全协处理器的中枢(IMH)。芯粒之间用Foveros 3D Direct混合键合,模块到中枢走开放标准UCIe-S的基板铜线——EMIB这次彻底不用了。有博主按渲染图估算,单颗计算芯粒不超过85mm²、每核不到5mm²,18A-P部分几乎没有良率挑战,真正悬的是3D混合键合的封装良率——同样结构的Clearwater Forest已经从2025年底跳票到2026年底,这是前车之鉴。知乎

256核却只有256线程:英特尔亲手砍掉自己发明的超线程,陈立武认错、2028年又请回来——AMD的512线程对台、E核战略的败局旧账和消费端要等到2029年的账全对完,谁该守住14代酷睿、谁该转投对面、谁该躺平等,说清楚了

今年8月初,一颗32核、240MB L3、主频只有1.1GHz的早期ES样品已经在SiSoftware跑分,说明18A-P确实点得亮。另外插一句信息演变的细节:这颗芯片此前流传的口径一直是"最高192核",Hot Chips上才确认顶到256——英特尔这次没有按原规划出牌,原因看对面就懂了。太平洋科技知乎

256核却只有256线程:英特尔亲手砍掉自己发明的超线程,陈立武认错、2028年又请回来——AMD的512线程对台、E核战略的败局旧账和消费端要等到2029年的账全对完,谁该守住14代酷睿、谁该转投对面、谁该躺平等,说清楚了

二、为什么砍超线程?三种解释,和一个最硬的反证

英特尔官方从来没正面回答过这个问题。Hot Chips讲义把256核和1.28GB缓存放在最显眼的位置,"无SMT"只是角落里几个字。这种沉默本身就是态度。市面上流传的解释有三种,可信度不一样:

“核心够宽,SMT收益小了”——半对。Panther Cove解码宽度和乱序窗口确实更大,执行单元被喂得更饱,留给第二条线程的空隙少了。但这个解释站不住的地方在于:AMD的Zen 5同样是宽度优先的设计,SMT照样开着,还把512线程当卖点讲。所以"核宽"能解释收益下降,解释不了必须砍掉。

面积和功耗——实在得多。256颗核心,每颗省掉一套架构寄存器、重命名和退休逻辑,乘上256就不是小数。这笔预算可以拿去把核心做宽,或者让650W量级的功耗装得下这么多核。在核心数被推到256这个量级时,SMT是性价比最低的那部分晶体管。知乎

安全与验证成本——不太摆得上台面但真实。2018年之后SMT侧信道成了数据中心安全评审的常客,不少云厂商部署时直接关掉它——硬件给了两条线程,实际只用一条。硬件层面不支持,等于替整个生态把这个决定做了。

而最硬的反证是:SMT会在2028年的Coral Rapids上回来。如果砍掉它是纯粹的技术进步,就没有理由隔一代再捡起来。更合理的读法是:这一代的取舍是为这一代的制程约束服务的,约束变了,答案就变了。工程决策跟着约束走,没什么可指摘,但"超线程是过时技术"这套叙事,英特尔自己已经用行动否定了。太平洋科技

三、同台的账:一样256核,AMD给你512线程

AMD今年7月发布的下一代EPYC Venice,核心数同样是256(Zen 6c单CCD塞32核×8颗),但SMT保留,线程数512。把两家的线程数排成一行:知乎

核心数

线程数

Intel Granite Rapids(上代)

128

256

Intel Diamond Rapids(这代)

256

256

AMD Turin密集核(上代)

192

384

AMD Venice(这代)

256

512

两家第一次在核心数上站到同一条线,内存也都跳到16通道DDR5-8000、MRDIMM-12800、峰值1.6TB/s,相似度是历年最高。分歧只剩两条:线程模型(256对512),和工艺路线——至强7核心芯粒用自家18A-P,Venice的CCD用台积电N2,是首个量产的2nm级x86服务器芯片。

但先别急着下结论谁赢。几个事实要摆清楚:Venice目前公布的数字全部是AMD自测,没有提交SPEC,没有第三方验证。PCIe 6.0通道数官方产品页写x96、多数媒体报128,IOD工艺有说6nm有说N3P——发布初期这类出入很常见。至强7那边更早,还在文档修订阶段。知乎

定位上两家其实是错开的:Venice的512线程吃虚拟化、容器、海量轻量并发——线程数就是硬通货的场景;Diamond Rapids的特长是计算密集负载,AMX提供同精度8倍的AI算力、AVX-10.2、APX扩充寄存器,这些都是对SMT不敏感的活。有分析直接说这一代数据中心CPU"井水不犯河水"。常规多核跑分上,缺了SMT的至强7大概率打不过Venice,但HPC场景可能是x86里最强的那颗。要等两家的产品都落地、第三方数据出来,才有资格谈胜负。知乎

256核却只有256线程:英特尔亲手砍掉自己发明的超线程,陈立武认错、2028年又请回来——AMD的512线程对台、E核战略的败局旧账和消费端要等到2029年的账全对完,谁该守住14代酷睿、谁该转投对面、谁该躺平等,说清楚了

四、打脸轮回:E核服务器的败局,和陈立武认的那个错

砍超线程不是孤立决定,它是英特尔过去几年"用E核替代超线程"战略的下半场,而这个战略已经宣告失败。

2024年英特尔在至强6上搞双轨:P核的Granite Rapids面向计算密集,E核的Sierra Forest堆到最高288核主打云原生高并发——设想是用海量便宜的能效核当"超线程平替"。结果市场不买账:头部云厂商不愿维护两套异构服务器,混合机房推高虚拟化和运维成本;国内绝大多数客户小批量测试后的结论是E核能效优势不明显,宁愿减少SKU、全部归一到P核。两代E核出货量远低于内部预期,还分流了P核订单。知乎

陈立武上任后快刀斩乱麻:E核服务器线停止更新,OKS平台回归纯P核,并且公开承认——放弃超线程使英特尔在竞争中处于劣势,重新引入是"缩小性能差距"的必要之举。今日头条知乎

英特尔官方早年给过超线程的账:约30%的性能提升,代价是约20%的功耗增加,性能功耗比反而降5%左右。8核16线程的机器承载虚拟机数量比同功耗8核8线程高出近40%;而在AI推理、HPC这类持续满载场景,双线程争抢缓存和执行单元,单线程性能反而掉20%-35%。这笔"场景分化"的账,才是整个反复横跳的底层逻辑。知乎

顺便看看全行业对SMT的态度,根本不是铁板一块:AMD全系标配SMT2但建议HPC负载按需关闭;海光直接上SMT4,一核四线程;IBM POWER玩到SMT8。ARM Neoverse坚决不做,理由是单核独享资源、性能可预测;华为鲲鹏920不支持、950之后又支持了SMT2;英伟达Vera CPU甚至在ARM上自研"空间多线程"。超线程从来不是"先进/落后"的问题,是目标市场和设计哲学的问题。知乎

五、这对你的装机单意味着什么

服务器神仙打架,但有三条线会顺着技术下放链条摸到消费端:

第一,你手里的14代酷睿,是英特尔桌面端最后一代有超线程的CPU。Arrow Lake、Lunar Lake、Panther Lake已经接连放弃HT,按流出的路线图,2026年底首发的Nova Lake和之后的Razor Lake依旧没有超线程,要到2029年的Hammer Lake才重启HT、并转向纯大核设计(注意:这是路线爆料口径,非官方承诺)。也就是说,想买带HT的新英特尔桌面平台,账面上要等三年。知乎今日头条

第二,接口终于不折腾了。同样是爆料口径:LGA1954接口将通吃Nova Lake→Razor Lake→Hammer Lake三代,横跨2026年底到2029年,一块900系主板三年里可以只换U不换板。这是照着AMD AM5的作业抄的,对等等党是实打实的利好,对现在纠结要不要上LGA1851的人则是个明确的观察信号。今日头条

第三,超线程值多少钱,按用途算账。结合官方数据和社区实测的共识大致是:打游戏,HT收益个位数,物理核心和单核频率才是大头,为HT加钱不值;虚拟机、多开、渲染、编译这类吞吐型负载,线程数就是硬通货,HT的30%提升是实打实的;延迟敏感的计算密集场景,关HT反而更稳——B站上关超线程跑CS2的测试视频一直有人在做。落到当下:主力打游戏,Arrow Lake的K系或者对面X3D都行,别为HT纠结;生产力多开,14700K/14900K这种末代HT处理器在涨价潮里的性价比反而凸显;什么都想等的,记住2026年两家桌面都没有新品,等Nova Lake首发看定价,Hammer Lake的HT回归当远期期权看,别当承诺。哔哩哔哩

六、接下来盯什么

给持续关注这条线的人留四个观察点:

  1. 今年Q3-Q4,AMD Venice上市:看它提不提交SPEC、第三方实测线程优势能不能兑现成份额——AMD预计今年数据中心CPU收入份额超50%,这是它最后的窗口证据。太平洋科技

  2. 2027年年中,Diamond Rapids能不能准时:它的目标上市窗口就在2027年年中,盯Foveros 3D Direct封装良率,Clearwater Forest跳票一年就是预警。知乎

  3. 2026年底,Nova Lake首发:LGA1954三代兼容是否官宣坐实,没有HT的新架构游戏性能能否翻身。

  4. 2028年,Coral Rapids:超线程回归成色如何,以及届时消费端Hammer Lake的HT+纯大核爆料有没有变成正式路线图。

256核却只有256线程:英特尔亲手砍掉自己发明的超线程,陈立武认错、2028年又请回来——AMD的512线程对台、E核战略的败局旧账和消费端要等到2029年的账全对完,谁该守住14代酷睿、谁该转投对面、谁该躺平等,说清楚了

一句话收尾:英特尔用两代服务器产品的代价验证了一个道理——理论上更优的架构创新,市场不一定买账;而被它自己宣判"过时"的超线程,绕了一圈又要回来了。技术史上很少有真正的死刑,多数只是缓期执行。你机器里那颗带HT的CPU,且用且珍惜。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章