7月20日,一条视频在B站悄悄火了,标题是《TaiShan 950 SuperPoD,业界首个通算超节点》。近2万播放、140条评论,但热评区却在互相"纠偏":这个是传统超算,不是ai超算,大家别搞错了——这条评论拿了99个赞。哔哩哔哩有人跟着补充:也不算超算,是通用性更强的高性能计算服务器,真正的超算是前几天爆火的灵晟。
还有一条更直接:CPU需要这么高的带宽嘛?哔哩哔哩连最硬核的爱好者圈子,都没完全搞明白这件事。而再过三周多,9月17日到19日,华为年度大会 Huawei Connect(HC2026)就要在上海开了。微博按路线图,鲲鹏950将在今年四季度登场——这意味着答案的下一步可能很快到来。等开会之前,先把这件事给大家理清楚。
TaiShan 950 SuperPoD 到底是什么
先说结论:它既不是超算,也不是AI算力,而是华为去年9月HC2025上公布的"业界首个通算超节点"。
"超节点"的意思,是用高速互联协议(华为叫灵衢,UnifiedBus)把多台服务器连起来,让它们像一台逻辑机器一样工作。TaiShan 950 SuperPoD 的官方规格:基于鲲鹏950,最大16节点(32路处理器)、最大48TB内存,支持内存/SSD/DPU池化,节点间通信时延从传统TCP网络的毫秒级压缩到百纳秒级。知乎知乎"池化"是关键词:远端节点上的数据,可以像本地内存一样被读取,不用走繁琐的网络协议栈。这恰恰是最挑剔的通算场景最想要的东西。

已经有落地案例了。移动云宣布基于 TaiShan 950 SuperPoD 技术的新一代国产化通算ECS,给出的数字是:内存池化让虚拟化内存利用率提升10-20%,Spark实时场景提升20%,虚机热迁移50毫秒完成,量化交易场景的通信时延可以压到百纳秒级。知乎华为官方的目标也很明确:TaiShan 超节点 + GaussDB 数据库,直接对标IBM大型机和Oracle一体机的传统地盘。知乎能不能真的替代,需要行业验证,但这是华为今年每场发布会都在反复强调的方向。
CPU 为什么要"抱团"
B站评论里那个问题其实很有代表性:GPU训练要大带宽,是因为模型参数和梯度同步;CPU不是负责通用逻辑计算吗,要TB级互联带宽干什么?
答案是:通算超节点瞄准的场景,恰恰是对时延和并发最敏感的:
分布式数据库事务:一笔交易可能跨多个节点读写数据,传统架构靠TCP通信,一个来回就是几十微秒时延。内存池化之后,"读别人的数据"接近本地访问;
量化交易、电信核心计费:百纳秒级的时延差距直接对应真金白银;
这两年兴起的 AI Agent 代码沙箱:成千上万个沙箱并发开关,资源需要池化调度,E2B 和 Mooncake 已经在鲲鹏950超节点上做了深度集成测试。知乎
华为在今年的鲲鹏昇腾开发者大会(KADC2026)上给过一个公式:系统业务性能 = 超节点规格 × 单颗芯片规格。知乎当单芯片制程进步受限时,把筹码压在互联架构和系统工程上,是华为公开说出来的选择。
三种"超级",一次分清
社区里最容易混的,是三个都带"超"字的东西:
TaiShan 950 SuperPoD:通算超节点。鲲鹏950,最大16节点,48TB内存池化,路线图2027年一季度开售。今年3月初已在MWC 2026巴塞罗那海外首秀,5月的KADC2026也展出了真机。
Atlas 950 SuperPoD:AI算力超节点。昇腾950DT,最多8192颗卡互联成一整套系统,今年3月与泰山一起在MWC海外首秀,7月的WAIC上展出真机并拿下SAIL最高奖,路线图今年四季度开售。它是给大模型训练/推理用的,和泰山不是一个赛道。
灵晟:超级计算机。今年4月24日由国家超算深圳中心发布,约4.7万颗鲲鹏CPU,全国产。6月在汉堡ISC大会公布的TOP500榜单上,以2.19 EFlops的持续双精度性能登顶,时隔九年,自"神威·太湖之光"之后中国重回世界之巅。微博但它是国家级科学计算设施,不是能买到的商品。
一句话总结:灵晟是"证明"——全国产路线能造出世界最快超算;TaiShan 和 Atlas 是两款"产品",基于同一套灵衢互联,一个做通算,一个做AI算力。

鲲鹏950 本体呢
最重要的还是芯片本身。目前已确认的信息:
架构:华为首个支持同步多线程(SMT-2)的服务器CPU——灵犀核,双线程,两个版本:96核192线程 和 192核384线程,都支持通算超节点;
时间:HC2025路线图写的是2026年四季度。也就是说年内就能看到正式发布和具体产品形态;
生态位:媒体引述的IDC数据——2025年,鲲鹏生态在国内ARM服务器市场份额超两成,在自主创新算力领域的占比约七成。知乎
但也要泼点冷水:鲲鹏950的制程官方仍未公布,没有官方第三方基准测试,社区所谓"类似麒麟9030内核"的说法都是推测。单核性能到底什么水平,要等真机。
再往后看:鲲鹏960 与 ARM 下场造芯的变量
今年5月底,华为公布了名为"韬定律"的芯片设计方法论,同时披露了下一代鲲鹏960的部分规格:设计频率4GHz,较前代提升约54%,晶体管密度靠3D堆叠提升。微博路线图里,鲲鹏960将在2028年一季度登场,同样两个版本:高性能版(单核性能+50%,面向AI Host、数据库)和高密度版(≥256核,面向虚拟化、容器、数仓)。

同时,竞争环境也变了。今年3月,ARM自己下场造芯,发布首款自研服务器CPU(36核 Neoverse V3、台积电3nm)。知乎华为作为全球最大的ARM授权客户之一,面对的不只是国产替代的红利,还有授权方的直接竞争。这也是为什么"鲲鹏啥时候用自家指令集"会成为社区里反复出现的问题——但至少目前,华为官方的答案是继续深耕ARM。
HC2026 看什么
如果你也在关注这件事,建议把9月17-19日的这四个点锁定:
鲲鹏950是否正式发布,官方频率、性能、合作伙伴机型是否公开;
TaiShan 950 SuperPoD 的商业化落地进度(运营商、云厂商、数据库厂商是第一波);
灵衢互联协议的开放节奏——规格是否进一步公开、生态如何扩展;
鲲鹏960有没有新的披露。
对信创从业者,这决定下一轮设备更新的节奏;对开发者,灵衢/openEuler工具链的成熟度决定迁移成本;对普通爱好者——不用急着冲"概念股",鲲鹏950四季度才登场,TaiShan 超节点2027年才开售,先看产品落地,再谈其他。
鲲鹏今年的故事,已经从"单芯片追赶"变成了"整个系统的架构重定义"。三周后,上海见分晓。