国产超节点WAIC密集集结成绝对焦点,华为昇腾950领衔
“遥遥领先”这个词,在今年的算力展馆里有了新的含义——不是单卡跑分遥遥领先,而是1024张卡协同工作的能力遥遥领先。
单卡已成旧日歌,集群时代势如河。华为领衔超节点,算力江湖起战戈。
走进2026世界人工智能大会H2算力主题展区,一整排像墙一样的黑色机柜立即映入眼帘。
这是华为首次线下展示的昇腾950超节点真机,1024张NPU卡高速互联,像一台计算机一样工作,能够提供1 EFLOPS FP8、2 EFLOPS FP4的澎湃算力。它斩获了大会SAIL最高奖。

展馆里几乎所有算力厂商,都推出了卡数各异的超节点产品——中科曙光展示了全国产十万卡AI超集群曙光8000(登峰)、中兴通讯发布了OEX超节点、沐曦股份展示了曦景S600超节点。
从单卡的性能比拼到超节点系统的整体较量,国产算力正经历一场深刻的竞争范式转移。
◇ 其一 超节点是什么?为什么成为焦点?
超节点并不是简单地把芯片塞进机柜。其核心思路是放大纵向扩展范围,将更多GPU通过高带宽、低时延的互联方式紧密耦合,使它们如同一台超级计算机那样协同高效工作。
壁仞科技AI框架架构副总裁丁云帆告诉记者,AI的发展正面临“超大参数、超长文本、超大集群”三大核心挑战,仅凭单张GPU的算力,已无法独立应对。
华为展台工作人员透露,昇腾384超节点已商用落地750多套,是国内唯一训练出SOTA模型的超节点。国产大规模算力集群已跨越了“技术可行”到“商业可用”的鸿沟。
从单兵作战到集团军,算力竞争的维度,升维了。
❝ 说人话就是:以前比谁能做出最强的单张卡,现在比谁能把最多张卡连在一起、高效协同。从“单兵作战”到“集团军”,算力竞争的维度升级了。
◇ 其二 算力供不应求,超节点是必然答案
“算力处于供不应求状态,整个人工智能的产业规模比互联网产业规模要大得多。”摩尔线程高级副总裁董龙飞在接受采访时说,“人工智能时代才刚刚开始,我们投入打造的算力底座,实际上是为未来十年、二十年搭建的新型数字基础设施。
就像当年大规模建铁路、高速公路一样,水泥等基建材料肯定供不应求,因为需求太大了。”
他进一步解释,模型参数从千亿奔向数万亿,Agent应用将上下文窗口从256K推至1M甚至更高,推理和训练任务动辄横跨成百上千甚至上万张卡。
超节点解决的正是让这些卡能更高效、更稳定地分工协作的问题。“这好比是一个交响乐队,256张卡就像256个乐手,每一个乐手自己都拉得很好。当整个乐队要合奏一首曲子时,大家就需要协同,这里蕴含着挑战。”
◇ 其三 系统级大考:不只是技术问题
超节点面临的挑战是全方位的。
首先是通信瓶颈。超节点内GPU间需要高速交换设备互联,壁仞科技自研的BLinkTM2.0超节点互联协议,目标就是实现“时延—带宽—可靠”端到端系统级协同。
其次是物理工程。董龙飞介绍,超节点的功耗非常大,一个超节点可能要达到400KW,一台高密度机柜就能达到48KW,而两三年前国内的普通机柜仅6KW。供电、散热、承重、布线,每一项都是考验。

更棘手的还有可靠性与运维。一个超节点价值动辄超亿元,涉及数百甚至上千张芯片运行。
沐曦股份联合创始人彭莉表示,厂商需要监控每张芯片的工作状态,在通信异常后保存故障现场、恢复任务,“它更多考验的是系统化的能力。”
◇ 写在最后
从单卡到集群,从芯片到系统——国产算力正在经历一次深刻的竞争维度升级。
当昇腾384已商用落地750多套,当华为、中科曙光、中兴、沐曦、百度纷纷亮出超节点方案,2026年或许正在成为国产超节点的放量元年。

谁能把最多张卡连在一起、跑得最稳、时延最低、功耗最优——谁就能在下半场的算力竞赛中占据先机。
一张卡不够就上一千张,一堵墙不够就上一整排。
超节点一个比一个大,算力越堆越像盖楼。
问题是电费谁买单?
来聊聊
算力像水电一样成为基础设施后,你最想用它来做什么?评论区聊聊。
【免责声明】:本文部分配图源自公开渠道或CC0协议素材,仅作行业交流与产业参考使用。如涉侵权,请联系后台处理。本文仅做行业科普与实操分享,不构成任何投资、消费决策建议。文中数据及案例均来自公开信源,仅供参考,具体以实际为准。
#国产算力# #超节点# #华为昇腾# #AI芯片# #WAIC2026怎么看#
