国产超节点已反超英伟达:大模型训练成本直降40%,但三类用户千万别碰

源自125位全网作者

05-17 15:45

内容由AI生成

精选参考来源

1. 每天140万亿算力消耗到底藏着什么机会?这场大会可能有答案#移动云智能新空间

2. #美团内测万亿级新一代大模型# LongCat-2.0参数量跻身全球顶尖,国产算力集群完成训练🤖4月24日,美团新一代基础大模型LongCat-2.0-Preview正式开放测试,总参数规模突破万亿,支持1M上下文窗口,可单次处理数百万字输入,量级与DeepSeek V4、GPT-5.5相当。新模型面向Agent场景深度优化,适配代码生成、复杂任务规划及企业自动化等生产场景。更关键的是,训练推理全程依托国产算力集群完成,动用约5-6万张算力卡,创国产算力最大规模大模型训练纪录。【评论】王兴“进攻AI”的承诺正在兑现。5-6万张国产算力卡的训练规模与技术突破,验证了国产算力生态的成熟度,王兴“把美团App升级为AI-Powered App”的目标,正从口号走向现实。万亿参数的LongCat若全面接入美团本地生活场景,或将重新定义“吃喝玩乐”的搜索与推荐逻辑——AI Agent的终局,在美团这里可能是“替你点外卖、帮你订酒店”。

3. #运营商##AI# 通信国产队真金白银出手,全力支持华为算力生态!近日,中国移动2026-2027年人工智能超节点设备集中采购项目完成开标,五家企业成功入围中标名单:河南昆仑技术、长江计算、华鲲振宇、宝德计算机和华启智慧。采购规模为6208张AI加速卡,折合776套计算节点设备,总金额约20.6亿元。值得关注的是,此次采购明确指定采用华为CANN生态方案,这是三大运营商在集团层面首次启动AI超节点设备集采,标志着运营商算力建设正式从"通用服务器堆叠"向"高性能超节点架构"战略转型,国产AI算力生态在大规模基础设施建设中实现重大突破。这是中国移动AI算力升级的里程碑事件,首次在集团层面整体部署AI超节点设备,明确选择国产华为CANN生态,对整个国产AI算力产业链具有强信号意义。该集采落地将加快移动云AI化转型,并推动国产AI生态在运营商市场的规模化渗透。

4. 【解说|AI芯片、服务器厂商纷纷推出的超节点为何重要?】超节点正迅速成为国产算力厂商的新卖点。2025年下半年以来,中国AI芯片厂商、服务器厂商和云服务商密集发布超节点相关产品或规划,节点规模不断被刷新。网页链接  所谓超节点(Scale-up),是指在一台服务器内部集成大量GPU或AI芯片,通过高速互联形成一个超级计算节点,也被称为纵向扩展;与之相对的是横向扩展(Scale-out),即通过多台服务器组成算力集群。由于芯片位于同一物理节点内,超节点可以显著降低通信延迟和能耗,在特定场景下具备更高的效率优势。

5. 黄仁勋最怕中国AI的事 DeepSeek刚刚做到了 黄仁勋最害怕事还是发生了:DeepSeek V4发布,华为昇腾超节点深度适配,全球AI圈等待已久的大事落定,聊一聊背后的三大核心真相 #ai #deepseek v4 #deepseek #黄仁勋 #梁文锋

6. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?

7. 全国首个!超3万卡国产AI算力上线,喂饱万亿参数大模型

8. 核心AI场景首超英伟达,一场国产算力的“破局叙事”|甲子光年

9. 【华为海外首发新一代算力底座:为世界提供新选择】#华为算力海外首次亮相# 当地时间3月2日,在世界移动通信大会(MWC26)期间,华为计算产品线总裁张熙伟首次在海外发布最新的Atlas950 SuperPoD,TaiShan 950 SuperPoD等多个型号超节点产品及解决方案。当前,人工智能加速发展,已从Generative AI时代演进至Agentic AI时代。万亿级模型参数和10万亿级数据训练成为标配,对算力需求提升十倍到百倍。模型支持的上下文序列长度从K级提升到M级,对算力规模和时延也提出了更高的要求。华为本次发布的计算产品及解决方案,包括Atlas 950 SuperPoD智算超节点、Atlas 850E 超节点服务器,以及业界首款通用计算超节点TaiShan 950 SuperPoD,和TaiShan 500、TaiShan 200等系列化产品。观察者网从现场了解到,基于新型互联协议“灵衢”打造的Atlas 950 SuperPoD智算超节点,以单柜64卡为基本单元,最大可支持8192张NPU卡高速互联,在算力规模、互联带宽等指标上领先英伟达,相比传统集群,大模型训练效率、可靠性与推理性能均大幅提升。Atlas 850E超节点服务器能够适配现有风冷机房,支持从8到1024卡的灵活扩展和快速部署,支撑运营商从小规模推理到集群推理的分阶段业务升级。“华为通过创新引领,打造开源开放的坚实算力底座,为世界提供新的选择。”张熙伟表示,华为Atlas 950 SuperPoD超节点,基于灵衢互联创新,支持上千个计算节点像一台计算机一样工作。同时,华为坚持全面开源开放,支持业界主流开源社区和项目,匹配开发者习惯,让开发者深度挖掘算力潜能,加速AI创新。在通用计算领域,TaiShan 950 SuperPoD是业界首创的通算超节点,支持百纳秒级超低时延、TB 级超大带宽、内存池化等能力,通过内存语义通信,可实现跨节点数据以读写方式高效传输,从根本上解决通算场景时延高、数据搬移开销大、协同效率低的难题。华为同时推出了TaiShan200和TaiShan500系列产品,覆盖高中低算力场景,通过和openEuler开源操作系统、BoostKit应用使能套件协同,满足运营商不同业务需求。华为轮值董事长徐直军曾表示,TaiShan 950加上分布式GaussDB数据库,能帮助金融系统破解核心难题,彻底取代各种应用场景的大型机和小型机以及Oracle的Exadata数据库服务器。软件生态方面,华为持续贡献openEuler开源操作系统,全面开源开放CANN异构计算架构,通过分层解耦,已经将算子库、加速库、图计算、编程语言等软件代码全量开源。北向支持PyTorch、vLLM、SGLang、xLLM、VeRL、Triton、TileLang等业界开源社区和开源项目,大幅提升开发者易用性。

10. 本次华为发布的计算产品及解决方案,包括Atlas 950 SuperPoD智算超节点、Atlas 850E 超节点服务器,以及业界首款通用计算超节点TaiShan 950 SuperPoD,和TaiShan 500、TaiShan 200等系列化产品,匹配运营商的多样化算力需求,为各行业AI智能化升级注入新动能。基于灵衢打造的Atlas 950 SuperPoD智算超节点,以单柜64卡为基本单元,最大可支持8192张NPU卡高速互联,为超大规模AI训练与海量推理并发场景提供最优选择。相比传统集群,大模型训练效率、可靠性与推理性能均大幅提升。Atlas 850E超节点服务器能够适配现有风冷机房,支持从8到1024卡的灵活扩展和快速部署,支撑运营商从小规模推理到集群推理的分阶段业务升级,实现应用快速上线。在通用计算领域,业界首创TaiShan 950 SuperPoD通算超节点,为通用计算性能突破开辟全新路径。支持百纳秒级超低时延、TB级超大带宽、内存池化等能力,通过内存语义通信,可实现跨节点数据以读写方式高效传输,从根本上解决通算场景时延高、数据搬移开销大、协同效率低的难题。华为同时推出了TaiShan200和TaiShan500系列通算产品,覆盖高中低算力场景,通过和openEuler开源操作系统、BoostKit应用使能套件协同,满足运营商不同业务需求。华为坚持全面开源开放,加速开发者创新,推动计算产业生态繁荣。持续贡献openEuler开源操作系统,openEuler已经成为全球开源操作系统社区领军先锋。华为全面开源开放CANN异构计算架构,通过分层解耦,已经将算子库、加速库、图计算、编程语言等软件代码全量开源,支持开发者按需使用,加速自主创新。北向支持PyTorch、vLLM、SGLang、xLLM、VeRL、Triton、TileLang等业界开源社区和开源项目,大幅提升开发者易用性。智能化的浪潮席卷而来,华为将继续与客户、伙伴和开发者紧密合作,共同打造坚实的算力底座,加速千行万业智能化升级,为全球算力发展提供新选择。

11. 最让英伟达害怕的,是华为的这个大家伙!昇腾384超节点,是华为打造的超大算力集群,单节点集成384颗昇腾NPU与192颗鲲鹏CPU,由12个计算柜和4个总线柜组成。它打破传统冯诺依曼架构,采用对等计算架构,凭借高速总线互联,通信带宽较传统方案提升15倍,单跳时延降至200纳秒,大幅突破算力互联瓶颈 。 其稠密算力达300PFLOPs,千亿大模型训练性能较传统集群提升2.5倍以上,MoE模型性能提升可达3倍。该超节点可灵活扩展为数万卡规模集群,支持训推共池、错峰调度,算力利用率更高,能高效支撑超大规模AI模型训练与推理,是国产高端算力的核心标杆方案 。#第九届数字中国建设峰会# 通信老柳的微博视频

12. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?

13. 摩尔线程发布新一代GPU架构“花港”:能效提升10倍,支持十万卡以上智算集群

14. Open Claw这一波,直接把AI市场搅翻天了。 现在不光是模型厂、云端厂在疯狂输出,底层设施厂也杀疯了。国外NV、Meta玩命堆密度,国内更狠,直接从干到算力架构底层。 综合各方信息来看,超节点已经提前预定下一个“小龙虾”席位。 而第一个掀桌子的,来了。 中科曙光马上要发布的超节点产品,形态和架构都出人意料,走的是一条之前没人注意的方向。正式发售后,大概率会把超节点推向一个新维度。 好消息是:超节点不再是巨无霸厂商的专属游戏。 坏消息是:那些还停在PPT阶段的,情况不太妙。 话说回来,超节点为代表的高端算力,无论形态,能真正落地,才是关键。

15. 【#打赢AI算力规模战# 国产“高速路”填平“隐形门槛”】当AI大模型参数冲向万亿级,决定算力效率的已不只是单卡性能,集群网络的“高速互联”成了新战场!新华网最新报道,国产算力迎来关键突破——中科曙光推出首款全栈自研的400G原生RDMA高速网络scaleFabric。⚠️传统以太网难满足AI训练的低延迟、高吞吐需求,进口方案又贵又受限。在大规模训练中,网络通信耗时竟能占到50%-70%,成为算力释放的“隐形门槛”。⚡scaleFabric基于原生RDMA技术,实现端到端时延低于1微秒,从根本上避免数据丢包。它“即插即用”,大幅降低组网复杂度与成本。目前已在国家超算互联网核心节点支撑3万卡集群稳定运行,服务超万名用户,成本降低30%,并可平滑扩展至10万卡以上!在“智能经济”战略部署下,万卡集群已成滩头阵地。这项技术突破,为国产算力从万卡向十万卡自主扩展铺平了“高速路”,是打赢算力规模战的关键一环! #国产技术突破##AI算力##新质生产力#

16. DeepSeek最新论文新突破:彻底解决大模型训练稳定性难题

17. #华为发布AI新技术#算力效率革命来了!华为这波Flex:ai黑科技直接改写行业规则🚀 谁懂啊!现在AI算力资源利用率普遍才30%-40%,大量GPU/NPU都在“闲置摸鱼”,华为新发布的Flex:ai直接把算力利用率拉满——单卡能精准切分10%粒度的虚拟算力单元,一张卡同时跑多个任务,平均利用率直接提升30%,相同硬件投入下训练速度快一倍、成本降三成! 这波“软件补硬件”的突破太顶了,国产AI生态越来越能打!

18. 在AI算力需求持续爆发的当下,超节点已经成为突破算力瓶颈的核心解决方案,一个方案是否为真正的超节点,关键看是否同时具备大带宽、低时延和内存统一编址三大核心能力,具备了这三点,多个物理结算节点高速互联,才能“像一台计算机一样工作”:《“超节点”解构:三大核心能力齐聚,才能“像一台计算机一样工作”》 “超节点”解构:三大核心能力齐聚,才能“像一台计算机一样工作”

19. OFC 2026前瞻:硅光子与CPO如何重塑下一代AI互联体系

20. #国产开源大模型下载量破100亿次# 国产开源大模型的走出去的底气都在这里:我过超大规模市场和完整产业链。10 亿 + 互联网用户、海量场景,让 AI 技术能快速落地验证,迭代速度远超海外。政策持续扶持,算力基建跟上,国产算力集群规模全球领先,成本还低,推理成本差不多只有美国的 1/16。再AI安全合规方面,国产大模型更是走在了美国的巨头的前头,本土算力与安全工具链完善,企业能快速搭建合规体系,无需像海外企业那样承担巨额合规支出。

21. 数据底座“二次转型”代价怎么避免?AI原生时代的内核能力模型与实战案例

22. 昇腾超节点很强,黑科技满满,不是所有技术或者产品都称得上是超节点,必须具备“超大带宽、超低时延、内存统一编址”三要素,说白了,就是让集群像一台计算机一样工作。昇腾384超节点已规模服务于互联网、金融、能源等行业,销售超550套。超节点关键的灵衢2.0协议也全面开放,让产业都可以打造超节点。#超节点#

23. 这么大,那么猛,超节点到底中用不中用?

24. 超节点的生存法则

25. Token经济时代,超节点如何重塑AI算力供给?

26. 2026年,华为正在引领“超节点”

27. 大模型的光刻机+行业业绩井喷!超节点概念异军突起

28. 液冷服务器(2) 2026年投资策略

29. 算力重构者

30. AI算力大变局

31. 2025年超节点发展报告-华为&中国信通院(附下载)

32. 业界首个通算超节点产品,华为TaiShan 950 SuperPoD值得关注!

33. 全国最大国产AI算力资源池,上线点亮

34. AI竞赛下半场,国产大模型与国产算力开始合流

35. 国产算力加速崛起

36. AI算力军备赛打响!中国最大国产AI算力池来了

37. DeepSeek V4 跑通国产AI产业链闭环,国产算力有望接棒海外算力,迎来2026算力基建大爆发

38. 用功率换算力,华为推出超节点,这个路子打破了美国封锁,走对了

39. 超节点

40. AI算力集群五大超节点技术深度对比

41. 上海人工智能实验室重磅发布《超节点技术体系白皮书》

42. 盘点超节点 | 技术崛起与生态竞逐交织,智算进入系统级竞争时代

43. 何为超节点?内存统一编址是支撑超节点实践落地的必备能力

44. 国产超节点技术突破,以太网成 AI 算力 Scale Up 核心路径

45. 国诚投顾

46. 国产超节点爆发元年

47. 2026算力决战

48. 华为超节点

49. 告别“算力作坊”,中国AI究竟需要什么样的超节点?

50. AI超节点互联技术发展思考(2026)

51. 超节点竞赛

52. 超节点重构算力,是芯片堆叠?还是协同互联

53. 炸裂!被卡脖子的华为,凭什么在超节点技术上,比英伟达走得更远?

54. 深度拆解超节点

55. 国产算力超节点重构AI基础设施

56. 超节点,来了!8家公司浮出水面

57. 国产芯片产业链多路进击

58. Rubin nvl72 VS 华为384 VS 中科曙光超节点 全面对比解析!

59. 智赋算力 领航AI——上海人工智能实验室发布《超节点技术体系白皮书》

60. 液冷、超节点、算电协同

61. 爆发在即!超节点重塑国产算力格局,产业链核心标的全梳理

62. 国产算力

63. DeepSeek-V4与国产超节点元年

64. AI框架迈入超节点时代 国产技术加快产业落地

65. 国家队坚定重仓!CPO+算力热门公司再梳理

66. 深度解析中国移动AI超节点集采

67. 国金证券

68. 简单聊聊:超节点和集群的本质区别

69. 华为打造“最强超节点”,这项全球领先技术很关键

70. 超节点互连技术落地,国产万卡超集群首次真机亮相

71. 超节点时代,连接器凭什么是核心?

72. 以太网锁定国产超节点算力互联主流

73. 简单说说算力网络:超节点的互联技术路线

74. 全网都在聊的超节点,到底强在哪?

75. 科普:超节点是什么意思?

76. 国产“大算力+大模型”加速对接,撬动AI计算万亿市场版图

77. 2026超节点报告:光、液冷、供电、芯片全面升级

78. 超节点算力革命一)| 超节点如何重构AI基础设施

79. 2026 算力新赛道:超节点发展逻辑、拐点周期、A 股细分产业链

80. 超节点架构产业链前瞻上

81. MWC2026观察:通用算力开始进入“超节点时代”

82. 超节点突破不断,5个算力方向可以关注(附列表)

83. 算力超节点三驾马车:算力芯片·交换芯片·光模块全景投资图谱

84. 2026年通信行业深度报告:超节点,光、液冷、供电、芯片的全面升级(附下载)

85. 【电子*陈海进】深度:超节点系列报告一:国产超节点方案量产元年,看好以太网成为主流技术路径

86. 深入浅出的谈谈什么是超节点

87. 一周趋势|算力“超节点”重构AI底座、脑机接口开启“大脑装修”

88. 超节点将成为算力主流形态!拆解各细分环节价值及核心公司名单!

89. 别再盲目堆卡了!企业AI算力,这种超节点才是刚需

90. 摩尔线程+中国移动研究院:发布《OISA高密超节点参考设计技术规范》

91. 超节点:算力集群的“超级大脑”

92. 国产AI算力再加速

93. 寒武纪新机遇:超节点技术加速AI芯片国产替代

94. 国产算力建设提速,超节点驱动网络侧高速成长

95. 超节点爆发元年!从“万卡训练”到“毫秒推理”,2026算力新主线

96. 算力市场逻辑突变!当超节点“游标卡尺”拨到40...

97. 超节点崛起:算力基建的“核聚变”革命,相关核心龙头梳理

98. 2026年中兴通讯超节点白皮书

99. 用大白话解释一下,什么是“超节点”?它和普通AI服务器集群,核心区别是什么?

100. 【研究笔记】超节点概述

101. 超节点破局 国产算力开启“双轨并行”多元时代

102. AI框架迈入“超节点时代”,昇思下载量超1300万

103. 全球首款无线缆箱式超节点,落地中国!

104. 超节点选型:跳出性能迷局,聚焦稳定与落地价值

105. 中科曙光(603019):6万卡集群落地!超节点整机交付为什么先看它?

106. 超节点超级周期,产业链全梳理及核心上市公司(转发留存)

107. 国产操作系统布局算力超节点时代

108. 超算互联网核心节点启用,“国家算力枢纽”的升维之路

109. 超节点行业全解析

110. DS V4国产算力里程碑:AI算力产业链国产化投资机会梳理

111. 超节点概念行业相关核心公司梳理

112. 超节点:光、液冷、供电、芯片的全面升级

113. 超节点亲和AI框架

114. 国产超节点液冷方案分享

115. 2026年电子行业深度报告:超节点系列报告一,国产超节点方案量产元年(附下载)

116. 超节点报告:AI设施迈入超节点时代

117. 邮储银行 × 华为:超节点赋能金融新型算力底座建设实践

118. 盛科通信:超节点交换芯片国产替代,DeepSeek-V4带宽需求的核心受益者

119. 国产AI超节点崛起,PC集群迭代升级,中国算力开启新征程

120. 超节点技术100个核心知识点(收藏版)

121. 国产算力全面突破,AI应用即将爆发 | 投研报告

122. GB200 NVL72超节点深度解析:架构、生态与产业格局

123. 特斯联发布异构超节点T-Cluster 512:互联带宽实现8倍提升

124. 超节点:光、液冷、供电、芯片

125. 昇腾MindCluster:超节点亲和调度算法实践

0
扫一下,分享更方便,购买更轻松
1评论

  • 精彩
  • 最新
  • 这个看着不错

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章