两则新闻在同一周末撞车。10月2日,英伟达股价盘中突破今年5月的高点、刷新历史新高,市值重返5.7万亿美元。一天后,10月3日,在华为全联接大会期间,徐直军给了另一组数字:昇腾 AI 芯片在中国市场的份额已达 50%,超过英伟达的 8%;2022 年的格局几乎相反,英伟达占 95%、昇腾仅占 3%。这不是媒体的转述加工,是华为轮值董事长本人在大会期间亲口给的口径。信息流当场劈成两半:一半在刷"NVIDIA 无敌",一半在喊"英伟达被超了"。界面新闻知乎微博
这篇内容服务的是盯着英伟达动向的人——持股的、用他家卡和 API 的、以及一边等显卡一边也在看国产算力叙事的中度关注者。不劝你嗨,也不泼冷水,把下面这三本账对完,你自己就有结论。
华为敢报这份份额的底气在硬件现场长什么样?先看这张图:博主在华为全联接大会展馆拍的 Atlas 950 SuperPod 节点,机柜成排、灯光压暗。小红书

账一:份额数字量的是什么
先把数字的性质钉死:50% 对 8% 是华为口径,徐直军自己也说英伟达的数据很难收集;统计的是中国 AI 加速器的出货份额,不是经第三方审计的营收数字。知乎
第三方口径还没走到这么极端,但方向一致:IDC统计显示,中国云端AI加速器市场全年交付约400万片,其中国产厂商交付165万片,份额跃升至41%,英伟达降至55%,华为昇腾以约81万片领跑国产阵营。知乎
TrendForce 复盘的轨迹更直观:2024年国产AI芯片整体占比约30%,2025年跃升至41%,2026年上半年高端AI芯片出货量同比增长83%。知乎
因果链也得如实讲:不是英伟达的产品在中国输给了昇腾,而是连续几轮出口管制把 A100、H800 一路管到"中国特供"的 H20 都禁运,中国客户用国产卡,买的第一属性是"供得上",不是"跑得更快"。
【判断】这个数字的真正含义是:国产算力已经从备选项变成中国采购清单上的主选项;它不能说明的,是英伟达这家公司输了——同一周它市值还在创新高,那是全球市场投的票。
账二:超了什么,没超什么
超的是"把大机器拼起来"的能力,单芯片这一行还有代差:流传的分析师判断是,昇腾950单芯片约追平英伟达三年前的H100,但和最新Blackwell仍差一代。先进制程受限,徐直军没有回避,华为的解法是把大量芯片互连组成大型计算机。微博
于是大会给出的答案是系统层:华为在本届大会发布 Peerium 计算架构与 UnifiedBus(灵衢总线)技术,一个拥有 25.6 万张计算卡的 SuperCluster 正在部署和测试中;基于昇腾 950DT 的超节点大规模供应预计今年年底或明年年初启动。知乎

回到开头那张现场图:展板上写着 1024 卡、256TB 统一内存编址、3 微秒 RTT 时延——这就是"用系统换单卡"的实物注脚。
没超的是生态。英伟达最厚的护城河从来不只是芯片,是 2006 年上线的 CUDA 和围着它长了几年的 cuDNN、NCCL、教程、踩坑经验和人才池;路透社复盘说得很直接:真正难替代的,不只是芯片,还有整套开发生态。已经有海外博主做了实测,把训练任务从英伟达卡搬到昇腾——能跑,但不轻松。哔哩哔哩哔哩哔哩
【判断】追单卡参数党可以确认:差距还在,一代没抹平;追"买得到、供得上、不被断"这条账的人,这确实是一场四年走完的逆转。
账三:本周真正的增量,是那六个开源库
国产算力这几年被念最多的短板,从来不是参数表,而是"没人敢往上迁"。9月30日,DeepSeek 一次性开源了面向华为昇腾平台的六大基础设施组件:TileLang、DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect。翻译成人话:分块计算 DSL、矩阵乘 kernel、跨卡通信、注意力 kernel——CUDA 生态里英伟达必须提供的每一层"锅碗瓢盆",都配上了昇腾版,而且是 V4 训练真实用过的栈,不是 demo。知乎

性能侧,开源材料里给出了 TileLang 昇腾 950 后端编译架构:写算子回到"描述算什么"的层面,线程排布、数据搬运交给编译器,产物直接落到 950 NPU。
而同一份材料里的基准图显示,TileLang 栈落到 950DT 后,在 GEMM、FP8 cast、GQA 三组测试中都压过了原有 Torch NPU 路径,FP8 cast 带宽那组是 2316 GB/s 对 402 GB/s。注意这是项目方自家口径的一张图,别单看柱状图就上头——但至少说明:这套栈是用来干活的,不是摆着看的。知乎

反证也得摆出来:仓库开源几天,Huawei 之外的团队有多少真拿它跑过一轮完整训练,还剩多少坑,没人统计;社区说的"全面适配",多是基于开源动作的合理外推,双方都没有就此单独召开发布会。
【判断】想跟踪"去英伟达化"这条线,盯这六个库的社区二次开发和真实上跑量,比盯热搜情绪准得多。
这四条线,跟谁有关
英伟达持股党:中国敞口已经被出口管制挤到边上,这轮新闻偏象征意义;真正影响盈亏的还是全球 AI capex 和财报数字。继续观察的只有一个信号:下一份财报是否单列中国区收入、还剩多少。别拿"国产份额反超"当交易依据。
准备自建训练/推理的人:可选项从 0 变成 1,但生态迁移成本要单独列预算——推理集群、垂直微调先试,前沿模型训练整迁不要。想吃昇腾超节点的红利,把交付时间当真:华为口径是今年年底到明年年初才开始大规模供应,现在下单谈不上海量产能。
装机党和持卡玩家:完全两本账。数据中心份额翻转不会动你的显卡价格,能动的还是内存报价和整卡价格曲线。
替国产算力嗨的:先别急着全面庆祝,等两样东西——第三方审计口径的份额数据,和这六个库被外部团队规模化用起来。
收尾
这周最值得记住的,不是"谁超了谁"——份额那笔账,出口管制早就写好了剧本——而是一家中国头部大模型公司,第一次把生产级训练用过的国产芯片底层软件栈摊开来公开。份额翻转是结果,六个开源库才是原因。英伟达真正该盯的也不是中国剩下的那 8%,而是管制圈之外,"不用英伟达"这条路有没有人继续往下修。
三本账对到哪本了?你觉得还缺哪一本,评论区拍。