DeepSeek砸25.6亿刀订16万颗华为芯片,国产算力这次真要起量了?
➡️ DeepSeek25.6 亿美元采购 16 万颗华为昇腾 950DT,美团五万卡训万亿模型,深圳万卡集群点亮,智谱吉瓦数据中心运营。本文拆解国产算力从试点到规模化的临界点,看清芯片参数、集群规模与生态差距。

文|捉驿 • 栏目|数字视线
十六万颗芯片,这笔订单砸下来的时候,整个圈子都震了一下。
彭博社 9 月 4 日曝出的消息很短:DeepSeek 要在内蒙古乌兰察布建一座吉瓦级数据中心,一口气部署至少 16 万颗华为下一代昇腾 950DT,全用来跑推理。
据媒体测算,订单总额约 25.6 亿美元,全部交付得一年以上。

但这事儿的分量,远不止一笔采购。美团刚用五万张国产卡训出了万亿模型,深圳点亮了一万四千 P 全栈国产集群,智谱的吉瓦数据中心也在运转。
头部玩家齐刷刷把筹码压到国产算力上,你说这是巧合?我不信。
十六万芯铺开算力新格局,千亿订单验证国产真功夫。
看完这三章,你再跟朋友聊国产芯片,就不只是说 "还不行" 了。
◆ 十六万颗芯片背后的账本
25.6 亿美元是什么概念?按单颗约 1.6 万美元估算,16 万颗刚好对得上。但这笔钱买的不只是芯片,是一整套算力基础设施。项目规划功率吉瓦级,16 万颗只占一部分容量。
DeepSeek 还跟华为联合定义昇腾超节点,专门优化长文本推理的时延和吞吐,往万卡级集群扩展。
为什么选乌兰察布?
东数西算八大枢纽之一,年均气温 4.3℃,天然降温凉库。新建数据中心绿电占比超 86%,全市投运算力 17.2 万 P,占全国 8.7%。
冷凉气候加便宜绿电,每一度电的算力成本都更低。
还有一笔账更实在。DeepSeek 官网上 V4 Pro 缓存命中输入才 0.025 元每百万 token,但官方自己说了,受限于高端算力,Pro 吞吐十分有限,等下半年昇腾 950 超节点批量上市,Pro 价格会大幅下调。
说白了,这批华为芯片到货那天,就是 DeepSeek API 再降价那天。

这就像一家餐厅不再租别人的厨房,自己盖了座中央厨房。以前出餐慢、排队长,因为厨房是共用的。
现在灶台、烟道、传菜路线全按自己的菜单设计,速度和成本自己说了算。
◆ 不只是 DeepSeek,全行业都在换芯
DeepSeek 不是第一个吃螃蟹的。
今年 6 月,美团发了 LongCat-2.0,1.6 万亿参数,五万多张国产卡从零跑完预训练到推理全流程,业界头一份。
3 月,深圳 11000P 全栈国产智算集群点亮,加之前面投运的,合计 14000P。
7 月,智谱被曝建了座规划功率约 1 吉瓦的国产芯片数据中心。
从美团到智谱,从深圳到乌兰察布,国产算力正在从 "能用" 走到 "好用" 再走到 "规模化用"。
以前是个别企业试点,现在是头部玩家标配。
英伟达在中国市场的份额掉得很快,国产替代这个趋势,挡不住了。
行文至此,兴起,赋诗一首:万卡连横起塞北,千芯破局立新碑,曾经海外称雄处,今日中华奋起追。
◆ 950DT 到底什么水平
昇腾 950DT 什么水平?华为官方规划 2026 年第四季度推出,主打推理解码和训练。
单卡 144GB 内存,访问带宽 4TB/s,互联带宽 2TB/s。对比一下,英伟达 H100 是 80GB HBM3,带宽约 3.35TB/s。
显存容量上 950DT 已经反超,带宽也接近了。
基于它的 Atlas 950 超节点,最多支持 8192 张卡,FP8 算力 8EFLOPS,互联带宽 16PB/s。
徐直军的说法是,超节点物理上是多台机器,但用起来像一台计算机。
目前 950DT 已经提前到 8 月上了华为云,字节、阿里、腾讯的工程师都在测。

参数好看是一回事,生态是另一回事。
性能不够的时候痛苦于算力瓶颈,性能够了又头疼于软件生态。
从 CUDA 到 CANN,从算子适配到集群调度,国产算力要补的课还很多,但路已经在脚下了。
拐点已至,路在脚下
国产算力不再是实验室里的样品,而是数据中心里日夜运转的主力。
从能用、好用到规模化用,每一步都不容易,但方向已经清晰。
说到底,十六万颗芯片不是终点,是国产算力真正起跑的发令枪。
你觉得国产算力什么时候能真正追上英伟达?是明年还是还要三五年?评论区聊聊。
#国产ai芯片# #华为昇腾# #DeepSeek# #算力自主# #AI数据中心# #昇腾950DT# #国产替代# #科技产业观察#
【免责声明】 :本文部分配图源自公开渠道或CC0协议素材,仅作行业交流与产业参考使用。如涉侵权,请联系后台处理。本文仅做行业科普与实操分享,不构成任何投资、消费决策建议。文中数据及案例均来自公开信源,仅供参考,具体以实际为准。
