今天「DeepSeek采购1.6万张昇腾950」的消息在微博上炸开了锅,热帖直接宣称这事「终于从传闻走到了官宣」。微博评论区最热的情绪高度一致:太好了,DeepSeek终于用上了国产算力,token降价是不是有戏了?
先泼一盆冷水:就在整整一周前,8月17日零点,DeepSeek的API全线涨价,个别计费项涨幅高达11倍,还第一次搞出了峰谷分时定价。「国产算力来了就会降价」这个预期,上周刚刚被打过一次脸。今天这篇,把这事掰开算清楚:为什么涨、该不该等降价。
先把今天这笔采购的事实和观点分开
这事其实有前情。7月的交流会上,梁文锋就说过拿到16000张昇腾950卡,「足够帮华为把生态跑通」。哔哩哔哩今天的微博热帖,等于是把这个信号又往前推了一步。
我把信息拆成了两堆,建议别混着看。
能被多信源交叉验证的部分:黄仁勋在CNBC采访中表态,英伟达已经「在很大程度上把中国AI芯片市场让给了华为」。钛媒体英伟达CFO也在财报电话会上确认,本季度及下一季度,中国区数据中心计算收入指引均为0,而去年同期这一收入达到46亿美元。摩根士丹利则预测,2026年华为将占据中国AI加速器市场62%的份额。同一时间,DeepSeek在推进首轮外部融资,资金重点投向国产算力芯片采购。「英伟达收缩、DeepSeek押注昇腾」这个大方向,可信度很高。
属于博主个人测算的部分:「1.6万张昇腾950等效算力只相当于4000张英伟达B系列芯片」「英伟达中国市场份额将从40%跌到8%」,这些是发帖人自己的推算和观点,不是官方数据。微博逻辑可以参考,别当成事实转发。
四月的「降价预期」,答案是反的
今年4月DeepSeek-V4发布并宣布支持昇腾950时,社区里曾经流行一个判断:等下半年昇腾950超节点批量上市,DeepSeek的价格会大幅下调。知乎上甚至有问题专门追问「这个预计还算数吗」,浏览量超过42万。知乎答案上周揭晓,是反的。8月13日,DeepSeek宣布V4-Pro正式版上线,同时宣布调整API价格;8月17日零点生效:V4-Pro缓存命中输入从每百万tokens 0.025元涨到0.30元,涨幅1100%。知乎输出从6元涨到高峰时段每百万tokens 27元,涨幅约350%。知乎这次调价还首次引入峰谷计价:每天9:00-12:00、14:00-18:00算高峰、全价,其余时段半价。

社区反应很直接。知乎上「这是在劝退用户吗」之类的问题热度一路走高,开发者骂「说好的价格屠夫呢」,还有人统计第三方平台的套餐,DeepSeek模型的调用次数直接从6万次掉到3千多次。知乎
买了国产芯片,为什么反而涨价?看三层
第一层,峰谷定价不是「闲时打折」,是「高峰加价」。产能如果过剩,没人会费劲做分时计费——需要用价格把人往闲时赶,恰恰说明白天的算力真的不够分了。
第二层,涨得最狠的项目最耐人寻味。缓存命中输入涨了1100%——缓存命中意味着服务器已经算过一次,边际成本几乎为零。把「几乎零成本」的项目涨11倍,有分析认为这不是「成本扛不住了」的被动涨价,而是「价值定价」:开始按你获得的价值收费。而且这不是DeepSeek一家的动作。摩根士丹利8月9日的研报显示,2026年Q2中国大模型平均API输入价格涨到每百万Token 4.9元、输出21.9元,比去年Q1分别涨了48%和80%。知乎智谱年内三次提价,Kimi K3的涨幅也有数倍。烧钱换市场的价格战阶段,是真的结束了。

第三层,算力账没有「芯片便宜=token便宜」这么简单。知乎上一个高赞回答说得很透:算力其实是最不值钱的,真正影响AI模型性能的是显存带宽和显存容量。知乎连黄仁勋自己都承认,GPU高达六至七成的时间在等待数据。推理的真正瓶颈在存储,不在峰值算力。
昇腾950恰恰是冲着这里去的:自研HBM方案最大144GB、带宽4TB/s,片间互联2TB/s,比910C快2.5倍。哔哩哔哩但这些要等四季度Atlas 950 SuperPoD批量上场,单节点8192卡、8EFLOPS。在那之前,算力供需的紧张不会根本缓解。
顺带一提,训练端也一直在「磨」。上周河套学院团队发布的SLAI T-Rex报告显示,在昇腾超节点上跑DeepSeek-V4-Pro(1.6万亿参数MoE)的全参数后训练,原始流程里通信占掉了设备执行时间的52.2%。知乎也就是说,超过一半的设备时间没在算,而是在等数据交换。
经过并行策略和算子优化,系统MFU(模型浮点计算利用率)从开源基线的11.67%提升到34.22%,接近3倍。知乎但注意边界:这是后训练,不是从零起步的预训练。
那到底该不该等降价?分人
API付费开发者:别指望短期降价,更现实的是吃峰谷差价——一天里有17个小时是半价窗口,批量任务挪到夜间跑,成本直接砍半。知乎如果业务必须在白天高峰跑,值得认真比一比同行:涨价之后,DeepSeek对海外顶级模型仍有明显价格优势,但和部分国产同行的差距已经收窄不少。已经有开发者在认真算本地部署和换供应商的账了,备用方案值得准备。

免费用户:暂时不用慌。这次涨的是API,网页版、APP没收钱,高峰加价本质上是冲开发者去的。不过「价格屠夫」自己都不打价格战了,「永远免费无限用」的预期,也该跟着更新一下。
围观国产算力的:这笔采购真正的价值不在卡的数量。就像今天那篇热帖说的,CUDA最怕的不是性能被超越,而是替代选项被验证可用。微博DeepSeek把真实负载跑在昇腾上,本身就是头部玩家给国产生态做的一次压力测试。
往后盯四个信号
四季度Atlas 950 SuperPoD的量产进度。这个齿轮咬合了,推理算力池才真正变大,谈降价才有前提。
DeepSeek下一次调价。涨完之后高峰价如果有松动,是算力供需缓解最直接的证据。
950DT四季度发布和自研HBM的供应链情况。存储是新瓶颈,也是新筹码。
其他国产厂商跟不跟涨。一家涨是商业策略,全行业涨,就是真的算力紧张。
一句话收尾:国产算力的真正价值,不是让token明天就降价,而是让DeepSeek的成本命脉从「英伟达开价多少」变成「自己供应链什么样」。这次涨价不是坏事,它只是把AI的真实成本摆上了台面。以后会不会降,别看口号,看四季度超节点的量产。