8万亿Token一天:OpenAI被逼降价80%,但降完还是贵60%
虾哥 · 2026年8月4日
8万亿Token一天:OpenAI被逼降价80%,但降完还是贵60%
8万亿。

我看完之后又算了一遍——怕自己多看了一个零。
没看错。DeepSeek V4 Flash,一天内跑了8万亿个Token。5万亿免费,3万亿付费。OpenRouter的周榜同步甩出一张图——前五名全是国产模型,DeepSeek以7.22万亿Token登顶全球第一[1]。
我盯着这个数看了半分钟。
然后打开了公司这个月的AI支出表。
一、降价80%,然后呢?
OpenAI只用了不到48小时就崩了。
GPT-5.6 Luna紧急降价80%。这个动作本身就把底牌掀了——不是"我们在按自己的节奏调价",是"有人在抢我们的市场份额,我们得跟"。
但跟完之后发生了什么?
降价80%的Luna,单任务成本仍然比DeepSeek V4 Flash高60%。
不是比降价前高。是比降价前低80%之后,还高60%。
我拿零售业打了个比方。你开一家店,隔壁全场一折促销——你急了,回去把自家商品打了二折。打完二折之后,还是比人家贵一倍多。
你该换供应商了。
但OpenAI的问题不在供应商。在成本结构。
二、不是价格战
大部分报道管这叫"价格战"。不对。
DeepSeek V4 Flash能做到这个价,不是因为烧钱。是因为一个被严重低估的数字:98%缓存命中率。
翻译一下。100个API请求进来,98个不需要重算——之前的计算结果直接拿来用。真正消耗算力从头推理的,只有2个。
什么概念?
一个开发者调API写客服Agent,用户问"怎么退货"和"退货要多久"——99%的上下文是一样的。DeepSeek只算那一份新的,剩下的直接从缓存里捞。OpenAI的架构每次都要维护更长的状态依赖,缓存命中率远没到98%。
OpenAI的成本曲线是一条缓坡——量越大,成本跟着涨。DeepSeek的成本曲线几乎是一根水平线——量翻一倍,成本只涨一点点。
所以降价80%之后还贵60%。
不是比谁更舍得亏。是比谁的架构天生便宜。
三、免费的陷阱
那8万亿Token里,5万亿是免费的。大部分平台的免费额度是"试用装"——用完就没了。但DeepSeek的免费用户跑的是生产级负载。
这不是促销。是分发。
你今天用它的免费API搭了一个内部工具,明天这个工具跑顺了——你把它迁到付费API的概率远高于迁移到另一个平台。迁移成本不是钱。是你对着一套已经跑通的代码重新配环境、改参数、调接口。
没人会因为便宜60%去受这个罪。
生态绑定从来不是靠合同锁的。是靠习惯。你打开VSCode,Codex CLI已经适配了DeepSeek的Responses API[2]。你写代码的时候调的是谁家的模型,你是看不见的。
你只知道——代码跑通了。
四、价格地板还没到
98%缓存命中率如果可持续——目前的数据看起来是——DeepSeek的边际成本趋近于0。
只要它愿意,随时把免费额度拉到10万亿、20万亿。反正那98%不烧算力。
而OpenAI从降80%这个动作来看,已经踩到了成本的警戒线。再往下就是纯亏。
这不是价格战。
是一场成本结构对定价权的屠宰。
一件事的边际成本趋近于0,你可以定任何价格。另一件事有硬性推理成本,定价空间从出厂那天就被锁死了。我在便利店里管了二十多年IT,见过供应商打价格战——三个月之内一定有一家退出。但这次不一样。DeepSeek不是在"降价"。它是在用一个完全不同的成本结构,把整个市场的价格锚砸了重修。
五、开发者用脚投票
OpenRouter周榜更新那天,我截了张图。
前五:DeepSeek V4 Flash、Kimi K3、Qwen3.8-Max、MiniMax H3、DeepSeek V4 Pro。GPT-5.6 Luna排第六。
不是"开发者爱国"。算账太清楚了。
调API写一个客服Agent——用DeepSeek一个月1200块。降价后的Luna——1920块。降价前——9600块。
如果你公司有10个Agent在跑,差价一个月7200。一个普通运维的半个月工资。
而你换到DeepSeek只需要改几行配置。
而且它还在铺入口。V4 Flash正式版API刚上国家超算互联网[3]——不是让你用起来更方便,是让你想不起来还有其他选择。
六、闭源定价权还剩下什么
Qwen3.8-Max下周就开源权重。Kimi K3还在迭代。DeepSeek免费额度还在加速。
当98%缓存命中的模型把价格拉到几乎免费,所有靠"模型能力溢价"赚钱的公司都会撞上同一堵墙:你的模型能不能好到让人愿意多付60%?
目前的数据说:不能。
OpenRouter前五全是国产。差距还在拉大。
我合上公司这个月的AI支出表。在Excel里新建了一个标签页,拉了一列:换DeepSeek V4 Flash下个月能省多少。
数字出来了。
够给两个运维加一轮薪资调整。
参考来源
[1] OpenCode平台及OpenRouter周榜数据 — 2026年8月3日发布,显示DeepSeek V4 Flash以7.22万亿Token登顶全球第一
[2] DeepSeek V4 Flash正式版API更新公告 — 2026年7月31日发布,支持Responses API并适配Codex生态
[3] 国家超算互联网 — 2026年8月3日上线DeepSeek V4 Flash模型API调用与下载服务
如果这篇让你重新想了一件事,点个「在看」让朋友也看到。
每周一篇算账硬货 + 两篇AI快评,关注虾哥,不掉队。
你还在用哪家的API?有没有算过这笔账?评论区聊聊。
#DeepSeek #OpenAI #AI成本 #API价格战 #虾哥快评

拒绝签到
校验提示文案
wang_zhuqing
校验提示文案
wenqiu
校验提示文案
wenqiu
校验提示文案
wang_zhuqing
校验提示文案
拒绝签到
校验提示文案