8万亿Token一天:OpenAI被逼降价80%,但降完还是贵60%

2026-08-04 09:45:24 2点赞 2收藏 3评论

虾哥 · 2026年8月4日

8万亿Token一天:OpenAI被逼降价80%,但降完还是贵60%

8万亿。

8万亿Token一天:OpenAI被逼降价80%,但降完还是贵60%

我看完之后又算了一遍——怕自己多看了一个零。

没看错。DeepSeek V4 Flash,一天内跑了8万亿个Token。5万亿免费,3万亿付费。OpenRouter的周榜同步甩出一张图——前五名全是国产模型,DeepSeek以7.22万亿Token登顶全球第一[1]。

我盯着这个数看了半分钟。

然后打开了公司这个月的AI支出表。

一、降价80%,然后呢?

OpenAI只用了不到48小时就崩了。

GPT-5.6 Luna紧急降价80%。这个动作本身就把底牌掀了——不是"我们在按自己的节奏调价",是"有人在抢我们的市场份额,我们得跟"。

但跟完之后发生了什么?

降价80%的Luna,单任务成本仍然比DeepSeek V4 Flash高60%。

不是比降价前高。是比降价前低80%之后,还高60%。

我拿零售业打了个比方。你开一家店,隔壁全场一折促销——你急了,回去把自家商品打了二折。打完二折之后,还是比人家贵一倍多。

你该换供应商了。

但OpenAI的问题不在供应商。在成本结构。

二、不是价格战

大部分报道管这叫"价格战"。不对。

DeepSeek V4 Flash能做到这个价,不是因为烧钱。是因为一个被严重低估的数字:98%缓存命中率。

翻译一下。100个API请求进来,98个不需要重算——之前的计算结果直接拿来用。真正消耗算力从头推理的,只有2个。

什么概念?

一个开发者调API写客服Agent,用户问"怎么退货"和"退货要多久"——99%的上下文是一样的。DeepSeek只算那一份新的,剩下的直接从缓存里捞。OpenAI的架构每次都要维护更长的状态依赖,缓存命中率远没到98%。

OpenAI的成本曲线是一条缓坡——量越大,成本跟着涨。DeepSeek的成本曲线几乎是一根水平线——量翻一倍,成本只涨一点点。

所以降价80%之后还贵60%。

不是比谁更舍得亏。是比谁的架构天生便宜。

三、免费的陷阱

那8万亿Token里,5万亿是免费的。大部分平台的免费额度是"试用装"——用完就没了。但DeepSeek的免费用户跑的是生产级负载

这不是促销。是分发。

你今天用它的免费API搭了一个内部工具,明天这个工具跑顺了——你把它迁到付费API的概率远高于迁移到另一个平台。迁移成本不是钱。是你对着一套已经跑通的代码重新配环境、改参数、调接口。

没人会因为便宜60%去受这个罪。

生态绑定从来不是靠合同锁的。是靠习惯。你打开VSCode,Codex CLI已经适配了DeepSeek的Responses API[2]。你写代码的时候调的是谁家的模型,你是看不见的。

你只知道——代码跑通了。

四、价格地板还没到

98%缓存命中率如果可持续——目前的数据看起来是——DeepSeek的边际成本趋近于0。

只要它愿意,随时把免费额度拉到10万亿、20万亿。反正那98%不烧算力。

而OpenAI从降80%这个动作来看,已经踩到了成本的警戒线。再往下就是纯亏。

这不是价格战。

是一场成本结构对定价权的屠宰。

一件事的边际成本趋近于0,你可以定任何价格。另一件事有硬性推理成本,定价空间从出厂那天就被锁死了。我在便利店里管了二十多年IT,见过供应商打价格战——三个月之内一定有一家退出。但这次不一样。DeepSeek不是在"降价"。它是在用一个完全不同的成本结构,把整个市场的价格锚砸了重修。

五、开发者用脚投票

OpenRouter周榜更新那天,我截了张图。

前五:DeepSeek V4 Flash、Kimi K3、Qwen3.8-Max、MiniMax H3、DeepSeek V4 Pro。GPT-5.6 Luna排第六。

不是"开发者爱国"。算账太清楚了。

调API写一个客服Agent——用DeepSeek一个月1200块。降价后的Luna——1920块。降价前——9600块。

如果你公司有10个Agent在跑,差价一个月7200。一个普通运维的半个月工资。

而你换到DeepSeek只需要改几行配置。

而且它还在铺入口。V4 Flash正式版API刚上国家超算互联网[3]——不是让你用起来更方便,是让你想不起来还有其他选择。

六、闭源定价权还剩下什么

Qwen3.8-Max下周就开源权重。Kimi K3还在迭代。DeepSeek免费额度还在加速。

当98%缓存命中的模型把价格拉到几乎免费,所有靠"模型能力溢价"赚钱的公司都会撞上同一堵墙:你的模型能不能好到让人愿意多付60%?

目前的数据说:不能。

OpenRouter前五全是国产。差距还在拉大。

我合上公司这个月的AI支出表。在Excel里新建了一个标签页,拉了一列:换DeepSeek V4 Flash下个月能省多少。

数字出来了。

够给两个运维加一轮薪资调整。

参考来源

[1] OpenCode平台及OpenRouter周榜数据 — 2026年8月3日发布,显示DeepSeek V4 Flash以7.22万亿Token登顶全球第一

[2] DeepSeek V4 Flash正式版API更新公告 — 2026年7月31日发布,支持Responses API并适配Codex生态

[3] 国家超算互联网 — 2026年8月3日上线DeepSeek V4 Flash模型API调用与下载服务


如果这篇让你重新想了一件事,点个「在看」让朋友也看到。

每周一篇算账硬货 + 两篇AI快评,关注虾哥,不掉队。

你还在用哪家的API?有没有算过这笔账?评论区聊聊。

#DeepSeek #OpenAI #AI成本 #API价格战 #虾哥快评

展开 收起
3评论

  • 精彩
  • 最新
  • 之前用cc调过deepseek一周吧,flash和pro确实都能做到缓存命中率98%多一点

    校验提示文案

    提交
  • 缓存命中的问题,是大模型主导的还是Agent ?

    校验提示文案

    提交
  • 好垃圾的Ai文

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
2
扫一下,分享更方便,购买更轻松