这周,如果你是用大模型 API 的开发者,心情大概率坐了一轮过山车。
8月17日零点,DeepSeek 新定价正式生效,早上起来账单就刷满了首页:有人的任务从原来的2.99元,按新价一算直接涨到7.27元微博知乎。还有人只问了2个简单问题,8毛钱就没了微博。最夸张的是缓存命中输入的价格,从每百万 token 0.025元直接干到高峰0.3元,涨幅1100%知乎。而在大洋彼岸,一件声量小得多但同样重要的事正在发生:OpenAI 把 GPT-5.6 Luna 的价格砍了80%,Anthropic 干脆取消了原定的涨价。同一周,国内涨、海外降,这笔 AI 账得重新算一遍了。
这次涨了多少?先看明细
新定价8月17日0时正式生效,同时 V4-Pro 结束测试、全面转为正式版商用服务微博。旗舰 V4-Pro 涨得最狠:缓存命中输入从0.025元涨到高峰0.3元/百万 token(+1100%),缓存未命中输入从3元涨到9元(+200%),输出从6元涨到27元(+350%);V4-Flash 也跟着涨,缓存命中输入从0.02元涨到0.1元(+400%),输出从2元涨到9元(+350%)知乎。
还有两个细节值得注意。一是这次在行业里第一次上了峰谷分时定价:工作日9:00-12:00、14:00-18:00算高峰,其余17个小时都是闲时,闲时一律半价知乎微博。二是这不是拍脑袋的决定,官方8月13日才正式发公告,只给了用户4天缓冲知乎。而早在6月底就流传过一版峰谷方案,最终落地的闲时价13.5元,已经超过了当时拟定的高峰价微博。

不止 DeepSeek 在涨
把视角拉远一点,这是整个行业的涨价年:智谱年内三次提价,一季度提价约83%,调用量反而逆势增长400%;豆包旗舰价接近翻倍;腾讯混元 HY2.0 Instruct 输入价一度涨了463%;Kimi K3 定价较前代涨超3.5倍,高价发布三天后就暂停了C端新用户订阅;头部厂商里,只有百度的 ERNIE 5.1 反而降了价知乎。
那涨完之后,DeepSeek 在国产旗舰里处于什么位置?把9家旗舰的价格拉个横评(元/百万 token,输入/输出):Kimi K3 是20/100,Qwen3.8-max 是12/36,DeepSeek V4-Pro 高峰9/27,GLM-5.2 是8/28,豆包 Seed-2.1 Pro 是6/30,ERNIE 5.1 是4~6/18~22,MiniMax M3 永久5折后约2.1/8.4,阶跃 step-3.7-flash 是1.35/8.1,腾讯混元 Hy3 是1/4知乎。
能看出来的第一件事:涨价之后,DeepSeek 已经不是最便宜的旗舰了,高峰输入价摸到了 Kimi K3 的一半知乎。
第二件事是个伏笔:只要能吃上缓存,涨后的0.3元命中价依然比同档位的1.2-2元便宜一个数量级——这也是后面要讲的最重要的省钱抓手知乎。
为什么偏偏这时候涨?
第一本是调用量的账。每经援引 OpenRouter 数据测算,上周全球大模型调用量75.3万亿 token,周环比涨9.13%,其中中国模型36.84万亿,对美国模型的10.26万亿,连续16周第一;DeepSeek V4-Flash 单模型周调用就有11.2万亿,连续两周排第一知乎。调用量爆表,算力就成了稀缺资源,价格是最直接的调节阀门。
第二本是 Agent 的账。这轮调用暴涨主要是 Agent 类应用带起来的,单次任务吃的 token 是传统对话的几十倍到上百倍,光 OpenCode 一个平台,V4 Flash 单日处理的 token 就干到了8万亿知乎。这种用法,补贴价根本扛不住。
第三本是生意的账。按投资者交流中透露的说法,梁文锋的定价哲学是以服务器10个月回本为基准,只赚合理利润知乎小红书。补贴换规模是早期打法,商业化这一步迟早要走。
同一时间,海外在反向操作
这是这轮行情里最有意思的部分。7月30日,OpenAI 把 GPT-5.6 Luna 的 API 价格直接砍了80%,降到每百万 token 输入0.2美元、输出1.2美元,Terra 下调20%知乎小红书。
Anthropic 推出了价格约为先前旗舰一半的 Claude Opus 5,还取消了原定9月1日生效的 Sonnet 5 涨价计划知乎小红书。另有消息称 GPT-5.6 Sol 的 OpenRouter 渠道价也砍了半,这条目前只有一个来源,先观望小红书。
砍完价,Luna 便宜到什么程度?按 Artificial Analysis 的单任务平均成本评测:Luna 以0.05美元垫底,DeepSeek V4 Pro 是0.25美元,GLM-5.2 是0.33美元,Claude Opus 5 要2.34美元,Claude Fable 5 要3.14美元知乎。

有人把主流模型的智能指数和单次任务成本画成了一张散点图(数据截至8月初),左上角性价比最高的那一簇,几乎全被降价后的海外新模型占了小红书。
为什么会分化?我的理解是:国内是需求先爆了,算力顶不住,用价格筛选需求;海外是在用降价抢开发者生态,锁使用习惯。两边都是商业策略,没有对错,但对用户的启示很明确——国产模型永远更便宜的时代,过去了。
连锁反应已经开始
最先流血的是承诺保价的第三方平台。DeepSeek 涨价后,OpenCode Go 套餐里 V4 Flash 的五小时调用量从63300次跌到3800次,一天跌掉94%知乎微博小红书。
月限额也从60美元被砍到15美元,后来才恢复到30美元,用户排队退订,此前信誓旦旦要保住低价的 CEO 也承认"并不容易"知乎小红书。
腾讯云 CloudBase 几乎同一时间官宣,完全跟随官方同步调价,连峰谷机制都一模一样知乎。

落到个人开发者身上,疼得更具体。AI 博主叨哥胡侃晒出自己的账单:涨价前可劲折腾,近2000万 token 只花3.14元;涨价后峰时用 V4 Pro 问一个简单问题,200万 token 就花了3.4元微博。另一位博主栋见加电,问了2个问题,8毛钱没了,直呼这次涨价有点猛微博。

这里必须把话说清楚:这次调价只动 API 接口,如果你平时只用 DeepSeek 的网页版和 App,一切跟你没关系,日常聊天写作依然免费知乎知乎。这轮冲击主要打在开发者,以及背后用 API 计费的产品上。
四招省钱,按需取用
第一招,错峰。闲时半价,周末全天都是闲时。批量翻译、数据清洗、定时报告这些不急的任务,挪到晚上或周末跑,成本直接减半知乎知乎。
第二招,把缓存命中率拉满。这是涨价后最值钱的一招:命中价相对未命中仍便宜30倍知乎。做法也简单——系统提示词固定下来,长上下文放前面,重复任务尽量复用同一套前缀。再避个坑:各家的上下文缓存是完全独立的,中途在同一会话里换模型,之前积累的上下文会被当作全新输入全额扣费,不仅不省钱,反而烧得更多小红书。
第三招,按任务分模型。批量简单任务用便宜或免费的:GLM-4.7-Flash 目前免费,腾讯混元 Hy3 只要1元/4元,阶跃 step-3.7-flash 是1.35元/8.1元,都比 DeepSeek 的闲时价还低知乎。旗舰留给真正的硬任务。
第四招,免费渠道别浪费。微信小程序成长计划正在送10亿 token 的大模型额度,个人开发者有项目的话可以先把免费额度领了知乎。海外降价之后,Luna 也是 GPT-5.6 家族里最便宜、最快的那一档,跑量大、简单的任务没有比它更划算的了知乎。
接下来值得盯的三个信号
第一,盯 DeepSeek 自己的调用量变化。调用量如果持续下滑,说明价格还需要回调;如果很快稳住,说明涨价筛出了真需求,其他国产厂跟涨的胆子会更大。第二,盯 Kimi、Qwen、GLM 跟不跟。它们现在的定价已经比涨价后的 DeepSeek 贵,有跟涨空间,跟了的话,便宜的国产旗舰就又少一个。第三,盯海外降价是不是可持续。Luna 的0.2美元如果能稳住三个月,很多国产应用的性价比锚点会整体移动——到时候可能不是国产贵了,而是海外变成了新的性价比基准。
最后问一句:你的 AI 月供是多少?涨价之后账单变了吗?评论区聊聊。