这周,用DeepSeek API的人集体被账单上了一课。
小红书上有人晒图:“没注意,一周300块就没了”。小红书有人说:“问了个问题,8块多,直接给我整欠费了”。小红书还有人发帖问:“涨价12倍之后,普通人还怎么用模型?我这一周花了一千多”。小红书而知乎上一位开发者做了件更狠的事:他把DeepSeek开放平台的账单按小时粒度导出来,拿自己过去78天的真实用量按新价表回溯重算,结论是——同样的用法,要多花4.06倍。
但同一轮涨价里,也有人把账单干下去一半。同一套新价格,为什么人和人的差距这么大?我把这周能找到的实测数据、官方价表和行业数据对了一遍,今天把账算明白。
一周之内,DeepSeek动了四次价格
先给没跟上进度的朋友补个时间线,这轮调价的密度远超大多数人印象:
8月6日:官方预告API将调价,措辞是"涨幅较大";
8月13-14日:V4-Pro正式版上线;
8月17日零点:V4全系涨价+峰谷分时定价正式生效——这是DeepSeek开放平台上线以来单次幅度最大的一轮提价;
8月23日零点:涨价刚满6天,规则又改了——周六、周日全天不分峰谷,统一按低谷价计费。36氪
重点看8月17日那张价表,以旗舰V4-Pro为例(单位:元/百万Token):
计费项 | 调价前 | 调价后(工作日高峰) | 涨幅 |
|---|---|---|---|
输入(缓存未命中) | 3 | 9 | +200% |
输出 | 6 | 27(低谷13.5) | +350%(低谷也翻倍有余) |
输入(缓存命中) | 0.025 | 0.3 | +1100% |

高峰时段是北京时间工作日9:00-12:00和下午(多数报道写14:00-18:00,有开发者按账单单价反推实际执行接近14:00-17:00,精确到分秒的建议以自己账单的单价列为准),其余时间是低谷,周末现在全天都是低谷价。观察者网ZAKER
为什么有人翻4倍:最狠的刀不是"白天变贵"
很多人第一反应是"白天贵了,那我晚上跑"。但那份78天回溯账单揭示的真相是:峰谷价差根本不是这轮涨价里最伤人的部分。
那位开发者旧价期一共用了152.84亿Token,其中88.9%跑在V4-Pro上,而且大头是缓存命中输入——也就是Agent编程里反复喂上下文的那种调用。按新价表重算,总费用从1019.56元变成4138.69元,涨4.06倍。知乎拆开看,真正放血的单项是缓存命中输入:单价从0.025元涨到0.3元/百万Token,涨了12倍。
这恰恰是这两年最主流的用法的命门。用DeepSeek跑Claude Code、OpenCode这类编程Agent,或者做长上下文的多轮对话,token消耗的主力不是"新写的内容",而是每一轮都要重新读一遍的历史上下文——这些几乎全部走缓存命中计价。以前这项便宜到可以忽略,现在它悄悄翻了12倍。
顺便说清楚:涨价后缓存命中依然是最便宜的输入档(0.3元 vs 未命中9元),该用缓存还得用。变的是"缓存便宜到不用算"这个前提没了。
另一个关键结论来自他的对照实验:同样用量下,把主力模型从Pro换成Flash,9天账单从534元降到254元。知乎也就是说,"用什么模型"比"什么时候用"影响更大。峰谷之间差一倍,Pro和Flash之间差的可不止一倍——而且切模型不需要改作息,挪时段只能省一半。
周末打折是真福利,但只给"等得起"的人
8月23日生效的周末全天谷价,是这轮调价里难得的纯利好:V4-Pro周末输出13.5元/百万Token,对比工作日高峰的27元,直接腰斩。ZAKER

但它的适用面比看起来窄。能被这条规则照顾到的,是数据清洗、批量评测、定时推理这类"不急着要结果"的任务。而大部分中小开发者的真实场景——实时对话、客服、在线文档、白天写代码——恰恰不可能挪到周末。价格杠杆指的方向,和多数国内业务的流量方向是反的。
还有个容易被忽略的细节:高峰窗口(UTC 01:00-04:00、06:00-10:00)换算到美东是晚上9点到凌晨6点。知乎也就是说,这套"中国白天=高峰"的定价,对欧美开发者来说等于他们工作时间全程享受低谷价。这波调价,海外用户其实是受益方。
不止DeepSeek一家在涨:"白菜价时代"在集体谢幕
把视角拉远一点,这轮涨价不是孤立事件。2026年以来国内大模型API几乎全线提价:
智谱:年内三轮调价,一季度API价格较去年底累计涨约83%(官方说法是涨价后调用量仍增长400%);
MiniMax:6月发布M3时API价格全面翻倍;
月之暗面:7月Kimi K3输出价格涨至100元/百万Token,较前代涨近4倍;
阿里云、百度智能云3月上调算力产品价格,腾讯云年内至少两次涨价。ZAKER
摩根士丹利的数据更直观:2026年二季度国内大模型平均API输入、输出价格分别为4.9元、21.9元/百万Token,较2025年一季度上涨48%和80%。21世纪经济报道

背景是两个:一是算力成本压不住了——8月上半月,V4-Flash在OpenRouter的调用量连续两周全球第一,单周最高11.2万亿Token,8月4日甚至出现容量不足;二是DeepSeek刚传出估值5000亿元的第二轮融资,资本的耐心要兑现成毛利率。钛媒体知乎中银证券的判断是,行业正在从"低价获客"转向"价值定价"。中国蓝观察
对用户的实际含义:指望某一家"良心发现"降回去不现实,但横向比价的空间反而变大了——DeepSeek涨完,高峰27元的输出仍然只有Claude旗舰模型的约1/13;而OpenAI上月末刚下调了GPT-5.6两个档位Luna和Terra的价格。钛媒体36氪便宜没有消失,只是换了地方。
三种人,三种动作
结合这周的实测数据,给不同情况的朋友分个类:
第一种:偶尔用用、月账单几十块以内。 影响有限,不用折腾。唯一要做的是打开用量页面看一眼新单价,心里有数即可。
第二种:拿API跑编程Agent的重度个人用户(账单涨得最狠的就是这群人)。 两个动作按优先级来:先把简单任务的主力模型从Pro切到Flash,这是实测最立竿见影的一刀;再检查一下你的工具是否在反复发送超长上下文——缓存命中涨了12倍,上下文管理从"可有可无"变成了真金白银。
第三种:有稳定调用量的团队。 把批量、离线、可延期的任务挪到夜间低谷和周末(周末全天谷价已确认执行);同时启动横向比价——但注意,智谱、Kimi同样涨过价,迁移前先拿自己的真实流量样本跑一周账单对比,别只看挂牌价。
接下来值得盯的三个信号
周末谷价目前实际在执行,但这条规则还没被正式写进官方计费文档。知乎规则会不会再变,值得盯。
一周改两次价的节奏说明定价还在"试探期",后续峰谷窗口和单价都可能微调,重度用户建议把账单导出做成周常动作。
V4-Flash刚上线了视觉版,多模态调用是另一套计价逻辑,别想当然按文本价格估预算。知乎
从"输入1元输出2元"的价格屠夫,到峰谷分时、缓存12倍的精细化运营,DeepSeek只用了一年半。ZAKER这轮涨价真正改变的不是某个数字,而是用法则:大模型API从"随便用"进入"算着用"的阶段。好消息是,账算清楚之后,能省的空间其实比想象的大。