DeepSeek单项涨幅1100%,老用户花光余额迁走
同一格计价,输入缓存命中从0.025元涨到高峰0.3元,涨幅1100%;输出从6元涨到高峰27元。DeepSeek这轮峰谷计价,把白天干活的团队全部自动带上了溢价——同一份用量,全按高峰价跑,账单比全空闲价贵整整一倍。
8月17日0点,DeepSeek的API新价目正式生效。官方把计价改成了峰谷两档,高峰时段贵,空闲时段半价。表面上只是换个计价方式,翻开价目表,有一格的价格涨了12倍。这一格最疼。
中国证券报把这组数字列得很清楚。V4 Pro这个档,调价前每百万tokens的输入,缓存命中只收0.025元。调价后高峰时段收0.3元,涨幅1100%。同一格空闲时段收0.15元,也是原价的6倍。
先解释一句什么是缓存命中。你给模型发请求,前面那段系统提示词如果和上次一模一样,模型直接复用算好的结果,只收象征性的钱。跑固定提示词的应用,比如套壳产品、批量生成、固定格式的报告,大头都落在这一格上。涨价12倍的,恰恰是这类业务最依赖的那一格。躲不开。
其余几格跟着动。缓存未命中的输入从3元涨到高峰9元,输出从6元涨到高峰27元。Flash档同步上调,缓存命中从0.02元涨到高峰0.1元,涨了4倍。空闲时段一律减半。
官方留了一扇门。网页版和App的普通用户不受影响,这一轮涨的全是开发者调API的钱。
高峰那7个小时,正好是干活的时间
高峰时段的定义值得细看,北京时间早9点到12点,下午2点到6点。工作日的白天全是高价,晚上6点以后才降价。
这套玩法你大概率见过。居民用电的峰谷电价跑了十几年,夜里洗衣、错峰充电,都是同一套逻辑。AI定价第一次把它搬进了按次计费的算力市场。我们当年上ERP的时候,服务器半夜跑批是默认动作,没人觉得这是省钱技巧。现在算力自己长出了电价,半夜跑批从习惯变成了手段。

我按官方价目算了一笔对照账。同一份用量,全按高峰价跑一遍,再全按空闲价跑一遍,账单差整整一倍。这是写进价目表的规则,空闲价格为高峰的一半。
这种调价对照我每个季度会整理一次,各家大模型的价目变动都收在一张表里。关注了,下次谁再动价目表,你直接看对照就知道涨在哪一格。
再折中一点,假设六成的量落在高峰、四成落在空闲,混合账单比全空闲还要贵六成。白天干活的团队几乎都落在这个区间,等于每个人的活都自动带溢价。
那位上微博算账的老用户给了个参照系。他说自己2.5个月用掉152亿tokens,换到新计价模式一年要花4000多元,够买五份竞品套餐。涨价生效前那几天,他搞了波报复性消费,把账户余额狠狠用完,现在正准备把大部分需求迁走。这笔是他的个人口径,我原样记下。
账怎么省,活往哪挪
省钱的路子官方已经写在时段表里了。批处理类的活,跑批、生成报告、离线翻译,全可以挪到晚上6点以后,成本直接砍半。挪一次,省一半,这是价目表白纸黑字给的折扣。
白天躲不开高峰的场景也摆在那。客服机器人、实时问答、跟着上班时间走的自动化流程,这些活躲不开高价时段,只能按9元、27元的单价买单。

这次的峰谷计价还带出一个新问题,议价权。大客户可以直接找官方谈,那位迁走的用户也提到,有人会把需求转去别的模型。中小开发者最被动,量不够大谈不下价格,又没精力整体迁移,只能咬牙按新价付。迁移这件事说起来一句话,代码、提示词、评测、回归,全要重做一遍,时间成本比账单更贵。
我的判断是,DeepSeek这轮调价的本质,是把选择权摆上台面。愿意挪时间的省一半,挪不了的替挪得了的付折扣。谁受益谁受损,一目了然。
口碑攒起来要几年,跳一次价只要一晚。那位用户说得直白,工具装了一堆,实在不想再研究了。
下一次调价来的时候,你账单里最贵的那一格,还在你能接受的比例里吗?
下单前行动清单
① 批处理、离线翻译、生成报告这类活挪到晚上6点以后跑,成本直接砍半。
② 白天躲不开高峰的实时任务,按缓存命中高峰0.3元/百万tokens重新做预算,是旧价的12倍。
③ 六成高峰加四成空闲的混合用量,按比全空闲贵六成估算账单。
④ 网页版和App普通用户不受影响,这轮涨的只是API调用。
建议收藏这份清单,下单前翻出来对照。

校验提示文案
校验提示文案