高峰翻倍闲时降价 DeepSeek给AI装了块峰谷电表
0.02元。
这是9月10日中午12点之后,DeepSeek Flash系列每一百万token缓存命中输入的新价格。旧的数字是0.05元,一夜之间砍掉六成。
我9月9日早上刷到公告的时候,正在给家里那个夜间批处理的摘要小工具看上个月的调用记录。这工具帮我把每天囤的资料在半夜自动做成摘要,跑了小半年,一直走官方开放平台直连的渠道,没经过任何中转商,到手价就是公告价。看到0.02这个数,我把三个价格逐行对了一遍,确认自己没看错小数点。
先摆完整的新价目。空闲时段,缓存命中输入从0.05元降到0.02元,缓存未命中输入从1.5元降到1元,输出从4.5元降到4元。高峰时段全部翻倍,命中0.04元,未命中2元,输出8元。高峰时段指周一到周五的9点到12点、14点到18点,其余时间都按闲时价格走。
一块峰谷电表
熟悉水电费的人一眼就能看懂这套结构。白天用电高峰贵,深夜便宜,电力公司靠差价劝你把洗衣机挪到夜里转。我家小区去年换的分时电表,深夜洗一次衣服的电费不到白天的一半,我妈早把洗衣机定时到11点半了。DeepSeek把同一套逻辑搬进了大模型API,用两倍差价告诉开发者,不着急的任务请夜里跑。
我对我那个小工具的流量分布做了一遍核对,结果很直白,九成以上的调用发生在晚上11点以后。也就是说9月10日之后,这个工具吃到的全是闲时价,输出部分每百万token从4.5元变成4元,输入未命中从1.5元变成1元。单价降一成三,花销跟着往下走,量越大省得越多。我算了下,按这个工具每月一千多万token的量,一年省下来的钱够多订两年服务器,数目不大,胜在不用改一行代码。

这次调价覆盖Flash系列两款模型,deepseek-v4-flash和带视觉能力的v4-flash-vision-exp执行同一套价格。真正省出大头的场景在缓存命中。客服机器人回答常见问题、文档摘要复用固定提示词、长对话里反复携带的系统指令,这些都属于命中率高的活。命中价直接砍到两分钱,等于官方在喊话,把你的调用逻辑设计好,重复的部分别重复付费。
拿一份千字文档的摘要任务按新价格过一遍,输入大约两千token。在闲时跑,输入未命中花0.002元,输出按800token花0.0032元,一份不到一厘钱。单价低到论斤称的程度,卡住大多数人的已经不再是价格,是想不想动手搭流程。
降价背后的三条线
这件事值得看的不止价格本身。回看时间线,DeepSeek在8月17日上调过一轮Flash系列定价,输出之外的项目都涨了。市场随即给出了回应,一部分流量转向第三方中转平台,一部分流向GLM这类竞价对手。三周之后,官方把输入价格退回8月17日之前的水平。
我的判断是,这轮退让把行业里最要害的一层挑明了。开源模型随便哪家托管商都能拉起来,价格能打到官方的零头,模型厂商手里的定价权已经残缺。Flash系列生来就是靠低价抢量的产品,一旦贵过第三方托管,它存在的意义就没了。涨价是试探承受力,三周退回是数据替市场投了票。
第二条线在成本结构。输出价格只让了11%,高峰时段照旧翻倍,说明推理产能确实紧,需要覆盖的成本没有消失。厂商的打法很清楚,用Flash守住用户量,用高峰时段和输出端赚回毛利。

第三条线对我们这些普通用户最有感。API降价从来不会停在开发者那一层,它顺着产业链往下传。做应用的公司成本降了,终端产品的价格、免费额度、会员权益都有空间松动。反过来看,高峰翻倍也是一种预期管理,将来别家跟进峰谷计费,我不会意外。
白天赶时间的用户也有自己的对策。同档位还有GLM这类竞价对手,第三方托管的开源模型价格能压到官方零头,火烧眉毛的任务多备一条调用通道,高峰价再翻倍也烧不到你。手里握着选择权,才是真正的省钱姿势。
谁能省到钱
给三个具体结论。手上跑着夜间批处理、定时摘要、无人值守任务的开发者,从9月10日起躺着受益,什么都不用改。做客服机器人、知识库问答这类高命中场景的,把提示词和系统指令的缓存设计做扎实,降幅最狠的六成就是给这部分人准备的。白天赶工出活、火烧眉毛要结果的,高峰价一分不会少,预算里得给两倍差价留位置。
我自己的安排已经定了,所有重活继续压在夜里跑。峰谷电表装上了,会用的人和不会用的人,月底的费用会差出一个量级。电价教会过我们的事,电表换成token计费,一遍都不会少。定价权从厂商手里往市场手里回流,这个方向已经由8月17日那轮回调验证过一次,9月10日只是第二次确认。
