今天凌晨,DeepSeek又悄悄改了一次计费:从8月23日起,周六、周日全天不再区分峰谷,统一按低谷价收费。知乎只看到这一条,你可能会以为是利好。但把时间往回拨一周——8月17日,它的API全面涨价刚刚生效:缓存命中输入从每百万tokens 0.025元,涨到高峰时段的0.3元,最高涨幅1100%。知乎十天两次调价,大模型的计费,真的开始像电费了。
如果你平时通过腾讯云调用DeepSeek、混元跑Agent、跑小工具,这笔账值得今天认真重算一遍。
这半年发生了什么:从"价格战"到"峰谷电价"
很多人的印象还停留在"DeepSeek=最便宜"。把时间线摆出来:
3月11日:腾讯云率先调整智能体开发平台计费,自研混元HY2.0 Instruct输入价从0.0008元/千tokens涨到0.004505元/千tokens,涨幅463%,同时结束GLM5、MiniMax 2.5等第三方模型的免费公测。微博
6月3日:DeepSeek官方降价,腾讯云同步跟进,V4系列模型最高降幅达97.5%,价格战气氛到达顶点。
8月13日:DeepSeek宣布V4-Pro正式版上线,同时引入峰谷计价,8月17日生效:工作日9:00–12:00、14:00–18:00为高峰时段,其余时间按高峰价的一半计费。知乎
8月中下旬:智谱、Kimi等也相继上调价格,而同期海外的OpenAI反而下调主力模型API价格,一边涨价一边降价,两个世界。
8月22日公告、今天生效:周末全天按低谷价计费。
这一波不是只有一家涨:智谱、Kimi涨幅分别达83%和最高3.5倍。知乎而海外的OpenAI,同期把GPT-5.6 Luna的API价格砍了80%。知乎

行业集体涨价不是巧合。受全球AI需求爆发、算力资源紧张及硬件成本上升驱动,大模型厂商与云服务厂商近期集体涨价。微博DeepSeek员工在官方交流群里的回应更直接:涨价是为了"腾卡"训练新模型。知乎靠补贴换用户的低价token时代,正在收尾。
涨了多少?先把"最高1100%"说清楚
网上传的"DeepSeek涨价11倍",很容易被吓到。其实1100%只对应"缓存命中输入"这一个计费项的高峰价,各项实际涨幅不一样:
缓存命中输入:0.025元 → 高峰0.3元(约12倍),低谷减半。
缓存未命中输入:3元 → 高峰9元(3倍)。知乎
输出:6元 → 高峰27元(4.5倍),低谷13.5元。微博

不是全面涨11倍——但如果你的业务重度依赖缓存、又都在白天调用,痛感是实打实的;反过来,主要在夜间调用的用户,涨幅会被再打一个对折。
和腾讯云用户有什么关系?
有人会说,这不是DeepSeek官方的涨价吗?对通过腾讯云调用模型的人来说,还真有关系:
第一,腾讯云自研的混元,3月已经涨过一轮,智能体开发平台的计费策略同步调整过——这一波谁都躲不掉。
第二,腾讯云有与DeepSeek官方定价同步的先例。6月降价时,腾讯云立刻跟进,最高降幅97.5%。知乎如今官方涨价,你在云上调用的DeepSeek系列按什么价格结算,下单和续费前建议打开计费页核对一遍。
第三,已有开发者注意到:腾讯云不再提供DeepSeek V4 Flash/Pro的Preview入口,由正式版直接接替。知乎免费试用的窗口,正在收窄。
算笔账:同一件事,差价有多大?
峰谷计价的核心逻辑和峰谷电价一样:用价格把能挪的需求挪到低谷。先看V4-Pro输出单价的变化:

模拟一个典型的Agent用户:每天50轮调用,输入合计约100万tokens(80%命中缓存),输出合计约10万tokens,全部走V4-Pro——
涨价前:每天约1.2元,每月约37元;
全在工作日高峰跑:每天约4.7元,每月约142元,接近4倍;
挪到低谷和周末跑:每天约2.4元,每月约71元。
同样的工作量,"白天跑"和"夜里跑"差出一倍。而Agent类任务内部动辄几十步推理,token消耗是普通对话的5–10倍,缓存命中占比又高——缓存命中输入恰恰是涨幅最大的计费项。大模型越强,token越贵,社区那句"龙虾(OpenClaw)快养不起了"真不是玩笑。微博
省钱指南:四种用法,四种操作

周末归谷已经生效,批处理任务挪到周六日,直接享受五折。不同用量的省钱路径完全不同:
1. 轻度用户(偶尔调用、小工具):不用慌。调用量本来就小,把任务挪到晚间和周末,峰谷计价对你几乎没有影响。这次"周末归谷",等于官方发了一张长期有效的半价券。
2. 批处理用户(批量生成、数据清洗、跑评测):两个动作。一是把调度器设到18点以后或周末,直接省一半;二是尽量固定系统提示词——缓存命中(高峰0.3元/低谷0.15元)和缓存未命中(9元/4.5元)差30倍,前缀稳定就是钱包稳定。
3. 实时业务用户(客服、搜索增强):躲不开高峰就做分层,非核心任务切到Flash系列,关键决策才上Pro;另外关注8月21日刚上线的多模态实验版V4-Flash-Vision,官方定价一张图最高只要0.001元,有看图需求可以试试。知乎
4. 重度用户(日耗千万tokens级):认真评估本地部署。社区已经有人算过账:部署V4 Flash的硬件约7–8万元,24小时约产出9000万tokens,电费与等量API调用费大致相当。知乎用量足够大时,回本周期是可以算出来的。
后面还有两个观察信号
这次调价大概率不是最后一次。十天两次调整,8月22日还出现过一次API故障,说明算力确实紧张,定价也还在摸索。两个信号值得盯住:
官方价格页。周末归谷是一次"补丁式"调整,后续峰谷时段划分还可能微调;
腾讯云的计费明细。DeepSeek系列是否同步跟调、混元下一步动作如何,一切以控制台实时价格为准。
“白嫖token"的时代过去了。现在值得买的,不是"最便宜的模型”,而是"同一个模型,在对的时间调用"。批处理挪到低谷、缓存用好、能降档就降档——这轮涨价之后,账单依然可以按住。