先说个上周在小红书刷屏的真事:有开发者在公司拿 DeepSeek 开发一个小 Agent,一天烧了 50 块,发帖感叹"以前做毕设 2 块钱够用一星期"。小红书底下最高赞的回复不是"换模型",而是"正常,现在一小时两块"。
这不是个例。8 月 17 日,DeepSeek V4 Pro 和 V4 Flash 的新价格正式生效,API 峰时价格最高涨到原来的 12 倍;紧接着 8 月 23 日 0 点起,官方又把计费规则改了一版——周末全天统一按谷价收费。腾讯科技机器之心一边是"上班时间的精准涨价",一边是"周末大放送",这周被账单刺痛的智能体用户,到底该换还是该留?
我把微博、小红书、知乎和 36氪这几天的讨论翻了一遍,把账算给你看。
一、先看清楚:这次到底涨了多少
这次涨价不是"统一上浮",而是结构性调价,扎心的地方全在细节里:
V4 Pro 峰时缓存命中输入:从每百万 token 0.003625 美元涨到 0.044 美元,约 12.1 倍(媒体说的"最高涨 11 倍"就是这一项)
V4 Pro 输出:0.87 → 3.96 美元/百万 token,约 4.5 倍
V4 Flash 峰时输出:0.28 → 1.32 美元/百万 token,约 4.7 倍

更关键的是峰谷时段的划分:谷时价格是峰时的一半,而官方划定的峰时(UTC 1-4 点、6-10 点)换算成北京时间,正好是上午 9 点到 12 点、下午 2 点到 6 点——国内打工人和开发者最集中的工作时间。
社区里流传最广的一句吐槽,来自一位开源社区程序员:“我可以接受 DeepSeek 性能稍差,但不能接受它涨价。DeepSeek 可以不强,但是不能贵,贵就是原罪。”腾讯科技
二、为什么智能体用户被扎得最狠
聊天用户按条数感受不明显,但跑智能体的人,用量结构天生吃亏。
OpenCode 公布过一个典型 V4 Flash 请求的结构:410 个新增输入 token、7.13 万个缓存 token、310 个输出 token。腾讯科技按这个结构算:
调价前,单次请求约 0.000344 美元
调价后,谷时约 0.000794 美元(2.3 倍),峰时约 0.001588 美元(4.6 倍)
也就是说,智能体干活最依赖的"缓存复用",恰恰是涨幅最大的那一项。
涨价还在往下游传导。订阅平台 OpenCode Go 每月 10 美元,原本靠批量采购给用户封装出远超订阅费的用量,这次调价后额度表已经改了:每 5 小时 12 美元的上限里,理论请求次数从约 3.49 万次掉到峰时约 7600 次,少了约 78%。
顺带辟个谣:社区里传过"额度缩水 94%"的说法,那个口径混进了临时双倍促销额度和平台早期显示值,夸大了。腾讯科技按可比口径算大约缩水四分之三——没那么夸张,但也足够肉疼。
小红书上的体感更直接:“以前一天两块,现在一小时两块”“以前用几天才十几块,现在一天十几块”。小红书小红书还有人的 Claude Code 夜里挂机跑个小任务,第二天任务没跑完,20 块钱先没了。
三、周末全天谷价:新变量,也是新操作空间
8 月 23 日 0 点起,DeepSeek 周末(周六、周日)全天不再区分峰谷,统一按谷时价格收费。机器之心对按量付费的用户来说,这是个实打实的省钱窗口:
批量任务、数据清洗、长文档处理这类不急的活,攒到周末跑,成本直接按谷价算
X 上已经有开发者说"一周的活儿两天干完,账单直接减半"(具体省多少取决于你自己的缓存命中率,别照抄)
这个规则也带出了点魔幻现实:此前有程序员发帖,公司为了省 token 成本开始调整考勤,周末上一天班、午休跟着峰谷时段走;短剧行业更早,AI 算力成本短期翻了近四倍后,渲染任务集体挪到深夜蹭低价。机器之心便宜算力正在变成一种需要"抢时段"的资源。
四、换还是留?先算清三笔账
第一笔账:你在哪个渠道,决定了涨价砸不砸得到你。
这次涨的是 API 开放平台的价格。如果你用的是 DeepSeek 官方网页版和 App,基本无感;真正挨刀的是三类人——用第三方智能体平台接 DeepSeek 的、订阅 Token Plan 的、自己写代码按量付费的。先确认自己的钱是从哪条渠道流出去的,再决定下一步。
还有一点容易被忽略:同一个 V4 Pro 0813,在不同渠道不是一个价。截至 8 月 18 日,这个模型已经接入十几家推理服务商,多数线路的报价已经向官方峰时价靠拢,但限时折扣、缓存单价和生成速度的差距还在——有的线路缓存单价能差出 10 倍,还有的挂着七折促销。官方涨价不等于你的账单立刻同幅度上涨,先看一眼自己用的那条线路。腾讯科技

第二笔账:缓存平衡点,决定 V4 Flash 还值不值得留。
涨价后 V4 Flash 和竞品 Luna(GPT-5.6 系列的小杯档)的价格关系变了:峰时 Flash 的普通输入是 Luna 的 2.2 倍,但谷时输出比 Luna 便宜 45%、缓存读取便宜 65%。36氪援引的测算给出了一个可操作的平衡点:当缓存 token 数量大于"新增输入的 40 倍 + 输出的 20 倍"时,V4 Flash 峰时仍比 Luna 便宜。
翻译成人话:如果你的智能体是在一个大项目里反复迭代(上下文大量复用、新增输入少),留在 V4 Flash 还是划算的;如果每次对话都是全新上下文、缓存吃不满,峰时换 Luna 或其他平价模型更省钱。
第三笔账:单价不等于总成本,任务成功率才是。
开源评测项目 DRadar 把 V4 Flash、V4 Pro 和 Luna、Sol、Terra 放进真实软件工程任务里算"综合成本-能力",结论是:涨价后,DeepSeek 基本退出了原来的性价比前沿——哪怕按谷价算,V4 Flash 的多个档位也被 Luna 用更低成本覆盖。腾讯科技原因不复杂:便宜的模型如果要多试错、多重试,总账单未必低。挑平替别只盯着单价表,拿你自己真实的小任务各跑一遍,对比总花费,比看任何榜单都准。

不想折腾的,评论区已经有人把平替清单列出来了(小红书"deepseek涨价平替"一帖,300 多条讨论):最高赞的建议是"一天才二十几块的用量,直接订 ChatGPT Plus 反而省心";往下依次是国家算力中心的 30 元套餐、Qwen3.7max 高峰期顶上、硅基流动的旧价线路、多平台免费额度轮换。还有硬核玩家直接"本地 5090 部署开源模型"——这条路电费和时间成本另算,轻度用户慎入。
五、两个坑,提前避一下
一是第三方低价渠道的"缩水"风险。Pi 项目核心贡献者 Armin Ronacher 最近有个流传很广的比喻:现在市面上买 token,像买成分不明的商品——可能是高量化的缩水版、实际版本存疑、"零数据保留"承诺和合同对不上。官方涨价后,如果某条第三方线路便宜得反常,先想想它靠什么便宜。InfoQ
二是缓存锁死。各家平台的缓存计费、保留时长、命中规则都不透明,而且换平台时缓存带不走,等于从头再烧一遍钱。如果你重度依赖某一家的缓存优惠,迁移成本要提前算进去。InfoQ
六、接下来值得盯的三个信号
涨价会不会回调。有财经博主把这次涨价和 DeepSeek 重启二轮融资(传估值冲 5000 亿)联系在一起——融资落地后价格策略是否松动,值得盯。微博
开源的 DSH(DeepSeek Harness)。涨价公告发出两个多小时后,DeepSeek 反手开源了自己的智能体工作台,一天 6.6 万 star,目前接近 17 万。工具免费、模型收费,这套组合能不能把"贵"的账算回来,社区还在吵。硬核看板另外 8 月 21 日 V4 Flash 还上线了视觉版,号称 1000 张图 1 块钱。36氪
DeepSeek 的智能体产品线。8 月 12 日,DeepSeek 为 Harness 业务线单独注册了官方公众号,被视为智能体产品正式落地前的信号。真到那天,定价模式可能又是另一套逻辑。

最后说句实在的:智能体从"聊天"变成"干活"之后,token 消耗的计价方式,本质上变成了你雇了一个按秒计费的临时工。涨价是大势,但账单是自己的——把能挪到谷时和周末的活儿挪过去,把缓存吃不满的场景换掉,把总成本算清楚,这波至少能少交一半学费。
你现在一个月在 AI 智能体上花多少钱?涨价之后是换了平替还是硬扛?评论区聊聊,我把大家提到的省钱路子整理成第二篇。