上周还在给大家递 DeepSeek Harness(dsh)的装机教程——开源、免费、MIT 协议,上线几天 GitHub 星标就冲到 177k、登上趋势榜第一。知乎但这周聊它有多香之前,得先把"电费"这件事说清楚:8 月 17 日零点,DeepSeek 新版 API 定价正式生效,首次引入峰谷分时计价。知乎
动静不小:B 站"DeepSeek 大肥鱼涨价"梗视频播放量冲上 14.7 万。哔哩哔哩知乎上"这是在劝退用户吗"的问题热度高达 91 万。知乎为什么反应这么大?因为这次涨价,几乎是为 Agent 人群量身定做的。如果你正在跑 dsh,或者正准备跑,建议先把这笔账算完再充值。
到底涨了多少?记住三个数字
先说清楚谁受影响:这次涨的只是 API 调用,官方网页版和 App 聊天依然免费,纯聊天党不用慌。知乎但如果你的 Agent 是跑在 API 上的,下面三个数字要记牢。
一,完整价目表。单位元/百万 tokens:V4-Flash 空闲时段缓存命中 0.05、未命中 1.5、输出 4.5,高峰翻倍为 0.10、3.0、9.0;V4-Pro 空闲 0.15、4.5、13.5,高峰 0.30、9.0、27.0。微博高峰时段是每天 9:00-12:00 和 14:00-18:00,一天 24 小时里有 17 个小时是空闲价。
二,输出价格。V4-Pro 从调价前 6 元/百万 tokens,变成高峰 27 元、闲时 13.5 元——哪怕你全部挑闲时跑,也比之前贵了 125%。知乎"半价"是在新高价基础上打五折,不是旧价打五折。
三,缓存命中输入。三个计费项里涨得最猛的,恰恰是这个不起眼的条目:从 0.025 元涨到 0.30 元,翻了 12 倍。知乎后面会看到,这一项精准命中 Agent 负载。
Flash 也没逃掉。有重度使用 Flash 的用户拿自己一个月的真实用量套算,涨幅在 2.06 倍到 4.11 倍之间。知乎
说句公道话:涨完之后,DeepSeek 在主流模型里仍算便宜的,痛主要是相对旧价格而言。而且也不是它一家在涨:智谱年内已三次提价,Kimi K3 发布后输出价格涨了近 4 倍。知乎摩根士丹利的研报更直接:中国大模型平均 API 输出价格,从去年一季度的 12.2 元回升到了今年二季度的 21.9 元。知乎
为什么被精准命中的是 Agent 用户?
懂 Agent 架构的人,能一眼看出这次的"点名"意味。Agent 循环干的事,就是把同一份系统提示词和文件上下文每轮重发、反复调用、反复生成——原本用来省钱的高缓存命中率,现在恰好是那个涨了 12 倍的条目。知乎
而 V4-Pro 本身就是给重负载准备的:100 万 token 上下文、38.4 万 token 输出,跑复杂推理和 Agent 任务的算力消耗,跟以前的轻量对话完全不是一个量级。知乎
任务还长。社区实测:一张架构图任务跑了 37 分钟。知乎
复杂一些的任务,直接是小时级起步。知乎一个任务很容易横跨高峰时段,想躲都躲不开。

DeepSeek 这么设计也不是故意为难:算力确实吃紧。OpenCode 创始人说,单日在 DeepSeek 上吞了 8 万亿 Token,消费 13 万美元。知乎峰谷计价本质上是用价格把弹性需求赶到夜间,给算力削峰填谷。知乎
更麻烦的是,截至目前开发者预览版的 dsh 没有任何逐轮 token 或成本显示,社区 Ideas 区 8 月 14 日一条高赞帖子要的正是这个功能。知乎界面上看得到缓存命中率,账单却得自己去服务商控制台对。
知乎上已经有人直接发问:deepseek harness大家用起来省成本么?知乎
算一笔账:一次任务到底花多少?
按接近社区实测的任务形态算:一次 30-40 分钟的 dsh 任务,40 轮对话,每轮重发约 2.5 万 token 的上下文、缓存命中率按 90% 计,最后输出 1.6 万 token。为了可比,只计旧价能确认的两项——缓存命中输入与输出(缓存未命中输入暂不计入,实际账单会更高):
旧价约 0.12 元一次;新价闲时约 0.35 元一次;新价高峰约 0.70 元一次。闲时约为旧价的 3 倍,高峰接近 6 倍,峰谷之间还差整整一倍。(以上为口径标注的估算,具体以你的控制台为准。)

上图是 dsh 里一次真实任务的界面读数:输入 602K tokens、缓存命中率 94%。这类负载正是本轮计价瞄准的形状,也是没有工具就最难对账的账单。
省钱清单:五招,按省事程度排序
第一招,批量任务挪到闲时。24 小时里有 17 小时是半价:早上 9 点前、中午 12-14 点、晚上 18 点后。知乎长任务排到 18 点以后再启动,这一招就能省出 50%。
第二招,换姿势看账单。dsh 自己不显示逐轮成本,对账要靠官方控制台;想在框架里记账,装插件——发布当天就已经有社区做的成本追踪插件补上了这个缺口。知乎
第三招,盯住插件生态。社区维护的 Awesome DSH Plugin 清单按用途分类,清单页面已收录 1305 个插件,其中"用量与计费"类有 78 个——成本焦虑,明明白白写在清单上。知乎

第四招,模型分层。分类、格式化这类轻任务用 Flash,复杂推理和长任务才交给 Pro。知乎
重度用户,认真对比一下订阅制。有用户测算,涨价后自己在 DeepSeek 上的月度费用已经大大超出 GLM coding plan(99 元/月)。知乎B 站"DS 涨价下如何选购 coding plan"的视频播放量已有 2.5 万,开票、模型数量、性价比各成一派。哔哩哔哩
第五招,给自己留出口。dsh 的自定义 provider 接受任何 OpenAI 兼容端点,启动时也可以用 @version 锁定版本号。知乎这两件事今天不省钱,但下次价格再动、或者出现破坏性变更时,你改的只是一个字符串,而不是一个下午。
谁可以继续用,谁该先算账
轻度用户(每天几个任务、学习尝鲜):涨幅影响也就一杯奶茶钱,照常用,能闲时就闲时。知乎
把 dsh 接进日常工作流的用户:值得花 10 分钟把"每天任务数 × 单次平均 token"盘出来,乘一遍新价目表得到月度预算,再决定是排班调度还是转订阅。这一步比骂或者急着迁移都重要。
变现与生产用户(成本直接进 COGS):从今天开始记录单任务成本;高峰期躲不掉的,考虑混合策略——高峰走订阅制或其他模型,闲时集中在 DeepSeek。
三个值得盯的信号
一,成本管理工具。下一个爆发的赛道,是"帮你管 AI 成本"的工具——当差价能到几倍时,预算管理就是真实需求。知乎dsh 官方什么时候把逐轮成本做进去只是时间问题,在那之前,先用控制台和插件自己记账。
二,版本侧还在快跑。RC.8 在 RC.7 发布两天后就放出,补齐多模态输入,还把 Claude Code 和 Codex 变成可以按需调用的子代理。知乎同时别忘了 README 里全大写的预告:会有兼容性破坏变更,锁版本号不是过度谨慎。知乎

三,同行的价签。这轮涨价不是 DeepSeek 一家的事,也不会到 DeepSeek 为止。峰谷时段和档位会不会再调、友商怎么跟,决定了这份"省钱清单"的腾挪空间,值得持续关注。
免费框架的时代才刚刚开始,但便宜算力的时代确实在进入尾声。对我们普通玩家来说,这不一定是坏事——至少账单终于变得可读了。跑任务之前先算账,这是 Agent 时代的新礼仪。