DeepSeek今天正式涨价,最高涨幅1100%:最先肉疼的恰是最会省钱的AI编程党,换工具前先算清这三笔账

源自15位全网作者

01:23

今天(8月17日)凌晨零点,DeepSeek API 的新价格正式生效。小红书

如果你只是在网页版或 App 上聊天、写周报,这件事跟你没关系——这次调价只针对 API,普通用户不受影响。但如果你是那种把 DeepSeek 接进 Claude Code、OpenCode、DeepSeek Harness 这类工具里,让 AI 替你改代码、跑测试、提 commit 的人,今天打开账单面板,心情可能有点复杂。

小红书上有位用户今天发了一组数字:涨价生效当天,opencode go 套餐里 DeepSeek-V4-Flash 的调用量,5 小时内从 63300 次掉到 3800 次,缩水约 94%。小红书虽然套餐中间商的成本失控会放大这种断崖,直接按量付费的用户未必走得这么决绝,但市场的应激反应已经说明问题:这次涨价,打疼人了。

而且最疼的那批人,恰恰是过去把 DeepSeek 用出最高性价比的人——用 AI 写代码的这批。

第一笔账:涨价的刀,精准落在"缓存命中"上

先把新价格表摆出来。这次不是普涨,是结构性重定价,核心是两条:

第一条:引入峰谷定价。 每天 9:00-12:00、14:00-18:00 是高峰时段,其余 17 个小时是空闲时段,空闲价格正好是高峰的一半。界面新闻对,跟电价一个逻辑,token 也开始分峰谷了。

第二条:各档位涨幅完全不同。 以主力模型为例:

  • V4-Pro 输出:6 元/百万 tokens → 高峰 27 元(空闲 13.5 元),涨幅 350%

  • V4-Pro 缓存未命中输入:3 元 → 高峰 9 元(空闲 4.5 元)

  • V4-Pro 缓存命中输入:0.025 元 → 高峰 0.3 元,涨幅最狠的一档,达 1100%,也就是 12 倍

  • V4-Flash 输出:2 元 → 高峰 9 元(空闲 4.5 元);缓存命中输入从 0.02 元涨到最高 0.10 元

顺带说一句,这次调价的是 V4 系列,网传"V3 也涨了 1100%"是误传。知乎

DeepSeek今天正式涨价,最高涨幅1100%:最先肉疼的恰是最会省钱的AI编程党,换工具前先算清这三笔账

看出问题了吗?涨得最狠的,是"缓存命中输入"。

普通聊天用户很少吃到缓存红利——每次问的问题都不一样,命中率很低。但 AI 编程场景正好相反:Agent 干活时,系统提示词、仓库上下文、工具定义,每一轮都要原封不动地重复发送,多轮对话里前面的内容也会一直带着。所以用 DeepSeek 跑编程 Agent 的人,缓存命中率普遍接近拉满,账单里缓存命中输入往往占大头。

过去这是 DeepSeek 写代码全网最便宜的原因——有人算过,一天处理 4 亿多 token,实际扣费 12 美元,缓存优化立了大功。知乎现在,12 倍的涨幅正好落在这个档位上。用知乎上一位用户的话说:以前最喜欢的是缓存命中接近 100%、计价超低,“用起来可以说非常爽”;现在缓存命中大涨,“按照以前的使用方式,整体账单就会至少涨价9倍”。知乎

顺带辟个谣:今天流传的"账单直接涨 9 倍"说法,已经被评论区懂行的用户修正过了——缓存命中的 12 倍是单价涨幅,但它在账单金额里的占比要看各人的用量结构,不能直接画等号。涨多少,取决于你的缓存命中占比、输出占比和高峰时段占比,下面教你怎么对账。

第二笔账:你的账单到底会涨多少,看三个数

打开你的 API 后台,拉一下过去 7 天的账单明细,看三个数:

1. 缓存命中输入占金额的比例。 这是你受冲击最大的一档。占比越高,说明你越"依赖缓存红利",这次涨得越疼。跑大型 Agent 项目的,这一项往往占账单一半以上。

2. 高峰时段用量占比。 工作日 9-12 点、14-18 点是高峰,价格是空闲的两倍。如果你主要在工作日白天让 Agent 干活,等于在电价最贵的时段开空调。

3. 输出占比。 输出涨了 3.5 到 4.5 倍,让 AI 写长文档、生成大段代码的场景,这部分会明显鼓起来。

举个现成的例子:有用户在涨价前两天晒过一张 DeepSeek Harness 的会话费用明细——单次编程会话,输入 1.4 亿 token,缓存命中率 100%,当时费用只有 4 块钱。小红书这就是"Agent 干活九成走缓存"的典型形态,也是这次涨价后最先膨胀的那类账单。

DeepSeek今天正式涨价,最高涨幅1100%:最先肉疼的恰是最会省钱的AI编程党,换工具前先算清这三笔账

给你几个参照系,感受一下量级:

  • 有知乎用户说,自己刻意避开高峰、在"非高峰"时段用,今天的账单依然比昨天贵了好几倍——因为缓存命中涨价是不分峰谷的,躲得开高峰,躲不开缓存。知乎

  • 小红书上有人晒账单:以前写代码一天用不了几块钱,现在一天十几块;

  • 但反过来,涨完之后 DeepSeek 依然便宜。有第三方做的基准任务成本测试:跑同一套任务,Anthropic 的 Fable 5 大约 3.15 美元,DeepSeek V4-Flash 大约 3 美分,而两者性能差距只有 5.3%。<#&!53#&!>小红书就算按最贵的高峰价算,V4-Pro 也还是全场最便宜的能干活的选项之一。

所以这不是"要不要立刻跑路"的问题,而是"你的用法还划不划算"的问题。

第三笔账:涨完之后,这钱到底该怎么花

把网上的讨论和官方的动作放一起看,思路其实挺清楚。

先说 DeepSeek 自己。这次涨价不算突然袭击:8 月 6 日官网就弹窗预告"预计涨幅较大",还建议开发者控制充值金额,给足了 11 天缓冲。小红书为什么涨?说白了是算力扛不住——7 月底那一周,V4-Flash 单模型在 OpenRouter 上的调用量就干到 7.22 万亿 tokens,排全球第一,8 月初 API 还因为访问量过大出过性能事故。据南方都市报、凤凰网报道,梁文锋 7 月在一场投资者交流会上说过,这个价格区间"需求是没有弹性的",价格翻一倍,token 消耗量区别不大,总收入反而接近翻倍。小红书DeepSeek 赌的是:你算完账,发现无处可去。

有意思的是同一周它的另一手:8 月 13 日,DeepSeek 把自家的智能体框架 Harness 以 MIT 协议开源了,还同步发了 V4-Pro 正式版。知乎上线 12 小时就拿到 5 万 star。界面新闻社区已经发现,Harness 的"极简模式"(只给 Bash 和 Edit 两个工具)配上 V4-Pro,在 Linux/Mac 上能把效果拉起来一大截——工具越少,上下文越短,token 越省。知乎一手涨价,一手把最省 token 的官方用法免费送给你,这算盘打得也算明白。

落到具体的人,我给四类用户分别写了应对:

第一类:按量付费的个人开发者(最典型的一批)。 先别换工具,先改用发。三件事:把批量的、不急的任务挪到空闲时段跑——晚上 18 点后、午间 12-14 点、早上 9 点前,价格直接减半;稳住缓存,系统提示词和上下文结构别频繁改,会话别随手重开,缓存一旦失效,输入就要按未命中的价格算,差着一两个数量级;长会话及时拆分,别让 Agent 背着两小时的上下文干活——Anthropic 这周刚发了一篇官方博客教 Claude Code 用户省 token,第一条也是这个,两边的省钱逻辑是通的。知乎

第二类:通过 opencode go 这类中间商套餐用的。 上游一涨价,套餐方的成本立刻失控,砍额度、调价是最自然的反应,94% 的调用量断崖就发生在这个环节。建议早做准备:手里备一两个同档位的替代模型(GLM-5.3、Kimi、Qwen3.8 这类,各家编程能力本站都测过),套餐真缩水的时候不至于停工。已经有用户把国产低成本档位的账算出来了:混元 Lite 这种输入输出缓存全免费的档位可以当备胎,小米 MiMo-V2-Flash 的缓存命中价还停在 0.07 元/百万 tokens,日常跑量够用。

DeepSeek今天正式涨价,最高涨幅1100%:最先肉疼的恰是最会省钱的AI编程党,换工具前先算清这三笔账

第三类:全天跑 Agent 的重度用户。 认真算一下订阅制套餐的账——当 API 按量价格涨上来之后,固定额度模式反而可能更划算。已经有动手快的用户找到了一个冷门选项:国家超算互联网的 TOKEN PLAN,30 元档约 6 万积分,按 DeepSeek Flash 的量折算差不多 1.3 亿 token,而且只有总额度限制,没有"5 小时/单日"这种窗口限额。小红书对比某家 Coding Plan 的 Lite 档(110 多元、0.8-1.2 亿 token 官方估算),单价更实在,模型能力上日常跑 Flash 档位也够用。GLM-5.3 这类新模型的订阅档现在有折扣系数,也可以纳入对比。逻辑是通用的:先算你月均 token 消耗,再拿套餐价和"高峰 API 价"对比,哪个低用哪个,或者干脆双轨——白天高峰用套餐,半夜跑量用 API。

DeepSeek今天正式涨价,最高涨幅1100%:最先肉疼的恰是最会省钱的AI编程党,换工具前先算清这三笔账

第四类:轻度用户,或者只是拿 API 偶尔干点活。 影响有限,甚至可以考虑网页版和 App(免费,不受影响)。真极端追求成本的,本地部署开源模型也是一条路,但先把显存账算清楚再说。

接下来值得盯的四个信号

这波涨价肯定不是今天就翻篇的事,给几个值得持续观察的线索:

  1. DeepSeek 会不会出订阅套餐。 知乎上现在点赞很高的一种说法是"不出订阅套餐,就完全没有性价比"。知乎如果真出了包月,整个 API 按量的账本都要重算;

  2. 未来一周的调用量回流。 94% 的断崖是套餐中间商的应激,真实需求弹性到底多大,看下周 OpenRouter 的周榜——梁文锋"需求无弹性"的判断对不对,一周就能验一半;

  3. 竞品跟不跟涨。 过去一年多,国产模型是跟着 DeepSeek 降价的;现在价格屠夫收刀了,GLM、Kimi、mimo 们是跟着涨,还是趁机抢客户,直接决定你换工具的性价比;

  4. 峰谷调度灵不灵。 峰谷定价本质是用价格换算力调度,如果高峰时段的拥堵真的缓解了,说明这招有效,后面大概率还有第二轮调价。

属于"3 块钱高强度玩一天"的夏天确实过去了。但账还没算完——对真正用 AI 干活的人来说,贵的从来不是单价,是你没看住的用法。先把今天的账单拉出来,三个数字看完,该错峰错峰,该换档换档。

你今天被涨价打到了吗?账单涨了多少?评论区聊聊,顺便看看谁的用法最省。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章