8月17日零点,DeepSeek 的新价格方案正式生效,AI 编程圈一下子炸了锅。有人感叹「价格屠夫收刀了」,有老用户直接把自己的使用评价「由夯降到拉」。知乎各大社区里到处是「换不换、换谁家」的讨论,传播最广的标题是「最高涨幅1100%」,看着像 DeepSeek 要抢钱。但我把官方价目表、券商研报和用户的实测账本都翻了一遍,发现这事既没有标题吓人,也不能不当回事。
一、「涨1100%」是真的,但只是其中一项
先说清楚最唬人的这个数字。1100% 对应的是 V4-Pro 高峰时段的「缓存命中输入」价:从每百万 Token 0.025 元涨到 0.3 元,整整 12 倍。雷达财经同一次调整里,V4-Pro 的缓存未命中输入从 3 元调整为高峰 9 元、空闲 4.5 元,输出从 6 元调整为高峰 27 元、空闲 13.5 元。DeepTech深科技问题在于,真实使用场景里缓存命中输入占了大头。跑 Claude Code、OpenCode 这类编程工具时,典型 Agent 任务的 token 结构大约是「缓存输入:新输入:输出 = 95:4.5:0.5」,按这个比例加权计算,DeepSeek 空闲时段的实际成本约为原来的 2 倍,高峰时段约为 4 倍。知乎换句话说,标题里的 1100%,摊到大多数人的真实账单上,是「翻倍到四倍」这个量级。
完整的新价目表如下(单位:元/百万 Token):
模型 | 时段 | 缓存命中输入 | 缓存未命中输入 | 输出 |
|---|---|---|---|---|
V4-Flash | 空闲 | 0.05 | 1.5 | 4.5 |
V4-Flash | 高峰 | 0.1 | 3 | 9 |
V4-Pro | 空闲 | 0.15 | 4.5 | 13.5 |
V4-Pro | 高峰 | 0.3 | 9 | 27 |

高峰时段定在北京时间 9:00-12:00 和 14:00-18:00,其余时间为空闲时段。雷达财经盯着这个时段定义看两秒,你会发现高峰恰好就是打工人的标准工作时间——这套定价本质上是在筛选「必须白天跑的负载」。
至于为什么涨,官方说法是合理调配资源,更现实的背景是算力缺口:中国信通院数据显示,2026 年一季度国内 AI 算力需求同比增长 417%,有效供给增速仅 128%。雷达财经
二、谁真的肉疼,谁其实不用慌
白天跑商业应用、高频 Agent 的用户最先中枪。涨价前两周,V4-Flash 在 OpenRouter 上的周调用量达到 11.2 万亿 Token,连续登顶全球第一。雷达财经这类「白天必须在线」的负载,撞上的是翻四倍的高峰价。
用第三方套餐的用户也被殃及。DeepSeek 涨价,先流血的是转售额度的平台:OpenCodeGo 把 V4-Flash 的 5 小时用量从 63300 削减到 3800,调用量砍掉 94%。知乎用户集体退订之后,额度又加回了一半,但社区里已有实测怀疑平台在降速。哔哩哔哩如果你在用第三方套餐,今后别只看价格,还要看额度规则和平台的改口记录。
反倒是个人轻度用户不用太慌。涨价后 V4-Flash 空闲时段的缓存命中输入也只要 0.05 元/百万 Token,按国盛证券的测算,V4-Pro 高峰时段的输出价格仅为 Claude 旗舰模型的约 1/13,闲时更是只有约 1/25。雷达财经每天跟 AI 聊聊天、偶尔写个脚本的用法,这波涨价基本无感。
三、三条路,各有各的账
第一条路:留下,挪到空闲时段。适合不需要即时响应的任务——批量生成内容、夜里跑 Agent、自动化测试。空闲价格正好是高峰的一半,V4-Pro 的空闲成本约为原价 2 倍,依然是国产旗舰里的底部区间。如果你的活儿能「倒时差」,这是迁移成本最低的方案。
第二条路:换国产订阅。GLM-5.3 在 8 月 14 日发布,编程与智能体能力接近 Claude Fable 5。36氪智谱的 Coding Plan 在 7 月底改版为积分制,积分套餐在空闲时段有 0.5 倍费率,DeepSeek 涨价之后,这个方案的成本优势又回来了。知乎Kimi 的 K3 面向长程编程和复杂知识工作,每百万 Token 普通输入 20 元、输出 100 元,定价不算便宜。DeepTech深科技不过需求是真实的:K3 发布后,月之暗面曾因算力不足暂停接受新的 Kimi 订阅。从 DeepSeek 官方公布的评测对比看,V4-Pro 在 Terminal Bench 2.1、DeepSWE 等编程和 Agent 项目上相对 Opus-4.8 有明显优势,但 GLM、Kimi 追得很紧,换家未必掉能力。

预算敏感的话,订阅制可能比拼用量更划算:火山方舟 Lite 档还有 9.9 元的活动价,MiniMax 的 Token 套餐 29 元/月起步,Kimi Code 订阅分 39 元到 559 元四档。百度千帆的 Coding Plan 也值得看一眼,Lite 档 40 元、Pro 档 200 元/月,一个订阅里打包了 DeepSeek、GLM、Kimi、MiniMax 等多家模型,可以随时切换。

第三条路:看海外。OpenAI 这次是反向操作:7 月 30 日,GPT-5.6 Luna 的 API 价格下降 80%,Terra 下降 20%,ChatGPT Work 和 Codex 里使用这两款模型消耗的额度也随之减少。DeepTech深科技Anthropic 也取消了 Sonnet 5 原定于 9 月实施的 50% 涨价。海外巨头在用低价抢开发者,国产模型在从价格战转向价值战,夹在中间的用户反而多了选择空间。
四、比换哪家更重要的:换个算法
这波涨价最深的变化,不是谁贵了谁便宜了,而是计价的单位变了。过去大家比「每百万 Token 多少钱」,但 Agent 时代,一个任务会触发几十次调用,不同模型完成同一任务的 token 消耗差异巨大。微软研究团队 2026 年评估 8 款推理模型时发现,21.8% 的两两比较中,标价较低的模型最终总成本反而更高,最大差距达到 28 倍。DeepTech深科技麦肯锡在内部使用中也观察到,同一项 Agent 编程任务的成本可能相差 30 倍,约 10% 的用户消耗了 65% 的 Token。社区里流传的这张「智能指数 vs 单任务成本」散点图很能说明问题:横轴是完成同一个标准任务的平均花费,纵轴是智能指数,DeepSeek 原本牢牢占据「最划算」象限,涨价之后,这个位置正在被重新定价。

所以接下来选模型,别只盯价目表,先问三个问题。第一,同一个任务平均要多少次调用?思考链长的模型,单价便宜也烧 token。第二,缓存命中率有多高?编程场景能到 95%,缓存价格决定成本的大头。第三,返工要几次?便宜的模型总答错,算上人工返工反而更贵。
最后,三个值得盯的信号
DeepSeek 涨价后的调用量和留存——这决定这次涨价是试探,还是「回不去了」的开端;
智谱的涨价节奏——年内已经三次提价,留意 Coding Plan 的额度会不会继续缩水;
海外旗舰的动向——GPT-5.6 刚降完价,新一代模型的传闻已经在流传,价目表年内可能再洗一次牌。
一句话收尾:DeepSeek 涨价是真的,但不必像标题渲染得那么慌。夜间党的成本只是翻倍,白天重度用户认真算算「挪空闲、换国产订阅、去 GPT-5.6」这三条路。绝对低价的时代正在结束,会算账的时代才刚刚开始。