兄弟们,如果你还在用 DeepSeek 的 API 干活,这周应该已经收到调价通知了。
8 月 17 日 0 点起,DeepSeek API 新价格正式生效。一句话总结:「梁文锋恩情还不完」的时代,至少在价格表上翻篇了。
涨了多少?把价格表摆出来
这次调价有三个关键点:
首次引入峰谷分时定价,高峰时段为北京时间 9:00-12:00 和 14:00-18:00,空闲时段价格为高峰的一半。
V4 Pro 高峰价:缓存命中输入从 0.025 元涨到 0.3 元/百万 tokens,涨 12 倍;未命中输入从 3 元涨到 9 元,涨 3 倍;输出从 6 元涨到 27 元,是原来的 4.5 倍。36氪
V4 Flash 同步上调,高峰输出来到 9 元/百万 tokens,此前它的峰值输出是 2 元。知乎
全计费项的涨幅区间,大致在 50% 到 1100% 之间。36氪注意,网页端和 App 的免费对话不受影响,这次涨价精准针对 API 开发者与企业客户。知乎所以看到「AI 免费时代终结」这类标题,直接划走就行。用 Claude Code 这类工具接 deepseek-v4-pro 干活的程序员,对这次调价会在账单上感受得最直接。

开发者社区已经炸锅。流传最广的调侃是「梁圣变梁子」,还有人算了一笔更狠的账:DeepSeek 每贵一块钱,就要破产几百家 OPC(单人公司)。36氪纯靠 API 调用过活的独立开发者,是这波受伤最深的群体。
为什么涨价?不只是「算力贵了」
需求端确实凶猛。第三方统计显示,V4-Flash 正式版上线后单周 Token 调用量冲到 8.83 万亿,环比暴涨 570%,连续两周全球第一。知乎服务器扛不住的时候,价格杠杆是最快的调节阀。
成本端也在收紧。英伟达 H100 小时租赁价从 1.7 美元涨到 2.35 美元,涨幅四成,B200 翻倍至 6 美元/小时;HBM 显存这类核心硬件,半年涨超 500%。知乎
但 36 氪(字母AI)的判断更值得听:DeepSeek 是最后一个坚持低价的头部玩家,它的涨价标志着一个时代的结束。36氪AGI 研发是无底洞,唐杰的摸高计划要百亿级投入,梁文锋除了迭代模型还要养 DSH 开源生态,靠补贴换市场的阶段正式落幕。从成本加成定价转向价值定价,是公司长大了的必经之路。
而且涨的不止 DeepSeek。智谱年内已三次提价,一季度累计涨幅约 83%。36氪2 月份智谱 GLM Coding Plan 套餐一次性上调 30% 起,连续包月、包季、包年套餐全部售罄。微博另据知乎网友统计,Kimi K3 的输出价也从 27 元涨到了 100 元。知乎全行业都在同向而行。
跑出来的流量,被 GLM-5.3 接住了
有意思的是时间点。涨价生效前三天,8 月 14 日,智谱发布了 GLM-5.3——而且没涨价。
成绩单确实能打:
Terminal-Bench 3.0(测真实终端里干真活的能力):官方自测从上一代的 4.6 分拉到 28.3 分,智谱称拿下开源第一;
DeepSWE v1.1:66.9 分,超过 DeepSeek V4 Pro 正式版的 62.7 分;
CyberGym:84.5% 登顶全球,压过 Claude Mythos 5 的 83.8% 和 GPT-5.6 Sol 的 83.6%(同样是智谱自测口径);
智谱官方性能图里编程、终端操作、Agent 任务、安全等八项,对 V4 Pro 正式版赢了七项;
在高难度编程任务上,用不到 Claude Opus 4.8 一半的 token,拿到了更高的完成率。36氪

已经有真实用户用脚投票。一位管了十几年生产环境的运维老兵,把主控 Agent 从 GPT-5.6 换成了 GLM-5.3,他的体感定位很克制:弱于 Fable,强于 V4 Pro,大约和 Kimi-K3 掰手腕。知乎他还有一句我很认同:主控可以交给它,签字权必须留给自己。
不过迁徙流量也确实猛:知乎有用户吐槽 GLM-5.3 在 ZCode 里不断重连、无法使用,Coding Max 用户一天下来每轮对话都在重连。这波流量,智谱接得也不轻松。
有意思的是资本市场的态度:GLM-5.3 发布当天,智谱股价高开低走,收盘跌 3.57%,日内最高点算回撤超过 11%。36氪投资者戏称智谱股价是「衡量 DeepSeek 能力最好的测试集」,这次市场把「同基座 + 后训练」的迭代判成了符合预期。
但迁移之前,先看这个「六倍」里的细节
这是本文最想写的部分。GLM-5.3 的分数强,但分数里藏着几个细节:
第一,六倍是从地板起跳。4.6 分本来就是接近垫底的分,从地板起跳,倍数天然好看。真正该问的不是「涨了几倍」,而是「28.3 能排到哪儿」。
第二,官方表里大部分分数是自测。explainx.ai 数过,约 19 行基准里只有 2 行有具名的第三方。知乎「公开基准」只说明题目是公开的,不代表这次跑分是第三方独立执行的。

第三,第三方公开榜的 8 月 17 日快照里,GLM-5.3 还没进去:榜首完成率 42.7%,GLM-5.2 以 4.6% 垫底。知乎拿 28.3 直接对比 42.7% 并不成立,一个是自测,一个是公开榜,不同源;而且榜单每行测的是「模型 + Agent 外壳」的组合,同一个模型换套外壳,分数能差出一截。
第四,完整权重要等两周后才放,大致在 8 月 28 日前后。知乎智谱给的理由是安全评估:这次 GLM-5.3 涌现出了网络安全能力,官方原话是「出乎意料的是,它开始跨越漏洞利用的多个阶段,形成完整的攻击链计划」。
红队测试的产出也很实在:智谱联合清华 NISL、南开大学和绿盟、奇安信等十余家安全团队,在 269 个真实开源项目里找出 2436 个去重漏洞,平均已经潜伏 26.6 年,最早的一处 1981 年就写进了代码里,其中 1983 年 DNS 协议里的缺陷躺了 40 多年。知乎安全能力本身也只向验证过的用户「可信访问」,不跟权重一起放开。
这事有真实的争论:支持方认为,发现计划外的攻击能力后先暂停分发,正是一家负责任的实验室该有的样子;反对方则指出,权重晚放两周,风险并没有跟着晚两周——API 发布当天就开了,想拿它找漏洞的人只需要付 token 钱。真正为这两周买单的,是等着可下载权重做部署的人。
有人已经给出验证办法:两周后对比 API 版本和权重版本在安全任务上的能力画像是否一致,基本一致的话,这两周就更像是姿态。这个方法值得存一下。
第五,体验上也有变化:GLM-5.3 的思考模式关不掉了(三档强度、默认最高档),上下文 1M tokens、单次输出上限 128K,只吃文字、看不了图。
所以,谁该迁移、谁别急着迁
直接给结论,按人群分:
免费聊天党:不用慌,这次调价不碰网页/App 免费功能,照常用。
靠 API 跑活的独立开发者:先做三件事再骂——错峰调用(空闲半价)、打开缓存命中(0.3 元对 9 元,差 30 倍)、低频任务批处理。如果月账单还是扛不住,可以试 GLM-5.3,但要对「模型强、服务暂时不稳」有心理预期。
Coding 订阅用户:GLM Coding Plan 目前向 Max/Pro/Lite 全档开放,并支持接入 Claude Code、Goose、Codex。知乎订阅价 $18/$72/$160 三档月费,年付更省。知乎低成本试一个月,拿自己项目的历史提交当测试题——跑分测不出读老仓库、遵守项目代码风格、调内部接口这些真活的适配度,别信任何人的榜,只信自己的业务。
本地部署 / 自托管党:现在别急,等 8 月 28 日前后权重放出。那天有两件事比跑分重要:许可证文件(前三代权重都是 MIT,这次官方还没宣布,惯例不等于承诺),以及有没有第三方能复现那个 84.5%。
依赖多模态、或者需要关掉思考省钱的:GLM-5.3 暂时不适合你。留在 V4 Flash 的空闲时段也行——它的性能并不弱,被媒体称为大模型的「斩杀线」:不一定在每项测试里最强,但能力已经覆盖大量真实任务,而价格足够低。36氪错峰价一叠加,智效比依然站得住。

最后,留几个值得盯的信号
8 月 28 日的权重窗口:第三方能不能复现跑分、API 和权重能力画像是否一致、许可证到底是什么,三个答案同一天揭晓。
智谱的下一次定价动作:年内三次提价累计 83% 之后,这次 GLM-5.3 不涨价接流量,下一版还扛不扛得住?价格战时代的免费午餐,正在越来越少。
DeepSeek 的错峰留存率:涨价后调用量如果不跌,说明需求是刚性的,全行业定价中枢还会上移;如果调用量崩了,涨价自己就会回调。
ZCode 的重连什么时候修好——这代表智谱接住迁徙流量的诚意。
一句话收尾:这一波不是「某家公司变坏了」,而是整个大模型行业集体成年、开始收钱。对我们用户来说,与其等一个「最便宜的模型」,不如学会算智效比、学会错峰、手里永远留两个备选。