这周的开源圈,信息量有点大,而且特别割裂:一边是 DeepSeek 把 Agent 框架 Harness 按 MIT 协议开源,GitHub 星标几天就冲上六位数,B 站一个入门教程播放量干到 82 万;另一边,还是 DeepSeek,8 月 17 日零点把 V4 系列 API 最高涨价 1100%,开发者哀鸿遍野。哔哩哔哩知乎隔天智谱发布 GLM-5.3,今天(8 月 19 日)API 平价上线。微博官方还承诺,8 月 28 日开源完整权重。
一个开源圈,两种开源法。这周的账,值得每个还在用开源模型干活的人算清楚。
一、先算账:DeepSeek 到底涨了多少
先看官方价目(每百万 Token):
V4-Pro 缓存命中输入:0.025 元 → 高峰 0.3 元,涨 1100%
未命中输入:3 元 → 高峰 9 元,涨 200%
输出:6 元 → 高峰 27 元,涨 350%
V4-Flash 同步上调,输出从 2 元涨到高峰 9 元
关键变化是引入了峰谷定价:工作日 9-12 点、14-18 点是高峰价,其余时间(晚上、周末)全部半价。国产主流厂商里,目前只有它一家这么玩。知乎
涨价有多疼?有个被反复引用的真实账单:一位博主 267 次请求、约 7673 万 Token(缓存命中占 98.35%),旧价 2.99 元,新价峰谷混合 7.27 元——轻度用量都翻了 2.4 倍。知乎跑 Agent 的人更惨,编程 Agent 反复读代码、读历史,缓存命中用量动辄上亿 Token,而这轮涨得最狠的恰恰是缓存命中价。
连锁反应已经开始:据媒体统计,第三方编程平台 OpenCode 上,V4 Flash 每 5 小时调用量从 6.3 万跌到 3800,暴跌 94%。知乎DeepSeek 模型月限额被砍到 15 美元,用户排队退订;腾讯云 CloudBase 几乎同步跟随官方调价。
而且这不是 DeepSeek 一家的事。把国产旗舰的公开定价拉一遍:豆包 Seed-2.1 Pro 输出 30 元,较前代接近翻倍;Kimi K3 输出直接定到 100 元;智谱自己也年内三次提价。反方向的是海外:OpenAI 把 GPT-5.6 Luna 降价 80%,Anthropic 的 Claude Opus 5 定价约为先前旗舰一半,还取消了 Sonnet 5 的涨价计划。知乎
一句话:按分计价的白菜算力时代,正在关门。
二、为什么一边开源,一边涨价
看着矛盾,其实是两套清晰的商业逻辑。
DeepSeek 开源的是「缰绳」,收钱的是「马力」。Harness 的定位不是又一个编程助手,而是 Agent 基础设施——模型、工具、技能、沙箱、UI 全部插件化,MIT 协议,谁都能拿去搭自己的 Agent。社区数据能说明它的火爆:据知乎作者统计,Codex CLI 花了几年才到 10 万星,Harness 几天就超过 15 万星。知乎B 站、小红书上从保姆级教程到 Web UI 皮肤包,生态一周内就长出来了。哔哩哔哩甚至有第三方项目在官方发布前就攒了 8 万星。小红书

但模型调用是生意。据多家媒体报道,DeepSeek 这轮涨价的背景是调用量爆炸——V4-Flash 单周调用量突破 8.83 万亿 Token,环比涨 570%,算力逼近物理极限;梁文锋在投资人闭门交流中提到的定价哲学是「以服务器 10 个月回本为基准,只赚约 6 倍合理利润」。知乎想便宜?可以,把任务挪到晚上跑——峰谷定价本身就是筛选器。
智谱走的是另一条路:API 平价稳住开发者,承诺开源权重换私有化部署市场,用 Coding Plan 和企业服务赚钱。GLM-5.3 今天上线,定价与 GLM-5.2 完全一致,而智谱自家的编程工具 ZCode 本身就是一个针对 GLM 深度优化的 Coding Harness——8 月 11 日刚完成大版本升级,上线了 Subagents、远程控制、闲时任务,GLM Coding Plan 全员额度回满。微博
两条路没有高下,但对用户意味着完全不同的参与方式。
三、GLM-5.3 值不值得换
先看硬货。GLM-5.3 没换基座、没堆参数,还是 744B 总参数 / 40B 激活的 MoE,靠大规模后训练强化学习提能力:
DeepSWE v1.1(复杂软件工程):46.2 → 66.9。知乎
Terminal-Bench 3.0:开源模型第一。
CyberGym(网络安全):84.5%,开源第一。
Artificial Analysis 综合智能指数:60 分,与 Kimi K3 并列开源第一,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同一水平。微博知乎

安全能力是这次的差异化卖点,而且不是 PPT:清华 NISL 等团队用 GLM-5.3 发现了 DNS 协议中潜伏 40 余年的漏洞类,据估算影响全球九成以上主流 DNS 系统。知乎智谱联合多家安全团队累计发现漏洞 2436 个,其中 1097 个中高危。之前 Hugging Face 遭入侵,闭源模型拒绝协助取证,换本地部署的 GLM 才还原了攻击过程——这件事连黄仁勋都公开评论了。
还有个容易被忽略的点:省钱。官方数据里,同样的高难度工程任务,GLM-5.3 用 7.5 万 Token 能完成 34.5% 的核心任务,GLM-5.2 要消耗 9.6 万 Token 只完成 23.4%——完成同等任务消耗的 Token 更少,API 又没涨价,实际成本是下降的。知乎

但也要泼点冷水:目前实测样本还很少,跑分主要来自官方发布和少数早期测评,真实工程表现要等社区大规模验证;「对标闭源旗舰」的说法,建议按「同一水平线、各有胜负」理解。真正的关键节点是 8 月 28 日权重开源那天——能不能本地跑、量化后还剩多少功力,才见真章。
四、这周该做的四个决定
按你现在的使用方式对号入座:
1)Agent 重度用户,主力还是 DeepSeek:别硬扛高峰价。把长任务、批处理挪到晚上和周末,直接半价;同时认真研究缓存——命中价虽然涨了 11 倍,但仍比未命中便宜约 30 倍,Harness 这类框架的前缀缓存优化,已经从省钱技巧变成生存技能。知乎
2)Coding 订阅党:GLM-5.3 已接入 GLM Coding Plan 和 ZCode,编码是这次提升最大的方向,值得把手头项目迁过去试一周,各基准的横向对比可以参照下面这张表。知乎预算敏感可以看腾讯混元 Hy3(1/4 元每百万 Token,国产旗舰最低)和 MiniMax M3,但要想清楚:便宜的旗舰,往往只是旗舰的价格,不是旗舰的能力。知乎

3)本地部署党:别急,等 8 月 28 日。官方已确认,会在两周内开源 GLM-5.3 的完整权重,并同步启动面向开源社区的「开源的盾」计划,免费提供安全审计模型额度。知乎MoE 40B 激活参数对量化部署相对友好,届时会有大批现成作业可抄。
4)Harness 围观党:理念值得学,下手不用急。它是 v0.1 开发者预览版,代码按 MIT 许可开源。小红书它开源的不是又一个编程助手,而是 Agent 运行时框架,核心公式是模型+Harness=Agent。哔哩哔哩「一切皆插件」的架构确实代表了 Agent 开源从「产品」到「基础设施」的路线切换。知乎想要即插即用的成品,Codex CLI、ZCode 目前更稳。
接下来值得盯的三个信号:8 月 28 日 GLM-5.3 权重开源的成色;OpenCode 等第三方平台的额度是否恢复;以及峰谷定价是否会被更多厂商跟进——腾讯云已经跟了。
开源没有死,只是「开源 = 免费」这个等号正在被重新定价。模型在变贵,但缰绳、权重和生态在变得更开放。这周的账单告诉你:该省的钱靠错峰和缓存省,该等的时间留给 8 月 28 日,该试的新东西,先试 GLM-5.3 的编码能力。