DeepSeek刚提价,GLM-5.3今日上线不加价:这份AI编程订阅值不值得换?

源自7位全网作者

15:50

DeepSeek 前脚刚提价,智谱后脚就用"不加价"接住了。如果你正在为 AI 编程订阅付费,今天这条消息值得花三分钟看完。

今天(8月19日),智谱正式上线 GLM-5.3 API,定价与上一代 GLM-5.2 保持一致。微博 Artificial Analysis 综合智能指数上,GLM-5.3 拿到 60 分,与 Kimi K3 并列开源模型第一,进入与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰相同的能力区间。而就在两天前,DeepSeek 新一轮 API 调价刚刚生效。36氪一个提价、一个不涨,性价比的对比一下就出来了。

能力是怎么涨的

这次 GLM-5.3 没有换基座:还是和 GLM-5.2 相同的约 743B 参数底座,所有提升都来自后训练。36氪说白了就是底子不动,只在后面加教"怎么干活"。智谱官方说法是,这轮喂的不再是传统编程题,而是"经验丰富的工程师也要花数天完成"的长程任务,这类训练环境比上一代多了数十倍。

官方自测分确实扎眼:Terminal-Bench 3.0(把模型丢进真实命令行环境干完一整件活)从 4.6 到 28.3;DeepSWE v1.1 从 46.2 到 66.9,超过 DeepSeek V4 Pro;安全侧 CyberGym 从 77.2% 到 84.5%,ExploitBench 从 24.4% 到 54.4%。知乎36氪

讨论度最高的是安全审计成绩:智谱联合清华大学 NISL 实验室、南开大学,以及绿盟科技、奇安信、腾讯玄武等十余家安全团队,在 269 个真实开源项目里找出 2436 个去重漏洞,其中 1097 个中高危。知乎有一处 DNS 协议缺陷潜伏了 40 多年,智谱称利用它能把服务器承受的压力放大近 8 万倍,波及超 1000 万处公网 DNS 服务——注意,这个量级目前是智谱单方口径,还没有第三方复核。

DeepSeek刚提价,GLM-5.3今日上线不加价:这份AI编程订阅值不值得换?

跑分要打几折看

这是我最想泼冷水的地方。

explainx.ai 的统计,智谱官方那张基准表上,约 19 行基准里只有 2 行有具名第三方,其余都是智谱自己跑的。知乎"公开基准"只说明题目公开,不代表这次跑分由第三方独立执行。

DeepSeek刚提价,GLM-5.3今日上线不加价:这份AI编程订阅值不值得换?

在真正的第三方公开榜上(截至 8 月 17 日快照),GLM-5.3 还没进去:榜首是 Claude Opus 5 的 42.7%,后面跟着 GPT-5.6 Sol 的 34.6% 和 Claude Fable 5 的 34.0%,GLM-5.2 还以 4.6% 垫底。知乎所以"自测 28.3"直接对比"榜首 42.7"不成立——两个数不同源,而且榜方测的是"模型 + agent 外壳"的组合分,同一个模型换套外壳,分数能差出一截。

那个"六倍"就更不必激动:从 4.6 起跳基本等于从地板起跳,倍数天然好看。智谱自建的 Z.ai Code Bench 上,GLM-5.3 拿 34.5% 对 Claude Opus 的 29.5%,但两边算力预算不一样(每题约 50K token 对约 120K),数据集和评测包都没公开——这种成绩只能当参考。

相对值得参考的是 Artificial Analysis 的 60 分,那是第三方口径——但它测的是综合智能,不等于编程能力。微博

用起来会碰到的坑

几个实际变化,上手就会遇到:

第一,思考关不掉了。GLM-5.2 允许完全关闭思考,5.3 只能在三档强度里选,默认直接给到最高档。知乎对只需要快速响应的场景,token 消耗和延迟都会上升。

第二,只吃文字,不看图。上下文窗口 1M token、单次输出上限 128K,但输入仅限文本。工作流里涉及设计稿、截图的,这个模型直接出局。

第三,开源权重还要等两周。今天能用的只有 API 和订阅,完整权重定在 8 月 28 日前后开放。知乎智谱官方说法是这两周要做安全评估和模型加固。等权重做本地或私有化部署的,现在不用急。最敏感的网络安全能力还要走"可信访问",只对验证过的用户开放。

第四,许可证还没公布。前三代权重都是 MIT,但那是惯例不是承诺。28 号权重放出那天,许可证文件比跑分更值得先点开。

价格与档位怎么选

现在能用的有两条路:直接调 Z.ai 的 API,或者订阅 GLM Coding Plan。订阅分 $18、$72、$160 三档月费,年付更省。官方至今没公布每百万 token 的单价,第三方托管平台最低报价是输入 $1.20、输出 $4.20,可以当参照。知乎另外还有一条第三方渠道:据 8 月 17 日的社区消息,火山方舟的 AgentPlan 和 CodingPlan 已经接入 GLM-5.3,订阅头两个月 2.5 折,最低档 10 元就能搞定。微博不想付美元、只想先试水的,这是个低门槛入口,具体额度以官方页面为准。

社区已经有成熟的省钱玩法:有人用 ZCode 的免费档配合额度规则,把小项目用最低成本跑起来;B站还有 UP 主出了免费额度翻倍、提升有效 token 利用率的教程。对之前按量付费有 token 焦虑的人,小红书用户的经验是:买个 Coding Plan 确实能缓解"担心一个任务把整个项目预算跑穿"的心理负担。

谁适合换,谁适合等

我的建议是按人群分开看:

DeepSeek 订阅用户、觉得提价有压力的,值得用 $18 的低档先试 GLM-5.3。编程能力至少在官方和社区实测里不弱,价格又正好卡在 DeepSeek 提价的档口。但记住一点:拿自己项目的历史提交去试,比看任何榜单都靠谱。

Claude Code 用户不必全量迁移,可以并行对比。GLM-5.3 的长程 agent 任务有亮点,但第三方榜上和闭源头部还有距离,而且它看不了图。

本地或私有化部署用户,等 8 月 28 日。等的不仅是权重,还有许可证和"加固之后能力有没有缩水"的答案。有一个验证办法:对比 API 和权重在安全任务上的能力画像是否一致,一致才说明这两周真的只是安全评估。

想用安全审计的,先别急。2436 个漏洞是实打实的成绩,但其中只有 53 个已经拿到 CVE 编号,剩下 2383 个还在协同披露禁令期——厂商补丁没出来之前,细节不能说。

两个后续值得盯的信号

一个是 8 月 28 日。权重放出后有没有第三方能复现那个 84.5%、许可证最终是什么,比任何官方说法都管用。

另一个是资本市场。8 月 14 日 GLM-5.3 发布当天,智谱(02513.HK)股价先涨后跌,收跌 3.6%。36氪8 月 18 日大跌 13.3%,收报 1043 港元,三日累计回撤超 30%,盘中一度触及 1000 港元关口。ZAKER摩根大通上调目标价也没拦住。华尔街见闻市场担心的不是模型能力,而是商业化兑现的节奏。不过对用户来说这不是坏事:竞争压力在,价格就不容易涨。

DeepSeek刚提价,GLM-5.3今日上线不加价:这份AI编程订阅值不值得换?

一句话:GLM-5.3 值得一试,但别被"六倍"带节奏。先用低档、拿自己的项目试,28 号权重落地后再补上最后一块证据。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章