同一个GLM-5.3,三种价格:Lite从49涨到118元,API藏着35倍的坑,哪种付费值得买

源自13位全网作者

06:06

今天(8月19日),智谱把 GLM-5.3 的独立 API 正式上线了。知乎往前倒几天,8月14日模型发布,GLM Coding Plan 订阅也同步重新开放。知乎小红书至此,想用 GLM-5.3 写代码的人面前摆着三条付费路:订阅套餐、官方 API 按量计费、第三方通道。

有意思的是,同一个模型,三种付费方式能差出完全不同的账单。订阅入门档从 49 元涨到了 118 元/月,主力档要 538 元/月;API 单价没涨,但一个大多数人不会去传的参数,能让你的账单差出好几倍。这篇把三条路一条条算清楚,你对照自己的用法选就行。

先花10秒对齐:你在为什么买单

GLM-5.3 跟上一代 GLM-5.2 是同一个基座,总参数 753B、激活 40B 的 MoE,提升全部来自后训练。知乎结果是在 Artificial Analysis 综合智能指数上拿了 60 分,进入全球前沿模型区间,和 Kimi K3 并列开放权重模型第一。知乎

编程相关的提升尤其猛:Terminal-Bench 3.0 从上代的 4.6 拉到 28.3,DeepSWE 1.1 从 46.2 升到 66.9。知乎与此同时,1M 上下文成了标配。知乎

唯一留了个尾巴:原定公开的模型权重往后推了大约两周。知乎

同一个GLM-5.3,三种价格:Lite从49涨到118元,API藏着35倍的坑,哪种付费值得买

一句话:这是眼下能花钱买到的最强开源编程模型之一,所以大家才抢着付费。问题只剩一个——用什么姿势付。

路子一:官方 GLM Coding Plan,从"抢不到"变成"买得起了但贵了"

之前蹲过订阅的都知道,Coding Plan 一直是限量抢购,老价格是 Lite 49 元/月、Pro 149 元/月、Max 469 元/月。小红书现在不用抢了,随时能买。小红书代价是价格上来了:最便宜的 Lite 118 元/月,主力 Pro 538 元/月。小红书

涨价不是白涨的。新版套餐换成了完全透明的积分制:输入、输出、缓存命中的 token,加上不同模型和 MCP 能力的使用,全部按公开规则折算成积分。小红书告别了以前"按 prompt 次数算"算不清的糊涂账。

但配额规则里有几个弯:

  • 周限额 + 5 小时滚动限额双卡,重度用户得规划着用。知乎

  • 每天 14:00-18:00 是高峰期,ZCode 高峰期消耗系数会调到 2x;非高峰积分扣除打 5 折,ZCode 非高峰系数只有 0.67。知乎

  • 周末全天都算低峰。小红书

同一个GLM-5.3,三种价格:Lite从49涨到118元,API藏着35倍的坑,哪种付费值得买

同一份 118 元的套餐,上午蹲着用和下午高峰硬刚,能干出来的活差出不止一倍。知乎有位重度用户的打法就很典型:早上和晚上用智谱,下午高峰切去别的模型,把每一分钱都花在低峰系数上。知乎

还有个隐藏福利:这次 GLM-5.3 发布,官方把所有套餐的额度直接重置了一遍,等于白送一波。知乎

社区的真实反馈也很直白:有 Max 用户说两天就烧掉周限额的 68%,“完全不够用”。小红书所以订阅制的真实价格不只是月费,还有你的使用节奏。

适合谁:每天高频跑 Claude Code、Cline 这类 Agent,不想折腾 API 配置的人。建议按月订阅、别锁年——这个赛道一个月一个样,隔壁 Kimi for Coding 的入门档还挂着 49 元。知乎

路子二:官方 API 按量,单价没涨,最贵的一行是你没传的参数

先看牌面价:输入 $1.40、输出 $4.40、缓存输入 $0.26,每百万 token,和 GLM-5.2 完全同价。知乎缓存价只有冷读的 19%,促销期存储费还免,重复的 system prompt 塞进缓存基本是白捡的便宜。知乎

真正的坑在这:GLM-5.3 的推理是恒开的,reasoning_effort 只接受 low、high、max 三档,默认是 max。知乎有人拿短分类任务实测:low 档输出中位数 3 个 token,max 档 105 个,两边答案一模一样——计费的输出部分差了 35 倍,折算成 100 万次调用,low 花 $84.6,max 花 $533.4。知乎同一个模型、同一份 prompt、同一个答案,差的只是一个字符串。

最容易被跳过的 high 档反而是甜点:比 low 贵 26%,但在代码任务上中位延迟反而更短(8.6 秒对 11.6 秒)。知乎

同一个GLM-5.3,三种价格:Lite从49涨到118元,API藏着35倍的坑,哪种付费值得买

max 档就更没必要了:代码任务要多花 5.5 倍的等待时间,产出还是得人来读。知乎

几个专门的坑,记一下:

  • 传 reasoning_effort: “medium” 或 “none” 会直接 400 报错,别拿别家的习惯猜参数。知乎

  • 订阅过 Coding Plan 的账号(包括已过期的),API 目前只能走 OpenAI Chat Completions 协议,换别的协议会失败。知乎

  • 从其他模型迁移过来,官方给的顺序是先改 effort 参数、再换模型 ID,反了会挂。知乎

适合谁:用量零散、跑高频短请求,或者团队里有能力自己管 token 消耗的人。记住处处显式写上 reasoning_effort,包括重试封装和框架帮你拼请求体的地方,少写一处就是一张 max 档的账单。

路子三:第三方通道和老玩家的组合拳

查了下 OpenRouter,挂的同样是 $1.4/$4.4,上下文 1,048,576,属于原价透传、没有加价。知乎所以第三方通道的价值不在便宜,在于一个入口管多个模型,适合混着用各家模型的人。

社区老玩家更流行的是组合拳:先把 Coding Plan 的订阅额度烧完,不够了再切 API 按量,下午高峰时段整体换个模型干活。知乎

还有人干脆两条腿走路——同档对比里,GLM-5.3 快:GLM-5.2 实测生成速度超过 110 tokens/s,GLM-5.3 延续了这副高吞吐底子。知乎Kimi K3 节奏慢半拍,但出手更稳,在大规模重构这类重活上更扎实。

同一个GLM-5.3,三种价格:Lite从49涨到118元,API藏着35倍的坑,哪种付费值得买

价格上 Kimi for Coding 入门 49 元、主力 199 元,和 GLM 的 118/538 正好错位,重仓库活儿两个订阅配着用,可能比单买顶配套餐划算。知乎

再往后看一条路:两周左右权重就放出来了。家里有显卡的可以盯一下,社区已经有人在 16G 显存上本地跑 GLM-5.2,慢是慢点,但量无限。知乎

一句话决策表

  • 轻度尝鲜:别买订阅,API 充个最低额度,把 reasoning_effort 设成 high;

  • 日常写代码当主力:Lite 118 元/月起步,把重活排在非高峰时段;

  • 全天候重度:上 Pro 或 Max,配"高峰换模型"的组合打法;

  • 团队接 API:按量计费 + 缓存 + 显式 effort 参数,大概率比订阅省;

  • 不管选哪种:按月来,别锁年。

后面有两件事值得盯着:一是两周后权重开源,自部署会不会把订阅的性价比逻辑改掉;二是新版积分制刚落地,实际跑一两周后额度紧不紧、官方会不会微调,社区很快会有共识。DeepSeek 8月17日刚完成一轮提价,这个市场的便宜窗口,从来都是说关就关。知乎

你现在用的是哪种付费方式?配额一天能烧掉多少?评论区报个数,帮大家把账算得更准。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章