智谱这周末放了个大招:ZCode用户数突破100万,官方拿出1亿GLM-5.3 token送给新用户,8月16日0点开始首次登录ZCode即自动到账。知乎活动原定做到8月17日早上9点,结果开启不到1小时,因需求远超预期,官方宣布暂停发放,已领取的不受影响,新用户标准3M token福利依然有效。微博官方表示调整完容量后会恢复活动。
领到的人怎么说
更有意思的是领到的人的声音。知乎"如何评价GLM-5.3?"下面有人直接发问:标的每日免费额度1亿token,跑了2个任务就没了,是计费有问题,还是真用了这么多。知乎
小红书上也有博主跑了两天代码任务,直言"编程能力是真的肉眼可见变强了,长任务不容易走偏"。小红书但另一位拿到大额额度的博主晒出了完全相反的用法——“我的3亿只消耗20%就是用的zcode”。小红书同样是GLM-5.3,同样是大额免费额度,体感差距为什么这么大?这个落差值得说清楚,因为它直接决定每个准备用GLM-5.3的人该怎么规划自己的钱包。
先对齐一下GLM-5.3是什么
一直追国产模型的朋友可以跳过这一段。8月14日发布,基座和GLM-5.2完全相同,7430亿参数MoE,没换架构,所有提升都来自后训练。知乎
效果上:Terminal-Bench 3.0从5.2的4.6分跳到28.3分拿下开源第一,DeepSWE v1.1拿到66.9分超过DeepSeek V4 Pro正式版的62.7分,网络安全基准CyberGym以84.5%登顶全球。36氪

反面的话也说在前面。编程体感提升50%是智谱内部评测的口径,"接近Claude Fable 5"同样是官方表态。知乎市场的反应很诚实:发布当天智谱股价跌了3.57%。36氪跑分是跑分,能不能干活,得拿自己的任务跑。
同一周,DeepSeek刚涨了价
还有个背景值得注意:8月17日0点起DeepSeek API新一轮调价生效,全面引入峰谷分时定价,全计费项涨幅50%至1100%,而智谱这次没给GLM-5.3涨价。36氪有开发者实测,空闲时段DeepSeek V4 Flash也涨了一倍多,1亿token大约要11块钱。微博所以这波"试试国产模型"的情绪,明显偏向GLM。
回到核心问题:1亿token到底经不经用
先看消耗机制。聊天式AI的token消耗大致是线性的,Agent式编程任务不是:每一轮模型都要把之前的上下文重新读一遍,输入随轮次滚雪球;思考过程和生成的代码是输出token;一个任务可能调用几十上百次工具。所以一个"重构+跑测试+自己调试"的自动化任务,一次烧掉几百万甚至上千万token很正常——1亿听着吓人,两个重任务真能烧完;反过来,只是问答、写小脚本,就耐用得多。

这事还有历史参照。GLM-5.2时代,智谱给ZCode用户每天300万免费token,有用户一天实际跑了近2900万token,额度却连300万的一半都没扣到;第二天开始卡,第三天限制并发,才变成实打实的300万。微博另一位博主回忆,额度被精准打回300万,“从’随便用’到’回到现实’,只用了两天”,官方没有任何说明。微博这说明两件事:名义额度和实际可用量之间,不是简单的一对一;免费福利随时会变,信息保质期极短。所以正确的姿势不是"1亿token等于多少天",而是"你拿它跑什么任务"。这个问题对后面所有免费额度同样适用。
1亿活动喊停之后,现在还能从哪儿免费用
先说智谱自家的:
ZCode新用户标准福利3M token,不依赖活动运气,目前依然可领,够验证GLM-5.3适不适合你的活儿。
ZCode闲时任务:最被低估的功能。不着急要结果的任务提交进队列,ZCode在算力低峰自动执行,官方承诺"在闲时任务权益范围内,不扣减用户的GLM Coding Plan积分"。知乎微博上已经有人感慨:“Zcode的闲时任务到底是哪个天才想出来的,真的一点额度都不降,纯免费跑GLM5.3”。微博注意边界:官方口径限定在"闲时任务权益范围内",具体边界要自己实测。
1亿活动:官方承诺调整完容量后恢复,没领到的值得蹲。

第二梯队是第三方平台:
Qoder模型最全:“GLM-5.3有,DeepSeek V4 Flash正式版有,V4 Pro正式版也有,顺手还有Qwen3.8-Max正式版和Kimi K2.7-Code。新用户注册送积分”。知乎
TRAE Work(字节):GLM-5.3目前免费,注册送积分,每天签到还送积分。
WorkBuddy(腾讯):DeepSeek V4 Flash/Pro正式版都有,但GLM-5.3目前不对免费用户开放——想白嫖GLM的别来这。
提醒一句:这类新模型免费活动极不稳定,说下线就下线,而且不同模型扣积分的倍率不一样,旗舰烧得快。标准操作是免费的全注册先用完,再考虑付费。

用Claude Code的同学,有个坑必须知道
把GLM-5.3接进Claude Code的,先打个/context看看第一行的分母。做模型网关的开发者发现,CC碰到不认识的模型名,会保守假设上下文只有200K,并按这个数字触发自动压缩。知乎GLM-5.3的真实窗口是1M,等于80%被默默浪费,而且不报错——你只会觉得"这模型老忘事"。
有人拿Claude Code 2.1.233做了更细的实测:200K那一侧还要再扣掉33K的auto-compact预留,实际能装的空间只有165K左右;加[1m]之后是998K,差6倍。知乎
解法是Claude Code自己在警告里给出的:模型名后面加[1m],比如glm-5.3[1m]。这是纯客户端标记,CC发送前会自己剥掉,不需要中转配合。知乎
但只给确认是1M窗口的模型加——GLM-5.2/5.3、Kimi K3、DeepSeek V4-Pro这几个核实过,窗口没依据的模型别乱标,标早了只是少用点上下文,标错了会一路顶到上游真实窗口直接报错。知乎/context第一行的分母,才是唯一可信的验收标准。
最后:谁该继续白嫖,谁该付钱
先看能力面:智谱官方性能图里,编程、终端操作、Agent任务、网络安全等八方面,GLM-5.3赢过DeepSeek V4 Pro正式版七项。36氪

再看价格面:这个8月,智谱把旗舰模型的购买门槛从抢购改成直接购买,代价是价格翻倍;Kimi发布K3后反而收紧供应。知乎国产coding订阅"便宜量大"的时代在退潮,免费额度的价值反而在上升。
想试试水的:免费组合够了。ZCode的3M+闲时任务,再加第三方平台的新用户积分,足够判断"GLM-5.3能不能干我的活",一分钱不用花。
中度使用:等1亿活动恢复,同时盯住限时窗口——8月31日前在ZCode用GLM Coding Plan还有1.5倍额度加成。知乎
重度使用、准备长期订阅:别只比价格。订阅套餐按credits计费,官方从没公布credits和token的换算比例,直接比价格本质是拿不透明单位硬凑对比。知乎更靠谱的做法是先按量跑一到两周,记录真实消耗,再决定订不订、订哪档。
后续值得盯的三个信号
1亿活动什么时候恢复。官方只说"调整完容量后会恢复活动",没给具体时间。微博没领到的,值得蹲。
权重开放。智谱承诺发布两周内开放模型权重。知乎届时第三方复测会取代官方口径,"50%"到底含金量如何,到时候见分晓。
价格。这次智谱没涨价,但看看新套餐已经翻倍、DeepSeek也刚调价,别把当前定价当永久承诺。
一句话:GLM-5.3的免费额度,够回答"值不值得换"这个问题;而"该为它花多少钱",让你自己任务的消耗来说话。