本周五(8月28日),智谱会把GLM-5.3的模型权重正式开源。
这不是传闻。8月22日,AIX财经和多位科技博主几乎同时确认了同一件事:GLM-5.3权重"下周五"开源。知乎知乎智谱官方也把GLM-5.3直接定位为"新一代开源基座模型"。知乎结合GLM系列一路开源权重的惯例,这件事基本没有悬念。
对盯着GLM大模型的值友来说,真正该盘算的不是"开源了能不能白嫖",而是——这个免费午餐,到底有没有你的份。
前十里块头最小,但你的机器装不下它
先看这模型凭什么值得等。
Artificial Analysis最新综合智能指数里,GLM-5.3拿到60分,和前代GLM-5.2的53分拉开明显差距,追平Kimi K3,并列开源权重模型第一,距离GPT-5.6 Sol只差1分。知乎在CyberGym网络安全基准上它拿到84.5%,超过了GPT-5.6 Sol的83.6%。知乎官方还披露用它审了269个开源项目,挖出2436个漏洞。知乎

更关键的是块头:60分以上的6个模型里,GLM-5.3是唯一参数量不到T级的——总参数744B,激活只有40B。知乎同分的Kimi K3是2.8T,DeepSeek-V4-Pro约1.6T。在AA的14模型对比集里,它的智能体(Agentic)指数排到第2。知乎长程Agent任务,恰好是激活参数小、推理成本低的MoE架构最吃香的场景。智谱官方博客的原话是:“它沿用GLM-5.2的基座,每一分提升都来自后训练。”

听起来很美好:最小的身板,第一梯队的脑子。但这里有个MoE模型最容易让人产生错觉的地方——激活40B,指的是每次推理时参与计算的参数规模,所以它跑得快、推理成本低;可744B的完整权重,一个字节都不会少,必须全部塞进显存。
按每个参数0.5字节做INT4量化估算,光权重就要约372GB,再算上KV缓存和激活开销,实际需求400GB往上——差不多是17张RTX 4090,或者3到5张H200级别数据卡的分量(以上为粗略估算,不含KV缓存)。这是机房级配置,不是桌面级玩具。
有博主的评价很到位:744B的体量,让"企业在自己机房拉起私有化部署的硬件门槛和成本,比动辄2T、3T的大家伙友好很多"。知乎注意这句话的主语——是企业,不是你我的工作站。
这份免费午餐,其实是给三类人准备的
那开源到底便宜了谁?
第一类是有私有化需求的企业。同样想本地部署一个60分档的模型,选2.8T的Kimi K3和选744B的GLM-5.3,硬件投入差出一个数量级。对金融、政企这类数据出不了内网的场景,这就是实打实的成本优势。
第二类是第三方推理平台。截至8月23日,SiliconFlow上还没有GLM-5.3的正式上架页面,ModelScope上也查不到官方权重。知乎这正常,毕竟还没开源。参考此前开源大模型的节奏,权重放出后,托管推理服务通常几天内就会跟上,平台之间的价格竞争也会把API单价往下压。现在GLM-5.3官方API定价是输入8元、输出28元每百万token,缓存命中输入只要2元。知乎OpenRouter上的价格是输入1.4美元、输出4.4美元。知乎开源之后会不会出现更便宜的托管价,值得蹲一波。

第三类是蒸馏、微调和应用生态的玩家。这两天全网给匿名模型OxAlpha"验血缘",其中一路猜测就是"有人拿开源GLM训练的"——你看,开源权重早就是整个行业的原料了。GLM-5.3放出来之后,小模型蒸馏、行业微调的素材库又多一个高质量选项。
个人用户,开源前这5天怎么安排
如果你只是想用上GLM-5.3,而不是把它装进自己机房,现在就有三条路,不用等周五。
轻度尝鲜,先薅免费额度。智谱的ZCode对新用户送1亿GLM-5.3 token。知乎第二轮1亿token的限时赠送活动8月24日早9点截止,手快还有得薅。微博北京超算那个面向科教用户的1000万token福利已经在8月22日过期,就不惦记了。知乎免费路径就这两条,抓紧的抓紧,错过的别纠结。
重度写代码,直接订Coding Plan。新版是积分制,Lite档每月118元,Pro 538元,Max 1078元。微博注意GLM-5.3在积分制里的消耗系数:输入6.9、缓存输入1.7、输出24,非高峰时段按0.5倍计。知乎翻译一下:把重活尽量安排在非高峰跑,同样订阅费能干的活翻倍,这也是"等等党"和"充值党"之外最省心的姿势。
按量付费走API的,记住一个坑:GLM-5.3的reasoning_effort默认档是max,有开发者在短分类任务上没手动调低档位,账单直接膨胀了几十倍。知乎下单前先看一眼推理档位设置,这比任何比价都有用。至于按量用到底贵不贵,可以瞄一眼DeepSWE自主编程任务榜单:它的成绩和单任务成本都站在第一梯队里,属于"能用得起的前沿"。知乎

另外几条顺手的路:阿里云百炼8月21日已接入GLM-5.3。知乎国家超算互联网也上线了兼容OpenAI与Anthropic接口规范的调用服务。微博GitHub Copilot那边有社区扩展支持自带密钥接入。渠道不缺,缺的是先想清楚自己的用量。
开源之后,盯这三个信号
最后给准备长线跟进的值友三个观察点:
一是开源当天或次日,有没有主流推理平台立刻上架托管服务——上得快,说明生态位早就有人卡好了,价格战大概率跟着来;
二是一周内社区会不会放出GGUF、MLX等量化版本和蒸馏小模型——这决定了"本地跑GLM"离普通人还有多远;
三是智谱会不会顺势放出同系列的小尺寸版本,比如已经在流传的GLM-5.3-Flash——对想用消费级硬件折腾的人来说,那才是真机会。
顺带一个数据当谈资:8月22日,GLM-5.3仅在OpenRouter一个平台,单日就跑出约100.2B token、128万次请求。知乎发布日股价虽然没给面子,智谱当天下跌了3.6%。知乎但开发者用token投的票,从来不看K线。
周五权重放出那天,值得回来对一对:上面这三个信号,兑现了几个。