还剩3天。智谱 GLM-5.3 的模型权重,8月28日正式开源。
如果你最近关注多模态大模型,大概率刷到过它的"匿名分身"——那个被全网叫作"牛来"的 OxAlpha。微博百万上下文、能读图片还能看视频,上线首日就冲上 OpenRouter 调用量榜首,顺手终结了 DeepSeek 在 OpenCode 上56天的霸榜。微博社区拿着分词器指纹、报错信息、视频编码器特征一路比对,把它的身份指向了智谱 GLM-5.3 一系。知乎智谱至今没有认领,但时间线很诚实:"牛来"的免费窗口临近收尾,而8月28日,正好是 GLM-5.3 权重开源的日子。

所以很多人在等这一天。但先别急着兴奋,这三盆冷水,可能帮你省掉下载一百多 GB 之后的失望。
先交代下这个开源为什么值得关注。GLM-5.3 在8月14日发布,API 8月19日上线。微博权重本来可以更早放出来,却硬生生拖到了28号。推迟的理由相当罕见:它的网络安全能力"超出了官方预期"。在 CyberGym 基准上,GLM-5.3 拿到84.5%,超过了一众闭源旗舰;智谱自己让它扫描269个开源项目,挖出2436个漏洞,其中107个严重级、990个高危级,最老的一个能追溯到1981年,潜伏了45年。知乎知乎上相关问题直接写进了标题:“首次因为网络安全能力推迟权重开源”。知乎开源阵营里,因为"太会找漏洞"而被按住两周的模型,这是头一个。

成绩也配得上这点波澜:沿用和 GLM-5.2 相同的基座(约744B参数),不扩参数、纯靠后训练,编程体感比上代提升约50%。知乎智源指数60分拿下开源第一,DeepSWE 拿了66.9,赢过体量接近它两倍的对手。

但热闹归热闹,8月28日你要等的到底是什么?先想清楚三件事。
第一,开源不等于你能本地跑。这是最容易被忽略的一点。GLM-5.3 是约744B参数的 MoE 模型——MoE 只是推理时激活一部分参数,权重本身一个字节都不会少。按4bit量化算,光装下权重就要接近400GB 显存,这还没算上下文缓存的开销,基本等于五六张以上旗舰卡组成的集群门槛。你手里的24G、48G 显卡,这次真的只能围观。对绝大多数人来说,这次开源的实际意义是:第三方平台跟进接入、Coding Plan 套餐扩容、社区基于权重做量化和蒸馏——而不是"以后不用花钱了"。社区已经在传 turbo 版和小尺寸版本的消息,那才是普通人真正该蹲的后续。
第二,开源不等于包含"牛来"的多模态。官方口径目前只说"模型权重8月28日开源",没有公布范围清单。而"牛来"最出圈的卖点之一——图片和视频输入——社区取证认为来自单独的视觉栈,并不一定在这次开源的包里。参考智谱之前的做法,多模态组件经常单独放(比如 GLM-OCR 就是独立开源的)。如果你冲的是"免费多模态劳动力",8月28日大概率要再等等后续,别把预期一次拉满。
第三,开源不等于争议结束。社区现在明显分成两派:一派认为它是"最强开源模型",另一派反驳基座没换、算不上真正的换代。知乎还有实测视频直接起名"GLM5.3言过其实"。"牛来"免费版的实测也翻过车,有用户反馈长任务动不动就断、分析深度一般。微博开源的好处恰恰在这里——权重放出来,跑分就能被复现,宣传就能被验证。它不是争议的终点,是验证的起点。
那这三天和开源之后,不同人该怎么站?给你三条路。
只是想尝鲜的:趁免费窗口还没关,去 OpenRouter 或 OpenCode 把 OxAlpha 试了。微博两个提醒:别放关键任务、别跑太长链路,社区反馈它的长任务稳定性一般;免费窗口大概率跟着开源节点走,想试趁早。
想用在生产里的:直接看 API。定价和 GLM-5.2 持平,输入8元、输出28元每百万 token,输出价大约是 Claude Opus 4.8 的六分之一。知乎编程、Agent、长程任务这些甜区场景,性价比现在是开源系里最能打的之一。

真想等开源的:适合研究者、要做微调二开的、和有集群的企业。8月28日当天,建议直接对着四样东西核对:开源清单里有没有视觉组件、许可证是否允许商用、有没有量化版和蒸馏版、以及智谱到底认不认"牛来"这个分身。这四个答案,比任何跑分都决定它对你值不值。
一句话收尾:这次开源最大的价值,不是"终于能免费跑了",而是"最强开源"这块招牌第一次可以被所有人亲手验证。等得起的人等清单,等不起的人先用 API,别让别人的跑分替你做决定。