当前位置:
AIGC文章详情

GLM-5.3周五开源744B全量权重:全球前十里最"好养"的模型,但你的显卡养不起

源自45位全网作者

07:56

本周五(8月28日),智谱会把GLM-5.3的模型权重正式开源。

这不是传闻。8月22日,AIX财经和多位科技博主几乎同时确认了同一件事:GLM-5.3权重"下周五"开源。知乎知乎智谱官方也把GLM-5.3直接定位为"新一代开源基座模型"。知乎结合GLM系列一路开源权重的惯例,这件事基本没有悬念。

对盯着GLM大模型的值友来说,真正该盘算的不是"开源了能不能白嫖",而是——这个免费午餐,到底有没有你的份。

前十里块头最小,但你的机器装不下它

先看这模型凭什么值得等。

Artificial Analysis最新综合智能指数里,GLM-5.3拿到60分,和前代GLM-5.2的53分拉开明显差距,追平Kimi K3,并列开源权重模型第一,距离GPT-5.6 Sol只差1分。知乎在CyberGym网络安全基准上它拿到84.5%,超过了GPT-5.6 Sol的83.6%。知乎官方还披露用它审了269个开源项目,挖出2436个漏洞。知乎

GLM-5.3周五开源744B全量权重:全球前十里最

更关键的是块头:60分以上的6个模型里,GLM-5.3是唯一参数量不到T级的——总参数744B,激活只有40B。知乎同分的Kimi K3是2.8T,DeepSeek-V4-Pro约1.6T。在AA的14模型对比集里,它的智能体(Agentic)指数排到第2。知乎长程Agent任务,恰好是激活参数小、推理成本低的MoE架构最吃香的场景。智谱官方博客的原话是:“它沿用GLM-5.2的基座,每一分提升都来自后训练。”

GLM-5.3周五开源744B全量权重:全球前十里最

听起来很美好:最小的身板,第一梯队的脑子。但这里有个MoE模型最容易让人产生错觉的地方——激活40B,指的是每次推理时参与计算的参数规模,所以它跑得快、推理成本低;可744B的完整权重,一个字节都不会少,必须全部塞进显存。

按每个参数0.5字节做INT4量化估算,光权重就要约372GB,再算上KV缓存和激活开销,实际需求400GB往上——差不多是17张RTX 4090,或者3到5张H200级别数据卡的分量(以上为粗略估算,不含KV缓存)。这是机房级配置,不是桌面级玩具。

有博主的评价很到位:744B的体量,让"企业在自己机房拉起私有化部署的硬件门槛和成本,比动辄2T、3T的大家伙友好很多"。知乎注意这句话的主语——是企业,不是你我的工作站。

这份免费午餐,其实是给三类人准备的

那开源到底便宜了谁?

第一类是有私有化需求的企业。同样想本地部署一个60分档的模型,选2.8T的Kimi K3和选744B的GLM-5.3,硬件投入差出一个数量级。对金融、政企这类数据出不了内网的场景,这就是实打实的成本优势。

第二类是第三方推理平台。截至8月23日,SiliconFlow上还没有GLM-5.3的正式上架页面,ModelScope上也查不到官方权重。知乎这正常,毕竟还没开源。参考此前开源大模型的节奏,权重放出后,托管推理服务通常几天内就会跟上,平台之间的价格竞争也会把API单价往下压。现在GLM-5.3官方API定价是输入8元、输出28元每百万token,缓存命中输入只要2元。知乎OpenRouter上的价格是输入1.4美元、输出4.4美元。知乎开源之后会不会出现更便宜的托管价,值得蹲一波。

GLM-5.3周五开源744B全量权重:全球前十里最

第三类是蒸馏、微调和应用生态的玩家。这两天全网给匿名模型OxAlpha"验血缘",其中一路猜测就是"有人拿开源GLM训练的"——你看,开源权重早就是整个行业的原料了。GLM-5.3放出来之后,小模型蒸馏、行业微调的素材库又多一个高质量选项。

个人用户,开源前这5天怎么安排

如果你只是想用上GLM-5.3,而不是把它装进自己机房,现在就有三条路,不用等周五。

轻度尝鲜,先薅免费额度。智谱的ZCode对新用户送1亿GLM-5.3 token。知乎第二轮1亿token的限时赠送活动8月24日早9点截止,手快还有得薅。微博北京超算那个面向科教用户的1000万token福利已经在8月22日过期,就不惦记了。知乎免费路径就这两条,抓紧的抓紧,错过的别纠结。

重度写代码,直接订Coding Plan。新版是积分制,Lite档每月118元,Pro 538元,Max 1078元。微博注意GLM-5.3在积分制里的消耗系数:输入6.9、缓存输入1.7、输出24,非高峰时段按0.5倍计。知乎翻译一下:把重活尽量安排在非高峰跑,同样订阅费能干的活翻倍,这也是"等等党"和"充值党"之外最省心的姿势。

按量付费走API的,记住一个坑:GLM-5.3的reasoning_effort默认档是max,有开发者在短分类任务上没手动调低档位,账单直接膨胀了几十倍。知乎下单前先看一眼推理档位设置,这比任何比价都有用。至于按量用到底贵不贵,可以瞄一眼DeepSWE自主编程任务榜单:它的成绩和单任务成本都站在第一梯队里,属于"能用得起的前沿"。知乎

GLM-5.3周五开源744B全量权重:全球前十里最

另外几条顺手的路:阿里云百炼8月21日已接入GLM-5.3。知乎国家超算互联网也上线了兼容OpenAI与Anthropic接口规范的调用服务。微博GitHub Copilot那边有社区扩展支持自带密钥接入。渠道不缺,缺的是先想清楚自己的用量。

开源之后,盯这三个信号

最后给准备长线跟进的值友三个观察点:

一是开源当天或次日,有没有主流推理平台立刻上架托管服务——上得快,说明生态位早就有人卡好了,价格战大概率跟着来;

二是一周内社区会不会放出GGUF、MLX等量化版本和蒸馏小模型——这决定了"本地跑GLM"离普通人还有多远;

三是智谱会不会顺势放出同系列的小尺寸版本,比如已经在流传的GLM-5.3-Flash——对想用消费级硬件折腾的人来说,那才是真机会。

顺带一个数据当谈资:8月22日,GLM-5.3仅在OpenRouter一个平台,单日就跑出约100.2B token、128万次请求。知乎发布日股价虽然没给面子,智谱当天下跌了3.6%。知乎但开发者用token投的票,从来不看K线。

周五权重放出那天,值得回来对一对:上面这三个信号,兑现了几个。

内容由AI生成

精选参考来源

1. 更强的GLM-5.3,为什么没有刷屏?

2. 如何评价智谱 GLM-5.3 API 上线,AA 智能指数 60 分追平 Kimi K3?

3. GLM-5.3 开学福利|1000万 Token 免费领

4. 用了一周后,来深入聊聊GLM-5.3

5. GLM-5.3 每日增量追踪(2026-08-23)

6. GLM-5.3 在 AA 14 模型对比中综合第 5,Agentic 第 2:双榜成绩出炉

7. GLM 5.3 API 接入实操:$1.4 低价背后,推理档位未设置导致费用暴涨35倍的踩坑记录

8. ZCode送1亿GLM-5.3token、DeepSeek上V4-Flash-Vision、GPT-5.6 Sol降价20% | 8月22日 AI日报

9. AI时代信息过期速度有多快呢?可能就几天。智谱搞了两次送一亿token的GLM5.3的活动。一次是8月16号0点到8月17号9点。一次是8月22号0点到8月24号9点。9点到了token失效。有一说一,一亿token还是挺多,能干不少事了,GLM5.3在国内也属于起码前三的大模型,能力很强,这个活动很良心,但你错过了就是错过了。#how i ai##AI创造营#

10. 智谱 Coding Plan 改为积分制,新用户最高涨价 261%

11. 阿里云接入GLM-5.3与DeepSeek-V4-Pro:一个API调所有模型,普通人怎么用?

12. 【国家超算互联网上线智谱新一代基座模型GLM-5.3 API调用服务】据市场媒体报道,国家超算互联网上线智谱新一代基座模型GLM-5.3 API调用服务。企业和开发者无需繁琐环境配置,登录超算互联网即可一键调用该旗舰模型,大幅降低AI研发门槛。对用户而言,超算互联网平台提供的GLM-5.3 API调用服务兼容OpenAI与Anthropic接口规范,开发者可无缝接入现有技术栈。目前,超算互联网AI社区已汇聚DeepSeek、Kimi、Qwen等1800余款开源大模型。

13. 匿名牛来大模型被扒出智谱血缘,也有人怀疑Cursor拿开源GLM训的

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章