GLM-5.3 在 8 月 14 日正式发布,一周之后真正值得盯的不是榜单,而是生态跟进的速度。发布当天,荣耀 YOYO Claw 的"虾虾大脑"就宣布装上 GLM-5.3。微博随后一周内,官方 API、百度千帆、国家超算互联网、WorkBuddy、阿里云千问相继开放接入,对一个权重还没开源的模型来说,这个密度相当少见。
先看能力。GLM-5.3 和 5.2 共用同一个基座,所有提升都来自后训练阶段的强化学习。微博在 Artificial Analysis 智能指数上,GLM-5.3 拿到 60 分,进入全球前沿模型能力区间。微博这个 60 分的参照系是:前代 5.2 只有 53 分,现在追平 Kimi K3,并列开源权重模型第一,距 GPT-5.6 Sol 只差 1 分。知乎
提升的方向很集中,社区拆解下来主要是两块:安全能力,以及终端任务、工具调用、大代码库修复这类长程任务的执行。微博智谱创始人唐杰把这代训练称为控制变量实验:万亿参数是集体弯路,GLM-5.3 一颗参数没加,AA 指数从 53 提到 60。微博社区里也有冷静的声音:所谓登顶,主要指在 Terminal-Bench 3.0 上拿到开源模型最高分,测的是终端环境里的真实软件工程任务,不等于全面超越 Claude 和 GPT。微博

再说正题:这一周 GLM-5.3 到底在哪儿上线了。8 月 19 日,智谱官方 API 正式上线,已接入 ZCode 等编码平台,并纳入 GLM Coding Plan。微博同日百度千帆 Day0 上架,上线模型广场与 TokenPlan 企业版,API 对外定价与智谱官方保持一致。微博8 月 19 日当天,国家超算互联网也上线了调用服务,企业和开发者登录超算互联网即可一键调用,无需环境配置。微博
8 月 20 日,腾讯系 AI 办公智能体 WorkBuddy 宣布平台内置接入。
8 月 21 日,阿里云千问 AI 平台接入 GLM-5.3 与 DeepSeek-V4-Pro 正式版,开放 API 调用,重点覆盖编程和智能体场景。知乎两款开源旗舰同时进千问,意味着在一个平台上就能并排对比当下最强的两个开源模型,切换成本几乎为零。

然后是大家最关心的成本。官方 API 定价与 GLM-5.2 完全一致:输入 $1.40/M tokens,输出 $4.40/M,缓存命中 $0.26/M,腾讯云报价分别为 ¥8、¥28、¥2。知乎但有个隐藏变量:AA 实测 GLM-5.3 单任务平均输出约 18,700 tokens,比上代多 20%,单价没变、消耗变多,实际单任务成本是高于 5.2 的。
不过编程场景有个反向数据:Z.aiCode Bench High 档 GLM-5.3 准确率 31.4%、每任务约 5 万 tokens 输出,优于 Claude Opus 4.8 的 29.5% 和约 12 万 tokens,准确率略高,token 花销只有对方四成左右。知乎
走平台侧的话,成本更直接:WorkBuddy 里 GLM-5.3 的积分消耗倍率是 0.79x,定位是兼顾办公、代码、数据分析和文件处理的通用选项。微博注意首批资源比较紧张,使用量大时可能要排队。
还有个羊毛信息:北京超算科教面向老客户送 GLM-5.3 的 1000 万 Token,8 月 20 日到 22 日限时三天,正好在窗口期内。知乎
最后是两个值得继续盯的信号。一是模型权重 8 月 28 日开源,MIT 许可。微博届时开源第一梯队与闭源旗舰的差距缩到 1 分以内,叠加成本优势和可私有化部署,不少团队的选型天平会倾斜。二是智谱这次为什么押注安全:GLM-5.3 把网络安全能力带给更多开发者和开源项目,帮助发现漏洞、审查代码、提前修复风险。微博Agent 越真正干活,攻击面就越大,安全能力其实是在给规模化落地买保险。

对大多数人来说,这周的行动建议很明确:编码用户可以先用官方 API 或 WorkBuddy 实测单任务成本,再决定充不充值;等开源权重的,直接盯 8 月 28 日;榜单分数不用急着下"追平闭源"的结论。真正决定值不值得投入的,是谁能用最低的成本把这代能力接进自己的工作流。