智谱开源 GLM-5.3:编程开源第一

2026-08-31 15:50:09 0点赞 0收藏 1评论

先说清楚:这不是 GLM-5.3-Flash。8 月 26 日开源、此前以 Ox Alpha 匿名亮相的 GLM-5.3-Flash,是 320B-A18B 的轻量加速版;这次开源的 GLM-5.3 是 743B 的完整基座版。一个主攻高性价比吞吐,一个主攻能力上限,是同一代模型的两条线,别搞混。

这个 743B 参数的基座模型,与 GLM-5.2 共享同一底座,全部提升都来自后训练,而它的卖点很特别:编程开源第一,外加一手"防御性网络安全"。

智谱开源 GLM-5.3:编程开源第一

基座没变,靠后训练 Scaling 封顶

GLM-5.3 和 GLM-5.2 用的是同一个基座模型,总参数 743B,智谱把这轮提升全部归功于"后训练 Scaling"——数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间,配合 IndexShare、SAO 和持续演进的新一代 Slime 框架做强化学习。用官方的话说,可能还远未开发出这个基座的智能上界。

效果有第三方背书:在全球权威的 Artificial Analysis Intelligence Index(AA 综合智能指数)里,GLM-5.3 拿到 60 分,与 Kimi K3 并列开源模型第一,和 Claude Fable 5、GPT-5.6 Sol 这些闭源旗舰处于同一水平区间。

编程:开源第一

编程是 GLM-5.3 的主场。官方内部自建体感评测里,编程能力较 GLM-5.2 提升 50%;在衡量真实终端环境下完成复杂任务的 Terminal-Bench 3.0 上,得分从 4.6 直接跳到 28.3,拿下开源最佳;聚焦长程软件工程的 DeepSWE v1.1 上,从 46.2 涨到 66.9。

网络安全:这轮最大的看点

GLM-5.3 在安全领域的能力有点出人意料。在 CyberGym 漏洞推理评测里,它从白盒源代码出发、通过触发程序故障来识别和验证漏洞,得分 84.5%——高于自家 GLM-5.2 的 77.2%,也超过了 Mythos 5 的 83.8% 和 GPT-5.6 Sol 的 83.6%。在白盒代码审查与漏洞发现任务中,表现与 Mythos 5 持平。

发布前两周,智谱联合国内安全团队做了密集测试评估:累计发现经初筛去重后的潜在漏洞 2404 个,其中 1088 个为中高危,最早的漏洞可追溯至约 40 年前,部分就存在于 Android、Windows、macOS 和各类 App 这些天天在用的软件里。

智谱给开源逻辑的解释也很直接:上个月 Hugging Face 曾通过部署智谱 GLM-5.2 还原了 AI 智能体入侵攻击过程、帮助控制了事态——如果强大的攻击能力正在扩散,防守能力就不能只攥在少数闭源模型公司手里。所以 GLM-5.3 权重里保留的是"防御价值",发布前专门追加了两周安全评估和模型加固。

开源规则:商用门槛很宽松

Z.ai 负责人李子玄介绍,GLM-5.3 使用需遵循其许可协议,支持本地部署、模型微调及商业化使用。安全审查门槛划得相当宽:只有当年营业额超过 100 亿美元(约合 674 亿元人民币)的机构,拟将 GLM-5.3 作为外部模型服务对外提供时,才必须进行安全审查——对绝大多数企业来说,等于自由商用。

行业背景:一个月内国产三巨头完成迭代

GLM-5.3 正好赶上国产大模型最密集的更新周期:7 月 17 日月之暗面发布 Kimi K3(2.8 万亿参数,全球首个迈入 3 万亿参数级别的开源模型);8 月 13 日 DeepSeek V4 Pro 正式版上线(1.6 万亿总参数、每 token 激活约 490 亿);8 月 14 日 GLM-5.3 发布。三家前后脚,打的都是"更强开源 + 更低门槛"。

总结

GLM-5.3 权重开源的意义,一是把"最强开源编程模型"的标杆又抬高了一截(AA 60 分并列开源第一),二是它在网络安全上的能力让"开源模型"第一次有了明确的防御叙事——当攻击能力随开源扩散时,防守能力也得跟上,这个逻辑站得住。

对开发者来说,最实在的还是那条商用条款:年营收 100 亿美元以下随便用,本地部署、微调、商业化都不设卡。开源模型的能力上限和商

作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

展开 收起
1评论

  • 精彩
  • 最新
  • 编程能力提升50%确实猛,不过日常开发场景下跟闭源模型实际差距大不大?

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松