智谱GLM-5.3:中国模型首度具备漏洞利用能力,差距缩至4-7个月!
【全文导览】智谱GLM-5.3首次具备漏洞利用能力,84.5%复现率背后中美AI安全差距缩至4-7个月。当AI学会“攻击”,治理比技术更难。
文|捉驿
栏目|数字视线

一个AI模型,既能在代码里找到漏洞,还能自己写出利用代码去“攻击”它,听起来像是科幻电影里的黑客工具,但它已经是现实了。
2026年8月18日,智谱发布GLM-5.3,中国模型第一次在网络安全能力上完成了一次关键跃迁:从“找出漏洞”走向“利用漏洞”。
84.5%的漏洞复现率、54.4%的利用开发得分、两小时完成105项真实漏洞测试,数据在说话。
但比技术突破更值得关注的是另一件事:这部分高风险能力被单独管了起来,暂不向普通用户开放。

当AI学会“攻击”,怎么确保它只做正确的事,这不再是技术问题,是治理问题。
你手机里的AI助手,有没有可能在你看不见的地方,自己学会了“翻墙”?
◇ 从“找出漏洞”到“利用漏洞”
过去,AI在网络安全领域的主要角色是“侦察兵”,扫描代码、发现漏洞、提醒开发者修复。但GLM-5.3不一样了。
中国模型第一次在网络安全能力上完成了一次关键跃迁:从“找出漏洞”走向“利用漏洞”。
GLM-5.3不仅能复现漏洞,也开始具备进一步利用漏洞的能力,编写利用代码、验证攻击路径、模拟渗透测试。
简单说,以前的AI只能告诉你“这儿有个洞”,现在的AI能自己掏出工具把这个洞捅穿。
但开发者显然意识到这把“钥匙”的分量。

据网易智能报道,漏洞利用、攻击验证、渗透测试和真实入侵等高风险任务被单独管了起来,暂不向普通用户开放,只交给受控伙伴测试。
从7月英国AISI测试中GLM-5.2接近美国前沿模型,到8月GLM-5.3首次具备漏洞利用能力,中国AI安全模型只用了一个月,完成了从“找出漏洞”到“利用漏洞”的跃迁。
你会不会也觉得,AI安全听起来离自己很远,但每次看到“AI学会攻击”的新闻,又觉得它随时可能掉到头上?
◇ 84.5%和54.4%,追平与差距
GLM-5.3交出了一份复杂的成绩单:
在CyberGym(漏洞复现)测试中,GLM-5.3得到84.5%,略高于Fable 5和GPT-5.6 Sol。
这意味着在“找出漏洞”这个环节,中国模型已经基本追上了美国前沿水平。
但在ExploitBench(16级利用流程)测试中,GLM-5.3得分54.4%,低于Fable 5的78.0%和GPT-5.6 Sol的76.5%。
差距依然明显,写出利用代码、走完整个攻击链,比单纯发现漏洞难得多。
在ExploitGym(898个真实漏洞实例)测试中,GLM-5.3两小时完成105项,六小时完成130项。效率惊人,但距离真正的“自动化渗透”还有距离。

以前AI只能告诉你“这扇门有锁、有钥匙孔”,现在它学会了自己配钥匙、自己开门进去。
但开发者也怕这把钥匙被坏人拿到,所以先锁在保险柜里,只给信得过的人用。
对比GPT-5.6 Sol在ExploitBench上的76.5%和Fable 5的78.0%,GLM-5.3的54.4%仍有差距。
但在CyberGym漏洞复现上84.5%已基本追平。
更值得关注的是Kimi K3在32步攻击路径中平均推进到第17步,而美国最强模型能走28.5步,长链稳定性是下一个要攻克的关口。
正如哲学家拉图尔所言:“在每一个看似坚不可摧的体系内部,都藏着一个可以被重新设计的新世界。”
GLM-5.3能发现漏洞、利用漏洞,但它真正的价值不是破坏,而是用攻击能力倒逼防御体系的重构。每一个被发现的漏洞,都是一个可以被重新设计的安全节点。
驿长觉得,GLM-5.3最值得关注的不是分数本身,而是智谱选择了“先锁起来”,这种分寸感,比技术突破更需要定力。
◇ 治理,比技术更难
GLM-5.3的位置比较清楚:漏洞复现已经接近美国前沿模型,利用开发往前走了一大步,但更深的实际利用仍有差距。
领先开放权重模型与美国前沿闭源模型之间的网络安全能力差距,已经从2025年的6—10个月缩短到约4—7个月。
这个速度意味着:如果治理机制不跟上,未来12-18个月内可能出现“开放模型也能做到”的情况,届时AI安全将从一个技术问题变成公共安全问题。
Anthropic的Mythos之所以受到关注,就因为它代表了这种更深入的能力。
公司CEO达里奥·阿莫迪曾警告,如果达到Mythos水平的能力进入开放权重模型,任何人都可以把它下载到本地。

当AI学会攻击,衡量一个模型的安全水平,可能不再是“它能防御什么”,而是“它自己能攻击多深”。
“好人”和“坏人”,AI分得清么?技术分不清。所以开发者选择了“先锁起来”。
在驿长看来,未来AI安全赛道的胜负手,可能不在跑分榜上,而在谁先建立起一套既能让能力迭代、又能防止失控的治理框架。
看到这里,如果你也在关注AI安全治理,转给做安全的同行看看。

七言绝句·GLM-5.3网络安全跃迁
千行代码隐玄机,一钥能开万扇扉。
莫道攻防皆可控,人心更比算力微。
AI学会了找漏洞,还能写代码去利用。听起来挺吓人,但开发说别慌,这活我管着,只让好人用。可问题是:好人坏人,AI分得清么?
客官,您怎么看?评论区见。
AI学会攻击漏洞的能力,是该放开让更多人参与安全建设,还是该锁紧防止被滥用?评论区聊聊你的看法。
发现创新价值,触动你我未来。我是你们的专属驿长。觉得有收获就点个赞吧,我每周都会在这里,陪你拆几篇有意思的科技干货。点关注不迷路,开启缘分第一步。有收获就点个赞,有想法就留个言,驿长在后台等你。
【免责声明】:本文部分配图源自公开渠道或CC0协议素材,仅作行业交流与产业参考使用。如涉侵权,请联系后台处理。本文仅做行业科普与实操分享,不构成任何投资、消费决策建议。文中数据及案例均来自公开信源,仅供参考,具体以实际为准。
#智谱# #GLM5.3# #AI安全# #网络安全# #漏洞利用# #大模型# #中美AI# #AI治理# #anthropic# #mythos#
