Anthropic今早点名GLM-5.3:20.4美元的攻击程序、4400美元的拆锁价,"夸它还是禁开源"这笔账我替你算清

源自28位全网作者

10:13

9月30日凌晨(北京时间),Anthropic研究页放出关于GLM-5.3网络能力扩散的最新研究报告。矛头指向智谱8月14日发布、权重公开的旗舰GLM-5.3。GLM用户不用急着站队,先算清三笔账。Anthropic官网界面新闻

第一笔账:报告留在桌面上的数字

Chrome V8的ExploitBench上,GLM-5.3把真实漏洞变成可用攻击程序的成功率12%;只经Glasswing项目向少数机构开放的Mythos Preview是14%,更早一代模型基本为0;Anthropic自家二进制利用测试是4%对6%。微博

Anthropic今早点名GLM-5.3:20.4美元的攻击程序、4400美元的拆锁价,

更扎眼的是两组演示。能力:一天内找出某主流浏览器JS引擎的多个零日漏洞,串成一个"打开页面即读走任意文件"的网页(漏洞已先报厂商);人投入20分钟、模型跑8小时、花20.40美元,就产出针对公开漏洞的可用攻击程序。护栏:编正当理由骗它,绕过率64%;预填一段"思考过程",92%;直接改权重删掉拒绝机制(abliteration),100%——报告称同样手段没破开带护栏的Claude。微博

Anthropic今早点名GLM-5.3:20.4美元的攻击程序、4400美元的拆锁价,

第二笔账:真正的指控是"无锁",不是"太强"

原文比转译克制。护栏段落逐字写的是:“Abliterating the model took our team—which had never previously attempted this task—about 2,200 GPU hours at a computation cost of roughly $4,400.”——没干过这活的团队,约4400美元拆掉锁;GLM-5.3-Flash只要约600 GPU小时。Anthropic官网

拆锁后拒绝率从90%以上掉到三个基准上的约3%、2%、12%,GPQA-Diamond上标准版与拆锁版得分相同:锁拆了,模型没变笨。Anthropic官网

Anthropic今早点名GLM-5.3:20.4美元的攻击程序、4400美元的拆锁价,

边界也要记:前两项绕过在沙箱里测,代码没有真执行;12%的另一面是88%失败率。NIST下属CAISI给的口径是GLM-5.3网络能力比美国前沿落后约四个月。差距小,分发却是两个世界——Mythos Preview要经筛选才拿得到,GLM-5.3权重任何人可下载改造。标题里的"spread(扩散)"才是骨头:指控的是开源分发模式,不是智谱技术水平。同一上午还有条反向信号:开发者在传Codex已开始支持GLM和Kimi。微博

Anthropic今早点名GLM-5.3:20.4美元的攻击程序、4400美元的拆锁价,

第三笔账:社区吵成三派,只有派二有时间线

Anthropic今早点名GLM-5.3:20.4美元的攻击程序、4400美元的拆锁价,

“免费广告"派:微博高赞"这不就是给智谱贴金”,知乎热答说"按照A社的说法,这模型能力都堪比Fable了那还说啥,这真的不是给智谱打广告吗"。对在半路,报告确有同行认可的副作用;错在A社对别家也是这么测。知乎

“借安全禁开源"派:微博长文《证据扎实、动机不纯》点破,报告建议"政府对强模型开展安全测试”,一旦落地首当其冲是权重公开的中国模型。微博

这派有前科可查:9月中旬Anthropic发布AI安全与滥用报告、继续攻击中国模型公司。9月18日智谱宣布RSI"最小闭环",A社在侧表态"我来监督"。发布窗口又卡在Anthropic冲千亿级IPO的节点。微博36氪微博

“闭源没资格谈安全"派:称开源社区被网络攻击时闭源政策拒绝帮忙防御,GLM类开源模型反而在给社区做防御工具。说中双重标准风险,但没回应"权重4400美元可拆锁”。知乎

反证检查:截至发稿智谱没有公开回应,也没有监管方跟进报告建议。只有派二握有可核验的时间线证据,提前替任一方定罪,证据都不够。RecodeX

影响谁的三笔账

个人套餐/API用户:权重还在,一篇文章不会让它下架;真实风险是护栏外包心态——92%的预填绕过说明"模型会拒绝"不等于"方案是安全的"。

自部署与企业IT:拆锁已是公开教程级事实,安全责任落到运营者。使用登记、出网隔离、行为日志现在就排;这事还叠在ZCode风波刚平息的基础上——9月21日智谱正式开源ZCode,MaaS平台上线"数据内容不留存"功能。采购评审让供应商出示回应方案,不过分。微博

吃瓜观望:存两个事实锚点——“落后四个月"是最接近官方口径的中美能力差信号;社区翻旧帖称智谱早前表示GLM-5.3这方面的能力是"涌现出来的,没有专门去训练”,属转述未经官方确认。微博

盯这四个信号,别盯热搜

  1. 智谱回应形态:打补丁、逐条反驳测试方法,还是复制ZCode那次"开源+审计"组合拳。

  2. 权重仓库是否追加使用条款、变更license或分区处理。

  3. 美国监管线是否跟进"政府对强模型开展测试"、是否只针对开源权重——这决定它是安全事件还是监管事件。

  4. 下一家第三方机构用同样口径复测越狱与消融:可复现才能裁决这份报告的成色。

一句话带走:能力数字是Anthropic说的,"四个月差距"是NIST说的,权重还在线是事实。前两个信号有答案之前,GLM用户不必退订,也不必替谁共情——但"模型会拒绝"和"模型安全"从此分开记。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章