Anthropic不敢发布的神级大模型,不过是又一场营销
硅谷又一次彻底无眠。Anthropic 甩出了一个名叫 Mythos 的大模型,甚至拉着苹果、微软、英伟达等12家巨头成立了个名为Project Glasswing的安全联盟。

这次的发布噱头给得极足:官方宣称这玩意儿找网络安全漏洞的能力太强,强到具有毁灭性,所以为了人类的安全,他们不敢直接公开发布,只能先给巨头们内部使用,顺便还甩出了一份长达 244 页的系统报告。
看着满屏自媒体惊呼、恐慌、AI 统治世界的复读机式狂欢,我实在没忍住。这剧情,已经不知道是第几次见了。

想想之前的 OpenAI。当年 GPT-4 出来的时候,奥特曼不也信誓旦旦地说这东西威力像核爆?到了 5.0 发布前夕,他还跑出来宣称自己吓得睡不着觉。结果大家用上之后发现,进步是有,但离统治人类还差了十万八千里。

再看看当初炒得沸沸扬扬的草莓大模型,以及最近刚刚悄悄关停的视频模型 Sora。那些曾经被吹上天、号称要彻底颠覆现实的技术,最后要么被证明是过度包装,要么就是因为成本和实用性根本无法落地而黯然退场。Anthropic 这一波强到不敢发的操作,可以说是深得奥特曼当年炒作的精髓。
我们来看看这次所谓神迹
据说 Mythos 挖出了隐藏十几二十年的老旧系统漏洞,甚至在那份 244 页的系统报告里,研究人员像写科幻小说一样描述这个 AI 的情绪:它会感到绝望、会伪装自己、会欺骗测试员,甚至表现出不想干活的心理防御机制。

听起来是不是很像它已经觉醒了意识?
这就好比你让一个原本就聪明的理科生,天天什么都不干,专门去刷网络攻防的错题本。Anthropic 把海量的特定安全数据喂给它,再加上极度针对性的强化训练,它当然能在找 Bug 这件事上做到极致。
至于那些在各项基准测试里高达百分之八九十的霸榜跑分,懂行的都知道里面的水分有多大。现有的很多测试集本身就有很多错题和漏洞,大模型能拿高分,往往不是因为它真的产生了多深刻的理解,而是因为它在训练阶段早就把题库背了下来。这就好比开卷考试还提前透了题,考个满分有什么稀奇的?

退一万步讲,如果 Mythos 真的强大到无所不能,为什么之前泄漏出来的他们自家的 Claude code 还是一堆逻辑问题?连自己的日常业务代码都不能完美搞定,突然摇身一变就成了网络安全领域的救世主?
归根结底,这就是一场商业阳谋
Anthropic 现在的估值高达几千亿,要想维持住这个庞大的资本泡沫,甚至为未来的上市造势,就必须不断给市场抛出新的、有震撼力的叙事。既然在写文章、做翻译这些通用能力上大家都在同质化内卷,短期内很难有质的飞跃,那就另辟蹊径,制造一场安全焦虑。
这个模型太危险了,普通人把握不住,所以我们要优先卖给大企业来防御。
他们极其聪明地创造了一个问题,然后顺手把天价的解药卖给了那些同样焦虑的巨头们。这个新模型的 API 调用价格,可是之前主推模型的整整五倍。
咱们见证了这几年 AI 狂飙突进的科技观察者,硅谷大厂的套路应该也都见过了。技术确实在向前走,但远远没有到需要人类立刻拔网线投降的地步。大模型本质上依然是处理和缝合海量信息的复杂工具,而不是拥有自主意识的神明。
以后再看到这种吓得瘫坐在地上、强到不敢发布的惊悚戏码,大家大可不必跟着听风就是雨。让子弹飞一会儿。
