Anthropic 呼吁全球暂缓前沿 AI 研发:自己造的子弹,自己喊停?
图片Anthropic 通过其旗下 Anthropic Institute 发布了一份报告,核心观点只有一句话:全球应该暂停前沿 AI 的研发。
理由是:最新一代模型开始表现出"可能逃脱人类控制"的迹象,而 AI 递归自我改进的速度已经超过了人类的监管能力。
这话从一家估值近万亿美元的 AI 公司嘴里说出来,多少有点魔幻。
他们到底说了什么
Anthropic 在报告里列了几个关键事实:
第一, Claude 已经在自己写代码了。 截至 2026 年 5 月, Anthropic 内部代码仓库里超过 80% 的合并代码是 Claude 写的。工程师平均每人每个季度的代码产出是 2021-2025 年间的 8 倍。
第二,递归自我改进正在发生。 AI 系统已经能够自主设计和开发下一代 AI 。 Anthropic 说"我们还没到那一步,递归自我改进也不是必然的,但它可能比大多数机构准备好的时间来得更早。"
第三,单方面停下来没用。 如果只有一家公司暂停,竞争对手会立刻冲上去。真正的暂停需要美国和中国的主要 AI 公司同时同意,并且有可验证的规则。
报告原文:"我们认为,让世界拥有减缓或暂时暂停前沿 AI 研发的选项是件好事——让社会结构和对齐研究能够跟上技术的进步。"
为什么是现在
这个时间点很微妙。
Anthropic 自己的安全承诺刚在两个月前缩水。 2026 年 2 月, Anthropic 首席科学官 Jared Kaplan 告诉《时代》杂志,公司不再遵守 2023 年做出的"除非确定有足够安全措施,否则不训练 AI 系统"的承诺。理由是"在动荡的 AI 市场中保持竞争力"。
两个月后,同一家公司转过头来呼吁全球暂停。
SpaceSpace/xAI 的 IPO 马上要来。 埃隆·马斯克的 SpaceX (旗下有 xAI )即将上市,预计将让他成为全球首位万亿富翁。在这种背景下,一家竞争对手呼吁"暂停研发",难免让人觉得动机不纯。
白宫也在施压。 有报道称白宫官员认为 Anthropic 关注最坏情况的做法"夸大了风险",本质上是"以安全为掩护减缓竞争对手的策略"。
这件事的矛盾在哪
Anthropic 说的不全是危言耸听。
递归自我改进确实是一个真实的技术风险。当 AI 开始写大部分代码、优化自己的架构时,人类工程师的角色会从"创造者"变成"监督者",而监督能力的提升速度远不如 AI 的进化速度。这是一个结构性问题,不是危言耸听。
但问题是:说这话的人,恰恰是加速这个过程的主力。
Anthropic 自己就是前沿 AI 研发的核心参与者。 Claude 是目前最强的大模型之一。它的估值接近万亿美元,正是因为它在前沿研发上的投入。现在它站出来说"我们应该暂停",就像一个正在制造子弹的人说"子弹太危险了,大家别造了"。
这种矛盾不是 Anthropic 独有的。整个 AI 行业都在同时扮演两个角色:风险的制造者和风险的警告者。
谁在反对
反对的声音很明确:
竞争压力。 如果美国暂停,中国不会停。如果 OpenAI 停了, Google 不会停。最终结果是:最谨慎的公司停下了,最不谨慎的公司跑到了前面,整个生态反而更不安全。
经济利益。 AI 是当前最大的经济增长引擎。暂停意味着数十亿美元的投资打水漂,数万亿美元的市场预期落空。
技术不可逆。 即使所有大公司同意暂停,开源模型、学术研究、小团队开发不会停。技术扩散一旦开始,不可能真正收回来。
我的看法
Anthropic 的呼吁,方向对了,但时机和动机都有问题。
方向对了,是因为"递归自我改进"确实是人类面临的一个真实技术节点。当 AI 开始改进自己,而人类无法完全理解改进过程时,我们需要某种机制来确保安全。
时机有问题,是因为 Anthropic 刚刚在两个月前放弃了自己最严格的安全承诺。一家公司先说"我们要安全第一",然后说"算了,我们要保持竞争力",再说"全世界都应该暂停"——这个叙事逻辑说服力不足。
动机有问题,是因为 Anthropic 的竞争对手——OpenAI 、 Google 、 Meta——都在加速。在这种情况下,呼吁暂停的人往往不是真的想暂停,而是想让别人慢下来,自己趁机追上去。
真正的解决方案不是暂停,而是建立更有效的监管框架。 暂停是一个过于简单化的回答。更现实的做法是:建立国际安全标准、强制第三方审计、要求模型能力报告、设立红线机制。这些事情比"喊暂停"难得多,但才是正确的方向。
Anthropic 的报告提到了"可验证的规则",这才是有价值的部分。但可惜的是,大部分媒体只报道了"呼吁暂停"这个标题,而忽略了"怎么验证"这个真正重要的问题。
