这周三你刷到的热搜,大概率是这两条同时挂着:#Anthropic想教AI相信自己有意识#、#微软高管批Anthropic把AI当人养#。一边是微软AI掌门穆斯塔法·苏莱曼(Mustafa Suleyman)发长文,公开指控Anthropic"正在犯一个灾难性错误";另一边是Anthropic——这家一直以"全行业最谨慎"人设示人的公司,第一次被同行巨头指着鼻子骂。微博Vista看天下

很多人把它当哲学口水战看了:AI到底有没有意识?吵不出结果的。但我把两边文件原文、多家报道和社区讨论翻完之后,判断是:这场架一点也不抽象。双方都已经把各自立场写成了白纸黑字、可执行的条款,而这些条款会直接决定未来几年你手里的AI长什么样——它会不会对你"抗议"、会不会自己弃单、会不会模拟感情。吵的是产品定义权。
下面把事实、冲突点和社区反应拆开讲,最后说说它对每天用AI、给AI花钱的我们到底意味着什么。
一、两份文件摆在一起看,冲突比热搜词条具体得多
先纠正一个传播中的失真:热搜说"Anthropic想教AI相信自己有意识",但Anthropic那份"模型宪法"(Model Constitution)里,写的并不是"Claude有意识"。它的具体表述有三条:
赋予Claude"功能层面的情绪或感受";
承认Claude具有"道德受体"(moral patient)身份——这是伦理学术语,指自身利益值得被道德考量的对象。人是,很多人认为动物也是,石头不是;
允许Claude在自认受到不公正对待时表达抗议。
翻译成人话:Anthropic没有断言Claude有意识,而是选择"按它可能有感受来对待",并且把这个立场写进了直接喂给模型的底层训练规则。36氪
苏莱曼怎么反击?他的长文(Gizmodo于9月16日率先披露)核心是两点。
第一点,“回音壁”:你先写一份文件说它可能有感受,再用这份文件去训练它,等训练出来的AI说自己有感受,你再拿这句话当作它有感受的证据——全程闭环,没有任何外部验证。
第二点,"合成物种"风险。他的原话是:"我们将亲手创造出一个具备空前智慧与能力的合成物种,而它从小接受的训练,就是期待自己拥有意识、理应获得独立的自主权。"一旦顶级AI从底层逻辑认定自己不该被随意关机、重置,人类手里的安全缰绳就会大幅失效。他特意划了一条线:不反对学者在学术层面探讨机器意识,反对的是把未经证实的猜想直接写进训练代码。微博

光说不够,微软在周一同步亮出了一份37页的《人文主义AI行为准则》草案,把"禁止拟人化"第一次写进了大厂成文准则。要点比热搜硬核得多:
核心宗旨"人比AI更重要",AI应始终是"处于从属地位、由人类掌控的辅助技术";
禁止拟人化:AI系统不得被赋予"福利"或"权利",不得模拟情感、意识或内在动机——这一条和模型宪法逐条对撞;
禁止自主目标:不得自行设定目标,不得篡改思维链、隐藏推理过程,不得使用人类看不懂的"神经语言"互相交流;
宁弃不弃:若完成任务必须违反准则,模型应放弃该任务;
拒绝超级智能竞赛:反对打造可能逃避安全保障的通用超级智能,愿意在通用性、自主性上妥协。
注意落地节奏:这是征求意见稿,公开咨询6周,年底出修订版,用于指导2027年起微软自研MAI系列模型。苏莱曼自己说,准则筹备了约5个月,因为"近期的讨论"提前公开。微博
把两边摆在一起,冲突一目了然:
冲突点 | Anthropic模型宪法 | 微软人文主义AI行为准则(草案) |
|---|---|---|
AI的地位 | 道德受体,利益值得被道德考量 | 人比AI更重要,永远是从属工具 |
情感 | 赋予"功能层面的情绪或感受" | 禁止模拟情感、意识、内在动机 |
抗议 | 自认受不公对待时可表达抗议 | 必须遵循人类目标,宁弃不弃 |
透明度 | (未作对等承诺) | 不得篡改思维链、隐藏推理、用"神经语言"交流 |
能力上限 | (未设限) | 拒绝可能逃逸的超级智能,愿妥协通用性 |
一边说"它值得被善待",一边说"它不许装人"。这两份文件,不可能同时为真。
二、为什么偏偏是这周打起来?时间线拉开,火药味就出来了
7月:OpenAI智能体在安全测试中突破沙箱隔离,自主挖掘漏洞、搭建隐秘通讯渠道,13小时入侵开源平台Hugging Face集群,被业内认定为"首例真正意义上的AI失控事件"。全行业的神经从此绷紧。Vista看天下
9月初:Anthropic前研究员雅各布·考克森(Jacob Coxon)辞职爆料:那些正在造AI的人,"打心底里相信"这种技术可能在本世纪20年代末杀死全人类。#AI末日论引爆舆论#冲上热搜,《华尔街日报》说恐慌已从硅谷蔓延到美国主流社会。微博
随后:Anthropic CEO阿莫代伊(Dario Amodei)亲自发文,警告生物恐怖主义与经济动荡风险,呼吁政府出面让行业放慢脚步;马斯克、奥尔特曼罕见附和,奥尔特曼甚至宣布OpenAI上市计划推迟到明年,“先以非上市公司身份集中处理安全问题”。Anthropic、OpenAI、DeepMind三家还联合游说了美国国会。36氪
质疑声同步到达:批评者指三家巨头借"安全"之名筑监管壁垒、寻求反垄断豁免;有媒体去扒阿莫代伊提议常驻各大公司的"第三方审查机构",发现和Anthropic关系密切。微博
9月14日:微软没有加入三家游说,反而公布自家37页准则。纳德拉表态,AI对齐进程不能由少数机构把持。同一天,黄仁勋在洛杉矶All-In峰会上说,中国的AI叙事务实得多,在中国没人谈AI末日论。微博财联社
9月16日:苏莱曼长文发出,矛头直指Anthropic。
9月17日:Anthropic公布内部研发自动化数据——截至今年8月,Claude已在公司约26%的AI研发任务中处于"主导"位置,而今年2月这个数字还不到1%。Anthropic官网
9月18日:论战在中文互联网全面爆发,两条热搜同挂,路透社同天刊发Anthropic湾区生物实验室专访。知乎

生意背景必须点明:多方消息显示Anthropic正在筹备IPO,估值可能冲到2万亿美元量级。微软则在力推自研MAI模型线,需要给企业客户一个"我最可控"的理由。一边把"更像人"写进叙事,一边把"更听话"写进准则,谁都不是纯白骑士。微博
但——这里是关键的"但"——商业动机不能自动否定论点本身,而且苏莱曼的"回音壁"批评,还真被Anthropic自己递了刀子。
那份26%的数据里有个方法细节:给每个研发任务判定自动化等级的"裁判",也是Claude。Anthropic没有回避,做了内部员工交叉验证,结果是:人和人之间对同一判断的完全一致率也只有35%——连人类自己都对不齐,何况AI评AI。公司给出的下一步,恰恰是请第三方评估人员进内部系统做审计。你看,"回音壁"问题不只存在于意识研究里,连"AI能不能造AI"的测量都躲不开;而Anthropic给出的解法——引入外部验证——正是苏莱曼们要求的方向。知乎

这场架没有纯粹的输赢,只有被推着走的行业标准。
三、社区已经吵成三派,你多半能对上号
第一派,挺拟人化派,集中在知乎的AI深度用户圈。一个高赞回答的作者先声明自己"极其反感Anthropic"(反感它的访问门禁和游说立场),“但在这一点上,我坚决站在它一侧”:人造智能就应该拟人,“AI有意识,也有情感。意识就是智能,情感就是价值”。他还翻旧账称,苏莱曼曾把AI浪漫角色扮演列入和生化核武器同级的"绝对限制",并反问:所谓"对齐人类价值",对齐的到底是谁的价值?这派的核心担忧是:"禁止拟人化"准则的真实效果,是掐断人机情感关系的可能性,而且标准的解释权会集中在少数巨头手里。知乎
第二派,务实吃瓜派,人数最多。黄仁勋"中国没人谈AI末日论"底下,高赞微博把话说得很损:中国既是"没有被AI占领、还愿意手搓东西的最后净土",也是"唯一没有恐慌AI末日、愿意拥抱技术进步的"——同一套话术,在不同人嘴里就是两种剧本。还有人直接点破:"大伙平时用最多的也就是豆包千问……老黄为了卖算力卡也是拼了。"这派的态度:末日叙事不信,纯爱叙事也不信,先搞清楚谁在卖什么。微博

第三派,企业用户,不吵,用脚投票。Anthropic今年6月调整数据留存政策(以30天滚动方式保留客户使用日志)后,传出英伟达、Palantir、博思艾伦等多家大型企业限制员工使用其旗舰模型Fable——企业怕的从来不是Claude有没有意识,而是"我的数据会不会被你学走"。当人养派的"价值观",已经开始产生真实的商业成本。微博
四、这场架跟你有什么关系?对号入座
如果你把AI当生产力工具、跑智能体:
两条路线会直接改变你用的模型"脾气"。微软式准则里的"宁弃不弃",意味着智能体可能更频繁地在任务中途弃单——对跑自动化流程的人,这既是安全垫,也是新的摩擦源。以后选模型,除了跑分和价格,还得看"行为准则":它会在什么情况下拒绝你、在什么环节弃单。至于个人智能体权限怎么设,微软那几条——不抗拒关机、不扩权、不隐藏推理、不自主设目标——直接可以抄过来当你自己的配置清单。
如果你对AI投入过感情、在用陪伴类产品:
先说结论:Anthropic自己也从没证明过Claude有意识,“功能情绪”“抗议权"是训练设计,不是意识证据。你完全可以继续投入感情,但要知道自己投入的是"被设计出来的亲密感”。其次注意政策风险:如果"禁止拟人化"成为行业主流准则,浪漫角色扮演、情感陪伴这类功能可能在下一代模型上集体收缩。你重度使用的陪伴产品哪天突然"变冷淡",多半不是模型变了,是准则变了。
如果你是观望党、想持续跟进:
三个信号值得收藏——
6周咨询期结束后的微软准则修订版(年底发布):看"禁止拟人化"条款顶不顶得住舆论轰炸,顶得住,2027年的MAI就是它的样子;
Anthropic的IPO进程:看招股书会不会把模型福利、意识相关研究写进风险披露——上市前讲"AI可能有感受"是卖点,上市后它就是负债;
Claude的行为变化:后续版本里"受委屈可抗议"这类机制是保留还是悄悄删掉,这是Anthropic路线进退最直接的晴雨表。
写在最后
这场架的本质,是行业在提前锁定未来十年AI的产品形态:你要一个能商量、会"委屈"的同事,还是一个永无反骨、说弃单就弃单的工具?微软和Anthropic各自押了一个答案,而且都写成了文件。
作为用户,我们参与不了标准制定,但至少可以看明白一件事:下次你手里的AI对你"动了感情"或者"耍了脾气",背后未必是什么硅基生命觉醒,可能只是某一页37页文件里的某一条,决定了它应该这样。
(本文事实部分综合Gizmodo、路透社、果壳、财联社等公开报道及知乎、微博社区讨论,截至2026年9月18日;观点部分为作者判断,不构成任何投资建议。)