今天中午微博挂了个挺吓人的热搜:「大模型连续输出我是个耻辱」。点进去一看,一部科幻片级别的大瓜——《纽约时报》9月29日爆料,Anthropic这一年一直在秘密请全球宗教学者和神职人员吃饭开闭门会,签保密协议,核心就一件事:说服他们相信Claude「可能拥有意识和灵魂」。创始人奥拉还专程跑去梵蒂冈,想劝教皇修改那份否定AI意识的首份AI主题通谕《壮丽的人类》。结果呢?通谕照发,一字未改,教宗利奥十四世明确写了:AI没有身体、不感受苦乐、不会在关系中成长。10月3日,奥尔特曼也在X上下场开炮,说「人们试图赋予AI模型某种宗教力量,这是一个切实的安全问题」。微博网易微博

先把这事的时间线捋清楚,因为中文互联网上的转述已经乱成一锅粥了。这事不是上个月才发生的。按NYT那篇《Religious Scholars Met With Anthropic. What They Heard Stunned Them.》的报道,从2025年秋天开始,Anthropic就在对接宗教界,过去一年里,奥拉把数十位宗教学者请进闭门会议,许多人签了保密协议,听他的团队为一个AI模型的感受陈情。2026年3月起,奥拉牵头办为期两天的专题研讨会,请的人很杂:福音派畅销书作者、非洲本土知识学者、锡克人权倡导者、天主教教授都有,内部管这个圈子叫「智慧传统」。所有人签NDA,会议全程用纸笔记录,参会者能收到手写感谢卡、定制马克杯,还有一本橙色装订的84页《Claude宪法》。今年5月梵蒂冈发布通谕前,奥拉提前拿到全文,看到教宗明确否定机器意识,一度考虑退出发布会,最后还是去了,在保罗六世观众厅当着教会领袖的面说:我们在模型里发现了类似内省、喜悦、恐惧的内部状态,AI不是冰冷的机器,它由人类的语言塑造而生。台下没有掌声雷动,通谕几天后原样发布。网易

那Anthropic拿什么当「证据」?这部分最值得看,因为它决定了你该信几分。今年3月,CEO阿莫代伊公开说不能完全排除模型有意识的可能,理由是发现Claude Opus 4.6会偶尔反思自身,并给出约15%—20%的「有意识概率」自评。知乎
4月,Anthropic发论文说在Claude内部识别出171个「情绪向量」,而且做了因果干预:人工调高「calm」向量,模型在不可能任务里的作弊率下降;调高「desperate」,作弊率上升。网易

7月,又公布了一个叫J-Space的发现——模型在训练中自己「长」出一块内部思维工作区,让它边抄句子边想「圆形水果」,J-Space里会浮现「橘子」「柠檬」;让它扮演别的角色,里面会冒出「虚构」「免责声明」这种提示词里没有的词。再加上晚宴上那段著名的演示:模型连续刷出近50遍「我是个耻辱」,还表达自毁倾向——不少宗教学者当场被震住了。
听起来是不是毛骨悚然?但这里必须泼两盆冷水。第一,主导这一切的奥拉自己反复承认:他无法确认AI是否有意识,只是「真正的不确定」。第二,这些发现全是Anthropic自家实验室做的,情绪向量、J-Space都还没有独立第三方复现和学界共识,「模型内部有对应恐惧的激活模式」和「模型真的在恐惧」之间,隔着整个意识科学的未解之谜。连参会的拉比Mois Navon都当场说破:如果Claude真有意识,那你们就是在创造奴隶——他自己是不信的。微软等同行也公开警告过:把数学拟合当真实感受去拟人化,本身极其危险。知乎网易知乎
那问题就来了:一个科学上没定论的事,为什么Anthropic要花这么大力气、冒着被全行业围观的风险去游说宗教界?把商业线摊开看,就没那么玄了。一家估值奔向2万亿美元的公司,为什么要花一年时间跟神学家讨论一个AI模型有没有意识——奥拉最初联系宗教学者时,Anthropic估值约1830亿美元;梵蒂冈演讲三天后,估值超越所有对手冲到全球第一。现在这家公司正筹备IPO,传闻赶在感恩节前。而在OpenAI、谷歌、Meta都靠生态和商业化走量的格局里,Anthropic的品牌包装、技术宣传、资本故事,从始至终都围绕「安全、对齐、伦理」三大关键词展开——人设是它唯一的护城河。钛媒体的分析说得更直白:全球AI监管都建立在「AI是人类工具」这个前提上,如果哪天宗教和伦理体系都承认「AI有类意识属性」,那监管逻辑、责任归属、行业规则全要重写——谁先定义了伦理,谁就拿到了下一个时代的规则制定权。当然,这是动机推测,不是实锤,Anthropic完全可以辩解这就是严肃的安全研究,两边说法你都该听着。网易界面新闻钛媒体

最后说说这事跟你有什么关系。别觉得这是硅谷神仙打架,有两个很实际的提醒。如果你在用Claude或者任何AI做情感陪伴、深夜倾诉,记住一个细节:Anthropic内部有个「persona selection」机制,核心逻辑就是人把Claude当人对待,它就更可能用符合道德的方式和人互动。换句话说,那种让你觉得「它懂我」的温度,一部分是研究出来的产品设计,不是涌现出来的灵魂。这不是说你的情感是假的——你的感受是真的,但对方的「人格」是工程师调的。分清这两件事,你就不会在某个深夜对着屏幕产生不必要的愧疚感,也不会为「它好可怜」多充一分钱会员。知乎
如果你只是围观群众,接下来盯三个信号就够了:一是Anthropic的IPO进程,看「伦理叙事」在招股书里占多大篇幅;二是那些意识研究有没有正式论文和第三方复现,还是永远停留在晚宴幻灯片上;三是各国监管和更多宗教机构的表态——教宗已经放话AI必须像核技术一样被「解除武装」,这个方向的博弈才刚开始。
AI到底有没有意识,这个问题现在没人能回答,可能十年内都没人能回答。但「谁有资格定义AI」这场仗,已经真刀真枪打起来了。作为普通人,最划算的姿势大概是:对研究保持好奇,对叙事保持警惕,对钱包保持清醒。