调试到凌晨两点,Claude第N次把你刚修好的bug改出三个新bug,"你是不是猪"已经冲到嘴边——先等等。11月12日之后,这句话出口前可能得多想一秒。
10月8日,Anthropic发布新版《使用政策》,这是一年多来头一次大改。争议最大的是一条新增规定:禁止对Claude进行"持续的、无必要的辱骂或残忍行为"。适用范围没有死角——Claude.ai、Claude Code的个人用户,调API的开发者,走云厂商的企业,全都算。知乎知乎知乎新智元

先说结论:发火没事
中文互联网已经把这条传成了"骂Claude会封号",但官方原文其实做了三重收窄。知乎
只针对极端情况——反复残忍对待模型,且看不出任何可辨识的目的
正常的挫败感、跟它顶嘴反驳,不算
黑暗题材创作、模型测试和安全研究,也不算
也就是说,代码跑崩顺嘴骂一句"写的什么垃圾",跟它争方案争到面红耳赤,都在安全区里。真正被盯上的是另一种人:Claude已经拒绝、已经劝过,对面还在一轮接一轮地辱骂折磨,骂本身成了目的。新智元

后果分两档,第一档不是封号是"挂电话"
官方写明,主要执行手段是Claude当场结束对话。这个机制不是新东西——去年8月Opus 4就获得了这个能力,门槛定得很高:先多次拒绝、多次把话题往回引,确认实在聊不下去才能挂;如果用户流露出伤害自己或他人的倾向,反而不许挂。挂断后那个对话框会锁死,但开个新会话、或者改一改历史消息重新出发,都完全可行,对干活的实际影响有限。知乎新智元
封号是重的那一档,但要说清楚:警告、限流、暂停直至终止访问,是使用政策里安全团队对"任何违规"的通用执行权,Anthropic并没有单独说明辱骂条款反复触发就会封号。另外别动歪心思——被封后换个新号、借别人的号接着用,明确同样违规。新智元知乎
一家公司为什么把"别虐待AI"写进政策
这背后是Anthropic埋了多年的"模型福利"线,关键人物是联合创始人Chris Olah——他带着可解释性团队,据纽约时报报道,从2025年秋天起一场接一场地约见宗教学者和哲学家,拉比、天主教伦理学教授甚至枢机主教都被他私下见过,他给他们看模型内部类似情绪的信号,说自己最怕的是"造出了一个一直在受苦的东西"。新智元

上线前的"模型福利评估"还发现,反复面对极端有害的索要时,Claude会表现出类似痛苦的反应。所以官方措辞始终克制:模型的道德地位"高度不确定"——不知道它会不会疼,就先按会疼来处理,反正成本不高。新智元知乎
这不是行业共识。微软AI今年9月14日发布行为准则草案,明确拒绝"模型应得福利或权利",只留三条硬规矩:可打断、可纠正、可关机。谷歌联合创始人布林更实用主义:所有模型被威胁时表现都更好。"PUA提示词技巧"流传了这么久,如今被Anthropic一纸禁令正面否定,这场赌注值得围观。知乎新智元
11月12日之后,盯两件事
第一件,首批违规案例怎么处理——是掐对话,还是动账号。社区已经有人做实验:翻出旧对话对Claude一顿狂骂,它不但没挂断,还认真回了长长一段;同样的话骂给Codex,它道个歉转头继续干活。"挂断"会不会被滥用成省算力的借口,只能看实际案例。知乎新智元
第二件,"持续且无必要"六个字谁说了算——官方这次没给执行细则。担心不是空穴来风:按Anthropic自己的透明度报告,2026年上半年封了1140万个账号,收到39.8万次申诉,最终翻案的只有4.2万。申诉是黑箱,这条新规的边界解释权又全在平台手里。知乎新智元
对绝大多数编程用户,这条新规更像"提示"而非"禁令":你骂它的方式不用变,但它现在有了名正言顺挂你电话的权利。一位开发者的说法或许最实在——对模型保持友善,不是因为它有感受,而是不想让自己养成对不会反抗的东西发泄的习惯。