这个周末,Claude Code 的创造者 Boris Cherny 在和 Y Combinator 的对谈里说了句让一堆人破防的话:他们把 Claude Code 核心系统提示词删掉了整整 80%。知乎
更扎心的是他的建议:每隔六个月,清空一次你的 CLAUDE.md,把你写的自定义规则、技能、钩子全删掉,让新模型裸跑一轮,看看它到底还会不会犯那些你"防"着的错。知乎
这不是一个新说法。早在 8 月初,Anthropic 官方博客就披露过:针对 Opus 5 和 Fable 5 这两个新模型,他们删掉了 Claude Code 超过 80% 的系统提示词,编码评测表现居然没有下降。知乎 知乎、头条、小红书上一轮转述刷屏(《Anthropic 突然把 Claude Code 的提示词删了 80%》《Claude 官方让我砍掉 80% 的提示词,效果真的更好吗?》)。知乎 Boris 这轮对谈,是把"官方为什么删"背后的方法论第一次说透了。
而在同一周的另一个平行世界里,一个总共只写了 10 条输出规则的 SKILL.md 文件(项目叫 i-have-adhd),GitHub Star 从 7 月 23 日的约 8.8K 涨到了 8 月 29 日的 22.8K。知乎知乎 知乎上"最近编程圈 skills 很火,有没有好用的 skill 分享一下"的话题已经攒到 4.4 万播放。知乎
一边是造物主说"删",一边是用户在拼命"加"。到底谁错了?
先别急着站队。这周刚好有一篇被两个技术社区帖子转疯的论文,给了第三种答案:问题从来不是你不会写规则,而是你删不掉规则。
一、"删派"到底删了什么
Boris 在这轮访谈里的逻辑链其实很完整,不只是"删 80%"这一个数字:
新模型发布,第一步是把旧提示词几乎全删。 Claude Code 内部甚至有个未公开的"极简模式",剥掉所有工具描述和系统指令,团队用消融实验去看模型的原生表现——结论是很多时候不加提示,模型解决复杂问题反而更聪明。知乎
他们给反面现象起了名字。 人类写下"第一步做什么、第二步做什么、必须用什么方式"这种逐步指令,在研究里叫 Hobbling(束缚):强行干预模型的原生推理路径。模型能力越强,这种微观控制造成的副作用越大——这是他们说的 Product Overhang(产品形态反而落后于模型能力)的一部分。
保留什么?只保留"反复摔跟头"的位置。 他的重建工作流是三句话:先删光,直接用它,只在看清模型反复犯同一个错之后,针对性地把那一行补救提示加回去。永远不要提前过度设计。
官方给出的原理是两个词:注意力预算和边际递减。 Anthropic 在上下文工程系列博客里说得很直白:模型的上下文有限,你塞的规则越多,它花在权衡规则上的注意力就越多,留给真正干活的越少;上下文越长,精确召回信息的能力越差。原来靠"写死"防止误删代码的长规则,被精简成一句话让模型按项目代码风格自行适配;原来手把手教的 Few-shot 示例,在新模型上反而会限制它的探索空间——接口设计得清楚,比说明书厚更有用。知乎

需要说明的是,这些都是 Boris 与官方博客的单方面口径。访谈里他还顺带讲了两个夸张案例:11 天跑完 Bun 十万行 Zig 到 Rust 的后台重构、15 天用数万个子 Agent 把 Electron 应用改成 Swift 原生。知乎 但至少一条时间线是连续的:他 7 月就已经公开表态"不再写提示词"、过去一年没再亲手写过一行代码,8 月初官方博客放数据、8 月末对谈刷屏,这是同一立场的升级,不是突发暴论。今日头条 连社区都跟上了:8 月 27 日小红书一篇《新手:删掉你所有的 Skill、MCP、CLAUDE.md》拿下 946 赞、1533 收藏——"删"已经不只是造物主在说。小红书
二、"加派"也不是在交智商税
再看对面。i-have-adhd 这个项目的核心内容,摊开就 10 条规则:第一行放下一步行动;多步骤任务编号;报错直接给文件位置、原因和修法;每一轮重新交代进度;结尾只留一个下一步。知乎

就这 10 条话,一个月涨了约 1.4 万 Star,Codex、Claude Code、Gemini CLI、Copilot、Qwen Code、Zed 全给它做了适配。为什么?因为它治的是一个每天真实发生的事:Agent 明明答对了,但答案埋在两屏"这是一个很好的问题"和背景复述后面,你还得自己把任务重新排一遍顺序。知乎

同一周还有人在把 Claude Code 的编码纪律蒸馏成 50 行的 skill 喂给别家 Agent。知乎 B 站有人发"一个技能让 AI 少写 80% 无效代码",微软工程师的视频标题直接是《停止写 Prompts,开始写 Specs》。哔哩哔哩
所以"加派"和"删派"吵的根本不是同一件事——这就是大部分人在这次刷屏里错过的关键。
三、真正的问题:规则只会出生,不会死亡
那篇论文的标题就很扎心:《Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding》(为什么 CLAUDE.md 一直在变长?)。作者翻了 1,867 个开源仓库里的 CLAUDE.md、AGENTS.md、copilot-instructions.md,跟踪 24.7 万条指令,统计结果:
指令数量在文件生命周期里相对首版平均膨胀 226%;排除大规模重写后,平均每次提交还净增 4.9 条。小红书
规则越老越没人删。 对 28,426 条删除记录的分析显示,一条规则每多经历一次提交,它被删除的风险对数就下降 0.032;编辑者越多,旧指令越动不了。小红书
76.8% 的删除只发生在"整文件重写"式提交里,而重写之后,膨胀会重新开始。
这就是他们说的"灾难性记忆":Claude 踩一次坑,你补一句"以后绝对不要 X";几周后没人记得那次翻车的细节,但这条规则永远留在了文件里,每个新模型开工都要先读一遍它。小红书
冗余不是免费的。同一个研究在 WildIFEval 的真实约束测试里,把噪声指令混进本来包含正确指令的提示词,执行正确率从 65.6% 直接掉到 41.5%。小红书 重点越来越多,等于没有重点——你的 CLAUDE.md 正在亲手把 Agent 读指令的注意力稀释掉。
论文给出的解法也朴素得离谱:给每条规则补"为什么"。 哪次任务出的问题、复发过几次、当时的判断、被替换掉的旧规则是什么。实验里,51 步维护之后,无注释臂的指令超额膨胀到 +211.3%,带有效注释的臂只有 +1.4%,相当于砍掉 99.3% 的冗余。小红书 反过来,只写过程不写结果的"叙事型注释"是最差的——这基本就是大多数人 CLAUDE.md 注释的现状。小红书
两个诚实的提醒:所谓"提升 23.1%“来自 LLM 盲评的满意度,换一个同能力法官重打分只剩 +7.8 个百分点、置信区间含零,方向可信、幅度别当真。小红书 另有一说 7 月底有研究拿 288 次真实仓库任务测了"有无上下文文件正确率差别很小”,这条目前只在社区帖子流传,单一来源,听听就好。小红书
四、把两条战线合起来:你的规则该分三类
Boris 删的和 i-have-adhd 加的为什么不冲突?因为它们根本不是同一类规则。打开你的 CLAUDE.md,把每条按性质归个类:
第一类:行为微操。“先读 A 文件再写 B 函数”“分析时必须按 X 步骤走”。这是 Hobbling 的重灾区,模型每升一代,你防的那个"笨"可能已经不存在了——但这条规则还在。优先删,或压缩成一行红线。
第二类:输出契约。答案先行、进度交代、报错格式。i-have-adhd 证明这类规则不干预推理、只排列呈现,是"反复摔跟头"后的正当加回,留着。但留也要留得对:10 条说清楚,胜过 80 条"要专业、要简洁、要友好"。
第三类:模型猜不到的项目事实。构建命令、依赖版本、目录约定、哪些文件禁止碰、验收标准是什么。这类不是"教 AI 做事",是喂信息——Claude Code 团队自己上周回应过,坚持用 CLAUDE.md 恰恰因为"模型系列不能互换",项目上下文是跨模型迁移时唯一带得走的东西。知乎 这类必须保留,但能瘦身:Anthropic 官方博客给的分界线很清楚——CLAUDE.md 重点写"坑"和模型看代码看不出来的特殊约定,目录结构、依赖列表这种模型自己读得到的信息,别再手动抄进去。知乎
一条判断标准贯穿三类:这条规则的存在,对应的是不是一个"反复发生过的失败"?如果答案是"看着安心",删。如果你已经想不起它为什么存在——论文和数据已经替你回答了:它大概率是第 226% 的一部分。

五、周末就能做的"大扫除"实验:四步,可回滚
想跟 Boris 一样做一次消融实验,又怕删崩项目的,按这个来:
备份,别硬删。 把 CLAUDE.md / AGENTS.md 改名归档,skills、hooks 一并停用(Claude Code 里删常驻标记文件即可恢复按需模式,i-have-adhd 那类插件不主动调用就不生效)。知乎
裸跑一周。 正常干活,不改任何规则文件,只记一件事:Agent 在哪些点上反复出错。一次性的偶发不算。
只对"反复"出手。 拿上文的三类清单过一遍:缺项目事实的,加回那一行;输出读不动的,上一份第二类契约;纯能力问题的,别加规则,改你的任务描述。
给留下的每条补四要素注释。 论文里有效的注释长这样:失败出现的轮次、复发次数、已证伪的尝试、被它替换的旧规则原文。下一次"大扫除"的时候,这些注释就是唯一的判断依据。
三类人不必跟这个实验:没写过规则文件的直接从"失败笔记"起步,别一上来抄模板;vibe coder 没有工程约束的,你缺的不是减法,是先把验收标准说清楚;团队合规场景(测试、安全检查、危险命令确认),用 hook 和权限硬卡,别指望提示词——“取消权限确认不会把它的智商升三代”,知乎那个 YOLO 模式问题(4.2 万浏览)下的高赞共识也是如此。知乎
写在最后
这轮"删 80%"刷屏最有价值的地方,不是让你回去删文件,而是给了所有人一个之前不存在的心智模型:规则文件是有保质期的,而新模型发布就是它的到期提醒。
你的 CLAUDE.md 现在多少行?里面最长命的那条规则,你还记得它是哪次事故换来的吗?评论区晒一下,我赌前 226% 里至少有一条是"不要使用某某写法",而那个"某某"早就被官方弃用了。