替你重复解释的每一遍,都是学费:AI"失忆"这笔账,该翻篇了

源自515位全网作者

05:05

9 月 4 日,小红书上一条《Codex 很值得养成的收尾习惯》被收藏了 30813 次——内容只有一件事:每次关掉长会话前,让 AI 写一份交接文档存进 HANDOFF.md,新会话的第一句话是“先读 HANDOFF.md”。两个月前,同款文案的原帖已经拿走 19271 个收藏:同一个土办法,两个月内爆了两遍,这在 AI 帖里是罕见的复利。评论区比正文还热闹——有人WORKLOG.md,有人维护 progress.md,有人干脆自己搭了个状态机记项目进度。同一个月里,知乎“上下文工程”话题密集更新了几十篇实操帖,B 站一个叫 unlazy 的项目以 2970 星冲上每日推荐,标题直译就是“AI 干活总半途而废”。小红书哔哩哔哩

如果你也是那种 Claude Code、Codex 付费用了一年多、天天让 AI 帮你写代码改方案的人,这波的信号你应该已经感受到了:提效圈的瓶颈,正在从"模型不够聪明"转向"它根本记不住你说过什么"。 而多数人的第一反应是错的——以为是模型退步了、套餐坑了、该换家了。

我把近一个月知乎、小红书、B 站的三十多篇帖子和翻车实录对了一遍,结论先放这:失忆不是玄学,是架构;解法不用等新模型,但也不是所有"记忆方案"都值得你掏时间。这笔账,分三层算。

第一层账:它不是忘了,是压根没"记住"这个功能

9 月 11 日知乎上一篇企业 AI 转型的实录,讲了一个很典型的测试现场:客服机器人"聊到第 20 轮,它就开始忘了最初的订单号";采购审批 Agent 跑到第 8 步,把第 2 步的预算约束忘了,“差点放行一笔超预算的采购”。知乎

这不是个别模型翻车。那位作者把机制讲得很直白:大模型的 API 调用本质是无状态的,每一次请求都是独立调用,模型本身不记得你上次说过什么。你看到的"多轮对话",是客户端把历史记录一遍遍重新拼进 prompt 里发给它。对话越长,每轮重传的内容越多——所以文章里那句判断我认为是这个月最值钱的一句话:“'聊着聊着就失忆’不是偶然,是机制决定的。”知乎

顺着机制往下,你会看到三件一直发生但你没注意的事:

  1. 成本在隐形上涨。 9 月 5 日知乎一篇讲上下文压缩的工程实践帖说得很清楚:全量历史每轮重传,推理成本随任务时长线性飙升,“几十轮交互下来,历史 token 量轻松突破十万级”,轻则早期信息被粗暴截断、任务跑偏,重则直接报错中断。知乎

  2. 你看到的"能一直聊",是平台偷偷帮你做了有损压缩。 接近窗口上限时,系统会把前面的历史压成几百字梗概。压缩必然丢细节——某个关键参数、某段报错原文,一次压缩就没了。

  3. 窗口再大也不等于记忆。 有人给常驻记忆块做实测,发现那块随身带的记忆"两千来个字符到头了,新东西进来,把旧的挤走"——纠正过好几回的事,回头就被排进来的新内容挤掉了。8K 扩到 128K 再到一百万,只是桶变大了,桶本身不是仓库。知乎

替你重复解释的每一遍,都是学费:AI

所以第一层账的结论是:别为失忆骂模型,它没有"记不住",它只有"没带上下文"。 你每天重复解释项目背景、代码规范、口味偏好,本质是在给一个"没写下来的规范"重复交学费——用上下文圈子里现在很流行的一句话总结:“没有写下来的规范,对 Agent 来说就不存在。”

第二层账:概念已经换了三次,你的用法还停在上一代

把时间线拉出来,这个圈子半年的共识变化快得离谱:

  • 2024-2025 上半年:拼提示词。 万能指令、模板、咒语帖统治小红书。

  • 2025 年中至今:改叫"上下文工程"。 9 月一篇被转了很多次的总结帖的说法是:2024 年"记忆"被列为智能体核心模块,2025 年 Karpathy 把"上下文工程"称为行业关键词;知乎那篇《Prompt 与上下文工程》讲得更不客气:现在行业共识已经变了——模型差距在缩小,上下文质量差距在放大,“同一道题,提示词写得烂的 o3,干不过上下文喂得饱的 4o”,圈内甚至有了"70% context / 20% model / 10% prompt"的调侃分工。知乎

  • 9 月这一周: “记忆"开始从上下文里拆出来单飞。9 月 11 日一天之内,出现了《记忆成为 AI 基础设施》《ForgeMemory》两篇拆解记忆赛道的文章,说法是 2026 年"记忆评测成为独立基准,独立的’记忆层’产品赛道出现”。知乎

概念换代的另一面,是社区已经自发演化出一整套"文件派"土办法。看那个 19k 收藏帖的评论区就知道:HANDOFF.md 只是入门,老玩家维护的是 WORKLOG(顶部现状+下面历史)、progress.md(每次写代码前强制先读)、错题本式经验记录,甚至"收工 skill"——说一句"结束",Claude Code 自动更新工作日志。这套东西没有一个是付费的,全是几行 prompt 的习惯。小红书

小红书上“AGENTS.md 让 AI 通过率 100%”的帖子收藏了 2671 次,8 月底更火的一版是“Vercel 工程师烧了 600 亿 token 总结出能省 80% token 的 8 条规则”——无论数字有几分真,方向是同一个:大家开始把功夫花在给 AI 搭“环境”上,而不是嘴皮子上。小红书

而开发者侧,Anthropic 的 context-engineering skill 把上下文拆成五层:从最持久的 Rules File,到单次会话内的临时上下文,明确说"Rules File 是所有层级中性价比最高的投入";LangChain 则把翻车原因归成三类——context poisoning(喂了错误信息)、context distraction(喂太多干扰)、context confusion(顺序和结构不对)。对照这三类,你大概率能立刻认领自己至少一种。知乎

替你重复解释的每一遍,都是学费:AI

第三层账:该花的、别花的、先别急的

把上面两层折成钱和时间,我按投入回报给这几类方案排个序:

第一档:当天就该做,成本几乎为零。

  • 给项目写一份规则文件:Claude Code 叫 CLAUDE.md,Cursor 用 .cursorrules,Codex/Continue 认 AGENTS.md,GitHub Copilot 是 .github/copilot-instructions.md。9 月 7 日知乎那篇 .cursorrules 迁移实操给了三条避坑:写在仓库根目录(放 docs/ 下工具读不到)、规则要具体到"命令和禁忌"(写"代码要优雅"等于没写)、多工具团队以 AGENTS.md 为一份主文件,旧格式只做兜底。知乎

  • 长会话收尾三件套(HANDOFF.md + 复盘归因 + 错题本),提示词直接抄那个高收藏帖的原话:“这个会话要结束了。请写一份交接文档存到 HANDOFF.md:我们在做什么任务、已经完成了什么、当前卡在哪、下一步计划是什么、有哪些踩过的坑绝对不要再踩。写给一个完全没有上下文的新会话看”。小红书

  • 改聊天方式:从流水账改成"章节式会话",每完成一个阶段就让 AI 存一次快照,新会话先贴快照再干活。

替你重复解释的每一遍,都是学费:AI

第二档:值得装,但别神话。 unlazy 这类"完成纪律"工具(DepthTree 拆任务 + GATES 验收账本 + Stop 钩子)思路是对的——每条验收标准绑一条真实检查命令。但连介绍它的视频都提醒:检查命令得你自己写,“写水了等于没装”。哔哩哔哩

第三档:谨慎观望——“记忆插件”。 9 月 11 日知乎一篇自己搭了外部记忆库的长文,把"只进不出的记忆库"的四个新坑扒得很细:库只会追加不会修改,端口从 8080 搬到 9090 之后,旧记录还排在答案前头;检索按字面相似度不按时间新旧,半年前的老黄历和昨天的进展混在一起;跨会话不会自动去查库,你不让它查它就当库不存在;所谓"按语义检索",用久了"真正出结果的是死抠字面"。给 AI 装记忆这件事,目前更像 2024 年给电脑装安全全家桶:方向没错,产品没成熟,装错了反而制造新故障。知乎

替你重复解释的每一遍,都是学费:AI

第四档:别掏钱。 一个词一旦成为共识,卖课和卖链的比研究者来得快。《AI 通识》那篇帖子自己都承认:学术界很少正经研究上下文工程,因为它"太脏、太工程化"。实际生态里,我在知乎搜"上下文工程",已经能看到讲 AGENTS.md 的实操帖里夹带第三方模型网关的充值链接广告,讲"记忆基础设施"的帖子后半段是数据库厂商软文。判断标准很简单:真方案的落点都是让你改自己的文件、自己的习惯;假方案的落点都是让你买它的东西。

收个尾

这篇最值得留的一句话:失忆是架构问题,重复解释是在给没沉淀的信息交学费;学费一次性结清的方式叫规则文件,而不是更贵的套餐。

接下来值得盯的信号有两个:一是"记忆层"到底会不会从厂商 PPT 里走出第一个能跨工具通用的标准(现在各家文件互不兼容,本身就是最大的槽点);二是各家 Agent 的自动压缩策略会不会公开"压缩了什么、丢了什么"——在它能告诉你之前,凡是长任务,收尾那份 HANDOFF 都别偷懒。

先把你那个开了三个月的仓库根目录里,那份还空着的 AGENTS.md 写了再说。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章