修同一个bug,5次请求和18次请求两种账单:Anthropic官方教Claude Code省token,先改习惯再谈升级Max

源自6位全网作者

07:03

8月中旬,Anthropic 发了一篇官方博客,专门教全球程序员怎么把 Claude Code 用得省一点,触发原因很直接:官方测算发现,用 Claude Code 干活的开发者日均消耗约 13 美元的 token,月均 150-250 美元,而同样修一个 bug,问法不同,花费能差出好几倍。知乎模型厂商亲自下场教用户省钱,这种事不多见,说明这种"无感烧钱"已经普遍到官方看不下去了。这篇文章替你读完官方博客,并交叉了 8 月 17 日的版本更新、订阅套餐机制和社区真实的额度焦虑,只把能直接上手用的部分留给你。

先搞懂钱烧在哪:你在为"记忆"付钱

Claude Code 的账单逻辑不是"你问了几次",而是"你给模型发了多少 token、模型又生成了多少"。一次请求分两段:读入上下文的预填充,和逐 token 生成的解码,后者贵得多——解码阶段对 GPU 的占用明显更重,所以输出 Token 的单价通常大约是输入 Token 的 5 倍。知乎同时它还有一层提示缓存:同一段上下文如果上一轮刚算过,这一轮就按缓存价读,缓存命中后读取只要正常输入价的0.1倍,最高省90%。知乎真正的大头在"上下文"里。Claude 读过的每个文件、跑过的每条命令输出、你打的每句话,都会留在会话里,之后每一轮请求都原样重发。假设每轮新增内容规模接近,第 2 次请求重读 1 份历史,第 3 次重读 2 份,第 n 次重读 n-1 份。知乎这就是为什么会话越用越贵:不是问题变难了,是你在让它反复重读前 39 轮的"人生回顾展"。

修同一个bug,5次请求和18次请求两种账单:Anthropic官方教Claude Code省token,先改习惯再谈升级Max

同一个任务,5 次请求和 18 次请求是两种账单

官方博客把同一次修复摆成了两组对照:同一个小修复,Claude Code 可以用 5 次请求完成,也可能先搜索仓库、打开一串候选文件,发到 18 次请求才收工。知乎差别全在第一句话怎么说。

修同一个bug,5次请求和18次请求两种账单:Anthropic官方教Claude Code省token,先改习惯再谈升级Max

说"测试挂了",它得自己 grep、自己开文件试探;说"修复 utils.test.ts 里失败的测试",跳过搜索;用 @ 把文件直接附上,连 Read 都省了——提到文件时,最好直接使用 @,而不是只敲路径。知乎而且一个会话里附一次就够,反复 @ 同一个文件,通常会把第二份副本也塞进上下文。

修同一个bug,5次请求和18次请求两种账单:Anthropic官方教Claude Code省token,先改习惯再谈升级Max

要说明的是,5 和 18 是官方教学示意,不是所有仓库的固定比例,但它指出的关系是实打实的:目标文件、失败现象、验收命令说得越清楚,模型花在"找路"上的请求越少。

今天就能换上的免费习惯清单

  • 任务之间做 /clear。Anthropic 的另一张示意把三个任务放进一条长会话,发送 token 约为任务间执行 /clear 的 1.9 倍。知乎以后还想找回会话,就先 /rename 再清。

  • 会话中途别随手换模型或推理强度。模型和 effort 都在缓存键里,中途切换,下一轮整段历史按原价重算;要换,在新会话或刚 /clear 之后的便宜时机换。

  • 最近几轮聊偏了用 /rewind,别急着 /compact。如果只是最近几轮聊偏了,不必急着 /compact。可以用 /rewind 回退到跑偏之前。知乎回退只剪尾巴、缓存还热着,压缩却是整段重写。

  • 把每天反复执行的命令连静默参数一起写进 CLAUDE.md,比如 `npx vitest run --reporter=dot`。不然测试框架把 400 个通过用例逐行打印、又没超过 3 万字符阈值的话,这 400 行会原封不动留在上下文里,跟着后面每一轮继续发送。

  • 新会话先跑一次 /context,看看第一句话之前已经加载了什么:CLAUDE.md 只留长期有效的项目指令,工作流说明放进 Skill,用不到的 MCP 用 /mcp 关掉。

  • 纯机械活,用 `MAX_THINKING_TOKENS=0` 启动那一次会话,直接省下思考 token。

  • 1M 上下文用户想保留自动压缩保护,跑 `/autocompact 200k`(需要 v2.1.221+)。

真正吵闹的探索活——大范围搜索、完整构建——交给子 Agent 更划算:它探索完上下文即用即弃,不会撑大你的主会话。

修同一个bug,5次请求和18次请求两种账单:Anthropic官方教Claude Code省token,先改习惯再谈升级Max

选模型:看任务难度,不看信仰

简单任务上,两种模型最终效果可能逐渐收敛;困难任务上,大模型往往能达到更高上限,小模型则可能更早碰到能力天花板。知乎所以省钱原则不是"永远用最小模型",而是开工前先定档:机械修改、格式调整、跑固定流程用小模型;需求含糊、复杂重构、多轮调试再上强模型。官方说的"same quality, fewer tokens",就是这个意思。

修同一个bug,5次请求和18次请求两种账单:Anthropic官方教Claude Code省token,先改习惯再谈升级Max

这两天还发生了两件值得知道的事

8 月 17 日的 Claude Code v2.1.234,把内置 claude-api skill 的上下文加载成本从约 200k tokens 降到约 25k tokens,参考文档改成按需加载,降幅约 8 倍。知乎常挂技能的人能直接吃到这波降幅——升级版本本身就是省钱。同一版本还把 Windows 凭证泄露的补丁扩展到了远程文件读取、会话恢复等更多路径,安全账也算顺手修了。

另一件是 AutoMode 从 8 月 14 日起面向 Pro、Max 和 Team 订阅用户默认开启。知乎Agent 能跨会话自主规划多步骤任务,用起来更省心,但额度消耗节奏也可能变快。刚改完习惯的话,建议先观察两周账单曲线,再决定要不要加钱。

要不要升级订阅:先改习惯,再谈档位

很多人额度焦虑的第一反应是升档。先看价格:Max 5x 和 Max 20x 都是月付,官方参考价格分别为 100 美元/月和 200 美元/月。知乎而且额度按滚动 5 小时窗口计算,实际能用多少还受对话长度和任务复杂度影响——20x 并不意味着"更聪明的模型",只是更大的使用空间。

所以升档只治标。说到底,Max 买的不是"更聪明的 Claude",而是更多的使用空间。知乎如果升完还在一个会话里拖半天、还让模型自己搜文件,20x 一样烧得飞快。合理的顺序是:先把上面的习惯清单跑两周;5 小时窗口仍经常撞顶,再上 5x;全天候重度使用、5x 长期不够,才考虑 20x。

顺带说一句:别把鸡蛋放一个篮子里

对国内用户来说,额度还不是唯一的焦虑:Claude Code确实强,但它有一个致命问题——封号和额度。知乎而另一边,编程模型的价格战今年没停过:Grok 4.6 接入 GitHub Copilot,API 定价 2 美元/百万输入、6 美元/百万输出,约为可比模型的一半。知乎微软的 MAI-Code-1.1-Flash 也直接把价格降到前代的四分之一。替代项越来越便宜,"养成好习惯"就比"死忠一个工具"更值钱——8 月 11 日几家大厂联合发布的 Agent Plugins 打包标准,就是为了让技能资产跨平台复用,以后的切换成本只会更低。

最后做个小调查:你一个月在 Claude Code 上花多少钱、多久撞一次限额?上面这些省 token 技巧,哪条是你亲测有效的?评论区聊聊,我把大家的真实数据整理成下一篇。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章