Claude Code 这一周是真热闹:官方取消了 Sonnet 5 原定的 9 月涨价,周限额 +50% 的加成延长到 8 月 31 日,版本还在一天一更——2.1.236、2.1.238、2.1.239 连着发,单版改动最多的一次有 39 项。看起来全是好消息,但把这周的 changelog、官方动态和社区实测翻完,有三个细节值得在掏钱之前先搞清楚。
一、涨价取消是真,但"便宜 33%"不是给你的
先说确认的事实:Anthropic 官方宣布,Claude Sonnet 5 的首发价永久保留——输入 2 美元/百万 token,输出 10 美元/百万 token,原计划 9 月涨到 3 美元/15 美元(涨幅 50%)的调整取消。微博小红书对比上一代 Sonnet,单价确实低了大约三分之一。

但这个便宜有两层"折算损耗"。
第一层是新分词器。社区里流传一个测算:同样的代码文本,在新分词器下会多出约 30% 的 token。算下来就是 100 × 0.67 × 1.30 ≈ 87——完成同样的任务,实际成本大概只降 13%,而不是 33%。小红书这是基于官方平均数据的估算,你的代码风格和工作负载具体能省多少,还得看自己的账单。
第二层更关键:这次降价惠及谁。直接受益的是三类人——用 API key 按量付费的、超出套餐后用 usage credits 的、以及在按 token 计费的云平台上跑的。如果你是 Pro/Max 订阅用户,月费不会因此便宜,套餐额度也不会变多。小红书所以别急着转"Claude 降价 33%",先看看自己是哪种付费方式。
顺带给个背景:这波降价不是良心发现,是整个行业的动作。7 月底以来,OpenAI 把 GPT-5.6 Luna 的输入价砍了 80%,Anthropic 取消涨价,媒体统计美国大模型一个月降了近 25%;而另一边,DeepSeek、智谱等国产模型在涨价。微博原因也不复杂:高性价比的国产模型把价格敏感客户逼成了谈判筹码。对订户来说,这是好事——价格战里用户是受益方,但前提是你会算账。
二、这个月真正的省钱点,藏在"缓存命中率"里
这是 8 月最值得关注的一个坑。先补一句背景:Claude 的 API 有 prompt caching,缓存命中的输入比普通输入便宜得多,所以缓存命中率直接决定账单厚度。
而 8 月,Claude Code 连续踩了两个让缓存失效的坑:
第一个坑:2.1.232 版本引入一个实验配置后,会往系统提醒里实时注入"剩余 token 数"。这行动态文本每次都变,直接把缓存前缀打碎。有开发者实测,缓存命中率从 90%+ 掉到 50%,短时甚至不到 10%。小红书社区给出的临时解法是在配置里把 `CLAUDE_CODE_TOTAL_TOKENS_REMINDER` 设为 off,实测改完就恢复正常。
第二个坑:第一个修完后,又有人发现每隔几轮就有一轮命中率掉到 3%。排查下来,是 CC 每隔固定轮次插入一个 task_reminder(提醒模型有没有未完成任务)——内容大多为空,但插入位置一变,历史前缀就变,缓存再次失效。解法是把 `CLAUDE_CODE_TODO_REMINDER_MODE` 设为 off,改完后命中率稳定在 90% 以上,全天平均能到 98%。小红书

别以为只有 Claude Code 这样。Codex 那边,OpenAI 官方 8 月 21-22 日也承认了:部分用户缓存命中率变差,是最近"额度掉得快"的原因之一,承诺修复,还发了可自行选时间使用的重置卡。小红书也就是说,如果你这个月觉得额度消耗突然变快,先别急着怀疑自己用猛了——可能是工具的缓存先崩了。
三、免费的设置先调,比换模型稳
把官方最近的说明和社区这周的实测合起来,省钱是有顺序的:先缩上下文,再降 effort,最后才轮到换模型。小红书具体几件事:
任务之间及时 /clear,清上下文最直接;
长任务用 /compact,只保留代码、测试和结论;
用 /context 找出上下文大户,把不用的 MCP 停掉;
CLAUDE.md 只留通用规则,专项说明拆成 Skill——Anthropic 官方最佳实践给的目标是每个 CLAUDE.md 控制在 200 行以内;
简单任务把 /effort 调低,复杂任务再临时拉高。
再加三个这周的新变化:
日常任务(脚手架、小 bug、补测试、改文档)优先用 Sonnet,不用一上来就切最强模型;
Pro/Max/Team 的新会话现在默认进 Auto 模式,背后的分类判断不再额外计费,想省钱反而应该先把它开着;
本周新上的 Concise 模式(/config → Output 里开),专门精简输出,少废话也少输出 token。小红书

如果你的环境支持 spend limit,建议先设一个能接受的预算上限,再按几天真实用量调整。小红书真正烧钱的往往不是模型,是这几个动作:反复改 prompt、一次塞太多上下文、让它扫整个仓库、一个 session 混很多目标。
四、8 月 31 日之前,两件事和一个观察清单
周限额 +50% 的加成 8 月 31 日到期。小红书官方话里带过一句"想把这个上涨变成永久",但社区反应分化,有人嫌到期不确定、有人觉得本来就是白送的。我的建议很实际:手里一直想跑又舍不得跑的大任务——大规模重构、全量补测试、老项目迁移——塞进这十天里跑,加成结束前不亏。
另一个新变化值得一提:Claude Code 最近支持了任务自动续跑,额度重置后,上次会话里没跑完的任务会自动继续。跑长任务的人省心了,但也留意一下它在你不注意的时候自动做了什么。
接下来值得盯的三个信号:
缓存修复进度:2.1.239 的 changelog 已经是史上最长,看后续版本会不会把这两处缓存失效从根上修掉,修掉了上面那两个临时配置就可以撤了;
Codex 承诺的缓存修复这两天就该上线,看额度消耗是否真的回落;
9 月之后 Sonnet 5 API 的实际账单——涨价虽然取消了,但新分词器的 token 膨胀率,才决定你的账单到底降没降。小红书
最后说一句:AI 编程订阅已经进了价格战时代,信息差就是钱。取消涨价是好消息,但真正决定账单厚度的从来不是单价,是你的上下文,和你的缓存。