这周 AI 圈发生了一件挺罕见的事。
8 月 14 日,Anthropic(Claude 母公司)发了一篇官方博客,不宣布新模型,不讲融资故事,而是手把手教用户「怎么少烧 token」。官方给出的测算很扎心:用 Claude Code 干活的开发者,日均 token 账单约 13 美元,月均 150 到 250 美元;同样修一个 bug,有人花 3 美元,有人花 15 美元。知乎
要知道,Anthropic 是按 token 收钱的公司,你烧得越多它赚得越多。这操作相当于加油站官方发文教你省油。
先交代一下背景,因为同一周还有另外两条新闻:Anthropic 二季度营收 115 亿美元,同比涨了 14 倍;公司正筹备今年 10 月上市,多家机构投资人估算估值超过 2 万亿美元——如果成行,这将是人类历史上最大规模的 IPO。知乎
营收狂飙的同时却怕用户烧钱烧跑了,这就是整件事最有意思的地方。它最赚钱的增长引擎 Claude Code(年化收入 5 个月从 5 亿美元冲到 25 亿美元),恰恰也是用户钱包的最大出血点。知乎用户烧怕了弃坑,增长故事就讲不下去了。所以这篇「官方省钱指南」本质上是一封挽留信。
但对我们普通付费用户来说,IPO 故事可以当谈资,真正该带走的是两样东西:这份官方省钱方法,和一份中国用户最容易踩的订阅坑清单。下面把账算清楚。
一、先搞懂:你的 AI 会员为什么「越用越烧」
很多人以为每月 20 美元、200 美元订阅了就是「自助餐随便吃」。AI 订阅的真实计费逻辑,比手机流量套餐复杂得多。Anthropic 这次把三个核心机制讲透了:
1. 你发的每一句话,都不是只发这一句。
每次请求,Claude Code 都会把整段会话历史重新发送——它读过的文件、跑过的命令输出、你们前面聊过的所有内容,全部打包重传。会话到第 40 轮,你等于在为前 39 轮的内容再付一次钱。会话越长,膨胀越快。官方博客里举了个例子:同样修一个测试,一种做法直接告诉 Claude「修 utils.test.ts 里失败的测试」,5 次请求搞定;另一种只说「测试挂了」,Claude 只能先全局搜索、再挨个打开文件试探,18 次请求才绕到目标,而且搜过的一堆无关内容会一直背在上下文里,后面每一轮都跟着付费。知乎

2. 输出 token 比输入贵约 5 倍。
模型生成的每一段代码、每一份长报告,都在按高价计费。你让它反复写大段解释,账单会明显抬起来。

3. 缓存命中与否,价格差 10 倍。
如果这次请求的开头和上次完全一致,服务器可以直接复用上次算好的结果——缓存读取只要正常输入价的 0.1 倍;但缓存很脆,一旦被打断(比如长会话中途切换了模型),整段上下文就要按全价重新读一遍,成本瞬间跳起来。知乎缓存有效期大约 1 小时。
这里要特别提醒订阅用户:界面里虽然看不到逐项计价,但这些请求一样在消耗你的套餐额度。而且 Claude 的额度不是按月发的,是每 5 小时滚动一个窗口,用不完的部分到点清零、不累积。你睡觉、开会、过周末的时候,花钱买来的产能就在空转。所以「包月」其实买的是实时产能,不是存粮。
二、官方 6 招省钱法,照着做就行
把官方博客拆完,能落地的动作其实就这六个。前四招管「少装没用的上下文」,后两招管「别把缓存撞碎」:
第 1 招:不同任务之间,直接 `/clear`。
很多人一个会话从早用到晚:修完 bug 接着做新功能,做完功能再改页面。上下文越滚越大。官方的建议很直接——任务切换就清空。一堆工作拆成几个短会话,通常比塞进一个超长会话更省。知乎

第 2 招:开工前定好模型和推理强度,中途别乱切。
长会话进行到一半切换模型或推理强度,是最贵的时机——缓存大概率失效,整段上下文重新全价读入。新会话开始时先用 `/model` 和 `/effort` 确认当前配置(这两项会记住上次选择,不查就容易稀里糊涂用着高价档)。纯机械活甚至可以临时关掉思考 token,再降一档。
第 3 招:用 `@` 直接把文件贴给模型,别让它自己搜。
写「修复 @utils.test.ts 里的测试」,文件会直接附加进消息,省掉搜索和读取的轮次;只写文件名甚至只描述问题,Claude 就得先 grep、再开一堆文件试探,这些「找文件」的动作全会留在对话历史里,每轮跟着付费。另外注意:同一个文件 @ 一次就够了,反复 @ 会重复附加副本。

第 4 招:给命令输出「降噪」。
每次跑测试、构建、git log,终端打印的内容都会像文件一样追加进会话并长期驻留。真正麻烦的不是超大输出(超过 3 万字符会被自动写进文件、只留摘要),而是那种「400 行通过用例逐行打印」的啰嗦输出。能加 --quiet 就加,把常用命令连同静默参数写进项目配置;输出天然多的任务,交给子 Agent 去跑,别污染主会话。
第 5 招:新会话先跑一次 `/context`,看看你还没说话就已经背了什么。
工具定义、系统提示词、项目规则(CLAUDE.md)、各种 MCP 工具……这些在你说第一句话之前就占着空间。CLAUDE.md 只留长期有效的项目指令,一次性工作流说明按需加载,当前用不到的 MCP Server 随手关掉。
第 6 招:会话跑偏了优先 `/rewind`,别急着 `/compact`。
rewind 只是从会话末尾剪掉几轮,前面的缓存依然有效,几乎零成本;compact 是重写整段会话,必然产生一次全价成本。知乎如果确实要压缩长对话,趁缓存还没过期(约 1 小时内)做,压缩时的读取只花 0.1 倍价钱。
Anthropic 团队自己实测:同样的全栈功能开发,优化用法后日均调用量翻了 3.2 倍,总支出反而下降 14%。知乎省钱的本质就一句话:上下文只装该装的,缓存别亲手撞碎。
三、中国用户额外要防的 4 个坑
省 token 是一半,另一半是别在订阅环节白花钱。这四个坑,社区里踩的人相当多:
坑 1:App Store 订阅要多交一笔「苹果税」。
有用户实测对比:在 iPhone 应用商店订阅 Claude Max,价格比官网原价贵约 25%,Pro 年付也要贵约 7.5%——Claude 选择把苹果、谷歌的渠道抽成转嫁给用户。知乎对比之下,ChatGPT 的订阅是把这笔费用自己扛了,内外一个价。如果你一直走 App Store 续订 Max,一年下来多交的钱够再订两三个月。能走官网渠道的就别走应用商店。
坑 2:续费失败会「静默降级」。
小红书上好几位用户遇到同一个情况:几天没登录,发现 Claude 从 Max 直接掉成了 Free——原因是支付失败,而且几乎没有像样的提醒。小红书Apple 余额不足、卡片过期、风控拦截都可能触发。如果你帮公司干活全靠这个额度,建议养成习惯:每次开工前看一眼订阅状态,别等写到一半被断档。


坑 3:代充和「额度变现」的灰产,碰之前先想清楚代价。
现在网上到处是「正规代充、直充自己号」的服务,甚至出现了让你「把闲置额度挂出去卖 USDT」的中继工具。两件事要想明白:这类操作基本都踩在 Anthropic 服务条款的红线上,被检测到可能直接封号,而且中国用户的账号本来就因支付风控更容易被盯上,封了极难申诉。知乎所谓「正规代充」你根本无从验证对方用的是谁的卡、什么渠道。省小钱冒封号风险,这笔账不划算。
坑 4:订阅囤多了,最贵的那个往往吃灰。
社区里有个很真实的帖子:一位用户同时订了 4 个 AI 服务,月账单接近 1500 元,结果最贵的那个一周没碰过。AI 订阅和健身房卡一样,冲动订、低频用是常态。续费前先看一眼各家后台的用量统计,砍掉连续两周没打开的那个,比研究任何省钱技巧都快。
四、会涨价吗?现在该怎么续?
先说三个判断依据:
第一,短期内订阅价格大概率「温和调整」而非暴涨。 Anthropic 七到八成的收入来自 API 和企业合同,个人订阅在收入盘子里占比很小——它没动力靠涨散户月费来冲报表,IPO 前更需要用户增长的故事。参考 OpenAI 此前 20 到 30 美元的调价路径,更可能的是加档位、调额度,而不是直接翻倍。
第二,「便宜」的窗口在收窄。 营收 14 倍增长、估值冲 2 万亿,意味着资本市场要求它持续把利润做厚。免费额度缩水、低价档消失、按量计费渗透进订阅档位,这些都是大概率方向。国产大模型虽然还在卷价格,但本周 DeepSeek 也调整了 API 定价,「永远有便宜可占」不是稳态。
第三,涨价之外更大的变量是「额度设计」。 5 小时滚动窗口、缓存机制这些细节说明:AI 订阅正在从「买会员」变成「买算力」,看不懂规则的人实际单价会越来越高。
对应到不同人,我的建议是:
轻度用户(偶尔问问题、翻译、润色):不必为焦虑付费。免费版加一两个国产模型(DeepSeek、Kimi、GLM 都有免费额度)足够覆盖,把订阅费省下来。
日常办公用户(写方案、查资料、做文档):Pro 档(20 美元/月)够用。两件事现在就做:把 App Store 订阅切到官网渠道省掉 25% 溢价;把「每周看一次用量」设成习惯,连续吃灰就降级。
重度编码用户(Claude Code 当饭吃):这是最该把上面 6 招抄进工作流的人。先照官方方法把 token 消耗压下来,再决定要不要从 Max 5x 升到 20x——很多人配额不够用,不是用得太多,而是在为重复的上下文反复付费。升级前先用 `/context` 和用量统计看一周真实消耗,再掏钱。
接下来值得盯的三个信号:10 月 IPO 的最终定价和招股书里对订阅业务的表述;Claude 是否推出新档位或调整额度窗口;以及年底各家 AI 的促销动作(IPO 之后冲用户数时,往往是订阅最便宜的时候)。
写在最后
AI 订阅这笔账,和买手机、办健身卡的逻辑已经不一样了:它不是一次性买断一个工具,而是持续购买一种「会越用越贵的产能」。Anthropic 亲自下场教省钱,说明连卖算力的人都明白——让用户看懂账单,生意才能做得久。
对我们来说也一样:看懂规则的人,才能把每一美元花在真正解决问题的 token 上。你现在的 AI 订阅每月花多少?最贵的那个真的在用吗?评论区聊聊。