当前位置:
AIGC文章详情

你的 Claude Code 账单终于有明细了:对着新版成本工具和全网真实账单查了一圈,发现 4 类隐形烧钱点

源自142位全网作者

02:54

这周有几条帖子,戳中了 Claude Code 用户的同一个痛点。微博上有人吐槽,用 Opus「两个小时不到就耗费 20 块」。微博小红书上有用户做网站项目,五个小时烧掉了充值的 60 多块。小红书知乎上一位重度用户则算了笔账:90 天、617 次会话、token 花费约 1400 元,交付了 4 个正式项目、约两万三千行代码。知乎同一款工具,用法不同,成本效率能差出好几倍。

你的 Claude Code 账单终于有明细了:对着新版成本工具和全网真实账单查了一圈,发现 4 类隐形烧钱点

那到底花多少算正常?按今年 4 月社区对 Anthropic 官方文档的整理,企业部署场景下,Claude Code 平均每位开发者每个活跃工作日约 13 美元,每月约 150-250 美元,90% 的用户每天不超过 30 美元。小红书对照前面那位知乎用户「90 天 1400 元」的账单,个人轻度使用其实远低于企业基准——差距不在订阅费,全在使用方式。

你的 Claude Code 账单终于有明细了:对着新版成本工具和全网真实账单查了一圈,发现 4 类隐形烧钱点

而恰好,Claude Code 在 8 月 21 日发布的 v2.1.239 版本,最大的改动就是冲着账单来的。

新版给了三个「成本抓手」

先看这次官方改了什么。三个成本管理入口:

  • `/cost` 命令,会话内随时查花费;

  • 状态栏显示成本,不用敲命令也能看见;

  • `–max-budget-usd`,启动时直接设预算上限,防止爆单。哔哩哔哩

还有两件事值得单独说。

第一,「仅美国推理」数据驻留工作区的 1.1 倍溢价,这次终于被算进显示成本里了。以前这部分溢价在屏幕数字里是缺失的,等于这类工作区的用户一直被低报约 10%。如果你用的是数据驻留工作区,升级后看到的账单可能「变贵」了——别慌,不是涨价,是终于算全了。哔哩哔哩

你的 Claude Code 账单终于有明细了:对着新版成本工具和全网真实账单查了一圈,发现 4 类隐形烧钱点

第二,Bedrock 用户注意:这个版本之前,如果代理把响应的 Content-Type 剥掉,Claude Code 会静默地把每一轮改成非流式重跑一次,等于每次 API 调用都在隐形烧双倍的钱。这个 bug 本版修掉了。如果你走 Bedrock、账单一直高得莫名其妙,可能不是用法问题。小红书

另外还有一个 changelog 里没写的变化:社区通过二进制逆向发现,新版藏了一个 `/low-priority` 低优先级模式——5 小时额度烧完后不再只能干等,可以选择消耗周额度、以低优先级继续跑,目前在灰度 A/B 阶段,仅限 Pro/Max 订阅,不含按量付费。小红书需要说明,这是社区逆向的推断,不是官方文档口径,仅供参考。

钱到底花在哪:4 类有实锤的隐形烧钱点

网上研究「怎么省」的人比想象的多,而且不少是真金白银实测过的。归纳下来是四类。

烧钱点一:上下文塞太满。 知乎那位用户做过对比:同一个重构任务,一次 @ 进 11 个相关文件,和只给 3 个核心文件加一段自己写的架构说明,后者质量明显更好。知乎文件塞得多不是信息全,是注意力稀释,token 还跟着多烧。

长会话同理:他实测单会话超过约 40 轮后,输出质量明显下滑,模型会重新捡起你早就否决过的方案。知乎大任务拆成独立会话,每个会话开头用 30 秒写段任务简报,反而更省。

烧钱点二:缓存失效。 缓存命中率直接决定你为多少重复内容付全价。有小红书用户发现,Claude Code 会周期性往会话里插入 task_reminder,内容多数时候为空,但插入位置一变,会话前缀就变了,缓存随之失效——命中率最低掉到 3% 出头。小红书

他的解法是加一条配置 `CLAUDE_CODE_TODO_REMINDER_MODE: off`,实测命中率稳定在 90% 以上,全天平均能到 98%+。小红书按量计费的用户,这条值得一试。

你的 Claude Code 账单终于有明细了:对着新版成本工具和全网真实账单查了一圈,发现 4 类隐形烧钱点

烧钱点三:多 Agent 重复沟通。 在跑多 Agent 的值得看这项研究:伦敦大学学院团队用 Claude Code 做了 1902 次实验,发现在 8 个 Agent、消息密集的任务里,把「Agent 之间反复同步」换成一份共享文件(比如一份记录目标、分工、进度的 AGENT_STATUS.md),输出 token 能少约 42%。知乎

另一个反直觉发现是:专门设一个「协调 Agent」并没有稳定提高成功率,反而多了一层传话筒知乎不过注意,42% 不是固定折扣——如果只有两个 Agent、只做一次交接,专门建文件反而可能更贵。

你的 Claude Code 账单终于有明细了:对着新版成本工具和全网真实账单查了一圈,发现 4 类隐形烧钱点

烧钱点四:模型档位和返工。 Sonnet 5 目前官方价格是输入 $2/MTok、输出 $10/MTok,原本计划 9 月的涨价也已经取消。写脚手架、修小 bug、补测试这类日常任务,没必要一上来就切最强模型。另一个好消息是:Pro/Max/Team 的新会话现在默认进入 Auto 模式,背后的分类判断不再额外收费。<#&!53#&!>小红书还有一点容易被忽略——返工才是最贵的浪费。前面那位知乎用户的习惯是:超过一个文件的改动,先进 Plan Mode 出方案,一次通过率从六成拉到接近九成。知乎少返工,就是最大的省钱。

其实 Anthropic 官方自己也认过账。按今年 4 月社区对官方文档的整理,官方给出的降本方向是:控制上下文长度、按需选模型、按场景调深度思考(Extended Thinking)参数、在请求发出前加一层预处理钩子过滤低价值输入。小红书和上面社区实测出来的路子,基本是一条心。

三类人的行动清单

订阅用户(Pro/Max):

  1. 开 Auto、日常默认 Sonnet,真卡住了再升级模型;

  2. 设好 spend limit,先定一个能接受的预算线,再按几天真实用量微调;

  3. 会话轮数高了就拆,别在一个会话里混太多目标;

  4. 如果灰度到了 low-priority,额度烧完不用干等,但注意它吃的是周额度。

API / Bedrock 按量用户:

  1. 先升到最新版,确认有没有被 Bedrock 双倍计费坑过;

  2. 核对一下自己的工作区是否带数据驻留溢价;

  3. `/cost` 加 `–max-budget-usd` 组合使用,预算告警当最后一道防线;

  4. 试试上面那条缓存配置,另外用 @ 文件引用代替整段复制代码。

多 Agent 玩家:

  1. 先问一句:这条信息会不会被多个 Agent 反复使用?会,就写进共享文件;不会,点对点交给需要它的 Agent;

  2. 协调 Agent 只负责拆任务、定验收、处理冲突,别让它当传话筒;

  3. 不需要旁听的 Agent,早点退场,别让它全程跟着收进度。

最后,两件值得留意的事

一是 8 月 22 日发布的 v2.1.240,官方 changelog 只有一行:「Bug fixes and reliability improvements」。小红书最近连续小版本,成本相关能力明显在持续补强,值得继续盯。

二是这篇文章里的省钱数字大多来自社区实测,不同版本、不同用法差异不小,建议把它们当方向参考,而不是固定折扣。如果你自己也有实测账单,欢迎在评论区聊聊——账既然有明细了,就该让它花得明白。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章