过去 24 小时,AI 编程圈出了两条和钱包直接相关的新闻。美国时间 9 月 1 日(北京时间 9 月 2 日),Anthropic 发布 Claude 家族最强模型 Fable 5.1,宣传口径是"最高降价 75%";几乎同一时间,月之暗面宣布 Kimi API 原生支持直连 Claude Code 和 Codex。知乎界面新闻一个用降价留人,一个用兼容性开门,方向都是你手里的 AI 编程预算。

但先泼一盆冷水:这个"75%"不是你以为的那个 75%。
一、先把"降价 75%"拆开看
Fable 5.1 的输入和输出价格,和上一代 Fable 5 完全一样:输入 10 美元/百万 token,输出 50 美元/百万 token。知乎真正降价的只有一个条目——缓存读取(cache read),从 1 美元降到 0.25 美元,降幅 75%。36氪也就是说,"最高降价 75%"是一句精确但有误导性的话。它降的是单一计费条目,不是 API 整体。36氪的报道标题总结得挺到位:Anthropic 也开始卷"缓存价格"了。
二、谁真的省到钱了
要理解这次降价利好谁,得先明白缓存读取是什么。用 Claude Code 这类工具写代码时,模型每一轮都在反复读取同一批上下文:你的项目代码、CLAUDE.md、历史对话。这些被重复读取的 token 按缓存读取价计费,在长任务里是成本大头。
Anthropic 用 2026 年 8 月四周的实际数据做了测算,结论分两档。知乎
使用场景 | 整体成本变化 |
|---|---|
Claude Enterprise / Claude Code / API 的典型工作负载 | 约降 25% |
缓存占比高、工具调用密集的重度 Agent 任务 | 最高约降 45% |
注意两个词:“约"和"最高”。这次降价的收益完全取决于你的缓存命中率,有两类人基本吃不到:
轻用户:一问一答、短任务为主,缓存命中率低,输入输出又没降价,账单几乎无感。
大输出任务:批量生成大量代码或文本时,50 美元/百万的输出价仍是成本大头,缓存再便宜也动不了大头。
换句话说,你跑得越重、任务链越长,省得越多。这次降价本质是给长程 Agent 工作负载的定向补贴。

三、Anthropic 为什么敢这么降
因为 Fable 5.1 的能力升级方向,恰好就是"长任务"。官方评测里,Agent 编程基准 Terminal-Bench 4.0 得分 55.8%,超过 Fable 5 的 42.0% 和 Opus 5 的 52.3%。36氪Cursor 场景的 CursorBench 拿到 73.4%,是跑过这个基准的模型里最高分。知乎
早期客户案例更直观:有模型在无人值守情况下连续跑了 38 小时的机器学习任务,回头自查出标签误差,又自己启动了 6 项新实验。36氪对 Claude Code 用户还有一个隐性福利:官方称安全误报减少,平均每个会话遇到的网络安全防护干预比 Fable 5 少约 60%——被"我不能帮你做这个"打断的次数会明显变少。知乎还有一个小提醒:同一个模型 ID(claude-fable-5-1),在 Claude 网页、Claude Code 和 API 里的默认推理强度不同,跑分不能跨产品直接比。想验证自己能不能受益,找一个已经做完、有测试的真实任务当基线跑一遍,再看账单里的缓存命中,比看任何评测都准。

四、同一天的第二条新闻:Kimi 把前门打开了
如果说 Anthropic 是在降价留客,月之暗面就是直接开门迎客。9 月 2 日,Kimi API 宣布同时支持 Anthropic 的 Messages API 格式和 OpenAI 的 Responses API 格式。<#&!53#&!>界面新闻翻译成人话:你在 Claude Code 或 Codex 里,不用转格式、不用搭本地代理,把 model provider 一改就能直连 kimi-k3、kimi-k2.7-code-highspeed、kimi-k2.7-code、kimi-k2.6。知乎

之前社区里已经有人用 Ollama 本地代理"偷梁换柱",把 Kimi K3 塞进 Claude Desktop 里跑。36氪现在官方把这条路直接修成了高速公路。
直连主力 kimi-k3 的价格,按公开价目:输入约 20 元/百万 token,输出约 100 元/百万,缓存命中约 1 元/百万。知乎注意,K3 比上一代贵了 5 倍,不算白菜价;但横向对比 Fable 5.1(输入 10 美元、输出 50 美元,按近期汇率折合人民币约 70 元和 355 元每百万),K3 整体便宜约 3 倍。对拿不到海外支付方式、或者预算就是紧的用户,这是一个第一次不需要折腾代理的正规选项。
五、订阅这条路,也不省心
按量付费有按量的账,包月订阅也有自己的坑。上周社区里吵过一件事:有用户反馈,Claude Code 200 美元 Max 套餐宣传的"20 倍用量",实际指每 5 小时窗口内的用量是 Pro 的 20 倍,而每周总量上限只有约 10 倍。小红书Codex 那边当天就出来回应,强调自家 200 美元会员确实提供 20 倍基础用量。
这事目前是社区实测加厂商口水战,没有官方定论。但它提醒一件很实际的事:订阅套餐别只盯着"20倍"这种倍数看,要同时确认两个数字——5 小时窗口额度,和每周总量上限。营销口径里的倍数,和你实际能用到的量,可能是两回事。
六、给三类人的决策清单
重度 Agent 用户(每天挂在大仓库上跑 Claude Code):这次缓存降价是实打实的利好,值得切到 Fable 5.1。动作上建议先拿一个完成的真实任务做基线,跑完对比账单的缓存命中再下结论,别只看首轮回答。
轻度用户(偶尔写脚本、做小工具):这次降价和你关系不大,不用为它专门迁移。你的成本结构没变,按需继续用现有方案就行。
预算敏感、或没有海外支付渠道:Kimi 原生直连值得试,零代理、零格式转换,消息格式原生兼容。但记住 K3 不是廉价档——简单任务路由到 kimi-k2.7-code 或更小的档位,才符合它的性价比逻辑。

最后给一个持续观察的信号:账单里的缓存读取命中率,是判断你有没有吃到这次降价红利的唯一标准。接下来一两周,留意自己切换模型后的实际账单,比任何宣传口径都可靠。
这轮 24 小时内的动作,方向其实很清楚:AI 编程的成本竞争,正在从卷单价,变成卷缓存、卷生态兼容。Fable 5.1 用缓存降价绑住重度用户,Kimi 用协议兼容撬动预算敏感用户。对你来说,决策反而变简单了——看自己的负载,看自己的预算,对号入座。