这周的 AI 圈,又热闹起来了。据消息人士爆料,Anthropic 可能在本周突袭发布 Opus 5.1。知乎这次升级的重点不是堆参数,而是「单 Token 的智能水平」——更强的编程能力、更稳的多步推理,还有长时间运行的 AI Agent 能力。预测网站 Polymarket 上,Anthropic 两周内发布下一代旗舰模型的概率已经冲到 74%。36氪

而下一代旗舰 Fable 5.1 据说已在暗中灰度测试了两周,部分 Claude Web 和 Claude Code 用户已被静默切换、免费用上。知乎OpenAI 那边也没闲着:代号「Bel」的十万亿参数模型,据传已在 OpenAI 的实验室里完成了预训练。36氪GPT Astra 正在路上,xAI 的 Grok 4.7 也排进了名单。下半年最密集的发布潮,眼看就要来了。
不过,先别急着激动,还有一条消息值得冷静一下。
最强模型,不一定是钱包的首选
据《金融时报》拿到的支付平台 Ramp 数据:Anthropic 最贵、最前沿的旗舰模型 Fable 5,发布两个多月后,在企业客户的 AI 工具总支出中只占约 11%。知乎而更便宜的 Opus 5,企业支出已经反超 Fable 5。36氪

为什么最强反而卖不动?原因不复杂,就四个字:够用就好。一年多的狂热之后,企业客户冷静了:与其为最后 5% 的极限性能付顶格价,不如选「95% 能力、一半价格」的模型。OpenAI 就是现成的例子——GPT-5.6 定价远低于 Fable 5,业务反而强势反弹,最新季度年化收入突破 400 亿美元。知乎这和我们买数码产品是一个道理:参数表是参数表,真正掏钱买的是「够不够我用」。
个人用户,早就开始算小账了
翻翻社区,讨论更现实。小红书上「AI 月供」的帖子下面,有人认真晒出每月给 AI 上的贡:Codex Pro 100 美元、Claude Max 200 美元,再加网络环境,差不多 3000 元,发帖人感叹快赶上小县城的房贷了。小红书数据面也在降温:追踪平台 TickerTrends 的数据显示,截至 8 月 10 日,Claude Code 过去四周的增长率已降至 5.2%,而 OpenAI Codex 同期增长 20.8%,接近前者的 4 倍。钛媒体

订阅的情绪也在变化。有人月初刚续完费就看到涨价通知,直接吐槽「这是什么新型背刺,专挑刚续费的杀」。小红书在 X 平台上,更有大量开发者表示,因为水印和额度限制,自己已经取消 Claude 订阅,全面转向 Codex。网易省钱的野生策略也跟着冒出来了:复杂用官方旗舰,简单用便宜的——关键任务交给旗舰模型,日常杂活用低价模型顶。这就是个人版的「够用就好」。
续费之前,先算这三笔账
结合这波发布潮的时间点,给 Claude 付费用户三笔值得算的账:
第一笔:你到底需要哪个档。目前在售的档位里,Pro 每月 20 美元,适合偶尔问问题、写文档、轻度写代码的用户;Max 5x 每月 100 美元,适合每天把 Claude Code 当主力生产工具的人;Max 20x 每月 200 美元,只适合全天跑 Agent 任务的重度用户。多数人的真实使用强度,其实落在前两档之间。那位吐槽涨价的发帖人就是典型:忙的时候天天顶着限额用,闲下来一周都不碰一次,最后成了「为峰值付费,为闲置买单」。小红书

第二笔:什么时候付更值。可以确定的是,新发布潮就在眼前,而「加量不加价」已经是新模型的惯用打法——Fable 5.1 据传就是如此。知乎新模型落地后,老档位的性价比会被重排,部分用户还可能被免费切换。所以:准备续费的,按周期正常续问题不大;但想升档、想一次买长周期的,建议等 Opus 5.1 和 Fable 5.1 正式落地,看清真实额度和定价再动,晚几天往往更值。
第三笔:你付的钱,真的用足了吗。有个很多人不知道的坑:Claude Code 接第三方模型时,如果模型名不被识别,会被静默按 200K 上下文管理——买的 1M 窗口,超过八成从来没参与过工作,而且不报错,只会让人觉得「这模型记性差」。知乎自查方法很简单:在终端输入 /context 看分母,如果是 200k,把模型名后面加个 [1m] 就行。订阅也一样,在喊「不够用」之前,先确认自己没被静默降级。
接下来,这几个信号值得盯
1)Opus 5.1 本周是否官宣,定价和额度怎么变。
2)Fable 5.1 灰度会不会扩大,普通付费用户能不能切到。
3)「够用就好」会不会成为长期趋势——企业支出占比的变化,是最真实的风向标。
4)降本的另一种路子:把 GLM-5.3、Kimi K3、DeepSeek V4-Pro 这类国产模型接进 Claude Code 替代高价订阅,但别忘了按第三笔账先查 /context 分母。知乎
模型军备竞赛是厂商的事,订阅预算是自己的事。最强模型只占企业支出 11% 这件事,其实是替所有付费用户提了个醒:档位按用量选,钱等新模型落地再决定加不加。