上一篇说"中秋到国庆这13天,六家模型集体憋大招,先别急着付钱"。大招确实放了:北京时间9月23日凌晨,Anthropic先发布Claude Opus 5.5,一个多小时后,OpenAI把GPT-6 Sol和GPT-6 Luna挂上API,两家公司同日宣布降价,热搜词条从"性能"变成了"腰斩"和"降40%"。知乎
但如果你每个月在给ChatGPT Plus、Claude Pro、Kimi或者豆包交钱,这一轮热闹大概率给你一种"跟我无关"的错觉——小红书上有人翻账单:“AI会员偷偷扣了我半年”;微博上晒成本的帖子更狠:三个ChatGPT账号一个月500美金,两个Kimi Max加起来1400人民币/月,“昨天凌晨远程看任务,没额度了,又买了一个包”。微博
所以这篇不恭喜"AI又便宜了",而是把三笔账算清:这轮降价到底降了什么、为什么还没传到你的会员合同、以及你的账单上真正归你管的开关在哪。算完你只需要回答一个问题:这个月续费,动手还是再等。
第一笔账:两家的"降价",降的不是同一个东西
先把价目表摆平(美元/百万Token,格式:输入/缓存读/输出)。
OpenAI这边:Sol和Luna的标价对GPT-5.6的促销价直接对半砍。Luna压到0.10/0.01/0.50,折合人民币约0.7元和3.5元,已经比DeepSeek V4.1 Flash闲时、缓存未命中的输入价还低。 Sol站在1美元档,属于"均衡型选手"。顺带一提,GPT-5.6本来排着11月涨25%的计划,这次直接掀了。 上一代中端Terra则从产品线里消失了,等于告诉你:别回头买旧货。微博知乎微博
Anthropic这边:Opus 5.5的Token单价只降了20%(输入5→4、输出25→20),真正动刀的是缓存读取——从0.50降到0.20,砍了60%。 官方说的"典型负载比Opus 5便宜40%",是按每个任务算的,不是按每百万Token算的。要知道Opus从4.5到5连着五代都稳在5/25,这是第一次动价。知乎知乎

还有个几乎所有二手报道都没强调的细节:最上面那档一分没降。GPT-6 Astra和Claude Fable 5.1还是10/50。这轮价格战打的是中间层互砍,天花板根本没碰。知乎
于是"降50%"和"降40%"被并排放进标题,制造了一个典型的误读:50%是每Token标价对半,40%是每任务成本,里面已经把"少用Token、多吃缓存"的收益算进去了。真要横比,得看同一把尺子——比如Zapier的AutomationBench:OpenAI给GPT-6 Sol xhigh档的数字是每任务0.27美元、得分33.2%,并强调这比Opus 5的max档便宜11倍;Anthropic官方表里Opus 5.5是40.0%,但脚注承认这组是无fallback跑的、安全机制一介入就算失败,分数被压了。 两张表都没造假,差别全在测试条件。ArtificialAnalysis这周干脆换了口径:把"智能指数×每任务成本"做成Pareto前沿,本周四大新模型一口气新增11个点位,Luna一家贡献5个。知乎知乎
给普通用户的直接结论:从今天起改个习惯——别再看单价,看你这类任务每跑一次多少钱。
第二笔账:价格战还没打到你的会员合同上,但有一周的倒计时
API腰斩,不等于你下个月少交钱。会员定价是"容量+便利"的价格,跟Token标价解耦,所以这轮降价的第一条传导链是开发者和API用户,订阅用户至少慢一拍。社区里的吐槽很直白:ChatGPT涨价了好几个月,下个月续费依然499;Claude刚涨价而已,续费就变成了999。 OpenAI那边,Sol、Luna目前是在ChatGPT Work和Codex里对Plus及以上开放,Free和Go用户桌面端能直接摸到的只有Luna——这倒反而是免费用户最先"吃到"的半价。 国内参照系也一样分叉:豆包6月下旬正式上线付费,标准版68元/月、加强版200元/月、专业版500元/月,聊天、写文案、基础绘画依旧免费。 会员权益跟"模型变便宜"没有直接绑定。小红书知乎微博

不过慢一拍不代表要乱动作,因为牌已经明牌了。Anthropic这边,官方口径里Sonnet 5.5、Haiku 5.5"几周内就到"。 OpenAI那边,路透消息称几天内就要预览专注网络安全的GPT-6 Cyber,同时公布十多款新产品的计划。 国产阵营,DeepSeek刚完成70亿美金B轮、估值750亿美金,弹药最足。 小米MiMo 2.6上周刚喊出"新的斩杀线",号称价格比DeepSeek V4.1 Flash还低。知乎知乎微博
有个细节能佐证传导确实开始了:这两周Codex社区里喊"额度重置"的声音明显变少——不是没人抱怨了,而是模型便宜到同样的额度能跑更多次。知乎
所以"再等"只对一个人群成立:正打算批量采购便宜档调用的人,可以再等两周看Sonnet 5.5和国产跟进价。你的工作不能停,就不值得为赌这一口气把主力模型换在发布当口。
第三笔账:真正决定你账单的开关,在你手里,不在价目表上
这轮降价最容易被忽略的一点:单价降了,总账单反而可能变贵的坑也变多了。三个隐藏开关:
思考档位。Simon Willison那个经典"鹈鹕骑自行车SVG"测试,Opus 5.5开到max档,两次都没画出来——它先判断"这是个经典测试请求",然后认真规划喙、链条齿数和图层顺序,想着想着撞上12.8万Token的输出上限,每次2.56美元、近20分钟。 企业侧的反馈是另一个画风:Factory把它设成medium档默认模型,Box说它用的Token只有Opus 5的三分之一。而且Opus 5.5的API端没有关闭思考模式的选项——需要秒回的场景,要提前切便宜档。知乎
缓存命中率。跑两小时以上的长任务,看账单里的缓存命中,它比单价对总成本的影响大得多。中途别改系统提示词,一改,缓存前缀全废。Anthropic这次动价的结构本身就说明了问题——新价目表里降幅最大的那一行,恰恰是缓存读取。知乎

饭量。有实测统计同一任务Opus的Token消耗约为Sol的3倍——单价差乘以饭量差,真实成本差距会滚得比价目表大。 最便宜的Luna在DeepSWE上66.6%的成绩还是拿max档换的,省下的钱会在等待时间里还回去。知乎知乎
还有一个必须写进来的反面案例:某大厂工程师测多Agent协作忘了设熔断,几十个Agent循环调用,13小时账单200万人民币。 单价普降之后,这种失控的痛感会变得更迟钝——熔断和预算上限,该设还是要设。微博
这个月怎么动:按人群给四张动作卡
重度个人开发者(天天挂Codex/opencode):拆两个槽——主力槽跑长任务、复杂重构、无人值守,Opus 5.5锁medium档,习惯OpenAI工具链就挂Sol,能力差距已经不足以当理由。 廉价槽挂Luna,跑批量改写、格式转换、允许失败的活。预算口径从"每百万Token"换成"每任务"。知乎
轻度对话用户:会员该续续,不用为了降价去折腾API;Free用户把Luna当默认桌面助手,是这轮最直接的免费红利。
小团队:主力档统一,别让每个人自己选;上Agent之前先把熔断和每任务成本入预算——单位便宜了,超预算反而更容易。
做产品的:默认Luna,关键路径升级Sol。Astra和Fable 5.1当手术刀,别当日常工具——除非你的任务真的扛不住中间层,否则别把最贵那档设成默认。
至于"要不要等国产跟进":Luna把0.1美元钉在桌面上之后,“DeepSeek斩杀线"这个说法第一次被海外厂商反向用在了自己身上,两家跟进的API调价随时可能落地。 但也别默认"价格战=只有降”——DeepSeek在8月17日刚完成一轮涨价、切换到峰谷定价模式,MiMo 2.6这类新玩家则在拿低价抢榜。 值得盯的信号就四个:Sonnet 5.5/Haiku 5.5上架、DeepSeek/小米/MiMo系的价格回应、GPT-6 Cyber与那"十多款产品"、以及各家订阅档权益会不会松动。微博知乎
一句话收尾,也是这轮价格战真正值钱的地方:别问谁最强,问谁在你的任务上每任务最便宜。你现在默认挂的是哪个模型,这次换了吗?