Opus 5.5和GPT-6降价潮杀到,国产按兵不动:别信单价,我把"1/6价差"换算回了你的真实账单

源自251位全网作者

19:39

9月22日到23日这不到48小时里,Anthropic和OpenAI前后脚把新模型和降价通知一起拍了出来:北京时间9月23日凌晨,Claude Opus 5.5、GPT-6 Sol/Luna相继发布,官方口径里任务成本直接砍掉四成到一半。 微博上"#OpenAI和Anthropic降价推新模型#"的话题挂了两天,速报视频一天一更,不少一直拿GLM当主力码模的人都开始犯嘀咕:海外都降到这个份上了,国产那点价差还值不值得我继续守着?东方财富网哔哩哔哩

先说结论:这轮降价潮里,"1/6价差"这个说法已经过时了——但它不是被降价打没的,是被算法算没的。把两边官网价目表拉到同一张桌子上,你会发现真正值得盯的根本不是单价那一行。

Opus 5.5和GPT-6降价潮杀到,国产按兵不动:别信单价,我把

一、先摊开这张新价目表(截至9月25日,单位:每百万Token)

海外阵营:

模型

输入

输出

备注

Claude Opus 5.5

$4

$20

较Opus 5降20%,缓存读取$0.20、降60%;AA智能指数58,当前第一

GPT-6 Sol

$2

$10

官方称较GPT-5.6促销价再降50%;AA分47,与上代旗舰5.6 Sol(48)基本持平

GPT-6 Luna

$0.1

$0.5

入门档,第三方测试任务成本降约六成,分数持平

GPT-6 Astra

$10

$50

真旗舰,是5.6 Sol现价的2.5倍,分数只高6分

Grok 4.7

—

—

单价没动,但平均输出token超上代两倍

国产阵营(人民币口径):

模型

输入

输出

备注

GLM-5.3(智谱)

¥8

¥28

缓存命中¥2;8月发布时原价没动,此前智谱2026年内三连涨价

GLM-5.3-Flash(智谱)

¥0.8(命中¥0.23)

¥2.8

AA指数57;有限时5折(命中¥0.115/未命中¥0.4/输出¥1.4)、Coding Plan夜间免费等窗口

MiMo V2.6 Pro(小米)

¥3

¥6

AA指数46,国产+开源双第一,四个月没动价

DeepSeek V4

高峰/闲时双轨

闲时约半价

闲时未命中¥1.5/输出¥4.5的档位仍在

二、"降价"两个字里藏着三道算法小字

第一道:半价是跟谁比的半价。 GPT-6 Sol号称降50%,但这个"半价"的参照系是它自家上一代的促销价,而且它坐的是中档的位置。 想用最强档就得看Astra:每百万token要$10/$50,反而是旧旗舰5.6 Sol现价的2.5倍。 降价潮没把旗舰拉下神坛,只是把入门档打穿了地板。微博微博

第二道:单价没涨不等于账单没涨。 Grok 4.7是最好的例子:挂牌单价一分没动,但平均输出token是上代的两倍——你为同样的活付的钱实际翻倍。 反过来,Anthropic宣传Opus 5.5速度提高30%以上、典型任务运行成本反而降低大约40%——那是效率口径,不是$20这个数字变小了。 数码社区8月底就为GLM-5.3-Flash和DeepSeek晒过一次真实账单,结论放到今天依然成立:决定账单的不是模型,是命中率和时段。微博微博知乎

第三道:最狠的降价在缓存那一行。 Opus 5.5缓存读取$0.20,直接砍六成,比它$4的基础输入价便宜了20倍。 智谱GLM-5.3的缓存命中价¥2是输入价的1/4,DeepSeek闲时命中价只有未命中价的1/30,国产厂商在这行小字上其实埋伏已久。 OpenAI这次甚至把整套计费规则全部公开:缓存输入按普通输入的10%收、Batch和Flex再打5折,但单次请求输入一旦超过27.2万Token,整个请求改按长上下文价收费——输入和缓存翻倍、输出提高50%。 百万上下文是真的,0.1美元也是真的,但两个数字不能直接乘起来。做长会话Agent的人,账单大头本来就在重复上下文上——这行小字才是给你们的,不是给偶尔查个问题的人的。微博知乎钛媒体

Opus 5.5和GPT-6降价潮杀到,国产按兵不动:别信单价,我把

三、把价差换算回"你的账单",而不是口号

拿汇率7.1粗算,先把"1/6价差"这个旧口号放一边——这条"国产模型价格基本是海外的1/6甚至更低"的说法这两天还在被反复转发,它的参照系是上代Opus 4.7。 那笔旧账是GLM-5.1输出$4.4对Opus 4.7的$25,约5.7倍;这轮之后Opus 5.5输出$20≈¥142,对GLM-5.3输出¥28仍是5倍——而智谱8月发布GLM-5.3时原价一动没动。 价差几乎没被降价打掉,只从5.7倍收敛到5倍。 至于智谱官方那句"GLM-5.3-Flash完成同一任务综合成本只有Opus 4.8的约1/40",作者自己都提醒了:这是任务成本口径,不是单价除以40,别拿它直接比单价或写进采购PPT。微博知乎知乎

真正能把人绕晕的是"单价"和"账单"的差距。OpenAI把Sol的缓存输入标到0.2美元、Luna的缓存读取标到0.01美元,和Opus 5.5的缓存价站在同一档。 套一个中等强度coding用户的月度模型(示例假设:输入2亿token、缓存命中80%、输出2千万):钛媒体

  • Opus 5.5:命中价$0.20只有基础输入价的1/20,2亿输入打完折≈$192,加输出≈$400,月账单约$590量级。

  • GPT-6 Sol:单看$2/$10像是Opus的一半,但80%命中率下两家有效输入成本都是$192,一分钱差都没有,账单差距全部来自输出价($400对$200)。单价减半≠账单减半,这就是"看单价会选错、看有效成本才对"。

  • GLM-5.3 API:命中¥2对基础¥8,同口径月支出约¥1200,约为Opus 5.5账单的三成。

  • GLM-5.3-Flash(限时5折):同口径约¥60量级;GPT-6 Luna同口径约$30——这两个数字才说明"白菜价"说的是入门档,不是旗舰。

数字别较真,较真的是结论:价差依然以倍数计,降价潮改变的只是"便宜档有多便宜",没改变"值不值得为海外旗舰多掏几倍钱"的答案。 而如果你已经买了包月Coding Plan,这波海外降价跟你几乎无关,唯一相关的是夜间免费和新模型什么时候进套餐。

Opus 5.5和GPT-6降价潮杀到,国产按兵不动:别信单价,我把

四、不同类型的人,这周各自该干什么

  • 套餐用户:按兵不动。降价潮打不到包月,但智谱2026年内有过三连涨的历史(2月Coding Plan起、3月5-Turbo、4月5.1),续费前看一眼条款有没有变相缩水,比看海外新闻有用。

  • 轻量API用户:这轮真正的受益档是GPT-6 Luna($0.1/$0.5)。摘要、改写、分类这类轻任务可以拿它当新默认,重活继续留在GLM-5.3/Flash上,账单会立刻变薄。

  • 长上下文Agent用户:值得去实测一次Opus 5.5的缓存价,重点测你自己的命中率——按你真实的重复上下文占比算月账单,再决定动不动。只跑Demo就喊"海外白菜价"的,都是在替厂商算账。

  • 观望换台的:先别换。Terminal-Bench 4.0一个榜两种结果(Anthropic自测66.4%对57.9%,Artificial Analysis自测两者打平59.6%),旗舰口碑目前只有一份"X上310条使用自述"级别的小样本——过半偏Opus、不到两成偏Astra,样本太小,等两周再看。

Opus 5.5和GPT-6降价潮杀到,国产按兵不动:别信单价,我把

接下来盯三个信号:第一,小米和DeepSeek会不会跟进缓存降价——MiMo V2.6 Pro的价还是四个月前那套:每百万token输入3元、输出6元。 第二,Qwen 4、Kimi K3.1、MiniMax M3.1这些新版本的发布前瞻社区已经传开了,国内下一轮报价单月底见分晓。 以及最重要的一条——你上个月的账单里,命中价和输出价各占多少。 把这两行数字看清楚的人,永远不会被"降价50%"三个字带节奏。微博哔哩哔哩

内容由AI生成

精选参考来源

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章