Haiku 5.5降价90%、200美元订阅再返200美元:Anthropic上市前夜的「亏本大甩卖」——续费、换队还是薅羊毛前,先把单价账、能力账、额度账、风向账分开算

源自131位全网作者

08:04

10月8日一早,很多Claude用户还没反应过来,Anthropic已经把小模型Haiku 5.5的输入价格从每百万token 1美元砍到了0.1美元——整整一折。紧接着第二天,Max订阅用户的群里又炸了一遍:这个月开始,每月白送一笔API额度,200美元档直接返200美元。微博

把这周发生的三件事放在一起看,才发现是一件事:

  • 10月7日(美国时间):Haiku 5.5发布,短上下文输入0.1美元/百万token、输出0.5美元、缓存读取0.01美元,官方称典型工作负载平均成本降约75%;

  • 同时:Sonnet 5.5缓存读取价腰斩,0.2美元降到0.1美元,官方估算Agent任务总成本还能再降约20%;

  • 本周起:Max 5x每月送100美元API额度,Max 20x送200美元,Team按席位汇总每月最多500美元。

对掏钱买AI的人来说,这是近两年最直白的一波"好价"。但先别急着续费换队——这钱是有来处的,而且来处写得明明白白:Anthropic的招股书已经递了,11月就要上市。这是IPO前的获客大促,而大促的另一面,是"能持续多久"没人敢打包票。

下面把四笔账分开算,算完你再决定薅不薅。

第一笔:单价账——打了一折,但"一折"是有门槛的

先看价目表(均为每百万token、美元):

模型

输入

输出

缓存读取

备注

Haiku 4.5(上代)

$1

$5

$0.1

上下文20万

Haiku 5.5(≤10万token)

$0.1

$0.5

$0.01

上下文100万

Haiku 5.5(>10万token)

$0.5

$2.5

$0.05

整档跳到短上下文的5倍

GPT-6 Luna

$0.1

$0.5

$0.01

超27.2万token后输入、缓存翻倍

三个细节别漏:

其一,一折只覆盖10万token以内。 超过10万,整档价格直接跳5倍。Anthropic自己给的数据是:Haiku 4.5时代约90%的请求都在10万token以内——所以大多数人确实吃到了折扣,但如果你是拿它读整个代码库、塞长文档的场景,请先按5倍档算账再欢呼。知乎

其二,分词器换了。 官方明确提示:同样的输入文本,Haiku 5.5计费对应的token数可能和上代不一样。跑生产环境的,升级后务必重新实测账单,别拿旧token数直接乘新单价。

其三,这价格已经低到什么程度? 有AI日报对比过:Haiku 5.5的输入输出价格,已经低于DeepSeek Flash的非高峰期定价。当全球最贵闭源模型公司的小模型,比国产模型的优惠价还便宜时,API调用方是这波最实在的受益者。微博

顺带说Sonnet 5.5那个缓存读取腰斩,很容易被误读。知乎上有人算账说得很到位:缓存读取降50%,不等于总账单降50%。你能省多少,取决于任务里缓存读取占多大比例——长时间运行、反复读取系统提示词和工具定义的Agent,省的是真金白银(官方估算再降约20%);以单次问答为主的轻量用户,几乎无感。知乎

Haiku 5.5降价90%、200美元订阅再返200美元:Anthropic上市前夜的「亏本大甩卖」——续费、换队还是薅羊毛前,先把单价账、能力账、额度账、风向账分开算

第二笔:能力账——跑分哪里碾压、哪里被打回

便宜了,货好不好用?把跑分摆开看,这模型的"偏科"非常明显。

碾压的地方(对比同价位的GPT-6 Luna):

测试

Haiku 5.5

GPT-6 Luna

OSWorld 2.1(计算机操作)

72.4%

48.9%

Terminal-Bench 4.0(Agent编码)

39.2%

16.4%

GDPval-AA v2.1(知识工作)

1620分

1437分

AA智能指数(最高档)

43

38

跟自己比更夸张:OSWorld 2.1上代Haiku 4.5只有15.7%,这次直接跳到72.4%;知识工作GDPval-AA从735分翻到1620分。企业侧早期测试也在佐证——Asana报告任务完成延迟降超30%,AlphaSense的400次文档问答得分从0.76提到0.84。知乎

被打回的地方:Artificial Analysis的浏览器/网页自动化评测Automation Bench-AA上,Luna拿53.2%,Haiku 5.5只有35.4%。同价位不是全面胜利,别指望一个便宜模型包打天下。36氪

Haiku 5.5降价90%、200美元订阅再返200美元:Anthropic上市前夜的「亏本大甩卖」——续费、换队还是薅羊毛前,先把单价账、能力账、额度账、风向账分开算

还有两盆冷水,一盆来自官方,一盆来自社区:

  • Anthropic自己承认:复杂Agent编程任务仍然更适合Sonnet 5.5和Opus 5.5,Haiku 5.5的定位是"范围明确的子任务、摘要、上下文压缩"——说白了是跑腿的,不是主脑。数据也支持:Terminal-Bench 4.0上Sonnet 5.5拿70.6%,Haiku 5.5只有39.2%,差了近一倍。知乎

  • B站一条4.7万播放的高热视频,标题就是《又是雷霆大思考,避雷Claude Haiku 5.5》。"思考"这事这代确实变了:Haiku 5.5首次引入Adaptive Thinking,模型自己决定想多少,开发者只能调个大概档位。这机制有个隐性代价——内部推理会占用输出token预算。如果你的程序只按最终答案长度设输出上限,升级后可能出现推理吃掉空间、正文生成不完整的情况。老用户迁移还得检查思考块的解析逻辑和部分采样参数的兼容性。哔哩哔哩

所以能力账的正确答案是:高频跑腿、子Agent、摘要抽取,放心用Haiku 5.5,又便宜又强;浏览器自动化,Luna目前更稳;正经写代码,该上Sonnet还得上Sonnet,省钱省不到这一步。

第三笔:额度账——返的200美元,有五道门槛

这轮最出圈的是订阅送API额度:Max 5x每月送100美元,Max 20x每月送200美元,Team按席位汇总每月最多500美元。200美元/月的Max 20x,相当于Anthropic把你交的订阅费按API面值原样返了一份,而且这笔额度和Claude、Claude Code、Cowork里的原有订阅用量是分开的,互不占用,每个计费周期重新发。36氪

想薅的人,先看清五道门槛:

  1. 不能抵Claude Code里的交互式使用,也不能抵订阅超额后的Extra Usage;

  2. 走Bedrock、Google Cloud Vertex AI、Microsoft Foundry的Claude调用不算;

  3. 没用完会过期,不累积到下月;

  4. 新订阅的Max/Team用户要满7天才能领;

  5. 能花的范围是Claude Platform侧:API、Batch API、Console Playground、Managed Agents、Agent SDK——好消息是任何当前可用的Claude模型都能消耗,第三方工具只要最终调的是你Console组织下的API Key,同样能吃这笔余额。

Haiku 5.5降价90%、200美元订阅再返200美元:Anthropic上市前夜的「亏本大甩卖」——续费、换队还是薅羊毛前,先把单价账、能力账、额度账、风向账分开算

这笔钱适合谁?自己写Agent、跑第三方Harness的个人开发者和一人公司——相当于Anthropic替你的副业实验先垫一部分算力钱。纯聊天用户基本用不上,别为了返额头上高档位。

补贴力度有多夸张?SemiAnalysis做过一个换算:把订阅额度按API标价折算,200美元/月的Claude订阅在中等负载下提供的API等价价值,约为OpenAI同价位订阅的5倍。这不是Anthropic突然大方,而是两家反向操作的结果:OpenAI先把200美元档实际价值腰斩、新增500美元档;Anthropic则在Opus 5.5降价后把Max档额度提了约20%、Pro档提了约50%。微博

同一份报告里还有两个更刺眼的数字:按满负荷使用,200美元档Opus 5.5的毛利率是-369%;订阅业务约占Anthropic一成收入,却吃掉四成以上的推理算力。翻译一下:你现在薅到的不是折扣,是Anthropic真金白银烧出来的增长数字。微博

第四笔:风向账——为什么突然大方,以及大方还能持续多久

撒钱的时间点,把动机全说清了。

据路透社等多家媒体,Anthropic已秘密向SEC递交S-1招股书,计划11月美国中期选举后登陆纳斯达克,目标估值超2万亿美元、最高募资1000亿美元。招股书里那些亏损账、算力合同账,前几天已经专门拆过,这里只提一个数:它的年化收入从2025年底约90亿美元,冲到今年7月底超过650亿。这条曲线要在IPO定价前保持住,最好看的故事就是"用户还在猛增"。钛媒体36氪

偏偏OpenAI还在施压:GPT-6 Luna把小模型价格打到0.1/0.5美元;Ramp数据显示GPT-6 Astra已拿下其追踪企业AI支出的约13%,Claude Fable约8%;OpenRouter上OpenAI模型的用户支出一度反超Anthropic——两年半来第一次。路透社直接点明,这让一些潜在IPO投资者开始重新评估Anthropic的领先位置。36氪

Haiku 5.5降价90%、200美元订阅再返200美元:Anthropic上市前夜的「亏本大甩卖」——续费、换队还是薅羊毛前,先把单价账、能力账、额度账、风向账分开算

于是你看到:Haiku 5.5把价格精确对齐Luna,Sonnet 5.5缓存价精确追平GPT-6.1 Sol——OpenAI打到哪,Anthropic跟到哪,撒出去的钱先记在获客成本里,只要上市前把用户、收入和调用量冲上去,这笔账就不难解释。

但反证也必须看。大客户那边正在吹反向的风:The Information报道,微软内部Claude年支出原计划至少10亿美元,如今预算砍掉三分之一还多,员工被要求少用Claude、多用自家Copilot和OpenAI系工具;Meta内部用Claude Code的员工从年初6万降到3万,直接腰斩(尽管28天仍付了1.05亿美元)。而微软加Meta两家,合计约占Anthropic收入的25%。知乎

一边是个人用户薅到补贴欢呼,一边是大客户出于站队考虑用脚投票。这波撒钱换来的收入成色,恰恰是招股书里最经不起细看的部分。

所以,不同人该怎么办

已在订Claude Max/Team的:不用犹豫,额度先领着(记住满7天规则)。没有自己的Agent项目,也可以拿Batch API跑离线任务慢慢消耗。但别单纯为返额度升档——没用完会过期,升档差价不一定赚得回来。

在Luna和Haiku之间摇摆的开发者:按场景拆开,别站队。高频子任务、摘要抽取、上下文压缩给Haiku 5.5(同价、跑分更高);浏览器和网页自动化给Luna(53.2%对35.4%,差距是实打实的);主Agent的复杂编程留给Sonnet,这波缓存降价对长任务是真实惠。

还在用Haiku 4.5的:迁移前做三件事——重测token数(分词器变了)、重设输出预算(推理会占额度)、检查采样参数和响应解析。别只改个模型名就上线。知乎

Haiku 5.5降价90%、200美元订阅再返200美元:Anthropic上市前夜的「亏本大甩卖」——续费、换队还是薅羊毛前,先把单价账、能力账、额度账、风向账分开算

国内用户:Claude网页端这个月刚悄悄上线简体中文界面,但Anthropic在内地没有官方销售渠道,订阅的支付和账号门槛都真实存在;其透明度报告显示2026年上半年封禁1140万个账号、申诉翻案仅4.2万起,账号风险对国内用户是要计入的成本。而Haiku 5.5的价格已经压到DeepSeek Flash非高峰期之下——纯成本敏感的场景,国产方案现在真不落下风。36氪

围观AI泡沫的:这波撒钱本身就是一个绝佳观察样本。盯三件事:①11月上市后第一份季报,年化收入还保不保得住650亿冲1000亿的斜率;②Max送API额度是长期权益还是IPO限时活动——目前官方口径只有"本周起",没说截止;③OpenAI会不会跟进砍价。跟进,补贴战继续;不跟,Anthropic上市后可能第一个收手。

最后说两句

站在纯用户视角,这次Anthropic是真给了好价:一折、缓存腰斩、订阅费原样返——连SemiAnalysis算出的-369%毛利率,在你这边都是白薅。

但要记得这份大方的来处:不是成本降到了这个地步,是2万亿美元的IPO需要你的调用量和订阅数。用户的好价和公司增长故事指向同一个方向时,尽管薅;等故事讲完——上市落定、或者增长撑不住——优惠券随时可能收走。

所以答案是:薅,但按窗口期薅,别按常态薅。续费决策回到自己的真实用量上,别把长期预算押在别人的上市前夜。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章