Haiku 5.5降价砸到GLM-5.3-Flash的饭碗线上:$0.10的输入价里藏着10万token的5倍跳价,先别急着搬家

源自92位全网作者

12:28

今天是10月8日。对智谱GLM的用户来说,这是个微妙的日子:昨天(10月7日)是智谱每天领100M tokens的赛博鸡蛋最后一天,薅完的人今天开始就要自己掏钱了。 结果就在今天上午,Anthropic发布了Claude Haiku 5.5,小模型时隔近一年首次大更新,均价比前代降约75%。 微博上粉丝30.9万的歸藏第一时间把价目表甩出来,配了一句很冲的话:这个Haiku 5.5真是盯着中国的这几个甜点级模型打,太恶心了。小红书微博·AI科技早报微博·歸藏的AI工具箱

我花一上午把他和另外几个AI博主、早报账号的原文对了一遍,又把GLM-5.3-Flash发布时的官方口径翻出来重新核。结论先放这儿:Haiku 5.5确实砸到了GLM-5.3-Flash的饭碗线上,但它没有很多人转发时说得那么凶,而且它有一行小字,恰好砸在GLM最舒服的地方。

先盘事实:这轮发布真正能确认的是三个数

第一个数:价格。 10万token以内的请求,输入每百万token 0.1美元、输出0.5美元,跟GPT-6 Luna持平。 超过10万token,两项都跳到5倍——Claude Code v2.1.293的更新口径也确认了这一点:每百万token $0.10/$0.50,超过100K提示为$0.50/$2.50。 缓存读取$0.01/百万token、缓存写入$0.125,这条后面算账会用到。微博·欧巴聊AI微博·AI反应洞穴

第二个数:分数。 ArtificialAnalysis当日同批的智能指数里,Haiku 5.5击败GLM-5.3-Flash和DeepSeek-V4.1-Flash,只比Kimi K3低1分。 另外有10月8日早报专门列了OSWorld离线子集72.4%——注意"离线子集"这个口径,是厂商自己挑的评测集,别直接当全量成绩单用。微博·子夜梦廊微博·AI科技早报

第三个数:定位。 官方把它定为迄今最便宜、最快的小模型,主打摘要、压缩、分类、数据库查询这类高吞吐任务,并可搭配Opus 5.5和Sonnet 5.5担任编码子智能体。 也就是说Anthropic没打算让它单挑旗舰,是拿它来把自家agent流水线的"工位成本"打下来。微博·AI反应洞穴

还有个背景容易被忽略:OpenAI今天同步向ChatGPT推送GPT-6,免费档10月8日起开。 甜点级这个价位带,是被两家欧美大厂互殴的炮火覆盖到的,不是专门瞄准国产模型的——但炮火落在哪、谁家要重新算账,这个才是跟你的钱包有关的部分。歸藏那句"盯着中国打",是立场不是事实,转发前建议分清。微博·AI科技早报

把三家的账摆在一起:便宜在哪,坑在哪

口径

输入($/百万tok)

输出($/百万tok)

长上下文

其他关键项

Haiku 5.5 官方

0.10(≤10万tok)

0.50(≤10万tok)

超10万tok整体×5

缓存读0.01/写0.125;闭源API

GLM-5.3-Flash 国际站

0.15

0.50

原生1M context,发布口径未提分段加价

开源权重,官方称跑在国产芯片

GLM-5.3-Flash 国内站

0.4元人民币

1.4元人民币

同上

人民币结算;8月发布时另有折扣口径,窗口是否仍在需自查

DeepSeek-V4.1-Flash

未取到各方一致的价目,不硬写

同左

同左

社区一致反馈:降价后仍比GLM-5.3-Flash贵

GLM-5.3-Flash国际站自8月发布起就是输入$0.15、输出$0.50每百万token的价目。 国内站人民币口径则是输入0.4元、输出1.4元每百万Tokens。 8月发布早期还有过"限时折扣后只要0.045美元"的说法,折扣窗口是否仍在需要你自查。微博·酱紫表微博·Ai李面请微博·科技锐评

三个容易算错的点,我按真实任务类型给你过一遍:

1. 纯输出重的活,两家打平。 代码补全、批量改写这类任务,大头是输出token。Haiku 5.5输出$0.50,GLM-5.3-Flash国际站输出也是$0.50——输入价差的那1/3,在输出重的账单里体现不出来多少。这就是"比GLM便宜三分之一"这种说法最大的水分:它只描述了输入那一半。

2. 长上下文是GLM的护城河,恰好是Haiku的跳价点。 你的活如果是整仓代码塞prompt、长文档审计、多轮agent轨迹累积,输入很容易冲过10万token。Haiku一过线就是输入$0.50、输出$2.50;而GLM-5.3-Flash按发布口径是1M context平价。对长上下文重度用户,这行小字直接决定搬家方向是反的。

3. 缓存玩法完全不同,别只看牌价。 Haiku缓存读取$0.01,对"一个长system prompt反复命中缓存"的agent流水线是个真实的降本器;但缓存写入$0.125,频繁换上下文的活反而要为写入付钱。GLM国际站的缓存折价口径我在采集到的材料里没看到一致数字,这项在官方明码之前先按无缓存优势处理,别拿对手家的缓存价给自己家做预期。

4. 国内结算用户,牌价上暂时没人打得动GLM。 0.4元/百万输入,按通行的7:1汇率粗算约等于$0.06,比Haiku的$0.10还低一截;这还没算合规直连渠道的稳定性差异。真正的问题不是价格,是你用的是官方站还是聚合平台——往下看。

分数这页有个"口径陷阱",收藏夹里的旧图先别看

八月发布季你大概率存过一张"GLM-5.3-Flash AA指数57分、打平Opus 4.8"的图。 今天你又会刷到"Haiku 5.5 43分、超过GLM-5.3-Flash"。57 > 43,好像GLM还赢了?不对,这两组数不在同一条基准线上,AA的分数基线随入池模型更新一直在重校准,跨月的绝对分数直接比大小是错的。有效的比较只有一个:同一天、同一批次、同一张榜里,Haiku 5.5 > GLM-5.3-Flash。至于是超2分还是超5分,目前转述里Terminal Bench 4.0这项连歸藏原帖两句话都对不上——高一分又"跟5.3 flash相同"。 这项看方向就好,别抠分差。微博·科技锐评微博·歸藏的AI工具箱

聚合平台的用户,降价和你无关

知乎上周有个问题挂着1.4万浏览:为什么WorkBuddy里DeepSeek 4.1F的价格是GLM 5.3F的两倍? 牌价更低的模型,在积分制平台上反而更贵,答案指向平台的积分倍率是按平均任务开销拍的,不按官方牌价。把这条经验放到今天:Haiku 5.5官方降价,落到WorkBuddy、各类"Coding Plan"聚合套餐里,兑换倍率可能一周内都是空的或者虚高。你在平台上看到的"Haiku 5.5"价格,在倍率公示前请当成未校准数据。知乎

五类人,五种做法

  • 国内站人民币用户:不动。GLM-5.3-Flash国内牌价仍是已核实口径里的地板,免费羊毛没了也有0.4/1.4元托底。

  • 海外卡直连、缓存重度的agent用户:值得拿5-10%流量灰度Haiku 5.5,重点盯缓存命中率,缓存读$0.01是它真正的杀器。

  • 长上下文重度用户(整仓塞prompt型):反向搬家更划算,10万token跳价线就是你的路障,留GLM。

  • 本地部署/合规敏感用户:无选择权。Haiku 5.5目前各家发布转述里都没有开源权重一说,GLM-5.3-Flash则是开源权重、完全运行于中国AI芯片——这条线目前是智谱独家。微博·酱紫表

  • 聚合平台积分用户:让子弹飞一周,等倍率。

接下来四个小时到一周,盯这四个信号

  1. 智谱有没有动作:昨天刚收免费口的网、今天对手就降价,48小时内有没有跟价或加补贴;

  2. WorkBuddy、Cursor这类平台什么时候上Haiku 5.5、倍率标多少;

  3. AA和Terminal Bench的独立复核数字,替代博主转述里的模糊项;

  4. GLM国际/国内两套价目会不会借这轮"统一口径"。

一句话收尾:$0.10的输入价不是搬家理由,你自己任务的输入/输出比例和上下文长度分布才是。这一页账先收藏,三方价格接下来一周大概率还会动,动完我可以再对一遍。

内容由AI生成
1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章