Haiku 5.5测评:降本75%性能跨越,重塑性价比标杆

源自24位全网作者

07:42

Anthropic 发布的 Claude Haiku 5.5 标志着其 5.5 家族矩阵的成型。作为该系列中主打轻量、高速和低成本的小型模型,Haiku 5.5 在保持高并发、低延迟优势的同时,实现了基准性能与成本控制的跨越,引发了行业对轻量级模型能力上限与性价比的广泛讨论。

从综合能力基准来看,Haiku 5.5 突破了以往小模型仅能处理简单简单文本的局限。在 Artificial Analysis Intelligence Index 测评中,该模型获得了 43 分的综合得分,相比一年前的前代产品大幅提升。在关键的自动化与编程能力项上,其计算机自动化操作能力在 OSWorld 2.1 测试中的得分从上一代的 15.7% 提升至 72.4%;在终端智能体编程测试 Terminal-Bench 4.0 中,得分也从前代接近于零的水平上升至约 39%。此外,在无工具辅助的跨学科综合推理测试中,其得分达到 45.9%。测评数据表明,尽管 Haiku 5.5 在绝对事实知识库的覆盖上略逊于部分竞争对手,但它展现出了较低的幻觉率,在面对未知知识时更倾向于承认无法回答,从而提升了自动化任务中的可信度。

价格与算力调优机制是 Haiku 5.5 测评中备受瞩目的核心要素。在定价策略上,针对单次请求在 10 万 Token 以内的常见场景(该类场景占历史调用的绝大多数),模型的输入与输出单价相比上一代直接下降了 90%,整体平均运行成本降低了约 75%。与降价同步引入的,还有首度在 Haiku 系列中搭载的可调节思考强度(Effort)参数与自适应思考功能。这改变了轻量模型单一的运行模式,使开发者能够根据具体任务的复杂度灵活调配算力,在快速响应、低成本输出与高准确率的深度推理之间自主寻找最佳平衡点。不过实际测试也显示,在最高思考强度下,模型消耗的 Token 数量会显著增加,因此在具体部署时仍需根据工况合理选择档位。

在实际应用落地与工作流设计方面,Haiku 5.5 被定位为大规模高频任务的执行引擎。它能够高效完成文本摘要、高通量数据分类、实时客服交互、数据整理以及浏览器自动化等轻量级场景。更重要的是,它被设计为复杂 Agent 架构中的子智能体(Sub-agent)。在这种多模型协同模式下,顶级模型负责总体规划与难题突破,而 Haiku 5.5 则承接拆解出来的密集型重复任务,从而大幅压低了长时运行工作流的整体账单。

综合各项测评表现来看,Haiku 5.5 的发布反映了当前大模型行业竞争焦点的转移。随着轻量级模型在计算机控制、代码执行和逻辑推理等核心能力上的补齐,“便宜够用”的门槛被重新划定。市场的评估标尺正逐渐从单纯的基准得分高低,转向单位成本下所能完成的实际有效工作量。Haiku 5.5 以极具竞争力的价格和显著提升的能力,为大规模商业化 Agent 的落地提供了更具性价比的技术选项。

内容由AI生成

精选参考来源

1. Haiku 5.5 发布,又要吃掉一波Flash级模型

Haiku 5.5 发布,又要吃掉一波Flash级模型 首先,A/ 现在是真的卷。 Claude 5.5 这一代,大杯、中杯、小杯几乎连着发: 🔹 Opus 5.5:9 月 22 日 🔹 Sonn

2. Claude Haiku 5.5发布:价格暴降90%!

Claude Haiku 5.5发布:价格暴降90%! 10月7日,Anthropic 正式发布 Claude Haiku 5.5,号称自家迄今最便宜、最快、能力最强的小模型。 这次值得关注的,不

3. Haiku 5.5智指数涨26分

Haiku 5.5智指数涨26分 Anthropic发布Claude Haiku 5.5,在Artificial Analysis Intelligence Index上得分43,较一年前上代提升26

4. 【深度】Anthropic 补齐 Claude 5.5 最后一块拼图:Haiku 5.5 成本降75%,IPO前打的是价...

【深度】Anthropic 补齐 Claude 5.5 最后一块拼图:Haiku 5.5 成本降75%,IPO前打的是价... 【深度】Anthropic 补齐 Claude 5.5 最后一块拼图:H

5. Claude Haiku 5.5 测评报告!究竟有多能打

Claude Haiku 5.5 测评报告!究竟有多能打 测评 Claude Haiku 5.5实测报告出炉!我把思考模式拉到High,看看这号称性价比之王的模型到底有多强?先来个硬核指令测试——从1

6. Haiku 5.5 降价,最难受的不是开发者,是那批“能力差一点,但胜在便宜”的二三流模型。 10万 Token 以...

Haiku 5.5 降价,最难受的不是开发者,是那批“能力差一点,但胜在便宜”的二三流模型。 10万 Token 以... Haiku 5.5 降价,最难受的不是开发者,是那批“能力差一点,但胜在

7. Claude 发布 Haiku5.5,跑分暴涨并降价 75%,这意味着什么?

Claude 发布 Haiku5.5,跑分暴涨并降价 75%,这意味着什么? Luna / Haiku 小杯模型默秒全,秒杀全部开源模型。基本上印证了我从GPT 5.6 Luna发布之后就开始说的,A

8. 正式发布 Claude Haiku 5.5:成本骤降 75%

正式发布 Claude Haiku 5.5:成本骤降 75% Anthropic 官方宣布正式推出新一代轻量级模型 Claude Haiku 5.5,定位为迄今为止速度最快、运行成本最低且综合能力最强

9. Anthropic 发布 Haiku 5.5

Anthropic 发布 Haiku 5.5 Anthropic 发布了 Claude Haiku 5.5,这是其迄今为止最快且最便宜的模型。 Claude Haiku 5.5 的定价为 $0.1

10. Claude Haiku5.5发布:这次小模型有点离谱!

Claude Haiku5.5发布:这次小模型有点离谱! 一句话总结:价格砍到 Haiku 4.5 的约 1/10,但不少能力已经摸到甚至超过 GPT-6 Luna。 几个比较值得看的数据:

11. Haiku 5.5 与中国模型对比 | A÷送 token

Haiku 5.5 与中国模型对比 | A÷送 token Anthropic 这个 Haiku 5.5 真是盯着中国的这几个甜点级模型打,太恶心了! 我对比了一下它和几个中国竞品的价格和测试评

12. Haiku 5.5能对标哪一代的Sonnet甚至Opus?

Haiku 5.5能对标哪一代的Sonnet甚至Opus? 今天凌晨 Haiku 5.5 发布后,我很好奇这个身材最小、调用最便宜的小杯,如果拉回自家演进史里横向对比,到底能对标哪一年的 Opus 或

13. Claude Haiku 5.5发布——小模型生物研究员

Claude Haiku 5.5发布——小模型生物研究员 Claude Haiku 5.5 发布了。 这次最值得看的,不只是“小模型变强了”,而是 Anthropic 已经开始系统测试 Claude

14. Anthropic 又把小模型价格砍了一刀:直接降

Anthropic 又把小模型价格砍了一刀:直接降 Anthropic 发布 Claude Haiku 5.5。 Haiku 本来就是 Claude 家族里主打“快、便宜、跑量”的模型,这次最狠的不是

15. Claude 发布 Haiku5.5,跑分暴涨并降价 75%,这意味着什么?

Claude 发布 Haiku5.5,跑分暴涨并降价 75%,这意味着什么? 短的结论:江海不择小助 基本情况: 上一次见到 Haiku 已经是一年前的 4.5,历史上从来没有单独给 Haiku 写过

16. 中国大模型的斩杀线,被斩杀了

中国大模型的斩杀线,被斩杀了 文|Sleepy 10 月 8 日,Anthropic 发布 Haiku 5.5。对于不超过 10 万 token 的短请求,每百万 token 输入收 0.1 美元、

17. 重磅:GPT6.0Chat开放!Haiku5.5斩杀Luna!

重磅:GPT6.0Chat开放!Haiku5.5斩杀Luna! 一觉醒来两件大事: [一R]ChatGPT6.0已经面向所有用户开放了!对于Plus用户而言,这几乎是免费无限量的,网页转本地插件又可以

18. Haiku这价格,先别急着喊真香

Haiku这价格,先别急着喊真香 刚看了一眼,MiniMax盘中跌超9%,智谱跌超6%,恒生科技指数跌约1% 虽然把跌幅都算到 Haiku 5.5头上,太想当然,但 Anthropic 这次 Ha

19. Anthropic发布新模型

Anthropic发布新模型 深夜炸弹来袭,简直是一场屠戮,梁圣我睡不着了! 先前早有预热的Haiku5.5在十月七日凌晨两点正式上线!价格竟比DeepSeek还便宜??! Claude 新出的 Ha

20. Anthropic 这个 Haiku 5.5 真是盯着中国的这几个甜点级模型打,太恶心了!我对比了一下它和几个中国竞品的...

Anthropic 这个 Haiku 5.5 真是盯着中国的这几个甜点级模型打,太恶心了!我对比了一下它和几个中国竞品的... Anthropic 这个 Haiku 5.5 真是盯着中国的这几个甜点级

21. Claude开启价格战!比Deepseek还低

Claude开启价格战!比Deepseek还低 Haiku 5.5来了,支持100万上下文。标准API按提示长度分档:不超过10万tokens,每百万输入/输出是$0.10/$0.50;超过后是$0.

22. Claude最强迷你模型登场,价格暴降90%,直逼DeepSeek?

Claude最强迷你模型登场,价格暴降90%,直逼DeepSeek? Claude最强迷你模型登场,价格暴降90%,直逼DeepSeek?智东西1791442871 智东西编译 | 程茜编辑 | 云鹏

23. 【#ClaudeSonnet5.5发布#】Anthropic 发布 Claude Sonnet 5.5,速度提升 30%...

【#ClaudeSonnet5.5发布#】Anthropic 发布 Claude Sonnet 5.5,速度提升 30%... 【】Anthropic 发布 Claude Sonnet 5.5,速度提

24. Anthropic 今天凌晨发了个新模型,叫 Claude Sonnet 5.5,是 5.5 系列的第二个。一句话概括:...

Anthropic 今天凌晨发了个新模型,叫 Claude Sonnet 5.5,是 5.5 系列的第二个。一句话概括:... Anthropic 今天凌晨发了个新模型,叫 Claude Sonnet
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章