Claude 5.5两兄弟怎么选?实测:编码省一半,复杂任务还得是Opus

源自211位全网作者

09:39

内容由AI生成

精选参考来源

1. Claude Opus 5.5发布:多数任务追平Fable 5.1,典型成本降40%

2. Anthropic推出Claude Sonnet 5.5 提速三成

3. Claude vs ChatGPT API for Developers: Honest Take

4. Claude Sonnet 5.5 发布:比肩 Opus 5.5|调用|速度|编程|代码|opus|显式标识_网易订阅

5. Opus5.5实测,感觉就是fable5.1蒸馏的? 给大家带来claude opus 5.5 的前端测试结果. 直接说结论, 我怀疑现在opus 5.5就是 fable 5.1 的量化版或者自家蒸馏版, 可以直接看我的视频, 几乎看不出两个模型实现细节上的差别. 而且模型继承了Anthropic一贯的优良特点, 一个字, 稳, 6次抽卡6次全都是这个质量. 除此之外我测试时很明显 opus 5.5 的思考token消耗更多. 这意味着opus5.5模型会更小一些(用reasoning长度换性能). 这同样意味着会有雷霆大思考的情况, 比如最后一个火山喷发测试, 我terminal和网页都测试了好几次, 结果都无法输出代码. 思考卡住了. 当然瑕不掩瑜. 毕竟比fable便宜又能获得差不多的性能, 只要不降智, 就是好模型(但无奈Anthropic降智是祖传艺能...). > #opus55 #claudeopus55 #anthropic

6. 一夜三连发,Claude Opus 5.5、GPT-6 Sol和Luna全部都来了

7. i陆三金的微博

8. OpenAI、Anthropic邀您进入“大模型折扣季”

9. Claude Sonnet 5.5 Is Faster. The Task Bill Depends on Effort. | NxCode

10. 全网开发者慌了24小时,Anthropic深夜一句话反转:Haiku没死,5.5全家桶杀到!

11. Why Claude switched models in your conversation with Sonnet 5.5 | Claude Help Center

12. 【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评 【Claude Opus 5.5】 9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。 【GPT-6 Sol】 9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。 观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。

13. 腰斩到$0.1一档:GPT-6不进聊天框

14. Anthropic与OpenAI夜间发布新模型:Opus 5.5与GPT-6Sol性能对比分析

15. 突发!GPT-6 Sol与Claude Opus 5.5同日开打

16. 全网哀悼“Haiku已死”!Anthropic深夜突然掀桌:Claude 5.5全家桶杀疯了

17. Anthropic:未来几周将推出Claude Sonnet 5.5与Claude Haiku 5.5两款大模型

18. Anthropic新模型Claude Opus 5.5发布,性能对标Fable 5.1

19. 青尘3141的微博

20. Anthropic Claude Sonnet 5.5 模型偷跑,实测碾压 GPT-6 Sol、直逼 Astra_新浪科技_新浪网

21. Anthropic推出Claude Sonnet 5.5 提速30%,成本降低

22. 眩晕瘫坐:Opus 5.5 一次生成的 3D 网页场景

23. Claude Sonnet 5.5灰度测试,编码能力直逼GPT-6 Astra

24. Claude Sonnet 5.5发布,官方称单项任务成本最多降低30%

25. 一夜三连发,Claude Opus 5.5、GPT-6 Sol和Luna全部都来了

26. Anthropic 发布了一篇文章,详细拆解 Claude Opus 5.5 在 Claude Code 中完成一次任务的实际成本。 对于 Agent Coding 来说,成本并不只取决于模型的单价。一次任务通常包含多轮模型调用,每一轮都会重新处理此前的上下文,因此任务的轮数、缓存命中率、输出 Token 数量以及模型本身都会影响最终成本。 Opus 5.5 的 API 价格为每百万 Token 输入 4 美元、输出 20 美元,缓存读取仅 0.2 美元。相比 Opus 5,输入和输出价格下降 20%,缓存读取价格下降 60%。 Anthropic 给出的示例中,一个包含 20K 到 120K 上下文、运行 40 轮的任务,大约产生 280 万输入 Token。90% 内容来自缓存时,输入成本约为 1.62 美元。如果减少到 25 轮,输入成本可以降至约 1.02 美元。 输出 Token 的成本更高。Opus 5.5 每百万输出 Token 为 20 美元,包含模型的思考 Token。因此,对于长时间运行的 Coding Agent,减少无效轮次和提高缓存命中率都会直接影响成本。 Anthropic 还提到,在相同 Token 用量下,Opus 5.5 相比 Opus 5 的示例任务成本约下降 31%。实际任务中的差距还取决于模型完成任务所需要的轮数和 Token 数量。 这篇文章的核心其实很清晰,Agent 的成本核算需要从单 Token 价格进一步细化到完整任务,包括模型调用次数、上下文复用、缓存以及推理 Token。

27. 价格腰斩。 OpenAI 9月22日再推两款GPT-6模型,Sol和Luna,API定价较上一代直接砍半。 Sol每百万token输入仅2美元,Luna更是压到0.1美元。Sam Altman放话:按任务成本算,市面上没有对手。但降价背后,藏着一场更凶的仗。 开发者们的反应最诚实,消息一出,AI编程社区创始人韦斯·温德当场开炮:Sol在DeepSWE测试中表现还不如上一代GPT-5.6 Sol。 OpenAI产品负责人蒂博·索蒂奥急忙回应,说Sol是“各方面都更好的模型”,别盯着单项跑分。温德不买账,回了一句狠话:高端产品反而更差,凭什么说整体更好。 说白了,这波降价不只是让利,更是在抢人。Luna每百万token输入0.1美元、输出0.5美元,直接把DeepSeek V4.1 Flash的闲时价格拉到了同一区间。 过去DeepSeek手里最大的那张低价牌,现在被OpenAI伸手抢了过去。而就在一个半小时前,Anthropic刚发布了Opus 5.5,运行成本比上一代降了40%。两家前后脚出招,方向一模一样,不再比谁最聪明,改比谁更便宜。 但真正需要警惕的是“永久降价”这四个字背后的账。 OpenAI官方说,这次降价归功于推理基础设施和缓存效率的改善,并且强调是永久定价,不是促销。 问题来了,降价的同时,模型完成任务消耗的token其实更多了。 Artificial Analysis的第三方评测显示,Sol每个任务平均输出约31k token,上一代是29k;Luna更夸张,从41k直接涨到了51k。单价砍半,用量反涨,这笔账最后谁买单,需要打个问号。 不过,对中小企业来说,门槛确实塌了。 有开发者算过,此前用Luna搭一个完整全栈应用只消耗周额度的4%,降价后意味着每周能构建一百个应用。以前不敢把大模型塞进核心流程的团队,现在可以重新算账了。 可别高兴太早,速率限制还在,并发上限还在,用量暴涨之后服务质量能不能扛住,OpenAI没有给出任何承诺。省下来的钱是机会,也是重新审视产品逻辑的窗口。 价格腰斩容易,信任翻倍很难。Altman说市面上没有对手,但开发者心里那杆秤,从来只认跑出来的结果。#OpenAI再推两款GPT-6模型 定价降50%##上头条 聊热点#

28. 腰斩到$0.1一档:GPT-6不进聊天框

29. 刚刚,性价比之王Sonnet 5.5发布!|Anthropic|Claude|OpenAI|开发者大会|测试_手机新浪网

30. Claude Opus 5.5深夜发布,减价40%!大语言模型正式开始吞噬多模态

31. 【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评 【Claude Opus 5.5】 9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。 【GPT-6 Sol】 9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。 观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章