Anthropic把牙膏挤爆了!Sonnet 5.5性能翻近7倍,价格却和上代一样

源自132位全网作者

09:40

内容由AI生成

精选参考来源

1. Anthropic推出Claude Sonnet 5.5 速度提升30%以上 成本降低30%-格隆汇

2. Claude Sonnet 5.5 发布!跑分贴着Opus 5.5,快30%也更省token_腾讯新闻

3. Claude Sonnet 5.5发布,官方称单项任务成本最多降低30%

4. Claude Sonnet 5.5发布:性能逼近Opus 5.5,安全防护升级_腾讯新闻

5. 刚刚,性价比之王Sonnet 5.5发布!|Anthropic|Claude|OpenAI|开发者大会|测试_手机新浪网

6. Anthropic Claude Sonnet 5.5 模型偷跑,实测碾压 GPT-6 Sol、直逼 Astra_新浪科技_新浪网

7. 未来图灵的微博

8. Claude深夜炸场!Sonnet 5.5发布,读财报、数据分析,金融能力超强

9. Building with Claude Sonnet 5.5 / claude.dev Blog

10. i陆三金的微博

11. 【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评 【Claude Opus 5.5】 9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。 【GPT-6 Sol】 9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。 观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。

12. Claude Opus 5.5发布,降价四成“干掉”Fable 5.1?

13. Anthropic深夜放大招:Claude Opus 5.5上线,任务成本大降40%

14. Claude Opus 5.5全平台上线,成本与速度双降

15. Claude Opus 5.5新旗舰:独立榜58分登顶,成本降40%速度升30%

16. Anthropic、OpenAI上新:Opus 5.5性能超Astra,GPT-6 Sol赢在价格

17. OpenAI、Anthropic邀您进入“大模型折扣季”

18. 腰斩到$0.1一档:GPT-6不进聊天框

19. Claude Opus5.5的关键信息和实测结果!

20. Opus5.5和Grok4.7建模对比 今天全球Ai模型实验室集体高潮,Claude发布了能力赶超自家fable5.1的Opus5.5,还慷慨的送了一次重置。Openai在晚些时候发布了gpt6系列的sol和luna系列,不过似乎平台出了点问题,暂时没法测试。Grok早一天低调发布了grok4.7。 我第一时间做了一次oneshot的threejs建模测试,opus5.5high对grok4.7xhigh,opus输出21.7万tokens,grok输出17.6万。按两家官方 API 价格算,这次做锦鲤池的成本大约是 Opus 5.5 $9.3,Grok 4.7 $3.3,Opus 贵了约 2.8 倍。 #Opus5.5 #claude #grok #ai建模 #gpt6

21. 眩晕瘫坐:Opus 5.5 一次生成的 3D 网页场景

22. 刚刚,性价比之王Sonnet 5.5发布!|Anthropic|Claude|OpenAI|开发者大会|测试_手机新浪网

23. Building with Claude Sonnet 5.5 / claude.dev Blog

24. Claude Sonnet 5.5 发布!跑分贴着Opus 5.5,快30%也更省token_腾讯新闻

25. Claude深夜炸场!Sonnet 5.5发布,读财报、数据分析,金融能力超强

26. Opus5.5实测,感觉就是fable5.1蒸馏的? 给大家带来claude opus 5.5 的前端测试结果. 直接说结论, 我怀疑现在opus 5.5就是 fable 5.1 的量化版或者自家蒸馏版, 可以直接看我的视频, 几乎看不出两个模型实现细节上的差别. 而且模型继承了Anthropic一贯的优良特点, 一个字, 稳, 6次抽卡6次全都是这个质量. 除此之外我测试时很明显 opus 5.5 的思考token消耗更多. 这意味着opus5.5模型会更小一些(用reasoning长度换性能). 这同样意味着会有雷霆大思考的情况, 比如最后一个火山喷发测试, 我terminal和网页都测试了好几次, 结果都无法输出代码. 思考卡住了. 当然瑕不掩瑜. 毕竟比fable便宜又能获得差不多的性能, 只要不降智, 就是好模型(但无奈Anthropic降智是祖传艺能...). > #opus55 #claudeopus55 #anthropic

27. Claude Opus 5.5发布:多数任务追平Fable 5.1,典型成本降40%

28. 一夜三连发,Claude Opus 5.5、GPT-6 Sol和Luna全部都来了

29. 【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评 【Claude Opus 5.5】 9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。 【GPT-6 Sol】 9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。 观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。

30. 刚刚,Claude Opus 5.5降价40%,高阶模型要换座次

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章