OpenAI和Anthropic新模型刚发,我就把编程能力这笔账算清楚了

源自114位全网作者

09-24 22:30

内容由AI生成

精选参考来源

1. Claude Opus 5.5的编程能力提升体现在哪些场景?|智能体|代码|成本|模型|测试_新浪新闻

2. Claude Opus 5.5发布,降价四成「干掉」Fable 5.1?_手机新浪网

3. GPT-6 Sol和Luna震撼发布,价格腰斩

4. 【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评 【Claude Opus 5.5】 9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。 【GPT-6 Sol】 9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。 观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。

5. OpenAI、Anthropic邀您进入“大模型折扣季”

6. 一夜三连发,Claude Opus 5.5、GPT-6 Sol和Luna全部都来了

7. Claude Opus 5.5深夜炸场!马斯克点赞,性能超越GPT-6、成本大降40%_代码_模型_工作

8. Anthropic Updates by Anthropic - September 2026 - Releasebot

9. Claude Opus 5.5 上线:680,000 行代码迁移,1M 上下文让长时 Agent 跑起大任务-CSDN博客

10. Claude Opus 5.5 | Evaluation Review & Metrics Benchmarks | Sonar

11. AI“减速”讨论未歇,OpenAI、Anthropic同日上新,竞逐更低成本

12. GPT-6 SolとClaude Opus 5.5で変わる、エージェントの费用の见方 | NxCode

13. 昨晚 AI 圈又炸了,我建议你们别再用 GPT-5.6 了-36氪

14. GPT-6猛砍价,Opus 5.5忙“变好用”:模型价格战,已经不能只看API定价|Anthropic|GPT-5.5|Claude Opus 5|Agent|Copilot_手机新浪网

15. Anthropic、OpenAI上新:Opus 5.5性能超Astra,GPT-6 Sol赢在价格

16. GPT-6 实测:我让它从零做了一款 3D 游戏

17. Claude 5.5狂堆3D回击Astra!曝价格还打8折

18. 清华开源机器人框架:GPT-6当大脑,成功率92.63%

19. 价格腰斩。 OpenAI 9月22日再推两款GPT-6模型,Sol和Luna,API定价较上一代直接砍半。 Sol每百万token输入仅2美元,Luna更是压到0.1美元。Sam Altman放话:按任务成本算,市面上没有对手。但降价背后,藏着一场更凶的仗。 开发者们的反应最诚实,消息一出,AI编程社区创始人韦斯·温德当场开炮:Sol在DeepSWE测试中表现还不如上一代GPT-5.6 Sol。 OpenAI产品负责人蒂博·索蒂奥急忙回应,说Sol是“各方面都更好的模型”,别盯着单项跑分。温德不买账,回了一句狠话:高端产品反而更差,凭什么说整体更好。 说白了,这波降价不只是让利,更是在抢人。Luna每百万token输入0.1美元、输出0.5美元,直接把DeepSeek V4.1 Flash的闲时价格拉到了同一区间。 过去DeepSeek手里最大的那张低价牌,现在被OpenAI伸手抢了过去。而就在一个半小时前,Anthropic刚发布了Opus 5.5,运行成本比上一代降了40%。两家前后脚出招,方向一模一样,不再比谁最聪明,改比谁更便宜。 但真正需要警惕的是“永久降价”这四个字背后的账。 OpenAI官方说,这次降价归功于推理基础设施和缓存效率的改善,并且强调是永久定价,不是促销。 问题来了,降价的同时,模型完成任务消耗的token其实更多了。 Artificial Analysis的第三方评测显示,Sol每个任务平均输出约31k token,上一代是29k;Luna更夸张,从41k直接涨到了51k。单价砍半,用量反涨,这笔账最后谁买单,需要打个问号。 不过,对中小企业来说,门槛确实塌了。 有开发者算过,此前用Luna搭一个完整全栈应用只消耗周额度的4%,降价后意味着每周能构建一百个应用。以前不敢把大模型塞进核心流程的团队,现在可以重新算账了。 可别高兴太早,速率限制还在,并发上限还在,用量暴涨之后服务质量能不能扛住,OpenAI没有给出任何承诺。省下来的钱是机会,也是重新审视产品逻辑的窗口。 价格腰斩容易,信任翻倍很难。Altman说市面上没有对手,但开发者心里那杆秤,从来只认跑出来的结果。#OpenAI再推两款GPT-6模型 定价降50%##上头条 聊热点#

20. 眩晕瘫坐:Opus 5.5 一次生成的 3D 网页场景

21. 刚刚,Opus 5.5跨级偷袭!直扑GPT-6

22. GPT-6发布两周了:5个真实开发场景实测,Claude还是赢了两项_gpt6-CSDN博客

23. 真实项目实测GPT-6:代码重构、3D建模、电路还原全记录-CSDN博客

24. Codex接入GPT-6 Astra实测:安装配置、模型切换与高频报错排查全记录-CSDN博客

25. Codex实测GPT-6 Astra:安装配置、模型切换与高频报错排查指南-CSDN博客

26. Claude Opus 5.5深夜炸场!马斯克点赞,性能超越GPT-6、成本大降40%_代码_模型_工作

27. Anthropic、OpenAI上新:Opus 5.5性能超Astra,GPT-6 Sol赢在价格

28. GPT-6 Sol和Luna震撼发布,价格腰斩

29. 【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评 【Claude Opus 5.5】 9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。 【GPT-6 Sol】 9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。 观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。

30. GPT-6猛砍价,Opus 5.5忙“变好用”:模型价格战,已经不能只看API定价

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章