Claude Opus 4.8发布,编程诚实度达新高
源自39位全网作者
05-30 12:08
精选参考来源
1
以前用 AI 最头疼的是什么?是它明明不懂还要瞎编,是写了一堆有 bug 的代码还假装没问题。这次 Opus 4.8 直接把这两个毛病治好了:官方数据显示,它的谎报率和偷懒率都降到了历史首次的 0%,遇到不会的会直接说 "我做不到",写完代码会自己检查出问题再交给你。接到一个大项目,它会自动拆成几十上百个小任务,然后召唤几百个 AI 子代理同时开工,干完之后还会派另一批 AI 互相挑错,最后汇总成完美的结果。Bun 的作者用它把 75 万行 Zig 代码迁移成 Rust,99.8% 的测试都通过了,只用了 11 天,这在以前是一个团队干几个月的活。最良心的是,这么大的升级,常规模式价格一分没涨,快速模式还提速了 2.5 倍,价格反而降到了原来的三分之一。现在的 AI 已经不是帮你打打下手的工具了,它真的能独立完成复杂的工作了。#ClaudeOpus4.8发布##Opus4.8和GPT5.5谁更强#
2
#Opus4.8和GPT5.5谁更强#这波更新直接把 Agent 编程的天花板拉高了一大截。SWE-Bench Pro 69.2%,比 GPT-5.5 高 10 个百分点GDPval-AA 真实世界 Agent 能力榜 1890 分,断层第一完成同样任务比上代少用 15% 步骤、少输出 35% tokenClaude Code 支持动态工作流,自动调度上百子 Agent 并行实测下来,它在长任务中的稳定性提升非常明显,能连续跑几个小时不用人工干预,遇到问题会自己调整方案,而不是直接摆烂。价格不变真的太香了,现在用 Opus 4.8 做开发,效率至少能翻一倍。#ClaudeOpus4.8发布#
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹