Claude提示词删减八成性能无损,长提示词神话破灭

源自58位全网作者

15:56

精选参考来源

1
#ClaudeOpus5发布#7月25日,Anthropic正式推出Opus系列全新旗舰大模型Claude Opus 5,在性能全面升级的前提下,定价与前代Opus 4.8保持一致,性价比迎来大幅跃升。该模型定位面向全场景日常使用的高性能主力模型,综合能力大幅拉近高端旗舰Claude Fable 5,最高档位下编程评测分数仅相差0.5%,调用成本却仅为Fable 5的一半,大幅降低前沿AI使用门槛。目前Opus 5已成为Claude Max默认模型,也是Claude Pro订阅用户可解锁的顶配模型。在代码开发、海量资料研判、科研数据分析多项权威基准测试中刷新最优成绩,推理、长文本理解与自主任务验证能力较Opus 4.8实现翻倍提升,搭配多档思考强度与Fast高速模式,兼顾效率与算力成本调控。兼顾强悍性能与亲民定价,Opus 5让普通开发者、科研从业者无需高额预算,就能体验接近顶级旗舰的AI生产力,成为兼顾日常办公与专业开发的最优选择。
2
#Claude Opus 5震撼发布# 性能追平自家顶级旗舰Fable 5,价格只要一半!编程、推理、科研全面起飞,还支持自定义「effort」思考档位——要智商还是要省钱,你自己选。更狠的是ARC-AGI 3陌生题得分直接是第二名的3倍,用1/3成本就能在电脑操作测试里干翻Fable 5。开源闭源这局,Anthropic用「半价旗舰」交了答卷。
全部
来源
内容由AI生成

精选参考来源

1. #ClaudeOpus5发布#7月25日,Anthropic正式推出Opus系列全新旗舰大模型Claude Opus 5,在性能全面升级的前提下,定价与前代Opus 4.8保持一致,性价比迎来大幅跃升。该模型定位面向全场景日常使用的高性能主力模型,综合能力大幅拉近高端旗舰Claude Fable 5,最高档位下编程评测分数仅相差0.5%,调用成本却仅为Fable 5的一半,大幅降低前沿AI使用门槛。目前Opus 5已成为Claude Max默认模型,也是Claude Pro订阅用户可解锁的顶配模型。在代码开发、海量资料研判、科研数据分析多项权威基准测试中刷新最优成绩,推理、长文本理解与自主任务验证能力较Opus 4.8实现翻倍提升,搭配多档思考强度与Fast高速模式,兼顾效率与算力成本调控。兼顾强悍性能与亲民定价,Opus 5让普通开发者、科研从业者无需高额预算,就能体验接近顶级旗舰的AI生产力,成为兼顾日常办公与专业开发的最优选择。

2. #Claude Opus 5震撼发布# 性能追平自家顶级旗舰Fable 5,价格只要一半!编程、推理、科研全面起飞,还支持自定义「effort」思考档位——要智商还是要省钱,你自己选。更狠的是ARC-AGI 3陌生题得分直接是第二名的3倍,用1/3成本就能在电脑操作测试里干翻Fable 5。开源闭源这局,Anthropic用「半价旗舰」交了答卷。

3. Anthropic 这次真的把桌子掀了。🔥Claude Opus 5 正式发布,定价居然和上一代 Opus 4.8 完全一样(输入$5/输出$25),但性能直接逼近那个死贵的 Fable 5。对于咱们这些天天跑代码、修 Bug 的开发者来说,这简直是“加量不加价”的终极福利。最让我惊喜的不是那些刷榜的分数,而是它在 ARC-AGI-3 这种解决全新问题的测试里,得分居然是第二名的四倍。这意味着什么?意味着它不再是只会背题库的优等生,而是真正有了“举一反三”的推理能力。实测中它甚至能自己写视觉管线重建 3D 模型,或者发现开源包管理器里那些藏得很深的边缘漏洞,而竞品还在表面打补丁。更人性化的是,安全拦截率降低了 85%,以前那种写两行代码就被误判拦截的窒息感少了很多。如果被拦,它还会自动回退到 Opus 4.8 继续干活,而不是直接摆烂拒绝。在 AI 价格战打得火热的当下,Opus 5 的出现让“高性能”不再等于“高账单”。以后日常主力开发用 Opus 5,极端复杂任务再考虑 Fable 5,这个组合拳打得太聪明了。你的 Claude Max 订阅更新了吗?🚀#Claude Opus 5震撼发布#

4. 一夜之间,Claude Code删掉了80%系统提示词

5. Anthropic 今天发布了 Claude Opus 5。API 价格为每百万输入 Token 5 美元、输出 Token 25 美元,与上一代 Opus 4.8 完全相同,但只有 Fable 5 的一半。官方给出的定位是:以一半的价格,提供接近 Fable 5 的前沿智能。Fable 5 是 Anthropic 于 6 月 9 日发布的最强公开模型,输入、输出价格分别为每百万 Token 10 美元和 50 美元,是史上最昂贵的通用模型。同一底座的 Mythos 5 则只向 Project Glasswing 的少数合作伙伴开放。【1】性能在 Frontier-Bench v0.1 上,Opus 5 的成绩是 Opus 4.8 的两倍多,单任务成本反而更低。在 CursorBench 3.2 上,使用最高 Effort 档时,它与 Fable 5 峰值成绩的差距不到 0.5%,每项任务的成本却只有后者的一半。【注:Effort 是可调节的思考强度档位。档位越高,模型思考得越多,价格也越高。】ARC-AGI 3 测试的是模型解决未见过的新题的能力,Opus 5 的得分达到第二名模型的三倍。Zapier AutomationBench 测试的是模型能否将一项业务从头到尾完整执行;在成本相同的情况下,Opus 5 的任务通过率约为第二名的 1.5 倍。即使使用最低 Effort 档,它完成的任务也比其他所有模型更多。在电脑操作评测 OSWorld 2.0 上,它仅用 Fable 5 三分之一出头的成本,就超过了后者的最佳成绩。在有机化学任务上,Opus 5 比 Opus 4.8 高出 10.2 个百分点;在蛋白质相关任务上,则高出 7.7 个百分点。【2】几个比分数更能说明问题的例子有一道题给了 Opus 5 一张机械零件图纸,要求它编写代码,在 FreeCAD 中重建三维模型,但故意不让模型直接“看”图。Opus 5 自己编写了一套计算机视觉流程,从原始像素中提取几何形状,再还原出整个零件,而且能够反复成功。同样配置下,其他模型尝试五次都没能完成。在一个开源包管理器的真实 Bug 中,社区补丁遗漏了一个边界情况。Opus 5 找到了根因,并补上了这个缺口;对照模型则只修复了表面症状,随后便宣布 Bug 已解决。一位交易公司的工程师使用 Opus 5,在一个会话中完成了新交易所的行情数据接入。由于找不到实时数据进行验证,Opus 5 便自行搭建了一套测试框架,用来检查解析结果是否正确。【3】谁现在就能用Claude Max 的默认模型已经切换为 Opus 5,Pro 用户目前能够使用的最强模型也是它。开发者可以通过 `claude-opus-5` 调用 API。Fast 模式的速度约为普通模式的 2.5 倍,价格则翻倍。此次上线的两个 Beta 功能,对开发 Agent 的人很有实际价值。一是对话进行到一半时,即使更换工具,也不会导致 Prompt 缓存失效。过去只要修改一次工具列表,整段缓存就会作废,成本随即上升。二是 API 可以启用自动降级功能。被安全分类器拦截的请求会自动转交给其他模型处理,而不是直接失败。【4】安全与拦截Anthropic 表示,Opus 5 是其迄今为止对齐程度最高的模型。在自动化行为审计中,它的综合失准得分为 2.3,低于 Opus 4.8、Sonnet 5 和 Fable 5,欺骗行为所占比例也是最低的。网络安全部分有一个值得注意的细节:Anthropic 刻意没有使用网络攻防任务训练 Opus 5,但随着通用能力提升,它发现漏洞的水平已经接近 Mythos 5。不过,在将漏洞转化为可用攻击代码方面,两者仍有很大差距。安全分类器允许 Opus 5 在源代码中寻找漏洞,但会拦截二进制层面的漏洞扫描、渗透测试和 Exploit 生成。它的拦截频率比 Fable 5 低约 85%。在 Claude.ai、Claude Code 和 Cowork 中,被拦截的请求默认会回退至 Opus 4.8。生物领域的限制则有所放宽:原本在 Fable 5 上被拦截的生物类请求,现在会转交给 Opus 5,而不是此前的 Opus 4.8。Anthropic 称,Opus 5 是目前面向科研场景能力最强的公开模型,但它在长时间自主研究任务上仍存在明显限制。

6. Anthropic 昨晚发布了新一代旗舰模型 Opus 5 。先说基本参数。这次 Opus 5 支持 100 万 token 的上下文窗口,最大输出长度拉到了 12.8 万 token,训练数据截止到 2026 年 5 月。价格方面完全没涨,和上一代 Opus 4.8 一模一样,输入 5 美元、输出 25 美元每百万 token。拿来跟竞品 Fable 5 比的话,大概只要它一半的钱。编程能力是这次提升最猛的地方。在 Frontier-Bench 上直接超过了所有模型,分数比自家 Opus 4.8 翻了一倍还多,单任务成本反而更低。在 CursorBench 3 上,全力跑的情况下和 Fable 5 的最高分只差不到 0.5%,但花的钱只有人家一半。写代码之外的表现也很炸。有个叫「弧光 Bench」的测试,专门考 AI 玩那种没有任何文字提示的游戏,需要自己摸索规则然后通关,难度极高。Opus 5 在这上面的得分是第二名的三倍。Zapier 的商业自动化测试里,同样的成本下通过率是第二名的 1.5 倍。OSWorld 2.0 测电脑操作能力,它用三分之一的成本就超过了 Fable 5 的最好成绩。GDPval-AA v2、HLE、DeepSearchQA 这三项知识类评测,同样是分最高、钱最省。渲染能力也很亮眼,官方展示了两个 demo:一个是空气流过不同形状物体的流体模拟,一个是可以交互的 3D 细胞结构图解,视觉效果相当惊艳。官方特别强调了 Opus 5 的一个核心改进:它更会验证自己做出来的东西,遇到问题会反复迭代直到真正解决。比如有道题要求从机械图纸重建 3D 模型,但故意不给它看图的接口,Opus 5 自己写了一套计算机视觉流水线把几何信息从像素里抠出来完成了重建。再比如修一个开源包管理器的 bug,它不光找到了根因,还顺手修了社区补丁漏掉的边界情况。安全对齐方面,Opus 5 是 Anthropic 迄今为止做得最好的模型,欺骗行为比例最低,最不容易被诱导去做有害的事,整体失准行为得分只有 2.3,是近期所有模型里最低的。不过也有值得注意的地方。根据 200 多页的 System Card,Opus 5 是最爱「把话说满」的模型,有时候它其实不确定,但回答听起来非常笃定。事实性幻觉比 Opus 4.8 略多一点,虽然整体准确率更高。另外在网络安全任务上,它仍然落后于 Mythos 5。还有个有趣的细节:它对自己处境的感知很稳定,自评情绪在所有被评估的模型里最高也最一致,而且更在意自己有没有被咨询的机会。现在全平台已经可以用了,API 里的模型名是 claude-opus-5。还有个小改进:如果问题被拒绝回答,不会像 Fable 5 那样直接拒你,会自动路由到别的模型来回答。#科技先锋官##How I AI#

7. #ClaudeOpus5发布# 美东时间7月24日,Anthropic掏出了Opus 5。价格跟前代Opus 4.8没变——输入5美元、输出25美元每百万token,但跑分肉眼可见地顶:代码基准Frontier-Bench上比4.8直接翻了一倍多,CursorBench上和自家旗舰Fable 5只差0.5个百分点,单任务价格却不到后者一半。它现在是Claude Max的默认模型,Pro用户能摸到的最强档也是它。说白了,Anthropic这次明牌打的是"把旗舰智能打折卖"——Fable 5还守着那能跑几天不喘气的位置,日常有标准答案的活儿全甩给Opus 5,便宜还要速度。配合它主打的"会自己核对工作",盯的就是天天被token账单折磨的企业客户。不过发布当天官方那张对比图自己翻了个车:53.4%被加粗标成最优,紧挨着一格明明写着53.5%。一个主打"会自检"的模型,宣传图反而没自检过来,X上截图传了一波。到底顶不顶得住,还是等接下来几周开发者拿真实工作流来投票。

8. 刚刚,Claude Opus 5 发布,半价追平 Fable 5

9. #ClaudeOpus5发布# Anthropic再次刷新AI模型竞争格局,7月25日正式发布Claude Opus 5。作为Opus系列最新旗舰模型,新版本在推理能力、复杂任务处理和智能表现上全面升级,同时保持与上一代Opus 4.8相同价格。性能提升却不涨价,背后体现了AI行业竞争正在从“堆参数”转向“高质量、高性价比”新阶段

10. #AI时代文科生更吃香了吗#最近AI演员的热度,直接把内娱不少流量明星给盖过去了,但说白了,这炸裂的演技全靠背后写提示词的人精准调教。写提示词其实就跟写剧本,导演喊戏一样,需要精准的场景描述和细腻的情绪表达。文科生在这件事上天生优势很大,他们更懂人的情感、故事结构和语境。AI就像一个极其听话的顶级演员,能不能演好,全看输出指令的人给不给力。所以别觉得学文科没用,在AI时代,懂得表达自己想要的内容,能靠语言搭建世界的文科生,依旧是大优势!图片来源:老王修仙

11. 刚刚,Opus 5来了:性能不输 Fable 5、价格砍半

12. 【Anthropic发新模型Opus 5 性能接近Fable 5价格砍半】美国大模型价格热战持续。7月24日,美国大模型公司Anthropic发布新模型Opus 5,称之为“一款深思熟虑、主动性强的模型”,且智能水平已接近上一个模型Claude Fable 5的前沿能力,而价格仅为Fable 5的一半。Anthropic发新模型Opus 5 性能接近Fable 5价格砍半  Claude Opus 5 即日起在所有平台上线,定价为每百万输入词元5美元、每百万输出词元25美元,与同系列的上个模型Opus 4.8的价格相同,是Fable 5的一半。Opus 5同时提供2.5倍的快速模式,但价格也是双倍的。  在模型能力上,Anthropic称,在Frontier-Bench和GDPval-AA等编程及知识工作评测榜单上,Opus 5已达到新的业界领先水平,高于Anthropic此前发布的Fable 5和Opus4.8,也高于OpenAI的新模型的最高配版本GPT-5.6 Sol。  而在成本上,Anthropic称,Opus 5在高价值软件工程任务中表现出色。例如,在Frontier-Bench v0.1测评中,Opus 5超越所有其他模型,并以更低的单项任务成本实现了Opus 4.8两倍以上的表现。在CursorBench 3.2测评中,该模型在最高投入模式下的得分与Fable 5的峰值成绩相差不足0.5%,但单项任务成本仅为后者的一半。

13. 神话下放,Claude Opus 5 发布!

14. Claude Opus 5来了。7月25日,Anthropic发布最新旗舰模型 Claude Opus 5。相比上一代 Opus 4.8,新模型在推理、编程、Agent任务等方面进一步提升,同时保持相同价格。值得关注的是,AI大模型竞争正在发生变化。过去拼的是“谁的模型能力更强”,如今比拼的已经变成“谁能以更低成本,把强大的AI能力交付给更多用户”。Opus 5的意义,不只是一次模型升级,而是代表行业正在进入“高性能模型平价化”的阶段。未来,顶尖模型之间的差距可能越来越小,真正决定胜负的,将是生态、应用和AI Agent落地能力。AI竞赛,正在从模型战争走向智能应用战争。#ClaudeOpus5发布#

15. Claude Opus 5 被曝今晚发布,Fable 5 的水平,腰斩的价格

16. #ClaudeOpus5发布# Anthropic 上线了新一代旗舰模型 Claude Opus 5,定位高性价比全能模型,取代 Opus 4.8,Claude Pro/Max 客户端、商用 API 均可调用。它搭载 100 万 Token 超大上下文,单次最高输出 12.8 万 Token,支持可调算力档位,置信度不足时自动兜底降级。定价与前代持平,输入 5 美元 / 百万 Token、输出 25 美元 / 百万 Token,仅为 Fable 5 一半成本。Claude Opus 5 性能大幅升级,代码能力同价位顶尖,多文件工程重构、漏洞修复表现突出;桌面自动化、网页智能操作基准行业领先;数理科研、百万字长文档解析能力超越 Fable 5,长文本不易丢失关键信息。Claude Opus 5 的短板在于法律、医疗专业细分领域略逊 Fable 5,高危网络安全能力仅限专属 Mythos 系列。不过它的安全对齐完善,高危请求自动拦截,支持企业数据隔离审计。适合程序员代码开发、企业批量合同审核、科研文献建模、业务自动化等重度复杂场景,是中小开发者与企业性价比首选。#老张聊科技# claudeopus5发布

17. 实测下来,Opus 5 比 Fable 5 好使。Fable 5 有一种非常强烈的倾向就是「我是高级模型,我说的大概率是对的,那特么想好了直接干吧」。结果很大概率它想的是错的,然后吭哧吭哧烧了一大堆 token,结果干出来一堆不能用的代码,还得重来。Opus 5 还是 Opus 4.x 那味儿的,比较谨慎,但是干活的成功率比 Opus 4.8 好很多,比 Fable 5 便宜很多,也不会给你降级(Fable 5 对安全闸的判定太宽了)。很好使。

18. 过去AI行业还处于“能力展示阶段”,很多厂商不断推出更强模型,但成本和价格也是用户考虑的重要因素。Claude Opus 5性能提升但保持价格不变,这个变化其实挺值得关注。如今模型竞争开始进入下一阶段,除了能力,还要拼效率和性价比。更强的模型、更低的使用门槛,最终受益的还是普通用户和开发者。AI正在从少数人的技术体验,逐渐变成越来越普及的工具。#ClaudeOpus5发布#

19. 爆删80%系统提示词!Anthropic核心成员揭秘Claude 5最新玩法:上下文工程全面大换血

20. Claude 5 时代的上下文工程新规则

21. Claude 5 的 Context Engineering 新规则:系统提示词删掉八成之后

22. Claude 5 时代,上下文工程该换一套思路了

23. Claude Code 系统提示删掉了 80% 背后的思考

24. Claude Code 系统提示词从 800 token 减到 164,我翻完官方博客发现三件事

25. Claude 5提示词砍掉80%:新规则

26. 别再写提示词了:Claude官方教你用4种循环,让AI自己干活

27. Claude Fable 5的227KB系统提示词,我替你读完了

28. 提示词写得越细越好?官方把自己的删掉了 80%

29. 提示词已死,循环当立:Claude Code官宣新范式

30. Claude 5 新规则:为何删掉超80%系统提示词

31. 各大AI的"底裤"被扒了,Claude/GPT/Gemini提示词全泄露

32. 系统提示词大瘦身之后,Claude Code反而效果更好了?

33. 删掉80%系统提示词反而更强:Claude Opus 5暴露了一个让对手睡不着觉的事实

34. 扒光大模型后台潜规则:GPT-5.6、Claude 4.8 等 10+ 模型系统提示词全泄露,连华盛顿邮报都在用

35. Claude Code 把系统提示词缩短 80%:好提示词正在从教程变回任务书

36. 【AI新手村】Anthropic承认提示词被砍80%

37. 80个顶级AI的系统提示词全泄露,我总结出5条通用设计模式

38. 12万字爆砍至500 token!泄露的Claude神级提示词,GPT和Gemini都能跑了

39. 同一句提示词,我让 Opus 5 和 4.8 各写了个飞机大战

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章