Anthropic发布Claude Opus 4.6:性能全面超越GPT-5.2,上下文窗口扩至100万token

源自39位全网作者

02-06 15:41

精选参考来源

1
召回率上去了 真的就不太需要精简//@高飞:现在的Claude 4.5写提示词,敢把整篇文章当few shot放进去。//@i陆三金:Anthropic 对齐微调专家 Amanda Askell 这段话可以参考,她说她的提示词经常超过 100 页。 评论配图 //@宝玉xp:回复@十三刺史部:这个确实的,理论值一百万不代表真的可以到一百万,而且上下文占用太多会影响效果,但我这提示词的长度对于Gemini来说不算什么//@十三刺史部:Gemini 2.5 pro变了!绝对没有百万tokens了。三四十万还是有的,再多就没有了//@宝玉xp:回复@七九三一:Gemini 2.5 Pro 是一百万tokens,这点长度完全不要担心影响上下文,当然确实有精简的空间//@七九三一:太长了,会吃掉很多上下文窗口,Gemini好用的上下文窗口大概也就是1万tokens左右,这个可能导致原文信息丢失。
2
Claude Opus 4.5 发布,最大的亮点是价格只有原来 Opus 4.1 的 1/3。定价为 $5 (输入) / $25 (输出) 每百万 token。另外它号称输出 token 减少了 76%。价格和Token减少这两点其实蛮重要的,因为虽然单价看起来还是比 Sonnet 贵,但如果你考虑到 Opus 4.5 完成同样的任务所需的 token 减少了(因为它更聪明,更少废话,一次做对),实际总成本可能并没有想象中那么高。这两周抓紧体验,现在 Anthropic 都是刚发布的前两周强的离谱,过段时间为了节省算力就会悄悄“量化”或“降智”。
全部
来源
内容由AI生成

精选参考来源

1. 召回率上去了 真的就不太需要精简//@高飞:现在的Claude 4.5写提示词,敢把整篇文章当few shot放进去。//@i陆三金:Anthropic 对齐微调专家 Amanda Askell 这段话可以参考,她说她的提示词经常超过 100 页。 评论配图 //@宝玉xp:回复@十三刺史部:这个确实的,理论值一百万不代表真的可以到一百万,而且上下文占用太多会影响效果,但我这提示词的长度对于Gemini来说不算什么//@十三刺史部:Gemini 2.5 pro变了!绝对没有百万tokens了。三四十万还是有的,再多就没有了//@宝玉xp:回复@七九三一:Gemini 2.5 Pro 是一百万tokens,这点长度完全不要担心影响上下文,当然确实有精简的空间//@七九三一:太长了,会吃掉很多上下文窗口,Gemini好用的上下文窗口大概也就是1万tokens左右,这个可能导致原文信息丢失。

2. Claude Opus 4.5 发布,最大的亮点是价格只有原来 Opus 4.1 的 1/3。定价为 $5 (输入) / $25 (输出) 每百万 token。另外它号称输出 token 减少了 76%。价格和Token减少这两点其实蛮重要的,因为虽然单价看起来还是比 Sonnet 贵,但如果你考虑到 Opus 4.5 完成同样的任务所需的 token 减少了(因为它更聪明,更少废话,一次做对),实际总成本可能并没有想象中那么高。这两周抓紧体验,现在 Anthropic 都是刚发布的前两周强的离谱,过段时间为了节省算力就会悄悄“量化”或“降智”。

3. Claude Opus 4.5 一夜打穿编程圈,并降价 2/3 (附 22 个 编程case 全能力测试)

4. 知名AI怀疑者和信仰者的碰撞,OpenAI可能会暴雷#Ai #Dario #Anthropic #OpenAI #AI泡沫

5. Claude Code Skills 采用了一种极其巧妙的三层上下文系统。请记住这个结构,当你构建技能(Skills)时会非常有用。第一层:主上下文(Main context)——项目配置,总是会被加载。第二层:技能元数据(Skill metadata)——只包含 YAML 前言部分,每个技能大约占用 100–200 个 token。第三层:活动技能上下文(Active skill context)——SKILL.md 文件以及按需引用的文档,在需要时才会加载。像脚本(scripts)和模板(templates)这样的支持文件不会被预加载到上下文中,而是在使用时直接访问,不消耗任何 token。这种架构让系统可以同时容纳数十个技能,而不会触及上下文长度限制。#人工智能##程序员#

6. Anthropic 性价比天花板来了,新模型 Claude Haiku 4.5 发布,只要 Sonnet 4 三分之一价格,就能实现同级编程能力。在 SWE-bench 测试中拿下 73.3% 高分,还比 Sonnet 4 更快两倍。API 定价仅为 $1 / $5 每百万 Token,主打低延迟、实时反馈,适合聊天助手、客服和 AI 编程工具等场景。Haiku 4.5 这次还新增了一个多模型协同,有点像项目经理带一群小模型同时干活。简单总结一下:Anthropic 把便宜又快做成了自己的新优势。如果 Claude 系列也分性价比天花板,这一代恐怕非它莫属。

7. gpt-5-codex 性能如何?

8. OpenAI 推出`GPT-5.2-codex`,其功能亮点有哪些?将对编程行业带来哪些影响?

9. OpenAI 重新发布 Codex,Huet 称未来的开发是和代码对话,对开发者们意味着什么?

10. Anthropic发布了最新模型 Claude Opus 4.5。主要是编程能力突破。在真实世界软件工程测试中超越GPT-5.1-Codex-Max等,而且支持8种编程语言开发,SWE-bench多语言基准7项领先。系统上也进化了,长程任务稳定性提升29%(Vending-Bench基准),新增多智能体协同管理能力,支持构建复杂系统。终端工具使用流畅度达行业新高度。价格也打下来了。输入/输出价格分别降至5/25美元/百万token,较上代直降67%,创顶级模型价格新低。

11. Claude全面禁中国企业?别怕,国产模型够顶! #大咖观察 #Claude #马斯克 #红衣聊AI

12. 【Anthropic官方出品:Claude Code实战课程全解析】Anthropic悄悄放出了一门官方课程,专门教你如何把Claude Code用到极致。15节课,1小时视频,还有测验和证书,干货密度相当高。课程地址:anthropic.skilljar.com/claude-code-in-action有人学完后整理了核心要点,值得收藏:快捷键与模式切换- Shift + Tab 按两次进入规划模式- Ctrl + V 可以直接插入截图(注意不是 Command + V)- 配合插件可以让Claude Code直接操作浏览器控制推理深度的魔法词在提示词中加入这些关键词,可以调节模型在任务上投入的token量:- "Think" — 基础推理- "Think more" — 扩展推理- "Think a lot" — 全面推理- "Think longer" — 延长推理时间- "Ultrathink" — 最大推理能力上下文管理- /clear 清空上下文- /compact 压缩上下文,可释放80%以上空间进阶扩展- 使用MCP服务器可以扩展工具集- 支持大量pre-hooks和post-hooks,在工具执行前后自动运行社区讨论中有个观点很有价值:课程没教的真正技能,是知道什么时候该重置上下文。很多人卡在问题里挣扎几小时,其实是在和"上下文腐化"作斗争,不如在完成一个里程碑后果断清空重来。还有人指出,/clear比/compact更彻底,该用哪个要看场景。当然也有老手表示,如果你已经每天高强度使用Claude Code,这门课的增量信息有限。但对于想系统入门或查漏补缺的人来说,官方出品的体系化内容,依然是最稳妥的起点。reddit.com/r/ClaudeAI/comments/1q1z5ke/want_to_learn_how_to_make_the_most_of_claude_code

13. Claude code + GPT5-codex 双管齐发的效果是否更好,还是单用好,怎样体验最好?

14. 盘点一周AI大事(11月30日)|AI自己剪片子 奥特曼预告下一代大模型Shallotpeat Anthropic发布最强编码模型Claude Opus 4.5 DeepSeek发布最强开源推理模型DeepSeek-Math-V2 微软开源最强行动智能体Fara-7B Black Forest推出最强开源图像模型Flux.2 阿里发布开源版小香蕉平替Z-Image 腾讯发布开源版Veo 3平替Tencent Harmony 字节开源AI剪辑大模型Vidi2 腾讯开源最强OCR模型HunyuanOCR 1B 科学家研发出最强数据分析智能体Edison Analysis RAI研发棒球陪练机器人 港科大训练出首个会打篮球的机器人 工程师开源家用机器人Aloha mini #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

15. 把手教你用上开源版Claude Code,Windows系统接入保姆级教程!

16. Claude Sonnet 4 支持百万上下文了,AI Coding 的想象力更大了

17. 盘点一周AI大事(11月2日)|OpenAI放出AGI时间表 OpenAI公布AGI路线图,202626年上岗AI研究员,能独立研究大型科研项目,2028年发布重大科研成果达成AGI,10年内冲刺超级智能 OpenAI正式重组为营利实体,估值1万亿 MiniMax推出最强开源大模型M2 字节发布最强通用游戏智能体Game-TARS Anthropic推出Excel分析师 Gemini上线一键做PPT Odyssey发布能实时交互的视频模型Odyssey-2 Adobe推出一键P视频Frame Forward 科学家研发出热力学采样芯片架构TSU,能效提升1万倍 奥特曼押注非侵入脑机接口,用超声波直接读取意念 马斯克的脑机接口Neuralink即将开启人脑增强实验 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

18. 【上下文工程实战指南:如何让AI代理真正听懂你的话】“AI垃圾输出”的锅,现在该用户来背了。在Claude Code这类黑箱系统中,上下文是我们唯一能控制的输入变量。既然如此,如何优化它就成了关键问题。+ 什么是上下文?上下文指的是你发送消息时提供给大语言模型的一切——不仅是提示词本身,还包括系统提示、元数据、历史对话、模型的思考过程、工具调用和响应。大模型的上下文窗口有限,对话越长,追踪信息的准确度就越低。Claude Code的上下文窗口看似有20万token,但实际可用空间远没那么多。运行/context命令就能看清真相:22.5%被预留,10.2%被系统提示占用,加上MCP服务器、子代理和规则,真正留给我们的只有约12万token。更关键的是,无论是否接近窗口上限,上下文越多,模型质量就越差。+ 基础功夫最重要和大多数事情一样,820法则同样适用于vibe coding。做好以下基础,你就已经完成了80%:- /upgrade升级到Max计划- /model选择opus 4.5- /init创建项目说明文件然后是基本工作流:1. 从计划模式开始(Shift + Tab)2. 让Claude通过提问来澄清模糊点3. 执行经过打磨的计划创建子代理、自定义命令、钩子、多代理编排确实很酷,但说实话,没有我们想象的那么重要。掌握基础才是核心竞争力。+ 如何实际运用这套工作流把每次新对话当作一个目标,严格控制范围:-“我要修复这个bug”-“我要构建这个功能”对于新项目,目标可以更宽泛,但这意味着需要更多规划和打磨——因为模糊性越大,误解空间就越大。多花时间规划,再多花时间打磨规划。让Claude不断提问,直到它开始为问而问。请它多次审查计划,讨论架构、最佳实践、安全风险、生产就绪度、测试策略——目标是在每个模糊点提供细节。+ 何时重置,如何重置如果进展顺利且后续任务与当前上下文相关,继续就好。接近上下文上限时,运行/compact释放空间,或让Claude Code自动处理。但如果事情不顺利呢?模型没做对,你陷入了“这太糟糕了请修复”→垃圾输出→“这更糟糕了你在想什么”→垃圾输出的循环。这时不要试图在同一线程中挽救,而是:- /rewind回到进展顺利的节点- /new开启新线程,优化原始提示词,明确指出“不要做什么”——把上次的教训写进去+ 避开复杂性陷阱如果你常刷社交媒体,可能已经收藏了无数花哨设置——MCP服务器、子代理、技能包……我的建议是:不要过度复杂化。正如Anthropic所说,我们的目标是“找到最小的高信号token集合”。往上下文塞太多MCP数据,只会用低信号填满窗口,同时烧掉你的钱。+ 善用MCP服务器获取优质上下文MCP服务器本质上是让模型能调用的第三方工具——文档、GitHub代码、Linear工单、Figma设计等。这类工具刚推出时被热捧,但人们很快发现很多会疯狂消耗上下文,得不偿失。我目前只用三个经过验证的:- exa.ai:AI代理的网络搜索- context7:AI代理的最新文档- grep.app:AI代理的GitHub搜索我主要用它们研究如何正确实现代码——这些事我自己查文档也能做。Anthropic把这称为“即时上下文”策略——代理在需要时自己寻找信息。这对Claude Code这类代理式编码工具非常有效。+ 用子代理节省上下文——我最喜欢的隐藏技巧Claude Code可以创建子代理——作为主代理的子实例运行。关键在于:- 子代理拥有独立于主代理的上下文窗口- 可以使用不同模型(比如非opus)这意味着我们可以让子代理执行消耗大量token的操作(如研究),然后向主代理提供精炼摘要——信息密度高,token消耗低。我最常用的是一个自定义的“图书管理员”子代理,运行sonnet模型扫描开源仓库和文档,向主代理返回精炼摘要。我会说:“用librarian研究如何用Y库实现X,然后实现Z”——子代理触发,调用所有工具找到高质量答案。这既防止主上下文被污染,又用更便宜的模型完成简单任务。+ 用技能包引入相关上下文技能包与子代理相反——不是把任务委派给专门代理,而是把专业能力引入当前代理的上下文。比如Claude Code内置的“前端设计师”技能,会引入一段较长的提示词,告诉Claude前端设计的注意事项。这些工作流听起来花哨,但原理很简单——Claude只是在认为需要时,把一段文本拉入上下文。+ 核心要义好的vibe coding是为价值密集的上下文而优化。你添加或从模型接收的任何信息,都应简洁地服务于帮助模型回答下一个请求。如果做不到这点,就不应继续在同一上下文中工作——这是避免陷入令人沮丧的垃圾输出循环的关键。社交媒体上那些花哨命令可能让你觉得自己落伍了。但实际上,事情没那么复杂——尽力用简洁、高质量的信息帮助模型,给它工具让它自己找到相关信息。就像你对待一位同事那样。x.com/jarrodwatts/status/1926054877836624014

19. Anthropic 预计 2026 年的年化收入将达到 260 亿美元,你看好该企业吗?

20. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型

21. Claude Opus 4.6 发布,全线碾压 GPT-5.2,一文详解

22. Claude Opus 4.5发布!2小时工程测试超人类

23. Anthropic发布Claude Opus 4.5:编程能力超过专业工程师!

24. Claude Opus 4.5 深夜突袭,AI 编程进入「超人时代」

25. Claude Opus 4.5发布!2小时工程测试超人类

26. Claude Opus 4.5 发布即登顶 智能体能力遥遥领先

27. Claude Opus 4.5 重磅发布:编程能力碾压人类 - 哔哩哔哩

28. Claude Opus 4.5 正式发布,AI 编程进入超人时代

29. Claude Opus 4.5发布!降本增效, 还推出 Claude For Chrome、Claude For Excel

30. Anthropic发布Claude Opus 4.5,编程性能全面提升

31. Claude Opus 4.5正式发布。Anthropic 正式发布了最新模型 Claude Opus 4.5。Claude Opus 4.5 非常智能高效,在编程、智能体以及计算机操作方面表现卓越,是当今世界最优秀的模型。该模型在深度研究、处理幻灯片与电子表格等日常任务上也有显著提升。Claude Opus 4.5 即可以通过 Claude app、API 以及三大主流云平台访问。如果你是开发者,只需通过 Claude API 使用 claude-opus-4-5-20251101 即可。 关于价格,Claude Opus 4.5 的最新定价为每百万 Token 5/25 美元(输入 / 输出),使更多用户、团队和企业都能轻松获得 Opus 级别的能力。可以看到,与上代 Opus 4.1 相比,API 定价降低了 2/3。#最新消息 #claude #编程 #AI编程 #gemini

32. Anthropic 发布 Claude Opus 4.5

33. Claude Opus 4.5全网反馈报告:Opus 4.5 vs GPT 5.1 vs Gemini 3

34. Claude Opus 4.5发布内容概览

35. 下放!Opus 4.5 在Claude Code 20刀订阅中可用

36. Claude 最新指南:从 Claude 4.5 Opus 深度评测到国内直连入口 (2025 最新)

37. 全网最全Claude国内使用攻略:从Sonnet 3.5到Opus 4.5,这个Claude镜像站全覆盖

38. Claude 中文版:Claude 4.5 国内使用指南~(支持 Claude Sonnet 4.5 和 Claude Opus 4.5)【12月更新】

39. ClaudeAPI哪个家好?Claude-Opus-4.5 极速接入与落地实战

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章