8. ClaudeCode×Opus4.8更新。Opus4.8这次主要在诚实性、动态工作流、编程能力、Effort Control等等上做了更新。
我比较关注的点有几个:
第一,它更诚实了。
Anthropic 官方提到,Opus 4.8 更可能标出自己工作里的不确定性,也更少在证据不足的时候直接下结论。官方评估里,它比上一代更不容易放过自己写出来的代码缺陷。
第二,长链路 coding 和 agent 任务更稳了。
官方文档里写到,Opus 4.8 相比 Opus 4.7,在 long-horizon agentic coding 上做了改进,包括更好的长上下文处理、更少的 compaction,以及 compaction 后更好的恢复能力。
第三,工具调用更可靠了。
官方说,Opus 4.8 减少了“任务明明需要调用工具,但模型跳过工具调用”的情况。这个对 Claude Code、agent 工作流、自动化任务都挺关键。
第四,effort 机制变得更重要了。
Opus 4.8 的默认 effort 是 high,而且这个默认值适用于所有 surface,包括 Claude API 和 Claude Code。官方也说,在 coding 和高自主任务里,可以显式设置 xhigh。
第五,用户可以在速度和思考深度之间做选择。
官方说,claude.ai 和 Cowork 里新增了 effort control:更高 effort 会让 Claude 更频繁、更深入地思考;更低 effort 则响应更快,也更省 rate limit。
第六,Claude Code 里有了 dynamic workflows。
这是一个 research preview 功能,官方描述是:Claude 可以先规划任务,再在一个 session 里运行上百个并行 subagents,最后在汇报前验证输出。这个功能面向 Claude Code 的 Enterprise、Team 和 Max 计划。
第七,1M 上下文窗口默认支持,但平台有差异。
官方文档写的是:Opus 4.8 在 Claude API、Amazon Bedrock 和 Vertex AI 上默认支持 1M token context window;Microsoft Foundry 上线时是 200k。
第八,prompt cache 的门槛降低了。
Opus 4.8 的 minimum cacheable prompt length 降到了 1,024 tokens,所以一些在 Opus 4.7 里太短、不能缓存的 prompt,现在也可以创建缓存。
第九,API 侧支持中途插入 system 指令。
官方文档写到,Opus 4.8 允许在 messages 数组里,在 user turn 后插入 role: "system",这样开发者可以在长任务过程中更新指令,同时保留前面 turn 的 prompt cache。
第十,拒绝信息的分类更清楚了。
官方说,stop_details 现在公开文档化,当 Claude 拒绝完成某个请求时,开发者可以看到更具体的拒绝类别,方便应用做后续处理。
我的感觉是,Opus 4.8 不是单点功能爆炸,而是一次“工作流稳定性”的更新:
更诚实、会自查、适合长任务,适合放进 Claude Code 这种多步骤 agent 工作流里。
#我在抖音聊科技 #claudecode #opus48 #vibecoding #ai新星计划