张大妈

Claude Managed Agents能省下数月工程量,却可能锁死你的定制化需求

源自50位全网作者

04-13 12:26

内容由AI生成

精选参考来源

1. Claude Opus 4.6 刚发布就用 Claude Code 写项目,有哪些要注意的吗?

2. 在国内如何使用Claude Code进行编程?

3. Claude自己写出Claude!2小时干完两月活,人类在工位上多余了?

4. 开源版Cowork爆火,逼得Anthropic下放Cowork

5. Claude Code真的那么厉害吗?

6. 《Building AI Agents with Google Gemini 3 and Open Source Frameworks》AI代理正从简单聊天机器人进化为具备复杂决策能力的半自主系统。谷歌最新发布的Gemini 3 Pro Preview,成为推动这一变革的核心引擎。它不仅提升了推理深度和多模态处理能力,还通过“思维签名”技术确保多步骤操作不丢失上下文,实现高效稳定的任务执行。Gemini 3支持开发者灵活控制成本、延迟和推理深度,满足不同场景需求。其大上下文窗口有效防止“推理漂移”,让代理在长时间对话中保持逻辑一致。更重要的是,谷歌携手开源社区,实现了LangChain、Vercel AI SDK、LlamaIndex、Pydantic AI和n8n等主流框架的Day 0支持,助力开发者快速构建下一代智能代理。- LangChain通过图形化工作流,支持多角色复杂代理开发。- Vercel AI SDK以TypeScript为基础,优化代码生成和推理性能,助力现代前端框架。- LlamaIndex专注知识型代理,强化数据交互与索引能力。- Pydantic AI结合Python类型安全,提升代理数据的可靠性和可维护性。- n8n赋能非技术团队,无需编码即可打造智能自动化流程。使用Gemini 3时,建议简化提示语,开启thinking_level参数调控推理深度,保持temperature为1.0以保证性能,严格管理思维签名的传递,合理设置多模态分辨率以节省计算资源。详细开发指南中包含迁移建议和API新特性,助力顺利升级。Gemini 3不仅是技术升级,更是智能代理迈向实际应用的关键一步,推动AI更好地服务于复杂业务和多样场景。原文:developers.googleblog.com/building-ai-agents-with-google-gemini-3-and-open-source-frameworks/

7. 笑死!xAI员工竟用Claude写代码?这回Anthropic反手拔了马斯克的网线

8. 如何看待2026年2月24日Anthropic公司声称中国实验室对Claude模型大规模蒸馏并点名?

9. #Google 正式发布 Gemini 3:面向开发者的最强推理与 Agentic 模型# Google 在官方开发者博客(https://blog.google/technology/developers/gemini-3-developers/)正式宣布推出 Gemini 3 系列模型,并立即向开发者开放 Gemini 3 Pro(Preview)版本。Google 称其为“目前最智能的模型”,在推理能力、Agentic(代理式)能力、多模态理解以及编程任务上实现全面突破,标志着“Gemini 3 时代”的开启。 核心亮点与技术跃进 Gemini 3 Pro 在几乎所有主流评测中位居第一,相比 Gemini 2.5 Pro 有显著提升,主要体现在以下几个方面: 1. 推理能力大幅增强 - 拥有最先进的推理能力(state-of-the-art reasoning) - 擅长复杂指令遵循、深度工具调用、“Vibe Coding”(用自然语言描述感觉就能生成完整应用) - 新增 thinking level 参数,可在多轮对话中保留思考过程,实现更连贯的 Agentic 工作流 2. 多模态理解达到新高度 - 在 MMMU-Pro(图像推理)、Video MMMU(视频理解)等基准刷新纪录 - 支持超长视频高帧率采样 + 百万 token 长上下文,可精准回忆长视频细节并合成叙事 - 文档理解超越传统 OCR,支持空间推理、指向、轨迹预测等具身任务 - 屏幕理解(桌面/手机/OS)能力极强,可直接从截图或视频理解用户意图并执行操作 - 新增媒体分辨率精细控制,开发者可按延迟与成本需求动态调整 3. 超大上下文窗口 - 保持 100 万 token 上下文窗口,在长文档、长视频、超大规模代码库场景下表现优异 4. Agentic 与工具使用能力 - Terminal-Bench 2.0(工具使用)得分 54.2% - WebDev Arena 排行榜 Elo 分数 1487,领先 Claude Sonnet 4.5、GPT-5.1 等竞品 - 支持实时 Google Search grounding、URL 上下文、结构化输出,可轻松构建抓取-提取-推理完整代理流程 开发者立即可用:接入方式与价格 - 立即体验:Gemini 3 Pro(Preview)已在 Google AI Studio 和 Vertex AI 上线 - Google AI Studio 免费试用(有速率限制) - 企业用户通过 Vertex AI 接入生产环境 - 预览期价格(特惠): - ≤200k token 提示:输入 $2/百万 token,输出 $12/百万 token - 详细价格与限额请参考官方文档 - 新工具与生态集成: - Gemini CLI 新增客户端 Bash 工具,可让模型直接提出并执行 shell 命令 - 服务端托管 Bash 工具(目前限早期合作伙伴,很快全面开放) - 已深度集成 Android Studio、Cursor、GitHub、JetBrains、Cline、Manus、Google Antigravity 等主流开发工具 - 支持流式输出、函数调用、思考过程保留、多轮 Agent 协作等 单提示生成完整应用的惊艳案例 博客中展示了多个“一句话生成完整可运行应用”的极端案例: - 用一句提示生成完整可玩的复古游戏(Synthwave Space) - 从潦草手绘草图或语音备忘录直接生成交互式落地页或完整 App - “Bring any idea to life” 应用:上传任意图片/视频,模型自动理解并生成对应代码 - Visual Computer 演示:模型实时观察屏幕内容,理解意图并自动操作 总结与展望 Gemini 3 Pro 的发布标志着 Google 在大模型竞赛中再次大幅提速,尤其在开发者最关心的推理深度、Agentic 能力、多模态长上下文、工具集成四大领域实现全面领先。Google 明确表示:“这只是 Gemini 3 时代的刚刚开始。”后续将快速推出 Gemini 3 Flash(轻量版)、更强多模态能力以及更低价格。 对于开发者来说,现在就是上手的最佳时机——直接前往 Google AI Studio 搜索 “gemini-3-pro-preview” 即可免费体验目前最强的商用大模型之一。Google 用真实基准分数和惊艳 Demo 证明:Gemini 3 正在重新定义 AI 辅助开发的极限。

10. 外网刷屏的 Claude Code 教程

11. 《Writing a good CLAUDE.md》大型语言模型(LLM)如Claude在每次会话开始时是“无状态”的——它们不会记忆之前的对话,只能依赖你当次输入的内容了解项目。因此,CLAUDE.md文件承担了“入门手册”的角色,负责向Claude介绍项目的背景、结构和工作方式。一个好的CLAUDE.md应清晰回答三个问题:- WHAT:项目技术栈、代码结构,尤其是多仓库时需要指出各部分职责;- WHY:项目目的和各模块功能;- HOW:如何操作项目,比如使用的构建工具、测试流程等。但写法很关键。文件太长或包含过多细节,Claude可能会选择忽略部分内容,因为Claude Code在系统提醒中会告知模型“只有高度相关时才用此上下文”,避免被无关指令干扰。太多无关指令反而影响效果。因此,遵循“少即是多”的原则至关重要。研究显示,顶尖LLM能稳定处理约150-200条指令,且越多指令,执行质量越下降。CLAUDE.md应只包含对所有任务普遍适用的核心内容,避免将所有风格指南、命令一股脑塞进去。为解决大项目中信息过多问题,推荐采用“渐进披露”策略:将特定任务说明拆分成多个文件,CLAUDE.md只提供文件列表和简要说明,让Claude按需调用,从而避免上下文膨胀。另外,别让Claude当代码风格检查器。代码格式和风格应交给专门的工具(如Biome)处理,既节省算力又保证效率。可以用钩子或命令将格式化和检查结果反馈给Claude,而不是让它自己找错。最后,别用自动生成工具随便产出CLAUDE.md。它影响所有后续工作流程和产物,必须认真打磨每一句话,确保精准传达项目核心。总结:CLAUDE.md是让Claude“入职”项目的关键文件,需简洁、聚焦、实用。只告诉Claude最重要的事,教它如何自己找信息,避免信息过载。用好CLAUDE.md,才能发挥AI编程助手的最大潜力。原文:humanlayer.dev/blog/writing-a-good-claude-md

12. 谷歌最新发布Gemini 3 Pro,被誉为“全球最智能的模型”,能够赋予你创意以生命。它在大多数基准测试中表现领先,真正的价值体现在谷歌自家的AI Studio、Gemini API和Gemini App等产品中,带来前所未有的智能体验。 Gemini 3 Pro不仅刷新了多个指标,部分性能提升高达50%甚至100%,仅有一个指标略逊于竞争对手。这背后体现了谷歌在AI技术深耕细作的实力,也引发了业界对AI未来潜力的广泛关注。 许多开发者和用户在试用后表示惊喜,尤其是它在代码处理、多语言支持和交互体验上的表现,极大提升了工作效率和创造力。同时,也有声音关注价格和使用限制,期待更广泛的开放和优化。 从这次发布可以看出,AI正逐步从“工具”升级为“智能伙伴”,它不仅能帮助我们完成任务,更能激发新的可能。未来,如何用好这些智能模型,打造个性化、互动性强的应用,将成为AI发展的关键。 正如业内专家所言,Gemini 3 Pro让“AGI”(通用人工智能)的梦想更近一步——智能不仅是能力的堆积,更是赋予机器理解和创造的生命力。 想深入了解?可查阅谷歌开发者博客:blog.google/technology/developers/gemini-3-developers 原推文链接:x.com/OfficialLoganK/status/1990813077172822143 这不仅是技术升级,更是智能时代的新起点。AI的未来,值得我们每个人期待和参与。

13. 谷歌洽谈加大对 Anthropic 投资,这背后有哪些战略考量?

14. Claude Code、Cursor、Trae、OpenCode怎么选?

15. 51万行源码泄露!Claude Code 里面到底藏了什么?

16. 如何看待Anthropic的新模型Mythos?

17. 如何评价Anthropic的下一个模型Claude Mythos?

18. OpenClaw 最佳模型选择:用 Claude Opus 4.6 配合 Anthropic 模式获得最强 Agent 效果

19. OpenAI 计划今年第四季度 IPO,目标抢在 Anthropic 之前,如何解读?

20. Claude Code 的 “CLAUDE.md” 配置指南www.humanlayer.dev/blog/writing-a-good-claude-md因为大语言模型(LLM)本身是无状态的 —— 它并不会记住先前会话或项目的信息,每次新会话它对你的代码库毫无“背景知识”。所以为了让 Claude Code “了解”你的项目结构、目的、依赖、构建/测试命令,以及你对编码风格/流程/测试/构建/运行方式等的期望,就必须借助 CLAUDE.md。 CLAUDE.md 越简洁、越聚焦、越“通用适用”越好。如果将太多针对特定任务或细节的规则填进 CLAUDE.md,反而可能让模型忽略整个文件,因为它在系统层会把它当作“可能不相关”。 作者推荐仅在 CLAUDE.md 中放入项目的总体 “WHY / WHAT / HOW”(项目目的、整体架构/技术栈、核心构建/测试/运行流程),以及一些对所有任务都通用的重要规范——然后把其它更细节、任务/模块专属的说明放在独立 markdown 文件中(例如 code_conventions.md、testing.md、architecture.md 等),并在 CLAUDE.md 中以引用/说明的方式指向它们。这样既能保持上下文整洁,也能让 Claude 在真正需要的时候按需读取。#科技先锋官#

21. Anthropic发布史上最强模型:Claude Mythos Preview,但遭禁用

22. Claude Code中没用过Hooks?那你可真是丢了个神器

23. 盘点一周AI大事(3月1日)|龙虾开车跑滴滴 工程师开发出首个能自主进化的龙虾Ouroboros Anthropic官宣龙虾摩尔定律 Claude全面升级为龙虾 Cursor上线程序员龙虾Cursor cloud agents Perplexity上线云端龙虾Perplexity Computer MiniMax上线云端龙虾 MaxClaw 阿里开源国产龙虾CoPaw Standard Intelligence发布最强电脑操作模型FDM-1 Confluence实验室开源通用求解龙虾 Google上线最强生图模型Nano Banana 2 Quiver发布最强矢量图模型 Arrow 1.0 Meta开源最强矢量字体模型VecGlypher 英伟达发布VR视频模型Generated Reality 研究员开源VR老婆Sarah #抖音年味新知贺岁 #前沿科技趋势发布月 #AIGC #龙虾 #openclaw

24. 把手教你用上开源版Claude Code,Windows系统接入保姆级教程!

25. Claude Code 创始人再放狠货!15 个隐藏功能曝光

26. 如何编写一份优秀的 CLAUDE.md

27. github.com/Piebald-AI/claude-code-system-prompts这是一个专门收集 Claude Code 系统提示词(System Prompts)的开源项目。包含了 40 多个提示词,涵盖了 Claude Code 的方方面面部分如图。#科技先锋官#

28. Claude Code开始失忆了?两大记忆神器帮你选

29. Anthropic 社区负责人连更31条Claude Code技巧!比Claude Code创始人私藏的还硬核

30. Anthropic发布 Cowork,给普通人用的Claude Code

31. 9个最佳的Claude Code提效项目1. Superpowers网页链接Superpowers是Claude Code的增强插件,提供快速原型开发和迭代编码能力。2. Awesome Claude Code网页链接精选的Claude Code资源、技巧、提示词、工具和集成的完整列表。3. GSD (Get Shit Done)网页链接轻量级任务自动化框架,帮助Claude Code高效完成日常开发工作流程。4. Claude Mem网页链接为Claude Code添加持久化内存能力,自动跨会话保存上下文,减少重复信息输入。5. UI UX Pro Max网页链接AI驱动的设计系统生成器,根据产品类型自动推荐配色、排版、布局和组件模式。6. n8n-MCP网页链接为Claude提供n8n自动化工作流的完整文档和API访问,让Claude能设计和部署复杂的自动化。7. Obsidian Skills网页链接Obsidian笔记软件的Agent Skills,使Claude Code能直接创建和编辑Markdown、Canvas和Bases。8. LightRAG网页链接轻量级检索增强生成框架,通过知识图谱和向量检索为Claude Code提供更精准的信息检索。9. Everything Claude Code网页链接production级Agent框架,包含28个专业子Agent、116个技能、59个命令和完整的安全审计系统。#HOW I AI# #程序员# (via. Hasan Toor)

32. Spotify 语出惊人:得益于 AI,我们最顶尖的开发者从去年 12 月起就没亲手写过一行代码From:TechCrunchAI 编程是否已经到达了引爆点?对于 Spotify 来说,答案似乎是肯定的。在本周举行的第四季度财报电话会议上,Spotify 分享了一个令人咋舌的消息:公司里最优秀的开发者“自去年 12 月以来,就没有写过哪怕一行代码”。这番言论出自 Spotify 联合首席执行官 Gustav Söderström 之口,背景正是该公司正在利用 AI 全面加速产品研发。值得注意的是,Spotify 指出他们在 2025 年全年为这款流媒体应用发布了超过 50 项新功能和改进。而且就在最近几周,他们又密集推出了一系列新功能,比如由 AI 驱动的“提示词播放列表”(Prompted Playlists)、针对有声读物的“页面匹配”(Page Match),以及“关于这首歌”(About This Song)。为了实现如此惊人的产品迭代速度,Spotify 告诉分析师,他们的工程师正在使用一套名为“Honk”的内部系统。这个系统允许利用生成式 AI——具体来说是 Claude Code——来实现远程、实时的代码部署。Söderström 举了一个非常具体的例子,画面感极强:“想象一下,一位 Spotify 的工程师在早上通勤的路上,只需要掏出手机,在 Slack (一款类似飞书、钉钉的企业办公协作软件) 上告诉 Claude 去修复一个 Bug 或者给 iOS 应用加个新功能。当 Claude 完成工作后,工程师的手机 Slack 上就会收到一个新版本的应用安装包。他可以直接测试,然后合并发布到生产环境——而这一切,甚至发生在他还没踏进办公室大门之前。”Spotify 认为,这套系统在加速编程和部署流程方面功不可没,效率提升是“巨大”的。“我们预见,这绝不是 AI 开发模式的终点,而仅仅是个开始,”Söderström 说道。这位高管还吹捧了 Spotify 构建独特数据集的能力,这是其他大语言模型(LLM)无法像抓取维基百科那样轻易将其变成通用商品的。他解释说,因为音乐相关的问题并不总有一个绝对的事实答案。举个例子,如果你问“什么是健身音乐?”,不同的人会给你完全不同的答案,这往往取决于他们住在哪里。美国人总体上偏爱嘻哈音乐,但也有数以百万计的人喜欢伴着死亡金属(death metal)锻炼;很多欧洲人喜欢电子舞曲(EDM),而许多斯堪的纳维亚人 (北欧人) 则对重金属情有独钟。“这是我们目前正在构建的一个数据集,其他人都没有真正在做。这种规模的数据集是独一无二的。而且我们看到,每次重新训练模型时,它的表现都在提升,”Söderström 指出。电话会议上的分析师还询问了 Spotify 对 AI 生成音乐的态度。公司解释说,他们允许艺术家和唱片公司在歌曲的元数据中标记这首歌是如何制作的 (比如是否使用了 AI 辅助),但平台依然会严格监管,打击垃圾内容。来源:网页链接----【附加】Claude Opus 4.6 对这条新闻的分析:Söderström 的原话其实比标题温和得多。他的完整表述是:"When I speak to my most senior engineers, the best developers we had, they say that they haven't written a single line of code since December. They only generate code and supervise it." 注意两个关键限定词——"most senior"和"they say"。这是在财报电话会上转述他与资深工程师的对话,不是一个经过验证的全公司统计数据。TechCrunch 的标题把它变成了 "Spotify says its best developers haven't written a line of code",一下子从个人谈话变成了公司官方声明的语气。你应该注意的几个"水分"第一,这是财报电话会上的发言。分析人士直接指出,这是 co-CEO 在股价承压的背景下,向华尔街分析师定位公司为 AI 领导者的言论,天然带有最大化投资者影响的动机。 Spotify 股价近期因为 AI 对其业务的看空预期大跌,高管急需讲一个"我们也是 AI 受益者"的故事。第二,"没写一行代码"和"没做任何工作"是完全不同的事。实际上这些工程师的角色变成了定义需求、审查 AI 生成的代码、做架构决策,然后审批输出。 这更接近于"从手写代码转向了用自然语言指挥 AI 写代码"——本质是工具切换,不是什么革命性的颠覆。第三,他们的内部系统 Honk 之所以能运作,前提是 Spotify 花了多年时间建设成熟的 CI/CD 管线、自动化测试、代码所有权管理(通过 Backstage 开发者门户),以及完善的代码审查流程。这个基础设施投入是绝大多数公司不具备的。标题暗示任何公司的顶级开发者都可以"不写代码"了,实际上离开这套基础设施根本跑不起来。第四,所谓"50 多个新功能"听着很多,但 Spotify 体量的公司一年发 50 个功能并不算夸张,这不是一个能证明 AI 带来了质变的数字。Tobi Lütke 那封备忘录的对比Shopify 那封备忘录(2025 年 4 月)其实比 Spotify 这次的财报发言务实得多。Lütke 的核心观点是 AI 使用应该成为 Shopify 员工的"基本期望",在申请新人力之前必须先证明 AI 无法完成这项工作。 两者的区别在于:Tobi 是在对内设定预期和行为标准,语气是"你们必须学会用 AI";而 Söderström 是在对外(投资人)讲故事,语气是"看,我们已经 AI 化了"。但两者也有共通之处——都反映了科技公司高管正在用"AI 取代编码"这个叙事来达成各自目的:Tobi 用它推动组织变革,Söderström 用它提振投资人信心。真实情况大概是:Spotify 的高级工程师确实在大量使用 Claude Code 这类工具,把日常编码工作交给 AI 完成,自己做审查和决策。这是一个真实的趋势转变。但"没写一行代码"这个说法是财报会上为了戏剧效果而做的简化表述,既不能证明 AI 已经完全替代了开发者,也不代表其他公司可以照搬这个模式。说到底,这更像是一个工具升级的故事,被包装成了一个"范式革命"的叙事——这在财报季是再常见不过的事了。

33. OpenAI Codex 团队的 Nick Baumann 分享了一个他日常用 Codex 干活的心得:与其每次把一堆文档、日志、API 输出丢给 AI 去啃,不如给它造几个专用的命令行小工具。他的逻辑很直接:MCP 连接器(比如 Slack、Linear、Sentry 这些)解决的是“能不能访问”的问题,但很多时候原始数据太大、太杂,AI 拿到手也处理得费劲。这时候更好的做法是把常用操作封装成一个带参数、输出 JSON、有帮助文档的 CLI 命令。Codex 本身就擅长用命令行,它会搜索、会加 flag 筛选、会把上一个命令的结果串到下一个命令里,不需要你教它怎么调。他自己实际在用三个这样的 CLI:【1】codex-threads:检索自己以前的 Codex 对话记录Codex 的会话存档噪音很多,直接让 AI 读原始记录又慢又乱。他做了个工具在本地建索引,可以搜索、定位、读取历史会话。典型用法是找到一次做得好的对话,然后把里面的模式提炼成 skill(可复用的工作指南)。【2】slack-cli:在 Slack 里精准找信息场景很具体:有人在某个 Slack 频道讨论过一个技术决策的理由,你知道讨论过但找不到在哪。这个 CLI 可以让 Codex 搜索、定位到具体的消息链、拉上下文、引用关键消息。它底层还是走 Codex 的授权网关,权限没变,只是把交互方式从扔一坨聊天记录变成了一条命令拿到你要的东西。【3】typefully-cli:写推文和排期发布他用 Typefully 管理社交内容,但不想每次都让 Codex 重新学一遍 Typefully 的 API。于是让 Codex 读 API 文档,编译出一个 Rust 写的小 CLI,只暴露他常用的几个操作。配套的 skill 里还写了一条规矩:不许自动发布、排期或删除内容,除非他明确要求。他把整个方法论总结成了一篇教程发到 OpenAI 开发者文档上,还配了一个 cli-creator skill 帮你用 Codex 自己造 CLI。这个思路对用 Claude Code 的人同样适用。核心就一句话:如果你发现自己反复在给 AI 喂同一类乱糟糟的数据,那就别再解释了,给它造个命令。Codex 团队还搞了一个 Skill 叫 cli-creator:developers.openai.com/codex/use-cases/agent-friendly-clis 网页链接github.com/openai/skills/tree/main/skills/.curated/cli-creator 网页链接#硅基茶水间装修日志#

34. Claude Managed Agents 是 Anthropic 推出的预构建、可配置代理框架,运行在托管基础设施之上,专为长时间运行任务和异步工作负载设计。与 Messages API 的直接模型提示访问不同,该方案提供完整的代理循环、工具执行和运行时环境,让开发者无需自行构建沙箱或基础设施即可

35. Claude Managed Agents-把Agent运行环境、工具链和长任务一起托管

36. 生产级ClaudeCode子代理团队实施手册公开!30天,发布速度提3倍

37. Anthropic推Harness框架 AI长程开发效率翻倍

38. Claude搞因果分析

39. Claude封杀龙虾后推自家Agent服务,又被开源平替了

40. Claude 4月9日上线托管代理:30分钟搭完别人3个月的活

41. Claude 4月9日上线托管代理

42. 月薪2万的工程师,Anthropic说6毛钱就能替代

43. 2025年Claude Code最佳实践(Claude Code Best practices):全面解析与实战指南

44. Claude Code用户实测:这10个命令行工具让效率翻倍

45. 适用所有团队研发提效|带你1分钟上手基于Claude Code的AI代码评审实践

46. OpenAI把Claude写的代码查出漏洞

47. Claude封杀龙虾后推自家Agent服务,又被开源平替了—顶端新闻

48. Anthropic发布Claude Managed Agents 解耦架构重塑长周期任务处理

49. Claude Managed Agents发布:AI Agent部署进入托管时代

50. Claude Code被产品经理当「实习生」用了3周,结果扎心了

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章