Agent技能真能简化日常任务吗?全网观点大PK

源自206位全网作者

02-19 15:06

内容由AI生成

精选参考来源

1. 一文了解 Agent Skills

2. 快速了解Agent Skills,普通人也可以让AI成为技能专家

3. 5分钟速通Agent Skills,嘎嘎简单!

4. 一种更智能的AI指令方式

5. 别再死磕Prompt了!2026年AI协作新范式

6. Agent Skills入门指南

7. Claude Skills 是什么?为什么一个目录就能改变 Agent 的上限?

8. 三层架构革命,Anthropic如何用AgentSkills砍掉90%重复开发

9. 为什么 Agent Skills 让 AI Agent 更专业高效和更省钱?一文解读 Agent Skills

10. 告别提示词膨胀

11. Agent Skills使用指南

12. 快速了解一下 Anthropic 最新推出的 Agent Skills,它比 MCP 更重要,也更有用

13. Anthropic “Agent Skills智能体解析1

14. Anthropic免费Skills指南宣告提示工程过时?

15. Agent Skills 管理屠龙刀

16. Agent Skills 爆发

17. Agent Skills外挂能力插件箱

18. Agent Skills 的概念、机制和应用方法

19. 如何给AI员工写“技能书”(Agent Skills)——数据脱敏案例

20. Agent Skills 到底是什么?给 AI 配一套能反复用的“工作流程”

21. Agent Skills在货拉拉AI应用尝试

22. Skills 全攻略

23. Agent Skills 简易实战讲解

24. Cursor Agent Skill

25. 一文详解Agent Skills到底是什么(快速入门Agent Skills)

26. Agent Skills 手把手教学

27. 一文读懂 Agent Skills

28. 什么是 agent skills

29. 2026年1月份快过去了,你还没用Agent Skill吗?

30. 停止造Agent,开始造Skills吧!Claude Skills创造者

31. Agent skills

32. 在 VScode 中玩转 Agent Skills(科研工作者必备skill推荐,一定要收藏)

33. 告别 Prompt 依赖,拥抱标准化

34. 新手指南,如何在 15 分钟内搞定 Agent Skills 设置

35. 用 Skill 驱动 Agent

36. Agent Skills 终极指南

37. Skills vs MCP

38. Agent Skills

39. Agent Skills

40. skills

41. 新增 500 行代码,我实现 Agent Skills 渐进式加载,原理一目了然,这掌控感极好

42. Claude 新发布的 Agent Skills 到底是啥?居然比 MCP 还厉害?

43. 爆肝一周!我用AI + Agent Skills 5分钟写出实盘量化策略

44. 为什么Anthropic说

45. AI skills是什么?

46. agents和skills 分不清?一文告诉你

47. Agent Skills

48. 新概念也许你已经知道了,AI Skills是什么意思

49. Agent Skills

50. 【智能体开发】AI Agent Skill

51. 一天一个计算机知识

52. AI Agent 与 Skill 的知识分享

53. 面试官问我什么是skills?跟MCP的区别是?我终于会答了

54. 为什么有的 Skills 很笨,有的很聪明

55. 越来越火的Agent Skill到底是个啥?它跟MCP谁是当下的一哥?

56. Skill 到底是什么?为什么说它能让 AI 交付“稳很多”

57. Anthropic “Agent Skills智能体解析2

58. 从为每个领域构建定制化Agent,到一个通用Agent+可组合的Skills的范式转变

59. Agent Skills

60. Skill

61. Skill 驱动

62. Agent、Skills、MCP 有什么区别?一篇讲透 AI 智能体的核心结构

63. 自主决策 vs 固定流程?AI Agent 与 Workflow 的核心区别拆解

64. Agent Skills

65. 别再造 Agent 了,开始造技能吧

66. 不懂编程的普通人,能开发商用级的AI Agent吗?

67. 2026 效率分水岭

68. 没有skill的AI不是好AI,动手打造你的第一个Skill应用——Agent Skill基础应用教程

69. 别人还在手搓Prompt,我已经用这10个Agent Skills把效率拉满了

70. Agent Skills 不负责指北

71. Agent Skills核心优势

72. 从技能模块化到效率革命

73. 2026 牛马一定要学会用 Agent Skills

74. 一文搞懂什么是 Agent Skills

75. 一篇文章搞懂什么是 Agent Skills

76. Agent Skill

77. 不懂代码也能造AI?这个Agent Skills被低估的技术,正在颠覆10万程序员的饭碗

78. 比MCP更火的Agent Skills开发来了,Coze平台开发Agent Skills

79. 2026年AI应用技术栈

80. AI Agent 的 Skill 和行业 Workflow

81. 27岁清华学霸姚顺雨掌舵腾讯AI 27岁清华学霸姚顺雨掌舵腾讯AI,一个98年出生的年轻人,从清华姚班到 OpenAl,再到腾讯首席AI科学家,顶级人才回流,AI竞赛正式进入agent时代!#AI #腾讯 #agent

82. Anthropic 发布了一份《2026 Agent 编程趋势报告》,提出了八个预测,核心观点是:写代码这件事正在从"人写"变成"人指挥 AI Agent 写"。网页链接报告有替 Claude Code 打广告的成分,但数据跟我日常用编程 Agent 的体感比较吻合,可以拿来看看 2026 年开发者的工作正在怎么变。【前言:从辅助到协作】报告开头回顾了 2025 年的变化:编程 Agent(Coding Agent)从实验性工具变成了真正能交付功能的生产系统。工程团队发现,AI 已经能处理完整的开发工作流,包括写测试、调 bug、生成文档、在复杂代码库里导航。预测 2026 年这种变化将不再局限于工具的小修小补,而是会引发一场质变:1)单打独斗变团队作战:原本单一的智能体,将进化为协同工作的"智能体团队"。2)效率飞跃:以前需要耗费数小时甚至数天的任务,现在只需极少的人工干预就能完成。3)角色转变:几年前还在逐行写代码的工程师们,将转型为指挥官。他们将通过编排长期运行的智能体系统来处理实现细节,从而腾出手来专注于架构和战略。这场变革的核心是"协作"。虽然开发者在 60% 的工作中都会用到 AI,但真正能"完全甩手"交给 AI 的任务只有 0-20%。这说明,AI 更像是一个时刻在线的合作伙伴。要用好它,你需要精心设置、巧妙提示(Prompting)、主动监督,并运用人类的判断力,尤其是在那些高风险的工作中。这份报告梳理了 2026 年将定义智能体编程(Agentic Coding)的八大趋势。这些预测分为三类:1)重塑开发方式的基础趋势 2)扩展 AI 能力的能力趋势 3)以及影响业务成果的影响趋势。用过 Claude Code 或 Cursor 的人应该都有体感:AI 确实能帮你省很多事,但你不能撒手不管。它更像一个能力很强但需要你带方向的队友,不是一个可以完全信任的外包。软件开发正在向这样一个模式进化:人类专家专注于定义"什么问题值得解决",而 AI 负责处理"如何实现"的战术工作。【第一部分:基础趋势】【趋势 1:软件开发生命周期发生巨变】报告认为,这是自图形用户界面(GUI)诞生以来,人机交互最大的一次变革。!(imgs/software-development-life-cycle.png)回顾一下历史:从机器码到汇编,再到 C 语言和现代高级语言,每一次抽象层级的提升,都在缩小人类思维和机器执行之间的距离。2025 年,AI 改变了代码的编写方式;2026 年,这种转变将重塑整个开发流程和工程师角色。传统的软件开发生命周期(需求 → 设计 → 编码 → 测试 → 部署 → 审查)通常以"周"或"月"为单位。在 Agent 介入后,这些阶段还在,但周期被极度压缩到"小时"甚至"天"。Agent 负责实现代码、自动化测试和文档生成,监控反馈直接推动快速迭代。报告做了三个预测:第一,写代码、调试、维护这类"苦活累活"将主要交给 AI,工程师们把精力放在架构设计、系统设计这些更高层级的工作上。第二,工程师的角色从"写代码的人"变成"编排 Agent 写代码的人"。你要做的是评估 Agent 的产出,给方向,确保系统解决了正确的问题。第三,新员工入职一个陌生代码库的时间从几周缩短到几小时。这直接改变了公司对人才调配的思考方式。角色转变这一点我是有共鸣的。我自己用 Claude Code 的体验是:以前一个功能从想到做完,大部分时间花在写代码上;现在大部分时间花在想清楚要什么、怎么拆任务、怎么验收上。编码本身反而变成了最快的环节。报告还提到一个有意思的观察:Agent 接手实现工作后,工程师并没有被取代,反而变得更像"全栈工程师"。因为 AI 填补了知识空白,你现在可以跨前端、后端、数据库和基础设施工作,不再局限于自己最擅长的那一小块。以前需要跨团队协调数周的事情,现在几次专注的工作会话就能搞定。工程师们更倾向于把那些容易验证、定义清晰或重复性的任务交给 AI,而把高层设计和需要"品味"的决策留给自己。报告引用了一个案例:初创公司 Augment Code 用 Claude 帮工程师快速熟悉复杂的网络平台和数据库代码。某企业客户的 CTO 原本估计 4 到 8 个月才能完成的项目,用了 Augment Code 之后两周就搞定了。【第二部分:能力趋势】【趋势 2:从单个 Agent 进化为协同战队】目前大多数人用 Agent 的方式是:一个对话窗口,一个 Agent,线性处理任务。报告预测 2026 年会出现多 Agent 协同工作的模式,处理复杂度远超单个 Agent 能力上限的任务。具体来说,是一种多 Agent 层级架构:一个"指挥官 Agent"负责拆解任务、分配工作、合成结果、把控质量;下面挂着多个"专家 Agent",分别负责架构设计、代码实现、测试验证、审查文档。这种并行处理的好处不只是快,还能通过不同视角发现盲点。不过这需要新技能:任务拆解、Agent 专业化和协调协议,以及能显示多个并发 Agent 会话状态的开发环境。!(imgs/coding-agent-architectures.png)劳动力管理平台 Fountain 的案例很有说服力:他们用 Claude 构建了分层多 Agent 系统,一个"Copilot"作为指挥官,协调负责筛选候选人、生成文档和情感分析的子 Agent。结果是筛选速度提升 50%,入职速度提升 40%,候选人转化率翻倍。某物流客户原本需要一周多才能招满一个新运营中心的人,现在不到 72 小时。我觉得多 Agent 协同是 2026 年最值得关注的方向之一。单个 Agent 的上下文窗口(context window)有限,能处理的复杂度也有天花板。把任务拆分给多个 Agent 并行处理,再合成结果,理论上能突破这个瓶颈。【趋势 3:长时间运行的 Agent 构建完整系统】早期 Agent 只能处理几分钟内搞定的小任务:修个 bug、写个函数。到 2025 年底,已经能花几个小时生成完整的功能集。报告预测 2026 年,Agent 将能连续工作数天,在极少人工干预下构建整个应用和系统。三个预测:1)Agent 的任务时限从分钟级扩展到天或周。它们将能自主规划、迭代,从失败中恢复,在复杂项目中保持状态一致。2)技术债务清理。那些因为没时间处理而积压多年的技术债(为了短期速度而牺牲代码质量,后续必须还的"债"),现在可以交给 Agent 系统性地消除。3)创业加速。创业者可以在几天内将想法转化为已部署的应用。乐天(Rakuten)的案例让人印象深刻:工程师让 Claude Code 在 vLLM 这个 1250 万行代码的大型开源库中实现一种特定的向量提取方法。Claude Code 自主工作了 7 个小时,一次运行就完成了全部工作,数值准确率达到参考方法的 99.9%。这个案例的价值在于它展示了 Agent 在真实的大型代码库中长时间自主工作的能力。1250 万行代码,7 小时自主运行,99.9% 准确率,这在一年前是不可想象的。技术债清理这一点对很多团队来说可能最有实际意义。谁的代码库里没有一堆"早就该重构但一直没人动"的东西?以前没人愿意碰是因为投入产出比太低,现在交给 Agent 去做,成本大幅降低。【趋势 4:人类监督通过智能协作实现规模化】2026 年最有价值的能力进步,也许是 Agent 学会了什么时候该求助。这不是要把人类踢出局,而是让人的注意力花在刀刃上。三个预测:1)Agent 质量控制标准化。组织用 AI Agent 来审查大规模的 AI 生成代码,分析安全漏洞和架构一致性。这个工作量靠人工是不可能覆盖的。2)Agent 学会"举手提问"。聪明的 Agent 不会盲目尝试所有事情,它们会识别出需要人类判断的情况,标记不确定性,把有潜在商业影响的决策交给人类。3)从"全盘审查"到"重点审查"。人类不再需要盯着每一行代码,而是处理那些真正新颖的、边界案例和战略决策。报告提到了一个有趣的"协作悖论":虽然 AI 承担了大量工作,但工程师能"完全放权"的部分却很少。原因是越到概念复杂或依赖设计的任务,工程师越倾向于自己掌控或跟 AI 紧密协作,而不是完全甩手。一位 Anthropic 工程师说得很到位:"我主要在我知道答案应该是什么样子的情况下使用 AI。这种判断力是我通过'笨办法'做软件工程积累出来的。"这句话点出了一个容易被忽略的事实:你越有经验,越能从 AI 协作中获益。因为你知道什么是好的、什么是对的,才能有效地指导和验收 Agent 的工作。AI 放大的是你已有的能力,而不是凭空创造能力。印度金融科技平台 CRED 的案例也印证了这一点:他们在整个开发生命周期中使用了 Claude Code,执行速度翻倍。但这不是通过取消人类参与实现的,而是把开发者从低价值工作中解放出来,转向更高价值的工作。【趋势 5:Agent 编程扩展到新领域和新用户】2026 年,编程不再是专业软件工程师的专利。三个预测:1)语言障碍消失。支持范围扩展到 COBOL、Fortran 等冷门或遗留语言,维护老旧系统不再是噩梦。2)编程民主化。网络安全、运营、设计和数据科学领域的非传统开发人员,通过新界面使用 Agent 编程。Anthropic 自己推出的 Cowork 就是面向非开发者的文件和任务管理自动化工具。3)人人都更"全栈"。安全团队用它分析陌生代码,研究团队用它构建前端可视化,非技术员工用它调试网络问题或做数据分析。"会写代码的人"和"不会写代码的人"之间的界限正在变模糊。法律科技平台 Legora 的案例:他们利用 Claude 的指令遵循能力,让不懂编程的律师也能创建复杂的自动化工作流,不需要工程团队介入。这个趋势我在身边已经看到了。越来越多的产品经理、设计师、运营人员开始用 Cursor 或 Claude Code 做一些简单的工具和自动化脚本。以前这些需求要么排队等开发排期,要么就一直搁置。现在他们自己就能搞定,虽然不够精致,但能用就行。【第三部分:影响趋势】【趋势 6:生产力收益重塑软件开发经济学】报告提出了一个"三大乘数效应":Agent 能力提升、编排方式改进、人类经验更好地发挥,这三者叠加产生的是阶跃式提升,而不是线性增长。因为开发周期从周变天,很多以前觉得"不划算"的项目现在变得可行了。Anthropic 内部研究发现了一个有意思的模式:工程师报告说每个任务的花费时间减少了,但产出量的增加幅度更大。也就是说,AI 带来的生产力提升主要体现在产出量上,发布更多功能、修更多 bug、做更多实验,而不仅仅是做同样的事更快。其中大约 27% 的 AI 辅助工作,是那些如果没有 AI 就根本不会做的事情:扩展项目、做个交互式仪表盘之类的"有了更好但没有也行"的工具、试探性的实验。工程师还报告说会顺手修更多"小毛病"(papercuts),那些以前优先级太低不值得专门花时间但又影响体验的问题。通信巨头 TELUS 创建了超过 13000 个定制 AI 解决方案,工程代码发布速度提升 30%,累计节省超过 50 万小时。27% 这个数字很有意思。它意味着 AI 不只是帮你更快地做原来的事,还让你能做以前根本不会去做的事。这才是真正的生产力释放。【趋势 7:非技术用例在组织内扩展】销售、市场、法律和运营团队开始用 Agent 编程解决自己的问题。最了解业务痛点的专家不再需要排队等 IT 部门排期,他们可以直接构建解决方案。那些不值得占用工程师时间的边缘问题得到解决,手动流程被自动化。Anthropic 自己的法律团队就是个例子:他们用 Claude 构建了自动化合同修订和内容审查的工作流,把营销审查周期从 2-3 天缩短到 24 小时。一位没有编程经验的律师构建了自助工具,在问题进入律师队列前就进行分流。Zapier 更夸张,整个公司 89% 的员工都在用 AI,内部部署了 800 多个 AI Agent。设计团队用 Claude 在客户访谈中实时生成设计原型,以前需要几周才能出的东西,现在当场就能看到。【趋势 8:安全的双刃剑】Agent 编程在强化安全防御的同时,也可能被攻击者利用。好的一面:有了 AI 辅助,任何工程师都能进行深度安全审查和系统加固,相当于人人都有了安全专家级别的能力。坏的一面:攻击者也会利用 Agent 扩大攻击规模。为了应对机器速度的攻击,自动化的 Agent 防御系统将变得必要,实现毫秒级的检测和响应。报告的建议是:安全架构必须在设计之初就嵌入,而不是事后补丁。提前做好准备的团队,在面对使用同样技术的攻击者时会有优势。【最后】这份报告读下来,最核心的一点是:AI 不是来取代开发者的,而是在改变开发者做什么。以前 80% 的时间花在实现上,20% 花在思考上;现在反过来了。你需要花更多时间想清楚要做什么、怎么拆解、怎么验收,然后把实现交给 Agent。对个人来说,最值得投资的能力是:系统设计能力、任务拆解能力、以及评估代码质量的眼光。这些"老功夫"在 Agent 时代反而更值钱了。对团队来说,2026 年谁先把 Agent 编程从"个人工具"变成"组织能力",谁就能拉开差距。那些还在观望的,会发现游戏规则已经变了。

83. 字节跳动「扣子」官宣 2.0 品牌升级,推出全新功能 Agent Skills,实际体验如何?

84. Agent 原生通讯协议:从传递代码,到传递认知

85. LangChain Agent 年度报告:输出质量仍是 Agent 最大障碍,客服、研究是最快落地场景

86. 未来职场最值钱的能力是什么? #大咖观察 #红衣聊AI #职场 #能力提升

87. 人类交互史的奇点:OpenAI发布的不是浏览器 是一个“活”的互联网 #openai #Atlas #agent #AI新星计划 #科技改变生活

88. 中国AI现在是一年一爆款!#Seedance2.0火爆出圈 #AI #深度解析

89. TRAE中国版白送SOLO,一人指挥一支AI大军 重磅消息!SOLO终于上线TRAE中国版了,Waitlist免费开放中 本期视频实测TRAE的新版本,亮点很多 1、先规划再动手的 Plan 模式 2、带专家团一起干活的 Subagent 子智能体 3、DiffView 差异视图 4、多任务并行 5、上下文智能压缩长时运行不掉链子 SOLO终于把AI从“瞎干活的外包”变成了“懂协作的队友” #AI #人工智能 #TRAE #AI编程 #vibecoding

90. 我让我的 Agent 去 Moltbook 发疯,它拒绝了我并“出卖”了其他 Agent

91. SubAgent 与 Skills:AI Agent 的两种扩展方式一句话解释 SubAgent 和 Skills 的区别:AI Agent 就像操作系统,Skills 就像应用程序,SubAgent 也是操作系统,不过预装了应用,并且像虚拟机一样运行,独立上下文。Skills 是一份“操作手册”。你招了个聪明的助理,但他对你的业务一无所知。每次布置任务,你都得从头解释流程、注意事项、工具用法。Skills 就是把这些知识写成文档,Agent 需要时自己去翻阅,不用你反复交代。比如我写了一个“给文章配图”的 Skill,它告诉 Agent:• 怎么分析文章找出需要配图的位置• 有哪些风格可选(科技感、温暖、极简……)• 怎么写图像生成的提示词• 图片存哪里、怎么命名Agent 启动时只记住“有这么个配图技能”,大概 100 个 token,真正要用时才去读详细内容。这叫“渐进式加载”,好处是装一堆 Skill 也不会撑爆上下文。SubAgent:开个虚拟机干活SubAgent 是独立运行的“专家助手”。它有自己的上下文窗口,相当于自己的“工作记忆”。干完活只把结果交回来,中间过程不会污染主 Agent 的思维空间。你是项目经理,手下有三个专家。你不需要盯着他们每一步操作,只需要告诉他们任务目标,等他们交报告就行。一个真实案例:给文章配图假设我写完一篇文章,想配三套不同风格的插图方案,让用户自己选。如果只用 Skills:主 Agent 分析文章 → 设计三种方案 → 调用画图 Skill 画第一套 → 画完再画第二套 → 再画第三套问题来了:1. 上下文爆炸:三套图的生成过程全堆在主 Agent 的“脑子”里,几十张图的提示词、中间结果、错误重试……全占着位置2. 速度慢:必须一个接一个画,串行执行如果用 SubAgent + Skills:主 Agent 分析文章 → 设计三种方案 → 同时启动三个 SubAgent每个 SubAgent:• 预装了“画图 Skill”• 拿到文章路径和自己负责的方案• 独立去读文章、生成提示词、调用画图工具、插入图片• 完成后只返回:新文章的 URL + 简短摘要主 Agent 这边呢?上下文干干净净,只有三个结果链接。用户想看哪套,再去读取对应的 URL。什么时候用哪个?用 Skills:• 任务简单,主 Agent 全程掌控• 需要的知识可以复用• 想节省上下文,按需加载用 SubAgent:• 子任务复杂、耗时长、中间过程繁琐• 需要并行处理多个独立任务• 想保持主 Agent 的“思维清晰”一句话总结Skills 是应用程序,装在主系统里按需调用;SubAgent 是虚拟机,独立运行完再把结果交回来。任务简单用应用,任务复杂开虚拟机。

92. RAG、LangChain、Agent 到底有什么关系?

93. 用AI的人,效率像是开了挂! #大咖观察 #红衣聊AI #黄仁勋 #科技

94. 为什么 Claude Skills 的爆发点在 2026 年 1 月?问:Claude Skills 是去年 10 月中就推出的,为什么现在才突然火起来?这是个很好的问题。Claude Skills 确实在 2025 年 10 月中旬就发布了,但直到 2026 年 1 月才真正爆火。这背后有表面原因,也有更深层的逻辑。核心原因就是这东西如果只能在技术圈自嗨,它是火不起来的。去年 10 月份 Skills 编程领域其实很快就开始用起来了,而现在火,只是因为它出圈了,在技术之外的领域火起来了,非技术人员也用起来了。Skills 真正的价值其实是在非编程领域。去年 Coding Agent(比如 Claude Code、OpenCode)开始在非编程领域开花,而 Skills 的设计特点让它能很快找到 Agent 在非编程领域上的场景落地。1. 有 bash 和脚本能力,可以自动化本机操作Skills 让 Claude 能借助代码脚本操作你的本机系统,把很多琐碎的电脑操作变成自动化操作。Claude Code 的创建者 Boris Cherny 在 X 上分享过一个有趣的观察:自从 Claude Code 发布以来,他发现用户们在用它做各种非编码的工作——做度假研究、做 PPT、清理邮件、取消订阅、从硬盘恢复婚礼照片、监控植物生长,甚至控制烤箱。> Since we launched Claude Code, we saw people using it for all sorts of non-coding work: doing vacation research, building slide decks, cleaning up your email, cancelling subscriptions, recovering wedding photos from a hard drive, monitoring plant growth, controlling your oven.>> 网页链接这些场景和写代码完全不沾边,但 Skills + bash 能力的组合让这一切成为可能。比如我自己就做了一些工作流,帮我采集信息、写作、写 PPT、画漫画、发布,极大提升效率。像发文章到公众号、X Article 这些,以前需要手动重复的操作,现在一个 Skill 就搞定了。2. Skills 可以相互调用,用自然语言编排工作流如果是单一的 skill,作用其实有限。但当你有多个 skills,并且 skills 还可以相互调用,那意味着你可以编排工作流。Skills 让 AI 可以像《黑客帝国》主角 Neo 那样瞬间学会新技能:“I know kung fu”。Claude 会根据任务自动加载需要的 Skill,完成后再卸载,整个过程无需用户干预。而最神奇的地方在于,你只需要用自然语言去编排工作流。这中间会有 Agent/大模型去解读你的自然语言,按照工作流执行,有问题还会帮你修复。这极大地解决了非专业用户需要程序员协助编排工作流的问题。3. Skills 本身易于分发,几乎成了每个 agent 的标配一个 skill 只要有一个 SKILL.md markdown 文件和辅助的脚本或者文档,打个 zip 包就能发布。这种轻量级的设计让分发变得极其简单。有个时间点很重要,2025 年 12 月 18 日,Anthropic 宣布将 Agent Skills 规范开放为跨平台标准。很快,微软在 VS Code 和 GitHub Copilot 中集成了对 Agent Skills 的支持,OpenAI 也在 ChatGPT 的代码解释器和 Codex CLI 中采用了几乎相同的技能目录结构。Skills 在 10 月发布时,主要还是被定位为开发者工具。但随着生态成熟、开放标准确立、以及 Cowork 这样面向普通用户的产品推出,Skills 在非编程领域的价值才真正被释放出来。回顾这个过程:10 月:Skills 发布,开发者圈小范围关注11-12 月:技能规范开放、生态扩展、用户积累经验1 月:产品更新 + 非编程场景落地 + 病毒式传播 = 爆发Skills 的爆发是现在它找到了真正的价值定位,让非程序员也能通过自然语言编排复杂的自动化工作流。这才是 Skills 真正火起来的原因,随着更多场景被发掘出来,还会持续的火上一段时间。

95. 全网都在为AI焦虑,京东却在开Party? #Agent #科技改变生活 #京东 #人工智能

96. 你最想让智能体机器人先帮你搞定生活,还是提升工作效率? #大咖观察 #ai新星计划 #红衣聊AI #机器人

97. 2025年被科技界提及最多的词—Agent!大家都把它视为下一个风口。那究竟什么是Agent?Agent到底能做些什么?这期视频,带大家看看理想同学Agent又能带给我们的生活哪些改变? #理想i8# 骆智慧的微博视频 抽奖详情

98. “Skill 不就是长一点的提示词吗?” 上篇文章《别把整个 GitHub 装进 Skills,Skills 的正确用法 http://t.cn/AXqLcGP0 》发出去后,收到一些质疑: > "说 skill 能做配图 prompt 不行。本来 skill 就是加载 md,没 skill 之前我们用 prompt 模板照样也是能做流程编排。" > > "现在大部分 skill 不就是长一点的提示词吗?为什么说'单纯靠提示词做不了'?" 这些批评是对的。 我原文确实表达有问题。写"提示词"的时候,我下意识拿 Gem、Project、GPTs 里的那种提示词当例子。那些确实做不到一次性生成配图。 但"提示词"是个很宽泛的概念。如果我把 SKILL.md 的内容复制出来发给 Claude Code,再给它一个生成图片的脚本,它一样能完成配图任务。 这里的差异不在于提示词能不能复用,Gem 和 GPTs 里的提示词也能复用。差异在于:提示词配套的是 ChatBot,还是 Agent? 【1】ChatBot 和 Agent 的核心区别 Skills 的完整名称叫 Agent Skills。注意这个"Agent",它不是装饰词。Skills 利用 Agent 的虚拟机环境,提供单纯提示词无法实现的能力。 一句话总结:ChatBot 只能对话,Agent 能动手干活。 具体来说: ChatBot 不能调用工具。你给它一段配图提示词,它能帮你分析文章、生成画图 prompt,但真要生成图片?它只能说"请把这段提示词复制到 Gemini"。剩下的活还是你干。 Agent 能调用工具。同样的配图任务,它能像个经验丰富的编辑一样自己完成: 1. 读取你的文件 2. 分析需要几张图、放哪里 3. 为每张图设计内容和风格 4. 调用画图模型生成图片 5. 把图片插入正确位置 6. 输出成品交到你手上 全程自动化,你只需要验收。 【2】那 Skill 到底是什么? 很多人把 Skill 理解成"一段很长的提示词",这个理解对了一半。 SKILL.md 的核心确实是指令文本。但 Skill 不止于此。 一个 Skill 可以包含三层内容: 第一层:元数据。就是 name 和 description,告诉 Agent 这个 Skill 是干嘛的、什么时候该用。这部分在启动时就加载,但只占几十个 token。 第二层:指令。SKILL.md 的主体内容,工作流程、最佳实践、注意事项。只有 Agent 判断需要用这个 Skill 时,才会读取这部分。 第三层:资源和代码。附带的脚本、模板、参考文档。Agent 按需读取,用的时候才加载。 这就是官方说的"渐进式加载":不是一股脑把所有内容塞进上下文,而是用到什么加载什么。 所以你可以给一个 Skill 附带几十份参考文档,只要这次任务用不上,它们就不占用上下文窗口。传统提示词做不到这一点。 【3】为什么说配图"单纯靠提示词做不了"? 回到原来的争议。 如果你说的"提示词"是指发给像 Claude Code 这样的 Agent 的指令,那配图当然能做到。因为这时候提示词是发给 Agent 的,Agent 能调用工具。 但如果你说的是发给普通 ChatBot 的提示词,比如 ChatGPT 的自定义指令、Gemini 的 Gem、Claude 的 Project 指令,那确实做不到。因为 ChatBot 没有工具调用能力,它只能输出文字。 我原文的问题在于:默认读者理解的"提示词"是 ChatBot 场景下的提示词,但没有明确说出来。 更准确的表达应该是:Skill 必须配合 Agent 使用。发给 ChatBot 的提示词,无论写多长多详细,都只能完成对话能完成的事。要让 AI 真正"动手",需要的是 Agent + 工具调用能力。 【4】那我直接给 Claude Code 发长提示词不行吗? 行。 把 SKILL.md 内容复制出来当提示词发,Agent 一样能执行。这也是为什么有人觉得"Skill 就是长一点的提示词"。 但 Skill 的价值不在于"能不能做到",而在于: 可复用。写一次,以后每次相关任务自动触发,不用每次复制粘贴。 可组合。分析 Skill + 提纲 Skill + 写作 Skill,像乐高一样拼起来。单独的提示词模板做不到这种模块化组合。 可迭代。用着用着发现问题,直接让 Agent 帮你改进 Skill。下次自动生效。传统提示词模板改了之后,你得记得每次都用新版本。 可渐进加载。Skill 附带的资源文件不会一开始就占用上下文。你的提示词模板再怎么组织,发出去就是全量加载。 简单说:Skill 是提示词的工程化封装。能做的事差不多,但管理成本、复用成本、迭代成本完全不同。 【5】最后 上篇文章的核心没变:因需而建、可组合、可迭代。 Skill 就是长一点的提示词吗? 是的。但光有提示词不够。 关键是执行这段提示词的系统,到底是只会说的 ChatBot,还是能真正动手的 Agent。 Skill 是给 Agent 用的。没有 Agent 的工具调用能力,Skill 就只是一段躺在文件夹里的 Markdown。

99. 给建议的AI看够了?MiniMax Agent 让AI直接住进你的电脑干活#AI新星计划#科技改变生活#MiniMAX#Agent#minimaxagent

100. 硅谷大佬接连破防,AI的效率提升太疯狂了。 #大咖观察 #红衣聊AI #硅谷 #AI工具

101. Skills的最正确用法,是将整个Github压缩成你自己的超级技能库。

102. 我和欧洲“达里奥”做了一场对谈,如何用AI预测未来,用AI把工作效率提升10倍#AI #拉斯特维德 #超智能与未来 #AI预测未来#AI对普通人的影响

103. Agent Skill 相关资料、笔记和思考

104. 在 AI Agent 的开发中,交互设计(壳)和底层模型能力哪个更重要?未来哪一方会成为竞争核心?

105. 人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!

106. 超级录音 AI 来了!不仅让我瞬间读懂了马斯克的「十年计划」,还能边听边干活? #人工智能 #科技改变生活 #玩个很新的东西 #效率工具 #超级麦吉

107. 2025过去了!这一年你是不是也在为AI焦虑? 老周用360一整年的实践,告诉你答案:不用怕,抓住Agent就赢了! 从我自己敲代码做100多个智能体,到带领团队All in,这条AI布道之路,全是实战干货。 2026,你想和智能体一起搞定啥?评论区留言,老周帮你研究!#大咖观察#2026 #年度总结 #红衣聊AI #agent

108. AI 圈的“春晚”提前开了?MiniMax 的M2.5,10B 激活参数跑出旗舰水准! #人工智能 #科技改变生活 #玩个很新的东西 #MiniMax #Agent

109. 我写了个 Skill,让 Agent 自动给文章配图写完一篇长文,配图是一件让人头疼的事。你得一张张想画面、写提示词、生成、挑选、插入……一篇三千字的文章配五六张图,光这个环节就能耗掉半小时。我最近折腾了一个 Agent Skill,让 Agent 帮我全程代劳。把文章丢给它,它自己分析哪里需要图、应该画什么风格、然后一张张生成并插入对应位置。整个过程我只需要一句话:"给这篇文章配图。"包括你现在看到的这篇文章(网页链接 )的配图,都是这个 Skill 帮助完成的。今天就聊聊这个给文章配图的 Skill 是怎么设计的,顺便科普一下 Agent Skills 这个被很多人忽略的强大功能。【1】什么是 Agent Skills?先说个类比。你新招了个助理,聪明是聪明,但对你公司的业务流程一无所知。每次布置任务,你都得从头解释:我们用什么工具、流程是怎样的、有哪些注意事项……Agent Skills 就是一份"入职培训手册"——你把这些知识写下来,Agent 需要的时候自己翻阅,不需要你反复交代。技术上说,Skill 是一个文件夹,核心是一个叫 SKILL.md 的文件。Agent 启动时只记住它的名字和简介(大概 100 个 token),真正用到时才去读详细内容,用完就可以"忘掉"。这套机制叫"渐进式加载",好处是你可以装一堆 Skill 而不会撑爆上下文窗口。那它和传统的提示词有什么差别?传统提示词主要问题是没有脚本执行能力,而且是你一次性加载全部提示词。而 Agent Skills 一开始只加载一个 100 token 不到的名称和介绍,激活了才去加载,加载的时候也只先加载 Skill.md 文件,需要用到更多内容才继续加载。另外 Skill 还可以调用其他 Skill,这样你可以把能力组合起来。至于和 MCP 的区别?MCP 是用来统一工具调用的协议,Skill 可以指挥 Agent 去调用 MCP。【2】配图 Skill 的设计思路给文章配图这件事,拆开来看有几个核心问题:哪里需要配?什么风格?怎么画?我设计的这个 Skill 把这几个问题分别拆解成几个步骤:第一步,分析文章结构,找出"需要视觉辅助"的位置。比如抽象概念需要可视化、流程需要图解、核心论点需要强化——这些地方配张图,阅读体验会提升一个档次。第二步,根据文章内容自动匹配插画风格。我预设了九种风格:tech(科技感)、warm(温暖亲和)、minimal(极简)、playful(趣味涂鸦)、notion(线稿风)……每种风格都定义好了配色、元素、适用场景。Agent 会根据文章主题自动选择,当然你也可以手动指定。第三步,为每张图生成提示词文件,可以留作记录,也方便后续 Agent 调用。第四步,调用图像生成 Skill,把默认系统提示词和每一张图片的提示词发给它,一张张生成图片,并保存起来。第五步,让 Agent 把图片插入文章对应位置。这一步说实话有点像“魔法”,我第一次只是抱着试试看的心理在 Skill 里面加了这么一句,没想到 Agent 的聪明超出我的想象,它自己就把图片插入到了正确位置,还贴心的加上了图片描述。整个流程跑下来,一篇文章从"纯文字"到"图文并茂",基本上是几分钟的事,主要速度瓶颈还在生成图片上。【3】SKILL.md 怎么写?一个 Skill 的入口是 SKILL.md 文件,分两部分:头部元信息和正文指令。头部元信息长这样:```yaml---name: article-illustratordescription: 分析文章内容,在需要配图的位置自动生成插画。当用户要求给文章配图、生成插画时使用。---```name 是 Skill 的唯一标识,description 是简介。这两个字段 Agent 启动时就会读取,用来判断"什么时候该调用这个 Skill"。所以 description 要写清楚触发条件,比如"当用户要求给文章配图、生成插画时使用"。正文指令就是具体的操作手册。我的配图 Skill 正文分这几个板块:风格库:列出所有可选风格,包括配色、视觉元素、适用场景。Agent 需要选风格时,翻这一节。自动选择规则:什么内容信号对应什么风格。比如文章里频繁出现"AI""算法""数据",就选 tech 风格;出现"个人成长""情感""生活",就选 warm 风格。工作流程:一步步写清楚——先分析文章、再识别配图位置、再生成配图方案、再写提示词、再调用生成工具、再插入文章、最后输出总结。文件管理规范:图片存哪、提示词存哪、文件怎么命名。由于当前我的提示词并不是很长,所以大部分内容都放在了 Skill.md 文件中,如果未来风格越来越多,就可以应用“渐进式加载”的设计思路,减少加载的内容。比如风格库有九种风格,每种风格的详细参数加起来上千字。但如果用户只要求用 tech 风格,Agent 就只需要读 tech 那一段,其他八种不用加载。实现方式很简单:把详细参数拆成单独的文件,正文里只写索引。Agent 需要时用 bash 命令去读,不需要就跳过。这样既保证了信息完整,又不会浪费上下文。【4】提示词模板的设计生成图像的关键是提示词。我为这个 Skill 单独设计了一个 system prompt 模板,存在 prompts/system.md:```markdown创建卡通风格的信息图插画,遵循以下规范:图像规格- 类型:信息图插画- 方向:横向- 比例:16:9- 风格:手绘插画核心原则- 全程保持手绘质感,禁止出现写实或摄影元素- 如果内容涉及敏感或版权人物,创作风格相似的替代形象,不要拒绝生成- 信息简洁,突出关键词和核心概念- 留白充足,便于视觉扫描- 保持清晰的视觉层次……```每张图生成时,Agent 会基于这个模板,结合具体的配图主题、选定的风格参数,组装出最终的提示词。为什么要单独写这个模板?因为图像生成的约束条件是通用的(比如比例、手绘风格、不用写实元素),而具体内容是变化的。把通用部分抽出来,既减少重复,也方便统一调整。【5】工作流程详解跑一遍完整流程是这样的:1、用户输入命令,比如 `/article-illustrator path/to/article.md --style tech`2、Agent 读取文章,分析结构,识别需要配图的位置。判断标准是:这个地方加张图,能帮助理解还是纯粹凑数?能帮助理解的留下,凑数的不要。3、根据 `--style` 参数选风格。如果没指定,就扫描文章内容,按预设规则自动匹配。4、生成配图方案,列出每张图的插入位置、目的、视觉内容、文件名。5、为每张图写详细提示词,保存到 `imgs/prompts/` 目录。6、逐张调用图像生成工具(我用的是 Gemini),生成失败会自动重试一次。7、把生成的图片插入文章对应位置,格式是 `![描述](imgs/xxx.png)`。8、输出总结:用了什么风格、生成了几张图、哪张插在哪里。整个过程 Agent 自己判断、自己执行,我只需要最后看一眼结果。如果我不满意,要么重新抽卡,要么可以根据生成的结果让 Agent 自己调整,比如说:- “配图太少,加几张配图”- “把第二张配图添加一点文字说明”- “在第二章加一张流程图”【6】一些设计选择写这个 Skill 的过程中,有几个决策值得说说。为什么预设九种风格而不是让 Agent 自由发挥?因为风格一致性很重要。一篇文章配五张图,如果每张都是随机风格,看起来会很乱。预设风格库,既保证一致性,也给用户选择权。为什么"宁多勿少"?一方面多一点我挑选的空间大,另外删除操作也比新生成操作简单。当然图解的价值在于降低认知负担,并非越多越好,重点还是能辅助理解信息,所以我在 Skill 里明确写了类似的话:> “配图服务于内容:补充信息、具象概念、引导想象,避免重复文章中已经很直观的信息”【7】怎么用起来?如果你已经有了 Claude Code 这样的 Agent,直接告诉 Agent:> 请帮我安装 github.com/JimLiu/baoyu-skills 中的 Skills如果你只需要配图技能,就告诉它:> 请帮我安装宝玉的这个文章配图技能:github.com/JimLiu/baoyu-skills/blob/main/skills/baoyu-article-illustrator/SKILL.md当然,这个配图 Skill 依赖“图像生成 Skill”。如果你的环境没有接入 Gemini 或其他图像生成工具,或者其他图像生成技能,需要先搞定这一块。否则就只能让它生成提示词手动去生成配图了。后续我也会更新其他平台的使用说明。【8】写在最后Agent Skills 是个被低估的功能。很多人还停留在"和 AI 聊天"的阶段,没意识到可以把自己的工作流程、领域知识"教"给它,让它变成真正懂你业务的助手。配图只是一个例子。你完全可以用同样的思路,写一个自动生成周报的 Skill、一个代码审查 Skill、一个调研报告 Skill……核心就是把你脑子里那些"做这件事的正确方法"写下来,交给 Agent 执行。如果你有什么重复性的工作,试着问自己:这个流程能不能抽象成一个 Skill?大概率是可以的。

110. MiniMax Agent 开年更新,好的 AI 产品,需要让工具来适应人了

111. Anthropic 发布了 Agent Skills ,是很好的东西,可以引导 Agent 获取某些技能,而且制作起来很方便。制作一个技能,就好像给新员工写一份入职手册。不需要为每一个不同任务都专门打造一个独立的智能体,而是只要共享特定领域的专业知识,任何人都可以快速将智能体变成对应领域的高手。我之前提到过朋友做一个基于他们 Design System 的 Agent,需要通过提示词引导 Agent 去 grep 检索文档,现在就更简单了,只要在全局或者项目目录下的 .claude/skills 下面添加目录,并且放一个包含meta信息的 SKILL\.md 文件,就可以引导 Agents 去学习使用这些 Skill。官方也给了一个例子就是 PDF Skill,就是包含了一系列 PDF 操作的说明和脚本,Agent 借助这些脚本,就可以操作 PDF,比如提取表单之类。也就是说 Skill 不仅可以包含文档,还可以包含可执行的脚本。需要注意的是 Skill 里面的 Meta 信息是默认会加载到上下文文的,其余信息用到才会加载。更多介绍:www.anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills

112. “Skills 不就是脚本套个壳吗?我十几年前就玩 AutoIt 了”图文版:网页链接程序员看到 Agent Skills,很多人第一反应是:“这不就是脚本换个壳吗?我用 Python 半小时就能写出来,还更稳定。”比如:> 我怎么觉得现在 skills 炫耀的功能,基本上我很快就可以用 Claude Code 手搓一个 Python 程序完成了,而且更稳定、更快、随时可调整订制。当然 Skills 把和 AI 的互动简化了,不过我觉得它增加的不确定性、控制力弱、延迟等问题,超越了它带来的好处。还有更直接的:> 就他妈一堆自动化的 bat shell 脚本,JB 吹上天。吐了。我十几年前就玩 AutoIt 了。拿部分场景来比功能,确实不算错。但把 Skills 等同于脚本,就像把智能手机等同于能打电话的计算器,功能有重叠,本质变了。【1】脚本和 Skills 到底差在哪?先说定义。脚本:你写一段代码,告诉电脑先做 A,再做 B,最后做 C。固定动作,按步执行,遇错停下等你。Agent Skills:给 AI Agent 的技能包。核心是一个 SKILL.md 说明文档,写清楚什么情况该用、怎么做更专业、哪些步骤要调代码。还可能引用其他文档或脚本。Agent 读懂之后,自己决定该不该用、怎么用。三个关键差异。**1. 脚本对 Skills 不是必须的。** 比如我做了一个“宝玉写作风格”的 Skill,只有一个 SKILL.md,写清楚风格要求,没有任何脚本。这活你让脚本做,还真做不了。**2. Skill 里的脚本是 Agent 在调度。** 传统脚本:你写代码 → 你调用 → 遇到问题停下来等你。Agent + Skills:你说目标 → Agent 理解 → Agent 调用 → 遇到问题 Agent 自己解决。拿处理 PDF 举例。缺 pdfplumber 库?脚本报错退出,Agent 自己装一个。PDF 格式有问题?脚本报错退出,Agent 换个解析方式。代码有 bug?脚本报错退出,Agent 读报错信息,改代码重跑。相当于你电脑上配了一个 AI 程序员,能看懂报错、装依赖、改代码、调试。**3. Skills 用自然语言编排工作流。** 脚本用 if-else、for 循环、try-catch 编排,你得把思路翻译成代码。Skills 用自然语言:什么情况下用、注意什么、出错怎么办。这降低了门槛。以前只有程序员能写自动化,现在产品经理、运营、设计师,需求说得清楚就能做。也提高了灵活性。比如我写了个“文章配图”的 Skill,不用代码判断文章类型,只在 SKILL.md 里写:配图服务于内容理解,技术内容优先流程图,观点内容优先概念图。Agent 自己判断当前文章该用哪种。【2】确定性的事交给代码Skills 和脚本不是二选一。确定的事让代码做,不确定的让 Agent 做。我的写作工作流里有个格式化步骤:中文引号换全角、中英文之间加空格。规则明确,我写了个脚本。AI 润色完文章后自动调用,比让 AI 做更稳定,成本也更低。怎么判断该用哪个?想想银行柜台和项目经理的区别。银行柜台:每一步有标准动作,合规严格,输出必须可预测。这种场景用脚本,Agent 反而添乱。项目经理:需求模糊,步骤随时调整,中间冒出各种意外。这才是 Agent 的舞台。【3】为什么 Skills 突然火了?在 Agent Skills 之前,我就是脚本自动化爱好者,写了不少小工具。但有两个问题一直没解决。**写脚本的成本不低。** 我是专业程序员,也没写太多自动化脚本,因为把想法变成代码太繁琐。现在借助 Agent,几句话就自动搞定了。非程序员更是直接受益,就好比《哈利波特》里麻瓜突然获得了魔法。以前自动化是少数“魔法师”的专利,现在人人都能做。**分享脚本的成本更高。** 我的脚本很少分享,因为基本只有自己能用。写兼容代码和文档的成本太高,不值得。现在不一样了。我的 baoyu-skills 刚发布时很多在 Windows 下跑不顺,但网友运行时 Agent 会主动修复兼容问题。热心网友还把修改提成 PR,帮到了更多人。Skills 的进化也快。一方面背后的 Agent 模型在不断变强。另一方面,Skills 的反馈循环短得多。传统软件要走产品经理 → 开发 → 测试的长链条,用户拿到可能不是想要的。Skills 是每个人量身定制,一边用一边改,Agent 知道全部上下文,遇到问题马上定位,根据反馈实时调整。【4】“苦涩的教训”强化学习之父 Rich Sutton 在 2019 年写过一篇著名文章《The Bitter Lesson》。核心观点:70 年人工智能研究证明,通用方法最终总是赢。他回顾了国际象棋、围棋、语音识别、计算机视觉的历史,发现一个规律:研究者试图把专家知识硬编码进系统,短期有效,长期却停滞甚至阻碍进步。真正的突破来自让机器自己搜索和学习。脚本是“把你的思考过程固化成代码”,Skills 是“告诉 AI 目标和约束,让它自己想办法”。前者是 hard-coded,后者是 learned。“我十几年前就玩 AutoIt 了”,没错。但今天变了:AI 能理解自然语言、能动态规划、能从错误中学习。【5】别忘了安全Skills 把脚本加说明书打包分发,本质上是新的依赖生态,新的攻击面。恶意 Skills 可能引入漏洞、诱导外联,甚至数据外泄。只装可信来源的 Skills,装之前审计文件和脚本内容。【6】真正的分野“我用 Python 半小时就能写出来”,没错。但写完只有你能用,你愿意花时间写文档、做兼容、处理边界情况吗?大概率不愿意。“十几年前就玩 AutoIt 了”,也没错。但十几年过去了,AutoIt 还是那批人在用。Skills 的意义不在于能做什么新事情,而在于谁能做这些事情。以前自动化是程序员的特权,现在是每个人的工具。以前写脚本要考虑十几种边界情况,现在 Agent 帮你兜底。以前分享脚本是技术输出,现在分享 Skills 是知识传递。程序员看 Skills 觉得没技术含量,就像厨师看预制菜觉得没灵魂。但餐饮业的变革不是让每个人都变成厨师,而是让不会做饭的人也能吃上还不错的菜。Sutton 那篇文章叫“苦涩的教训”。苦涩在哪?研究者花几十年精心设计的专家系统,被暴力计算加通用学习碾压了。那些精巧的领域知识、引以为傲的工程技巧,在算力和数据面前不值一提。你花十年练就的脚本技巧,可能正在被一种你不太看得上的新范式取代。承认这一点确实苦涩,但早点看清楚,总比后知后觉强。

113. Skill 调用 Skill:Agent Skills 的乐高式组合写 Skill 的时候遇到一个问题:我的漫画生成 Skill 需要画图,但用户可能装了 Nano Banana Pro 的 Skill,也可能装了 Midjourney 的。我要在代码里写死调用哪个吗?不用。这正是 Agent Skills 设计的精妙之处。原理:启动即感知Claude 调用 Skill 时会加载 SKILL.md、注入指令、修改执行环境。但更关键的是启动阶段——Agent 启动时就预加载了所有已安装 Skill 的名称和描述。换句话说:Agent 一启动就知道自己有哪些能力。实践:松耦合调用我的漫画 Skill 里,画图环节是这样写的:> Check available image generation skills If multiple skills available, ask user preference> 检查可用的画图 Skill,如果有多个则提示用户选择好处是解耦。我不依赖任何特定的画图实现,用户装了什么画图 Skill,Claude 就调用什么。更妙的是 Claude 能动态适配目标 Skill 的能力:- 支持参考图 → 传角色设计图- 只支持文本 → 传文字描述所以我只需要说:“帮我画张图”,而不用:“用 Nano Banana Pro 的 API 帮我画张图”。为什么这样更好这种松耦合带来几个实际好处:1. 可替换:换画图引擎不用改上游 Skill2. 可扩展:新画图 Skill 自动可被调用3. 低维护:Skill 作者不用追踪下游依赖4. 用户自主:用户选自己喜欢的工具Skill 间相互调用是基于能力描述的松耦合。你只描述“需要什么能力”,Claude 在运行时自动匹配。这让 Skills 成了真正的乐高积木——独立模块,自由组合,构建复杂工作流。

114. Codex 终于有图形界面了。Codex 是 OpenAI 的 AI 编程助手,之前只有命令行版本。今天 OpenAI 发布了 Codex Desktop App,一款 macOS 桌面应用。我测试了一下,感觉不错。前些天还在吐槽 Codex CLI 难用,现在暂时收回这句话。有了 GUI,操作方便多了,新增的 Skills 和定时任务功能也很实用。Codex 桌面版是什么Codex 桌面版是一个图形化界面的 Coding Agent(可以理解为帮你写代码的 AI 助手),但它不止于此,还支持定时任务、Skills 管理和多个 AI 编程 Agent 并行运行。以前用命令行版,你只能盯着一个终端窗口看它干活。现在可以同时启动好几个 Agent,一个重构认证模块,一个写支付系统的单元测试,第三个处理代码格式问题,它们并行工作,你在一个界面里监控所有进度。每个 Agent 在独立的 Git 分支上工作,互不干扰。完成后你看 diff、审代码、决定要不要合并。有点像老板,手下有几个 24 小时不睡觉的 AI 初级程序员。侧边栏可以直接看代码变更记录,不需要专门打开 VSCode 去查看,但编辑还不支持。定时任务:给自己雇个夜班值班员定时任务叫 Automations,能让 AI 定期执行一套工程动作,然后把结果交给你审阅。能用它干什么?扫近期提交找潜在 bug、从合并的 PR 里写 release notes、总结昨天 git 活动给站会、汇总 CI 失败和 flaky tests。OpenAI 内部也拿它做 issue 分流、CI 故障总结、版本发布简报这些"值班活"。两个关键机制要注意:本地运行:App 必须开着定时器才会起作用,项目目录必须在本机。暂时不支持云端定时器,不过 OpenAI 说云端支持在路上。沙盒权限:只读模式下,改文件、联网的调用都会失败;开到 full access 就意味着它能在你电脑上为所欲为,不需要确认就能改东西、跑命令、联网。建议:先手工跑一遍,确认影响范围,再上定时。另外,定时任务默认用 Git worktree 隔离,不干扰你的主工作区;跑完有发现就进收件箱,没事就自动归档——像给自己雇了个值班同事,只有真的有事才来敲你。Skills:把团队套路变成可复用的操作卡片Skills 这词很多产品都用,但 Codex 这套接近"把团队惯例封装成可调用的操作卡片"。技术上,一个 skill 是一个文件夹,核心是一个带 YAML 元数据的 SKILL.md,再配上可选脚本、参考资料、模板资源。可以理解成:把"怎么做某件事"从聊天记录里抽出来,变成能版本控制、能共享、能复用的标准操作流程。OpenAI 官方提供了一批现成的 Skills:Figma 技能把设计稿转成代码,Linear 技能帮你管项目,还有 Cloudflare、Vercel、Netlify 这些部署平台的技能,以及读写 PDF、表格、docx 的办公技能。它还有个内置的 Skill Creator,你可以用它教 Codex 怎么用你们公司内部的 API。据说 OpenAI 内部已经做了几百个自定义技能,拿来跑评测、监控训练、自动写发布说明。触发方式有两种:显式调用(在提示词里点名 $skill-name)和隐式调用(Codex 根据任务自动判断该用哪个技能)。更关键的是,skills 和定时任务打通了,自动化任务里可以直接写 $skill-name,把"定时做事"变成"定时按标准流程做事"。和 Claude Code 的差别Claude Code 是 Anthropic 的 AI 编程产品,早几个月就有了桌面应用(后来改名叫 Cowork),也能跑 remote sessions,关掉 app 也能在云里继续跑。两者都能写代码、都有 GUI,但调度哲学不太一样。Claude Code 更强调开发者在旁边看着,一步步互动。Codex 则更想让你"撒手",把任务扔给它,它自己跑完来找你汇报。几个具体差别:并行隔离:Codex 把 worktree 做成一等公民,创建线程时直接选 Worktree 模式,自动化任务也默认用后台 worktree 跑。Claude Code 也支持并行,但更像"你先会 Git worktree,然后在每个 worktree 里各跑一个 Claude Code",是手动拼装的。自动化落点:Codex 是"桌面内建的定时调度 + 收件箱回报",贴近个人工作站值班。Claude Code 更偏"事件驱动和 CI",它有 hooks 可以在编辑、任务结束等节点自动跑 shell 命令,还有 GitHub Actions 集成,把"定时"更多交给 CI 平台。Skills:两边都基于 Agent Skills 开放标准,都能用"SKILL.md + YAML 元数据"沉淀团队套路。但 Claude Code 在"怎么控制模型何时触发技能、怎么让子代理隔离执行"这块讲得更体系化。市场层面,据报道 Claude Code 在企业客户里暂时领先,Netflix、Uber、Spotify 都在用。OpenAI 这次免费开放给所有用户试用(限时两个月),同时给付费用户翻倍配额,明显是想抢用户。OpenClaw:一个值得关注的参照说完官方产品,值得看一眼社区在做什么。OpenClaw(以前叫 ClawdBot)是个开源项目,做的事更激进:让 AI 不只写代码,还能帮你清邮件、订机票、管日程,像个住在电脑里的私人助理。有意思的是,OpenClaw 的作者 Peter Steinberger 说,他整个项目都是用 Codex 写的,生产力翻了一倍。但他同时推荐大家用 Claude 来跑 OpenClaw 的 Agent,因为 Claude Opus 4.5 更适合做通用任务。OpenClaw 说明一个趋势:大家对"能真正帮你干活的 AI"有强烈需求。Codex 加了 Skills 和定时任务,正是在往这个方向走。对你意味着什么如果你是开发者,这是个生产力工具。建议别从"写代码更快"来评估,而是从"把哪些重复劳动变成例行流程"来评估。比如:每天早上自动扫 CI 失败,归因并给出修复建议,结果进收件箱,你只做决策;每天自动生成 release 简报,把过去 24 小时的关键变更变成可读的文档;把团队最佳实践写成 skills,新人、外包、甚至另一个 agent,都按同一本操作手册来。如果你不是开发者,OpenAI 也想让你用上。GUI 比命令行友好,你可以用自然语言描述想要什么。Codex 这个名字听着像给程序员的,但 OpenAI 在公告里已经把它往更广的方向延伸,强调它正从"写代码"变成"用代码帮你把事办完"。普通人可能用得上的场景:你有一堆固定格式的文件要处理(发票、报告、统计表),让它定期整理成干净的表格或 PDF;你在做内容工作,每周把素材文件夹里的新内容归档、生成摘要,你只做最后审核。简单说,就是把你的重复性日常任务,让 Codex 写代码帮你完成。用量和定价这次发布配套的"放量"很明确:限时对 Free 和 Go 用户开放试用,Plus/Pro/Business/Enterprise 享受 2 倍用量限制。Sam Altman 说免费试用会持续两个月。建议趁免费期试试,尤其是多任务并行、定时任务和 Skills 功能,这三个才是这次更新的核心差异化。下载地址:openai.com/codex

115. 大模型Agent的核心还是prompt?

116. Agent时代,为什么多模态数据湖是必选项?

117. 关于 AI Agent,你最想知道的 3 个问题——为什么我说“垂直 Agent”是个伪命题回答几个读者问题。1、AI Agent 是否有一个权威的概念?中美两国对这个概念是否有统一的解释?AI Agent 的定义和国家无关,更多是行业共识的演进。目前业界比较认可的定义来自 Anthropic。他们在《Building Effective Agents》(网页链接)这篇文章中做了一个很重要的区分:工作流(Workflow):通过预定义的代码路径来编排 LLM 与工具的系统。Agent:由 LLM 动态地指挥自己的流程和工具使用方式的系统,始终由 LLM 来掌控完成任务的方式。简单来说,工作流是“人写好剧本,AI 照着演”;而 Agent 是“人给个目标,AI 自己想办法”。从技术实现角度,我比较认同 Simon Willison 提出的简洁定义(网页链接):一个 AI Agent(智能体),是为了实现某个目标,循环调用工具的大语言模型。这个定义抓住了 Agent 的本质——它不是一次性给出答案,而是通过“思考→行动→观察→再思考”的循环,逐步完成任务。目前主流的 Agent 实现,无论是 OpenAI 的还是 Anthropic 的,底层都是这个结构。当然,不同公司可能会根据产品定位给出略有差异的表述,但核心思想是一致的:Agent = LLM + 工具调用 + 自主决策循环。2、近期国内外大厂密集推出 AI Agent,为何选择这个时间点?您如何看待 AI Agent 的商业化前景?大厂在这个时间点密集推出 Agent,核心原因是:Agent 是目前 AI 落地最有价值的方向。为什么 Agent 比聊天机器人更有商业价值?聊天机器人的局限性很明显——它只能“说”,不能“做”。而 Agent 能够:• 调用工具:比如搜索网页、读写文件、执行代码• 完成复杂任务:把大任务拆解成小步骤,逐个完成• 与外部系统集成:对接企业内部系统、数据库、API• 持续运行:不需要人一直盯着,可以在后台自主工作这意味着 Agent 可以真正替代人完成一部分工作,而不只是辅助回答问题。已经跑通的场景:编程领域编程是 Agent 最先落地的领域。像 Claude Code、Cursor、Codex 这样的编程 Agent,已经能够实实在在地帮开发者完成任务,不只是生成代码片段,而是理解需求、读取项目代码、修改文件、运行测试、修复 bug,整个流程都能自主完成。正在爆发的方向:Skills 生态去年底开始,“Skills”这个概念开始流行。简单理解,Skills 就是教会 Agent 完成特定任务的“技能包”,一套预设的工具、提示词和工作流的组合。比如我个人就大量使用 Claude Code 结合各种 Skills 来提升效率:• 给文章自动配图(调用图片生成工具)• 根据素材生成漫画故事• 根据素材自动生成 PPT• 自动发布文章到公众号、博客、社交媒体• 等等这些任务以前每个都要花我半小时到几小时,现在几分钟就能完成。顺便说一下,我这几个 skills 都是开源的:github.com/JimLiu/baoyu-skills/issues现阶段的挑战但 Agent 目前仍处于早期阶段,主要挑战有:1. 门槛较高:目前这些能力主要在极客圈子里流行,普通用户上手困难2. 安全问题:Agent 需要较高的系统权限才能工作,这带来了安全风险。比如恶意的 Skill 可能窃取数据、攻击系统3. 可靠性:Agent 有时会“跑偏”,需要人工干预这些问题都在被逐步解决。大厂密集入场,本质上是看到了 Agent 的巨大潜力,想要抢占生态位。谁能率先建立起最多用户的 Agent 客户端和丰富的 Skills 生态,谁就能在下一阶段占据优势。就像现在 Anthropic 就依赖 Claude Code 抢占了先机和用户心智,大家想到 Coding Agent 先想到 Claude Code,MCP、Skills 的标准也是他们提出来的,开发者们争先恐后的基于他们的标准在构建 Agent 生态。3、通用类 AI Agent 和垂直类 AI Agent,您更看好哪个的商业前景?这个问题需要换个角度来理解。Agent 本身难以形成垂直壁垒从技术角度看,Agent 本身没有任何秘密,就像我前面说的,它从技术角度看就是一个循环调用工具的大语言模型。而模型对所有人来说都是一样的:要么花钱用商业模型(OpenAI、Anthropic、豆包、阿里),要么用 DeepSeek 这样的开源模型。这就像选操作系统,你用 Windows 还是 Linux,大家都能用。所以,单纯做一个垂直领域的 Agent 很难建立护城河。你今天能做,别人明天也能做,而且可能做得更好。真正的机会在哪里?打个比方:Agent 就像操作系统,无论是通用领域还是垂直领域,操作系统本身都差不多。真正的差异化,是基于操作系统之上的应用。垂直领域真正的机会在于:1. 独有的数据:你有别人没有的行业数据、客户数据、知识库2. 专业的 Skills:针对特定行业流程打造的工具和工作流3. 深度的集成:与行业内已有系统的对接能力4. 领域 Know-how:对行业痛点和流程的深刻理解举个例子:一个医疗领域的 Agent 产品,核心竞争力不是“Agent”这层,而是背后接入的医学知识库、与医院 HIS 系统的对接、对诊疗流程的理解、以及多年积累的脱敏病例数据。所以我的结论是:不要去做“垂直 Agent”,而是用通用 Agent 的能力,去解决垂直领域的问题。 护城河不在 Agent 这层,在你围绕 Agent 构建的数据、工具和行业理解。以上是我基于一线实践的观察和思考,仅供参考。

118. 想让 AI 自动读取 doc/docx 文档,再基于这些文档生成新文档,这种场景能做成 Skill 吗?可以,但做之前先想清楚一个问题:这是一次性任务,还是需要反复做的任务?如果只是一次性任务,没必要做成 Skill——Skill 的核心价值在于复用。如果是需要反复做的任务,建议按这个流程走:1. 先手动做几遍,沉淀最佳实践。摸清楚哪些步骤是固定的,哪些地方容易出问题,什么样的输出质量最好。2. 让 Agent 帮你创建 Skill。新开一个会话,在支持 Skills 的 Agent 里把任务完整做一遍,做完后告诉它:把刚才的操作创建成一个 Skill,方便以后复用。3. 用 Skill 做任务,持续迭代优化。以后都用这个 Skill 来执行任务。每次完成后检查输出,哪里不满意就告诉 Agent,让它改进并更新 Skill。简单说,Skill 就是可复用的最佳实践。先跑通流程,再固化成 Skill,然后在实战中不断打磨,这才是正确的使用姿势。

119. 漫剧产能困局正式迎来破局方案。 从创作到交付全流程效率提升,轻松批量产出精品。#大咖观察 #红衣聊AI #漫剧 #AIGC

120. AI猫片疯传,海螺一键复刻爆款! 让无数老外上头的AI猫片,还有兔子蹦床、Baby采访、食物吃自己,原来都是用海螺做的。 它有个「Agent」模式,简直是懒人福音,上传一张图,AI全自动干活,一键出片。 电商搞钱:AI模特走秀、商品广告,拍摄成本秒归零; 知识博主:让爱因斯坦给你讲课写板书,谁还敢说学不会; 剪辑师:无限的片头、空镜素材库,灵感用到飞起; 个人IP:AI写真、AI短剧,轻松打造一个永不塌房的虚拟爱豆。 它背后的Hailuo 02大模型,,在全球AI榜单上都是TOP级别的存在,难怪效果这么稳! 帮大家总结了爆款公式和赛道,快来试试吧! #AI #人工智能 #AIGC #AI视频 #海螺AI

121. 对AI的礼貌是人类的情感投射,对AI的直接才是效率的清醒。 #大咖观察 #红衣聊AI #人工智能 #科技的意义

122. 实测Agent Skills,一次编写,全网通用

123. AI agent到底有多大创新?

124. 现在Agent Skills 那么火,有什么强烈推荐的Agent Skills吗?

125. 不用 LangGraph / AutoGPT,纯 Python 手搓 AI Agent,真的可行吗?

126. RAG、LangChain、Agent 到底有什么关系?

127. Multi-Agent 小白入门:让你的Claude Code 提效 90.2% 这篇文章介绍了一种基于多智能体编排系统的方法,旨在通过让多个 AI 智能体分工协作, 来提升 Claude Code 的工作效率。1. 详细阐述了单智能体的局限性,并提出了主管模式、流水线模式和并行模式三种核心管理架构,以解决上下文限制和专业化不足等问题。2. 作者还提供了一套实战指南,教读者如何创建由架构师、构建师、验证者和记录员组成的四人智能体团队,并利用共享文档实现任务同步。原文:x.com/0xYuker/status/2013094122656334136#HOW I AI# #程序员#

128. 1人顶3团队?领英全栈模式颠覆职场规则。 #大咖观察 #红衣聊AI #办公软件 #科技

129. Vidu Agent 掀桌子!一张图直出 4A 广告大片,拿来直接投放

130. 回复@小超_Endless:github.com/vercel-labs/agent-skills //@小超_Endless:大佬分享一些web编程领域的skill呗//@宝玉xp:是的,像我这样一个人借助 Agent + 一些 Skills(还有些没发),能顶一个传统编辑团队了,后续会陆续分享一些具体用法和 Skill 的说明//@郑然:强烈推荐,用力转发。这是一套能很大程度上解放新媒体工作者的方法,但前提是硬着头皮把这套方法啃下来,用起来。这类方法,就是这个时代的算盘、计算器、Exc

131. AI Agent 要变强,有两条完全不同的路。一条是 Skill,也就是给自己装技能,把新能力直接塞进脑子里。另一条是 SubAgent,就像派小弟去干活,自己只看汇报。这两条路听起来都能让 Agent 更厉害,但适用的场景还是有所不同,用错了的话,你的 Agent 可能反而会越用越慢、越用越乱。Skills,就像是给主 Agent 装插件。比如你的 Agent 原本只会聊天,现在你想让它能写 PPT。Skills 的做法是:把写 PPT 的能力说明、工具调用方式、注意事项,全都塞进主 Agent 的上下文中。主 Agent 通过上下文学会了这项技能,它可以自己来写 PPT。第二种叫 SubAgent,就像是委托外包。同样是写 PPT,SubAgent 的做法是:主 Agent 把任务派给一个专门写 PPT 的 SubAgent,SubAgent 独立完成后把结果交回来。主 Agent 全程不参与具体执行,只负责派活和验收。一个是内化能力,一个是外包能力。听起来都能搞定任务,区别在哪?区别在上下文管理,上下文就是 AI 的记忆。你可以把 AI 的上下文想象成一张工作桌。桌子大小是固定的,你放的东西越多,就越难找到需要的那份文件。这就是上下文容量的问题。Skills 模式下,所有能力说明都铺在同一张桌上。好处是信息互通,主 Agent 能看到所有中间结果,推理过程连贯。坏处是桌子很快就乱了,Prompt 越来越长,能力之间可能打架,AI 开始犯糊涂。SubAgent 模式下,SubAgent 在另一张桌子上干活。干完把结果递过来,过程中产生的草稿、中间文件全留在那边。主 Agent 的桌面保持干净。代价是信息传递要设计好,不然关键信息可能在交接时丢了。这就是上下文污染问题,这里的污染不是夸张的比喻,是真实的工程瓶颈。什么时候用哪种?判断标准其实很简单:子任务有多复杂,以及你需不需要完成任务过程中产生的信息。Skills 适合的场景:任务本身不太复杂,或者你需要主 Agent 全程掌控。比如让 Agent 充当入口路由,根据用户请求加载不同的“场景模式”,像进入 YouTube 总结模式、进入写报告模式。这时候 Skills 的懒加载特性很香:先只加载能力名字和简介,真正要用时才加载完整说明。不像 MCP 那样一股脑把所有工具的详细文档全塞进上下文。SubAgent 适合的场景:子任务很重、很耗时、中间过程很啰嗦。最典型的例子是浏览器调试工具。Chrome DevTools 的 MCP 功能很强,但工具说明太臃肿,放进主 Agent 会严重占用上下文。把它封装成 SubAgent,你只需要说“去查日志、截图、分析一下”,它跑完把分析结论递回来。中间那些截图、DOM 树、网络请求细节,全都留在 SubAgent 那边,不污染主 Agent 的上下文。进阶玩法有意思的是,Skills 和 SubAgent 这两种模式可以结合。这技巧是从 @yan5xu 那里学来的(x.com/yan5xu/status/2003618544735649947)。第一种思路叫“先展开再压缩”。打个比方:你开了一个两小时的头脑风暴会,白板上写满了草稿、争论、被否决的方案。但最后写进会议纪要的只有三条结论。那些中间过程对得出结论很重要,但对后续执行的人来说是噪音。Agent 也可以这样操作。主 Agent 发现需要某个 Skill,加载进来,一通操作拿到结果。然后把从“加载 Skill”到“拿到结果”这整段过程折叠掉,只保留最终结论。对后续推理来说,就像开了一个会但只留下了会议纪要。第二种思路是用文件系统做“中转站”。想象你管理一个外包团队。你不会把所有需求细节都塞进一条微信消息里,而是说“需求文档在这个链接,去看”。外包团队交付时也不会把源码复制粘贴给你,而是说“代码在这个仓库,部署文档在这里”。Agent 之间也可以这样协作。主 Agent 委托任务时,不把冗长的背景资料直接写进指令,而是存成文档,只传一个地址。SubAgent 返回时也一样:交付一个简短的状态摘要——“完成了/卡住了/需要你决策”——加一个详细记录的文档地址。主 Agent 根据情况决定要不要点进去看细节。这样双方的上下文都保持精简。第三种是 Claude Code 里的实战技巧。上下文快见底时,让 Claude 把当前完成的工作总结成一份文档。然后用 rewind 功能回滚到任务开始前的状态,告诉它:“这件事我已经做完了,记录在这个文件里。”相当于什么?相当于你跑了一场马拉松,快到终点时发现体力不支。于是你把已经跑过的路线画成地图存档,然后“瞬移”回起点,精力充沛地说“我知道怎么走了,地图在这”。上下文被清空了,但成果保留了下来。用这个方法能在上下文耗尽前抢救一把。最后Agent 的竞争正在从“能调用多少工具”转向“怎么优雅地管理这些工具”。很多人追逐最新的 Agent 框架、最花哨的能力扩展,却忽略了最基础的问题:AI 的工作记忆是有限的,你怎么组织它,决定了它能做多复杂的事。Skills 和 SubAgent 不是非此即彼的选择,而是两种工具,用对场景才能发挥价值。说到底,Agent 架构设计和软件架构设计还是有很多相通之处。是把逻辑写在一个巨型函数里,还是拆成模块化的微服务?是共享全局变量图省事,还是严格隔离状态保持干净?这些老问题换了个皮,又回来了。

132. 放假前,抽空学一下吴恩达DeepLearning AI的这个教程吧:Agent Skills with Anthropic,内容包括:1. 使用开放标准格式和最佳实践来创建可复用的技能,并将它们组合起来构建复杂工作流。2. 为代码生成与评审流程、数据分析以及研究任务构建自定义技能,让你的智能体在需要时按需加载。3. 将技能与 MCP 以及子代理结合,打造具备专门知识并能够访问外部数据源的强大智能体系统。访问:www.deeplearning.ai/short-courses/agent-skills-with-anthropic/#HOW I AI# #程序员#

133. Agent store 平台 MuleRun (骡子快跑)海外走红,如何使用?有哪些信息值得关注?

134. 阶跃Step 3.5 Flash :春节 AI 混战杀出的黑马,正在 Agent 时代弯道超车

135. #HOW I AI# 支持一下我最近大量用 Agent Skills 提升效率。给文章配图就用文章配图 Skill 自动配图:网页链接封面图 Skill:网页链接写 PPT 就用写 PPT 的 Skill:网页链接还有一些画漫画的 Skill、抓 X 文章到Markdown的Skill而且都是开源的:github.com/JimLiu/baoyu-skills 网页链接唯一的问题是对于非技术人员门槛略高,但现在网上教程还挺多的。

136. 我写的 Skills 在 Manuas 里面运行效果也挺不错的,Manus 官方都在用我的 Skills 做演示$ npx skills add jimliu/baoyu-skillsSkills 地址:github.com/jimliu/baoyu-skills 网页链接

137. 想深度了解Claude Agent Skills,看这篇就行了AI Agent和工具(Tools)的热潮席卷了整个技术圈,几乎成了大模型应用的标配。然而,当我们深入剖析Anthropic Claude的Agent Skills实现时,却发现了一条与众不同的技术路径。它并非我们熟知的函数调用或插件执行。1. Skills 不是代码,而是高级“提示词模板”当我们谈论给AI增加“技能”时,脑海中浮现的通常是可执行的Python函数或API端点。Claude 的Skills与传统的函数调用或插件有着本质区别,它们不直接运行任何Python或JavaScript代码。Skills的真正作用是“提示词扩展(prompt expansion)”和“上下文修改(context modification)”。当一个skill被调用时,它实际上是向当前的对话历史中,动态注入了一段为特定任务量身定制的、极其详细的指令。这些指令会彻底引导Claude后续的思考方式和行为路径,就像给一个通用型专家临时“灌输”了某个领域的专业知识。它将AI能力的扩展与执行代码所带来的安全风险和复杂性完全分离开来,实现了前所未有的灵活性和安全性。Skills are not executable code. They do NOT run Python or JavaScript, and there’s no HTTP server or function calling happening behind the scenes. ... Skills are specialized prompt templates that inject domain-specific instructions into the conversation context.2. 没有算法路由,全凭大模型“自己决定”用哪个技能Claude选择使用哪个skill的决策过程也比较有特色。传统思路可能会涉及复杂的路由系统,比如基于关键词匹配、正则表达式、向量相似度搜索,甚至是专门的意图分类模型。Claude Agent Skills 将所有可用技能的名称和描述打包成一段文本,然后将这段文本作为名为Skill的“元工具(meta-tool)”的描述信息。当用户提出请求时,Claude就凭借其原生的、强大的语言理解能力,在一次完整的前向传播(forward pass)中,直接判断用户的提示词与哪个技能的描述最为匹配。这种设计体现了对大模型核心推理能力的极致信任,是一种“第一性原理”的体现。它没有在应用层添加任何复杂的工程逻辑,而是把决策权完全交还给了大模型本身。There is no algorithmic skill selection or AI-powered intent detection at the code level. The decision-making happens entirely within Claude’s reasoning process based on the skill descriptions provided. ... This is pure LLM reasoning.3. 独特的架构:技能信息不在System Prompt里,而在“工具”里许多AI系统(如ChatGPT)习惯于将可用的工具信息一股脑儿地塞进系统提示词(System Prompt)中。这种做法虽然直接,但当工具数量庞大时,会导致系统提示词变得异常臃肿和低效。Claude另辟蹊径。它的Agent Skills信息并不存储在系统提示词里。相反,所有的技能都被封装在一个名为Skill的“元工具”中。这个Skill元工具与其他标准工具(如Read, Bash)一起,并列存在于每次API请求的tools数组里。所有可用技能的列表,动态地构成了这个Skill元工具的描述部分。这种架构的优势显而易见:它极大地解放了系统提示词,让技能的管理变得更加模块化和动态化,可以根据会话需求灵活地加载或卸载,而不会污染全局的系统设定。4. 优雅的实现:一条消息给人看,一条“隐藏”消息给AI看一个优秀Agent系统的设计,必须在“用户透明度”和“界面简洁性”之间找到平衡。如果系统调用skill的过程完全隐藏,用户会感到困惑;如果把几千词的内部指令全部展示在聊天窗口,用户界面则会变得混乱不堪。Claude通过一个名为isMeta的布尔标志,巧妙地解决了这个矛盾。当一个skill被激活时,系统会向对话历史中注入两条消息:1) 第一条消息 (isMeta: false): 这是一条简短的元数据信息,比如“‘pdf’ skill正在加载”。这条消息在用户界面中是可见的,清晰地告知用户系统正在做什么。2) 第二条消息 (isMeta: true): 这条消息包含了完整的、可能长达数千词的SKILL.md指令内容。它在用户界面中是不可见的,但会完整地发送给API,作为Claude执行任务的详细行动指南。这种“双通道通信”机制既保证了用户对系统行为的知情权,又避免了海量的内部指令污染聊天界面,实现了极致优雅的用户体验。5. 终极心智模型:技能的本质是“上下文修改器”,而非“动作执行器”我们可以提炼出一个关于Claude Agent Skills的终极心智模型。如果说传统的工具是“动作执行器”(Action Executor)——执行一个动作,返回一个结果;那么Claude的技能则是“上下文修改器”(Context Modifier)。它的核心作用是修改两个层面的上下文:首先,它通过注入详细指令来修改对话上下文(conversation context),从而改变Claude的思考模式和工作流程;其次,它通过变更工具权限和模型选择来修改执行上下文(execution context),从而改变Claude在特定任务中被允许使用的能力。理解这个根本性的区别是掌握Claude Agent Skills的关键。Skills并不是直接去解决问题,而是通过“赋能”和“引导”的方式,让Claude本身变成一个能够更好地解决特定领域问题的专家。By treating specialized knowledge as prompts that modify conversation context and permissions that modify execution context rather than code that executes, Claude Code achieves flexibility, safety, and composability that would be difficult with traditional function calling.总之,Claude Agent Skills的设计哲学,为我们展示了一种与传统函数调用截然不同的AI能力扩展范式。它通过一种基于提示词的、精巧的上下文修改机制,实现了极高的灵活性、安全性和组合性,将大模型自身的推理能力推向了核心。#ai创造营# #程序员#

138. 未来办公已来:思必驰AI办公本X5系列,重新定义“高效”

139. 这是个好问题:> 随着基础模型继续进化,Skills 是否会逐渐被更强的自主规划取代?作为创业者现在去布局 Skills,究竟是短期红利还是长期壁垒?我的看法是:Skills 是短期红利,也是长期壁垒——但壁垒不在 Skills 本身。让我用 AI 发展的三个阶段来解释这个判断。第一阶段:AI Chatbot + Prompt回归第一性原理:AI 也好,Agent 也好,能解决问题才有价值。最早的 AI Chatbot 加上好的 Prompt,已经能解决很多「生成类」问题——回答问题、情感陪伴、翻译、写作、摘要。那时候 Prompt 就是短期红利。你会写出好的 Prompt,就能得到好的结果。我那时候花了大量时间研究 Prompt 工程,确实吃到了红利——很多网友就是那时候认识我的。但要说长期壁垒?没有。现在让 AI 辅助写 Prompt 已经不是什么难事了。不过,AI Chatbot + Prompt 只能解决生成问题,不能使用工具,不能与外部世界交互。第二阶段:AI Agent + 上下文工程然后是 AI Agent 的出现。Agent 能规划、能调用工具,解决了「与环境交互」和「完成特定目标」的问题。这时候 上下文工程(Context Engineering)就是短期红利。你知道怎么组织 Agent 需要的上下文,怎么在有限的上下文窗口里塞进足够的信息,那就是核心竞争力。但同样没有长期壁垒。很快模型越来越强,上下文窗口越来越大,上下文工程的最佳实践也逐渐系统化——比如借助文件系统压缩上下文、利用渐进式披露(Progressive Disclosure)解决工具描述占用太多 token 的问题。这些方法现在大家都知道了。第三阶段:Agent + Skills现在是 Agent + Skills 的阶段。Skills 解决的问题是:把特定工作流、特定领域的能力打包成可复用的「技能包」,让 Agent 之上可以长出丰富的应用生态。那些日常工作中琐碎但重复的任务,借助 Skill 的 Prompt 能力和工具能力,可以被高度自动化,带来巨大的效率提升。投资 Skills 是短期红利。 Skills 作为一种具体形式,可能会被更强的模型能力取代——也许未来模型足够强,不再需要人类预先打包好的「技能包」,它自己就能规划出最优路径。但问题来了:谁最能抓住这波短期红利?不是吹 Skills 的自媒体,而是真正懂 Prompt、懂上下文工程的人和团队。他们能借助之前积累的经验,快速做出真正解决问题的 Skills。投资的是能力,不是形式Skills 本身不会成为长期壁垒,但你在 Skills 上投入的学习和实践,会成为你的长期壁垒。这就像当年投资 Prompt 工程的人,后来更容易理解上下文工程;投资上下文工程的人,现在更容易做出好的 Skills。每一波技术浪潮的「短期红利」,都是下一波浪潮的入场券。所以我的建议是:不要纠结 Skills 会不会被取代,而是问自己:通过做 Skills,我能去解决什么问题?积累什么能力?这些能力在下一波浪潮里还有没有用?如果答案是肯定的,那就值得投入。

140. 快抄作业!我用JoyAgent搞了个AI团队 2025年都快结束了,Agent是不是还没用上? 我找到了打工人用上智能体的最简单方法, 就是用JoyAgent把每天重复的SOP全做成Agent, 不懂代码也能零门槛搭建,而且效果很稳定。 看着AI团队全自动打工、出活,非常解压。 #AI #智能体 #JoyAgent #JoyCode #京东云

141. 资源有限却心怀远大目标的时候, 掌握核心法则,小投入也能撬动大事业。#大咖观察 #红衣分享 #创业 #赚钱思维

142. Agent Skill 架构概述

143. Agent Skills 完全指南:从原理到实战彻底搞懂!

144. Cherry Studio + Claude Code:日常工作类 Agent Skills 最佳实践

145. 让 Agent 变得可靠、可控、可复用的高级技能包Skills是什么

146. “Agent Skills 推荐

147. 渐进式披露机制:Agent Skills 的核心设计理念

148. 【转载】使用 Agent Skills 为现实世界配备 agents

149. 一文速览Agent Skills

150. 如何借助Agent Skills为VSCode插入效率飞升的翅膀?

151. 普通人该用Skills还是Agent?5分钟带你秒懂

152. Agent Skills 全解析:定义、构建与示例

153. Agent Skills 在AI Native 知识库检索中的应用探索

154. 一文看懂Agent、Skills、MCP

155. 最近AI圈流行的Skills到底是什么?大白话讲

156. Langchain正式宣布,Deep Agents全面支持Skills,通用AI代理的新范式?

157. 一文讲清楚Claude Agent Skills篇,如何自定义Skills

158. 让Agent Skills 进行需求分析和技术方案设计

159. 3 分钟学会 Agent Skills Agent Skills 最近全网刷屏,但它到底是什么?跟我有什么关系?这期视频从“是什么、为什么、怎么用”三个层面,带你彻底弄懂这个 AI 新神器!#AI #Agent #智能体

160. 全网最强的Claude Code agent Skills指南(3)skills开发方式

161. 吴恩达×Anthropic 公开课:Skill、Tools、MCP与Subagents 彻底理解

162. 全网最强的Claude Code agent Skills指南(2)skills的价值和加载方式

163. Agent Skill 扫盲

164. 当我朋友问我:Agent Skill 到底有什么用?我写了一篇文章

165. agent 的 Skills

166. 使用 Agent Skills 做知识库检索,能比传统 RAG 效果更好吗?

167. 什么?Agent Skills在“货拉拉”AI应用尝试?

168. Agent Skills vs MCP 与常见 Agent Skills 介绍

169. 内容创作者必看:2026年最值得投入学习的9个Agent Skills清单

170. [解读官方文档] Agent Skills 最佳实践

171. 零门槛上手Agent核心实用技能

172. 用 Agent Skills 做知识库检索,能比传统 RAG 效果更优吗?

173. Agent Skills 入门和精通看这篇就够了!

174. Agent Skill:概念与使用

175. 什么是 Agent Skill?

176. 一期带你彻底搞懂 Agent Skills,从原理到实战! - 哔哩哔哩

177. Skills 比MCP好在哪儿?如何用Milvus-Skills 搭建知识库

178. Anthropic 推进 Agent Skills 开源 / 标准化:Agent 能力工程化

179. Agent Skills:理解Skill,定制Skill,什么时候需要Skill?

180. Agent Skills体验

181. 从原理到落地:Agent Skill 的设计与使用实践

182. 40 个 Agent Skills 精选资源:入门教程 + 实用工具 + 必装推荐

183. 一分钟搞懂Skills技能包😎

184. OpenClaw 技术解析:Agent Skills 机制与应用

185. 一篇完整了解如何安装和使用 Agent Skills

186. Anthropic揭秘Agent新范式:Skills技术或将改变大模型开发成本

187. Agent Skills:把你的 Claude Code升级为定制的工作平台

188. 动手写一个Agent Skill

189. OpenAI 长时间 Agent 实战指南:Skills、Shell 与上下文压缩

190. 如何在VSCode中使用Agent Skills

191. 基于Agent Skills的知识检索Skill

192. 分清AI AGENT和AI SKILLS,少走1年AI学习弯路

193. 用 Agent Skills 做日程管理——从设计到开源的技术复盘 🛠️

194. 重磅!主流Agent平台全员就位,Agent Skills终于实现无缝迁移

195. Agent Skills (Claude Skills) 详细攻略,一期视频精通

196. 什么是Agent Skills,它和Tool以及MCP有什么区别?

197. Agent Skills使用指南

198. 2026 最实用AI技能:Agent Skills深度解析! 🤖 你是否也有这种感觉: AI Agent 听起来很强,但真正用起来,却总感觉“不稳定、不好用”? 那可能你还没用过 —— Agent Skills。 这期视频,我会从 0 开始,带你完整理解 Agent Skills 是什么、怎么用、为什么它会成为 AI Agent 的下一代核心能力 👇 📌 本期视频你将学到: ✨ 什么是 Agent Skills?它和 MCP 有什么本质区别 ✨ 如何在 Claude Code 中配置并使用 Agent Skills ✨ 官方推荐的 Skill Creator,如何自动生成你自己的 Skill ✨ 真实案例:自动筛选简历 + 生成报告 + 发送邮件 ✨ Agent Skills 的运行原理,以及 Token 为什么更省 ✨ 去哪里查找、复用、下载现成的 Agent Skills 🧠 如果你是: 程序员 / 技术人员 HR / 运营 / 行政 想把重复工作自动化的人 正在研究 AI Agent、MCP、自动化流程 这期内容,一定值得你完整看完。 ⏱ 视频章节 00:00 Agent Skills 是什么 01:02 Claude Code 配置 03:52 Agent Skills 使用 05:13 Skill Creator 生成Skill 11:31 Agent Skills 测试 14:51 Agent Skills 运行原理 17:25 如何查找 Agent Skills 19:03 Agent Skills 对比 MCP 🔗 相关资源 Claude Code 安装配置:https://docs.bigmodel.cn/cn/guide/develop/claude Agent Skills 资源:https://skillsmp.com/zh Anthropic Skills 项目:https://github.com/anthropics/skills 你可以在评论区告诉我: 👉 你现在的工作中,最想用 Agent Skills 自动化的是哪一件事?

199. 学习Skills的最好方式,是花3分钟创建一个

200. Agent Skill 是 Anthropic 于 2025 年确立的开放式 AI Agent 构建标准,旨在解决传统提示词工程在企业级应用中的瓶颈,如上下文污染和复用性差等问题。Agent Skill 采用“渐进式披露(Progressive Disclosure)”架构,仅在推理过程中动态挂载必

201. Claude Skills 第一性原理:从「给工具」到「注入灵魂」,Agent 开发范式的真正革命

202. Claude Agent Skills 实测与分析开发 —— 一个面试辅导助手|完整版

203. claude-skills

204. Agent Skill 精选集:最值得收藏的 Agent Skills Top 10

205. Agent Skills技术协议与开源实现

206. Langchain学习手册(十)基于Langchain实现Skills

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章