AI Agent一进生产环境就崩?问题不在模型,而在Skills模块的可靠性设计缺失
04-13 13:14
精选参考来源
1. Agent Infra到底是什么?【AI基建】
哔哩哔哩 2025-10-15 00:00:00
2. Skills的本质是什么?
知乎 2026-02-14 00:00:00
3. Antropic这个视频视频“Don't Build Agents, Build Skills Instead“,讨论了智能体的发展方向。Claude认为,尽管代理很智能,但它们缺乏领域专业知识和持续学习能力,因此提出了一种名为技能(Skills)的新范式。这些技能本质上是组织化的文件集合,包括脚本和程序知识,充当领域专家的角色,使智能体能够更一致和高效地执行任务。技能的设计理念是任何人都可以创建和使用,并正在形成一个迅速增长的生态系统。一、Anthropic 为什么“放弃”传统 AI Agent核心原因只有一句话:现在 AI 的问题不在“不够聪明”,而在“没有专业经验”。大模型像智商很高但没上过班的新人,面对真实业务场景(财务、法律、工程、运营),稳定性和可靠性都不够。继续堆“更强的 Agent”解决不了这个问题。二、真正的瓶颈是什么不是推理能力,而是可复用的领域专业知识。现实工作需要的是“熟练工”,不是“天才从零推导”。三、Anthropic 的第一个关键转向通往数字世界的通用接口不是复杂工具,而是代码。只要 Agent 能写、能读、能改代码,它就能:1) 访问 API2) 操作文件系统3) 数据分析4) 生成结果而且代码是可调试、可修改的,比固定工具强得多。四、真正的颠覆点:不用复杂系统,只用“文件夹”Anthropic 用一个极端简单的方案解决“经验沉淀”问题:把专业知识封装成技能(Skill)= 一个有结构的文件夹。技能本质是:1 可执行或可调用的程序性知识2 放在文件里,能被版本管理、共享、复用3 需要时才加载,避免上下文爆炸这比“智能 Agent 自动学习一切”要现实得多。五、他们真正构建的不是 Agent,而是三层结构1 模型 = 处理器(负责思考)2 Agent Runtime = 操作系统(负责任务与资源调度)3 技能 = 应用程序(真正的业务能力)价值不在模型本身,而在“技能生态”。六、为什么这比 Agent 更重要因为技能让 AI 第一次拥有了可积累、可迁移、可复利的记忆。今天学到的流程,可以变成技能;明天、下个月、下个版本的 Claude 都能直接用;团队内部、社区之间还能共享。AI 不再每天“从头做人”,而是像员工一样越干越熟。总之,不要再指望一个“无所不能的超级 Agent”。真正有价值的是:一个通用 Agent + 一个不断增长的技能库。AI 的未来不止是“更聪明”,更是“更有经验”。#科技先锋官# #ai创造营#
新浪微博 2025-12-19 00:00:00
4. 无问芯穹首曝智能体服务平台,以基础设施加速企业级「智能体自由」
微信公众号 2025-12-16 00:00:00
5. 一文带你上手 Skills:构建可复用的 AI 能力体系
知乎 2026-01-21 00:00:00
6. 火爆全网的Skills,终于有了最简单的打开方式。
知乎 2026-01-20 00:00:00
7. OpenClaw 多 Agent 架构实战:一个 Gateway,多个智能体
知乎 2026-03-22 00:00:00
8. 3天赚1200刀?纯聊天就能捏出个能搞钱的 AI Agent!【教程】
哔哩哔哩 2026-02-24 00:00:00
9. 月之暗面直接把OpenClaw塞进Kimi里 Kimi Claw Beta上线,简单说就是浏览器里跑AI Agent,不用自己搭服务器装环境了 核心就三点:接入了ClawHub的5000+社区技能,比自建多好几倍;给了40GB云存储,Agent能记长期东西;搜索升级了,能抓Yahoo Finance实时数据 底层跑的是Kimi K2.5模型,万亿参数MoE架构,实际只激活320亿,性能实测超了Claude Opus 4.5。还有个Agent Swarm能并行跑100个子任务,速度提升4.5倍 最关键是那个Bring Your Own Claw,你可以把自己本地部署的OpenClaw接进来,本地控数据,云端用界面和技能库,灵活度拉满 国外已经有老哥拿来管课程、做闪卡、调度任务、搞智能家居自动化。不过也有担心安全的,毕竟目前缺合规认证,定位更像个人和小团队的原型工具,离企业级还有距离 但我觉得这玩意儿最大的意义,是把AI Agent的门槛从“配VPS”干到了“打开浏览器”。以前折腾OpenClaw得折腾半天,现在点一下就行#ai#
新浪微博 2026-02-19 00:00:00
10. 2026企业级智能体白皮书|甲子光年智库
微信公众号 2026-03-23 00:00:00
11. 实测用TRAE Skills接管工作流,打工人的自动化神器 #AI #AI编程 #TRAE #SOLO #Skills
抖音 2026-01-22 00:00:00
12. 现在Agent Skills 那么火,有什么强烈推荐的Agent Skills吗?
知乎 2026-01-20 00:00:00
13. Claude 的 Agent Skills 本质上就是:AI 模型不必把所有能力硬塞在绝对静态的“大脑”里,而是通过“可插拔技能模块”的方式,让模型在面对不同任务时“辅以专属插件/套路”。这种方式在软件工程里早就被验证为经典,比如插件系统、微服务、模块化设计。可以关注 Antropic 这个开源的 Skills 项目:github.com/anthropics/skills「Skills 是一组“指令、脚本、资源”的集合,Claude可以动态载入这些 Skills,从而在特定任务或领域里表现得更好、更定制化」#人工智能##程序员#
新浪微博 2025-10-19 00:00:00
14. 我用1400年前的三省六部制,搞了一套很酷的多Agent协同方案。
知乎 2026-04-02 00:00:00
15. 看看这篇论文"Where LLM Agents Fail and How They Can Learn From Failures" 对我们构建Agents有什么可以借鉴的↓一、Agent 设计1. Agent 应显式模块化为四大核心环节:- Memory(记忆):跨步检索过去状态、关键实体、任务目标。- Reflection(反思):判断上一步是否有效、目标是否达成。- Planning(规划):生成下一步策略,考虑约束与目标。- Action(执行):把规划转化为具体操作(API、点击、文本输出等)。2. 系统级模块要独立定义- System 模块单独追踪环境层问题,如 API 报错、超步长、网络错误。- 避免模型把这些外部失败“误归因”为自身逻辑错误。3. 每一步应有完整的四模块流水线每个 step 输出 <memory>、<reflection>、<plan>、<action> 四段内容。这让后续错误追踪、纠错具备结构化基础。4. 模块化输出格式化用明确标签 ...,确保后续调试能准确分区分析。对 Reflection、Plan、Action 模块统一采用自然语言模板输出。二、错误理解与防护层5. 错误不是孤立的,而是系统的绝大多数失败并非某一步的局部问题,而是“早期错误的放大效应”。6. Error Propagation(错误传播)是核心敌人一次错误记忆或误判,会导致后续所有步骤都偏离正确轨迹。所以设计 Agent 时,应重点强化 early-stage robustness。7. 每层的错误类型- Memory:记忆失败、虚构记忆、过度简化。- Reflection:进度误判、结果误读、错误归因。- Planning:忽略约束、不可能行动、低效计划。- Action:格式错误、参数错误、计划-行动不一致。- System:API、环境、步数上限、模型限制。8. “根因错误(Root Cause Error)”是比“错误点”更重要的概念根因定义:若修正此处错误,则任务能成功。其他错误可能是“衍生”或“掩盖”错误。9. 错误识别应遵循最早原则找到第一个导致结果不可逆的步骤,而不是最后失败时的那步。10. 错误标注应以模块为单位每一模块都单独判定错误类型,保持因果可追踪。三、Agent 自调试与学习机制11. AgentDebug 的三阶段循环非常值得模仿(1)细粒度错误映射(Fine-grained Analysis)(2)关键错误检测(Critical Error Detection)(3)迭代反馈执行(Iterative Feedback Rollout)12. Fine-grained Analysis 阶段可由 LLM 直接完成使用错误定义表(taxonomy definition)自动匹配模块输出,判断是否符合特定错误模式。13. Critical Error Detection 阶段要引入“反事实测试”模拟性地修改一个步骤,若任务成功,则说明该步是根因。可用 binary search 或最早匹配法来确定。14. 反馈生成要具备可操作性(actionable feedback)Feedback 不是总结,而是对下一步执行的“修改建议”或“策略指令”。15. Agent 应能在下一轮 roll-out 中读取上一次反馈相当于“带记忆的 retry”,让每次失败成为学习信号。16. Re-rollout 不必从头开始从根因错误所在的步骤重新执行,节省算力,提高修复效率。17. AgentDebug 的本质是“以 LLM 驱动的调试层”它可作为任何 LLM Agent 框架(如 ReAct、AutoGen)的外挂组件。18. Iteration 控制设置最大调试轮数(如 3–5 次),防止死循环。每次迭代记录失败原因与修复建议。19. 反馈结构标准化使用结构化 JSON 输出包含:{ "critical_step": x, "critical_module": "planning", "error_type": "constraint_ignorance", "correction_guidance": "考虑任务约束条件重新制定计划"}20. 建立自成长记忆(Self-Learning Memory)记录每次任务失败的根因 → 在新任务中预防重复错误。 类似“调试经验库(Debug Memory)”。四、数据与评估层(构建 AgentEval)21. 构建类似 AgentErrorBench 的内部测试集自己收集失败轨迹,手动标注错误类型和模块。用于回归测试与Agent鲁棒性评估。22. 聚焦三个代表性任务环境ALFWorld(具身交互)、GAIA(信息检索与推理)、WebShop(结构化交易场景)。分别对应不同 Agent 能力维度:感知、工具调用、交互执行。23. 评估指标要分层Step Accuracy:能否找到正确错误步骤。Step+Module Accuracy:能否同时识别模块。All Correct:步骤 + 模块 + 错误类型三者全对。24. 强调“检测准确率”和“任务恢复率”双指标检测正确 ≠ 任务成功;关键是能否利用检测结果指导恢复。25. 设计错误可视化工具使用 Sankey 或 heatmap 显示错误传播路径。可快速定位在哪些阶段最易出错。五、实践实现与架构优化技巧26. Prompt 层要分模块定义Memory、Reflection、Planning、Action 各有独立 prompt 模板。Prompt 中明确上下文依赖(Memory → Reflection → Planning → Action)。27. Reflection 模块应包含明确问句“是否完成任务?”、“上一步有效吗?”、“需要调整策略吗?”保证反思不是复述,而是真实的进度监控。28. 引入“Consistency Checker”在 Planning 与 Action 之间插入一致性验证器(plan–action alignment check)。29. 强化外部记忆的可控性限制记忆检索范围、使用关键片段索引,减少 false recall。30. 监控任务长度与中途崩溃对 step limit exhaustion 进行提前检测与主动调整。31. 测试小模型的鲁棒性时可配合 AgentDebug实验表明,小模型在有调试反馈时性能提升幅度更大。32. Debug 可与 Self-Refine、Tree-of-Thought 互补ToT 负责拓宽思考空间,AgentDebug 负责收敛错误与修复。33. 设计“学习率型调试”每次迭代调整反思深度或思维链长度,类似于 meta-learning。六、总体启发:让 Agent “学会失败”34. 失败不是终点,而是数据每一次失败都能产出一条训练样本:(错误类型 → 改进策略)。35. Agent 的进化逻辑从“执行任务”到“理解失败”再到“自我修正”,这一步是让 Agent 从工具变成认知体的关键。36. 未来方向构建“Debug Memory + Root Cause Feedback + Iterative Rollout”三位一体架构。让 Agent 不仅能反思,还能真正“debug 自己的反思”。如果你后续打算设计一个具备自调试能力的 Agent 框架,可以直接基于本论文提炼出一个五层结构原型:> Memory → Reflection → Planning → Action → Debug Layer(AgentDebug)其中 Debug Layer 执行 “错误识别 → 根因检测 → 修复反馈 → Re-rollout”。论文:www.researchgate.net/publication/396048725_Where_LLM_Agents_Fail_and_How_They_can_Learn_From_Failures#人工智能##ai创造营#
新浪微博 2025-10-26 00:00:00
16. MCP vs. Skills?智能体协议之争的答案在于执行环境
知乎 2026-04-11 00:00:00
17. 刚刚,阿里ATH事业群甩出王炸「悟空」!企业级正规军下场,龙虾们这次真要炸了
微信公众号 2026-03-17 00:00:00
18. 【Claude Code的技能系统:百个技能背后的九大类型与最佳实践】快速阅读:Anthropic团队在Claude Code中实际使用了数百个技能,总结出9大类型和若干制作原则。技能的本质是可包含脚本、数据的文件夹系统,而非简单的文本说明。最有效的技能往往专注于“反常识”信息,通过渐进式披露避免过度引导。---技能系统已经成为Claude Code最常用的扩展机制。但灵活性也带来困惑:什么样的技能值得做?好技能的秘诀是什么?Anthropic内部运行着数百个活跃技能。这些经验可能有参考价值。一个常见误解是把技能当“markdown文件”。实际上,技能是包含脚本、素材、数据的文件夹——Agent可以发现、探索、操作这些内容。最有意思的技能都在创造性地使用配置选项和目录结构。九种类型技能大致分九类。好的技能清晰归属其一,混乱的往往跨越多个类别:1. 库与API参考 解释如何正确使用内部库、CLI或SDK。包含代码片段库和常见陷阱清单。比如:billing-lib(内部计费库的边界情况和易错点)、frontend-design(让Claude更好地遵循设计系统)。2. 产品验证描述如何测试代码是否工作。常与Playwright、tmux等外部工具配合。有价值的做法包括:让Claude录制测试视频,在每步强制状态断言。值得工程师花一周时间打磨验证技能。3. 数据获取与分析连接数据和监控栈。包含获取数据的库、凭证、仪表板ID,以及常见查询工作流。例如funnel-query定义了“从注册到激活到付费”需要join哪些事件表。4. 业务流程与团队自动化将重复工作流自动化为一条命令。通常较简单,但可能依赖其他技能或MCP。保存之前结果到日志文件,帮助模型保持一致性。如standup-post聚合ticket、GitHub活动和Slack历史,生成格式化的站会更新。5. 代码脚手架与模板为特定功能生成框架样板。当脚手架有自然语言需求、无法纯靠代码覆盖时特别有用。6. 代码质量与审查强制执行代码质量。可以包含确定性脚本以提高鲁棒性,可能作为hook或GitHub Action自动运行。adversarial-review会生成一个“全新视角”的子Agent来批评代码,实现修复,迭代直到问题降级为吹毛求疵。7. CI/CD与部署帮你获取、推送、部署代码。babysit-pr监控PR、重试不稳定的CI、解决合并冲突、启用自动合并。8. Runbook接收一个症状(Slack线程、告警、错误签名),执行多工具调查,产出结构化报告。9. 基础设施运维执行日常维护和操作流程——有些涉及破坏性操作,需要护栏。比如<resource---制作要点+ 别说废话Claude Code已经了解你的代码库,Claude本身也懂编程。如果你的技能主要是知识传递,专注于那些能推Claude脱离默认思维的信息。frontend-design技能就是好例子——它通过与用户迭代,避免Claude总用Inter字体和紫色渐变。+ 建立Gotchas章节技能中信号最强的内容。这些章节应该从Claude使用技能时的常见失败点累积而来。你需要持续更新技能来捕获这些坑。+ 利用文件系统与渐进式披露技能是文件夹。把整个文件系统当作上下文工程和渐进式披露。告诉Claude技能里有什么文件,它会在合适时机读取。最简单的形式是指向其他markdown文件,比如把详细的函数签名和用例拆到references/api.md。你可以有references、scripts、examples等文件夹。+ 避免过度引导Claude会尽量遵循指令。因为技能高度可复用,小心别太具体。给Claude需要的信息,但保留适应情境的灵活性。+ 考虑设置流程有些技能需要用户提供上下文。比如发送站会到Slack的技能,可能要问发到哪个频道。好做法是在技能目录下存config.json。如果配置未设置,Agent就问用户。+ 描述字段是给模型看的Claude Code启动会话时,会构建所有可用技能的清单及其描述。这个清单是Claude扫描的依据——“有没有适合这个请求的技能?”所以描述字段不是摘要,是触发条件。+ 记忆与数据存储有些技能通过在内部存储数据来实现记忆。可以简单到追加日志文件、JSON文件,复杂到SQLite数据库。比如standup-post技能可能保存standups.log,记录每次发的内容,下次运行时Claude读自己的历史,知道昨天以来发生了什么。技能目录中的数据可能在升级时被删除,应存到稳定文件夹,目前提供${CLAUDE_PLUGIN_DATA}作为每个插件的稳定存储。+ 存储脚本与生成代码给Claude代码是最强大的工具之一。给Claude脚本和库,让它把精力花在组合上、决定下一步做什么,而不是重构样板。比如数据科学技能可能有从事件源获取数据的函数库。为了让Claude做复杂分析,给它一组辅助函数。Claude随后即时生成脚本组合这些功能,回答“周二发生了什么?”这类问题。+ 按需Hook技能可以包含只在调用时激活、持续整个会话的hook。用于你不想一直运行、但有时极有用的强意见hook。例如/careful通过PreToolUse匹配器阻止rm -rf、DROP TABLE、force-push、kubectl delete。你只在知道要碰生产环境时才需要它——一直开着会逼疯人。---分发技能共享技能有两种方式:- 把技能签入repo(./.claude/skills下)- 做一个plugin,建立Claude Code Plugin市场,用户可以上传和安装小团队在少数repo间工作,签入repo效果不错。但每个签入的技能都会给模型增加上下文。规模扩大后,内部插件市场允许你分发技能,让团队决定安装哪些。+ 管理市场我们没有中心化团队决定;而是有机地发现最有用的技能。如果有技能想让人试用,可以上传到GitHub沙盒文件夹,在Slack等地方给链接。一旦技能获得关注(由技能所有者决定),他们可以提PR移到市场。警告:创建糟糕或冗余的技能太容易了,发布前确保有某种策展方法。+ 组合技能你可能想让技能互相依赖。比如文件上传技能,CSV生成技能制作CSV后上传。这种依赖管理还没原生内置到市场或技能中,但可以按名称引用其他技能,模型会在安装时调用它们。+ 测量技能为了了解技能表现,我们用PreToolUse hook记录公司内部技能使用情况。这样能找到受欢迎的技能,或相对预期触发不足的技能。技能是强大而灵活的工具,但仍处于早期,大家都在摸索最佳用法。把这些当作有用提示的集合,不是权威指南。理解技能的最佳方式是开始、实验、看什么有效。我们的大多数技能都始于几行字和一个坑,因为人们在Claude遇到新边界情况时不断添加而变好。ref: x.com/trq212/status/2033949937936085378#AI创造营##人工智能#
新浪微博 2026-03-22 00:00:00
19. 一文带你看懂,火爆全网的Skills到底是个啥。
知乎 2026-03-17 00:00:00
20. Skills的本质是什么?
知乎 2026-01-30 00:00:00
21. 深度|暗壳AI Agent2.0:破局人居行业,链接“设计与交易”的一站式创作生态平台
微信公众号 2026-03-16 00:00:00
22. 有哪些搭建agent的框架是必须掌握的?
知乎 2025-10-21 00:00:00
23. 最近,360安全团队发现了OpenClaw一个高危漏洞。 OpenClaw创始人随后邮件确认了这个漏洞。而发现这个漏洞的,不是某个安全专家,而是一个我们刚发布不到一周的智能体。#openclaw #网络安全 #红衣聊AI #安全漏洞
抖音 2026-03-23 00:00:00
24. 每天120万亿Tokens:Seedance 2.0和ArkClaw龙虾,让豆包大模型调用量炸了
微信公众号 2026-04-02 00:00:00
25. 在线调试常遇到AI半途放弃、只修表面问题、频繁原地打转,不仅效率低还容易错过关键Bug。tanweai/pua 这个开源 AI Coding Agent 技能插件,通过“大厂PUA话术”驱动 AI 穷尽所有方案,提升至少50%能动性,让AI主动查阅源码、验证环境、主动出击。核心特点:- 大厂级“PUA话术”逼迫AI不轻言放弃- 调试方法论贯穿全流程(闻味道→揪头发→照镜子→执行→复盘)- 多重能动性鞭策,避免暴力重试、甩锅、被动等待等偷懒模式- 可集成Claude Code、OpenAI Codex CLI、Cursor、Kiro等主流AI平台- 自动触发失败检查清单及手动/pua命令触发,覆盖调试、实现、部署等多种开发任务真实案例显示,pua skill能显著提升bug修复点数和隐藏问题发现率,强制AI跳出死循环,查日志读源码,直至找到根本原因。项目地址👉 github.com/tanweai/pua 在线体验👉 pua-skill.pages.dev用上它,做 P8 级工程师也不怕AI半途而废,效率飞跃提升!#AI创造营##人工智能#
新浪微博 2026-03-11 00:00:00
26. Antropic Claude 推出新概念 Agent Skills,让 Claude 从“通用模型”进化为“可编程的专用智能体”,它通过可加载的技能体系,将人类的知识和流程转化为可复用的智能模块。1. 核心概念:Agent Skills 是一种“技能包”,由说明文档、脚本和资源组成。Claude 可以在需要时动态加载这些技能,而不是一开始就加载全部上下文。2. 作用:让 Claude 能执行特定领域的任务,比如处理 PDF、填写表单、运行脚本、执行数据分析等,相当于给 Claude 增加“专业模块”。3. 结构:每个 Skill 是一个文件夹,核心文件是 SKILL.md,包含技能的元数据(名称、描述)和使用说明;也可包含其他资源文件或可执行代码。Claude 根据任务需要,分层加载这些内容。4. 原理:Claude 先读取每个技能的基本信息,当判断某个技能相关时,再逐步加载其详细内容或脚本执行逻辑,实现「渐进式上下文披露」。5. 优势:(1)增强 Claude 的专业性与上下文理解;(2)减少 token 占用,提高执行效率;(3)让组织可复用知识,把程序性经验打包成模块化能力。6. 安全与可扩展性:Skills 可以自由创建与共享,但要注意代码安全和上下文来源;未来 Claude 还将具备自动创建、评估和优化技能的能力。Blog:www.anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills#人工智能##程序员#
新浪微博 2025-10-17 00:00:00
27. AI编程代理经常缺乏生产级工程技能,容易跳过规格编写、测试验证、代码审查等关键步骤,导致代码质量低下、后期维护成本高。agent-skills 为AI编码代理提供生产级工程技能包,覆盖从需求定义到部署上线全开发生命周期的最佳实践。包含19个结构化技能工作流和7个斜杠命令,支持Claude、Cursor、Gemini CLI等多平台AI工具,让代理像资深工程师一样规范开发。GitHub:github.com/addyosmani/agent-skills主要功能:- 7个开发生命周期命令:`/spec`(规格先行)、`/plan`(任务分解)、`/build`(增量实现)、`/test`(测试验证)、`/review`(代码审查)、`/code-simplify`(代码简化)、`/ship`(安全部署);- 19个核心技能:从`idea-refine`(想法提炼)到`shipping-and-launch`(上线发布),每个技能包含步骤、工作流验证和反合理化表;- 专业代理角色:`code-reviewer`(资深工程师视角)、`test-engineer`(测试专家)、`security-auditor`(安全审计);- 参考清单:测试模式、安全检查、性能优化、无障碍标准等快速参考;- Google工程实践:集成Hyrum's Law、测试金字塔、Chesterton's Fence、Trunk-based Development等实战经验;- 多平台集成:Claude Code一键安装,Cursor规则文件,Gemini原生技能,支持任何Markdown提示的AI代理。通过`git clone`本地运行或Marketplace安装,适合开发团队、AI代理爱好者和工程实践训练。#AI编程# #工程技能# #AgentSkills#
新浪微博 2026-04-06 00:00:00
28. 在线开发智能代理系统遇到上下文管理难题?推荐看看 muratcankoylan 的开源项目「Agent Skills for Context Engineering」,这是一个面向生产级 AI 代理系统的全面技能库。它提供了完整的上下文工程方案,涵盖基础理解、架构设计、多代理协作、工具开发、评估优化等多维度技能,帮助你科学管理语言模型的上下文窗,实现最高效的上下文利用和智能决策。主要亮点:- 深入讲解上下文衰减、压缩和优化,避免模型“迷失中间”;- 支持多代理架构设计,含监督者模式、图谱记忆、沙盒环境等;- 提供完善的评估框架,支持LLM作为裁判进行性能对比和偏差缓解;- 包含项目开发全流程指导,从概念设计到流水线部署;- 独家认知架构技能,形式化建模代理心智状态,实现理性推理与解释;- 跨平台、通用原则,适配Claude Code、Cursor等主流代理平台。GitHub:github.com/muratcankoylan/Agent-Skills-for-Context-Engineering无论你是搭建单一代理还是多智能体系统,这套技能库都能助你构建、优化和调试高效智能体,推荐 AI 开发者和研究者深入学习!#AI创造营##人工智能#
新浪微博 2026-03-02 00:00:00
29. 为什么在生产环境部署多智能体系统(Multi-Agent)容易出现成本失控,有哪些常见的踩坑场景?
知乎 2025-12-05 00:00:00
30. 构建 Claude Code 的经验:Anthropic 如何运用 Skills 技能
知乎 2026-03-18 00:00:00
31. DeepSeek V3.2来了,首个会"思考"的Agent模型,首个开源性能打平GPT-5的模型
微信公众号 2025-12-02 00:00:00
32. 「Github一周热点101期」IT咖啡馆的开源项目,cowork的开源替代大批出现
哔哩哔哩 2026-01-24 00:00:00
33. 删掉 OpenClaw!Hermes Agent 才是真王炸,一键本地部署 +模型接入全教程(避坑指南) | 零度解说
哔哩哔哩 2026-04-11 00:00:00
34. Hermes Agent 势头很猛,这几天推荐的人很多,可以关注一下。我自己安装试用了还可以。Hermes Agent 是由 Nous Research 在今年 2 月底开源的 AI 智能体框架,上线不到两个月,GitHub 星标已经接近三万。这个项目被社区认为是 OpenClaw(龙虾)上线以来,第一个真正意义上的竞争对手。两者都是自托管的开源智能体,都能接入 Telegram、Discord、Slack、WhatsApp 等聊天平台,都支持多模型切换,都走 MIT 协议。但设计哲学完全不同。【1】龙虾是网关,Hermes 是引擎OpenClaw 的核心是一个 Gateway(网关守护进程),负责统一管理会话、路由和渠道连接,像一个调度中心,把你的各种聊天应用连接到 AI agent。你可以理解为它是一个“多渠道个人助理操作系统”。Hermes Agent 的核心则是 agent 自身的执行循环。它不是围绕“怎么把消息送到 agent”来设计的,而是围绕“agent 怎么变得越来越强”来设计的。官方管这叫 closed learning loop(闭环学习循环)。【2】会自己写技能的 agent这是 Hermes 最有意思的地方。当它完成一个复杂任务(通常涉及五次以上工具调用)后,会把整个过程沉淀成一份结构化的技能文档,存成 Markdown 文件。下次遇到类似任务,直接加载这份技能,不用从头解决。更关键的是,这些技能在使用过程中会自我迭代。如果 agent 在执行技能时发现了更好的方法,它会自动更新技能文档。有 Reddit 用户反馈,agent 在两小时内自动生成了三份技能文档后,重复性研究任务的速度提升了 40%。OpenClaw 也有技能系统,但主要依赖人工编写和社区贡献的技能市场 ClawHub。Hermes 这边等于把“写技能”这件事也交给了 agent 自己。【3】记忆体系的差异两者都声称有跨会话记忆能力,但实现方式不同。Hermes 用 SQLite 配合 FTS5 全文检索,把所有历史对话存下来,需要时通过搜索加 LLM 摘要召回。它把记忆分成两层:一层是常驻的关键信息(写在 MEMORY.md 里,每次对话都注入上下文),另一层是全量历史检索(容量无限,按需调用)。OpenClaw 同样用 Markdown 文件存储记忆,也支持 SQLite、QMD 等多种检索后端,通过 memory_search 工具做语义或混合检索。它的特色是在上下文压缩前会执行一次静默记忆写入,防止压缩丢信息。官方的设计原则是"无隐藏状态",记忆就是工作区里可读可编辑的文件。两者的核心差异在于:Hermes 更强调对全量历史对话的检索和总结能力,像给 agent 装了一个搜索引擎;OpenClaw 更强调记忆的透明性和可编辑性,用户能直接看到和修改 agent 记住了什么。【4】安全思路也不一样Hermes 搞了一套五层纵深防御:用户授权、危险命令审批、容器隔离、凭据过滤、上下文注入扫描。默认对高风险操作(比如执行终端命令、写文件)要人工审批,超时未批准就自动拒绝。OpenClaw 这边则更强调信任模型和配置审计。它提供了 openclaw security audit 命令,可以一键扫描网关配置的安全隐患。但 OpenClaw 在安全方面的历史记录不太好看,今年 2 月被曝出多个高危漏洞,13.5 万个实例暴露在公网上,技能市场也有超过 300 个恶意技能被发现。【5】要不要换或者选哪一个如果你日常用的 Agent 已经顺手,没必要。如果你之前的龙虾主要是 claude code 的授权现在用不了可以试试这个,但不能保证继续用多久。如果喜欢折腾想试试不同的选择,也可以试试。如果你想要一个“多渠道助理平台”,接入各种聊天工具,用社区现成的技能市场,OpenClaw 的生态更成熟,34.6 万星标不是白来的。如果你更关心 agent 的长期进化能力,想让它用得越久越聪明,或者你是做 AI 研究的,需要生成训练轨迹、跑强化学习实验,Hermes 的架构更对口。它还内建了一个兼容 OpenAI API 的服务端,可以直接作为后端接入 Open WebUI 等第三方界面。Hermes 跑在 5 美元一个月的 VPS 上就够用,也支持 Docker、SSH 远程、Modal 等 serverless 方案。安装只需要一行 curl 命令。安装不复杂,参考官方文档即可:网页链接爱马仕的英文也是 Hermes。 宝玉xp的微博视频
新浪微博 2026-04-08 00:00:00
35. AI Agent落地“卡壳”?腾讯云用100毫秒沙箱打通“最后一公里”|甲子光年
微信公众号 2025-12-26 00:00:00
36. 如果你想高效利用Claude Code进行大规模项目开发,这篇六个月深度实战总结绝对值得一读。作者独自重写30万行代码,打造了以下几大核心系统:1. 技能自动激活系统(Game Changer!) 通过自定义TypeScript钩子(UserPromptSubmit和Stop Event Hook),自动识别当前编辑内容和用户意图,智能加载相关技能并提醒Claude遵循最佳实践,彻底解决了技能“摆设”问题。配置中心是skill-rules.json,定义关键词、意图模式、文件路径等触发条件。2. 模块化技能设计(500行规则) 避免单个技能文件过大导致上下文限制,采用主技能文件+多个资源文件的渐进式加载,显著提升token利用率和响应效率。3. 开发文档系统,防止Claude“失忆” 为每个大任务创建三个文档(计划、上下文、任务清单),通过自定义slash命令自动生成和更新,确保Claude在多轮对话中始终保持正确上下文和规划。4. PM2进程管理,后台调试利器 用PM2管理七个微服务,实现实时日志读取、自动重启和性能监控,让Claude可以自主读取日志、定位问题、重启服务,极大提升调试效率。5. 钩子体系确保“零遗漏” 包括文件编辑追踪、构建检查、错误处理提醒等钩子,自动检测TypeScript错误并提醒修复,确保代码质量和格式统一,杜绝“漏网之鱼”。6. 专用Agent军团,任务分工明确 包括代码架构审查、错误修复、测试路由、战略规划等10个专用agent,针对具体任务精准输出,避免过度泛化。7. 附属实用脚本与工具 诸如测试认证路由的脚本、数据库重置、Mock数据生成等,均附着于技能中,方便Claude调用,避免重复造轮子。8. 合理分工文档与技能 技能负责通用最佳实践和模式,文档聚焦项目架构、数据流、API等具体内容,形成清晰职责分离,提升Claude理解与执行力。9. Prompt技巧与复盘 强调详细明确的需求描述,避免引导性问题,多次重提和调整prompt以获得更优输出。10. Slash Commands极大简化交互 设计多条自定义命令,快速生成开发文档、执行代码审查、运行测试等,极大提升工作流效率。作者坦言,这套体系花了数月打磨,但效果显著:Claude自动激活技能、一致遵守代码规范、快速定位和修复错误,单人完成了原本需要多人协作的大型重构,质量和效率双提升。如果你正苦于AI助手技能难用、代码质量参差不齐、项目上下文频繁丢失,不妨参考这套基于钩子和自动激活的Claude Code基础架构。它将让你体验到真正的“AI协作开发”而非被动工具。详细源码和文档地址:github.com/diet103/claude-code-infrastructure-showcase🔗 www.reddit.com/r/ClaudeAI/comments/1oivjvm/claude_code_is_a_beast_tips_from_6_months_of/---总结:- 规划先行,技能+钩子实现自动激活 - 文档系统锁定上下文不迷失 - PM2管理微服务,实时调试无压力 - 钩子链保证代码零错误 - 专用Agent分工明确,效率倍增持续优化你的AI开发环境,放胆用Claude Code打造你的下一个爆款项目吧!
新浪微博 2025-10-30 00:00:00
37. 在线开发经常需要不同领域技能之间切换,选错工具导致效率大打折扣。Claude Skills 整合了 66 项专为全栈开发者设计的专业技能,涵盖前端、后端、测试、DevOps、安全、数据等多个领域。用它配合 Claude 代码助手,可以让 AI 变成你的全能资深编程搭档。不仅支持自动根据需求激活对应技能,还能组合多技能完成复杂任务,比如从需求到测试上线整个开发流程辅助;还有丰富参考资料和项目工作流命令,支持与 Jira、Confluence 等工具集成。GitHub:github.com/Jeffallan/claude-skills 主要优势:- 66 个细分技能,覆盖 12 大技术类别,资深专家级能力;- 自动根据上下文激活对应技能,极大提高代码生成精准度;- 多技能联动支持复杂业务开发、调试、测试和安全加固;- 丰富的参考文档和决策树,便于快速理解和应用;- 工作流集成 Atlassian 工具,支持项目从需求到回顾全链路管理;- 跨语言支持,涵盖 Python、JavaScript、DevOps 脚本等多种技术栈。适合全栈开发人员、技术负责人和敏捷团队打造高效协作开发环境。#AI创造营##人工智能#
新浪微博 2026-03-06 00:00:00
38. 数据科学工作流程复杂,涉及规划、执行、验证和反思多个环节,单靠传统工具难以高效协作和持续优化。Agentic Data Scientist 是一个基于多智能体架构的开源框架,利用 Google Agent Development Kit 和 Claude Agent SDK,实现了从智能规划到分阶段执行再到持续校验的闭环工作流。它能自动拆解任务,迭代优化方案,结合先进的科学技能库和模型上下文协议工具接口,帮助数据科学家高效完成复杂分析任务。主要功能包括:- 自适应多智能体协同工作,迭代规划与执行保障质量;- 任务分阶段管理,实时跟踪成功标准与进度;- 集成 Claude 科学技能库,支持多种科学计算和数据处理;- 文件管理与网络检索工具,方便数据导入与外部信息获取;- 灵活部署,支持命令行快速启动,满足多场景需求。适合需要系统化、多步骤数据分析的科研人员与工程师,项目地址:github.com/K-Dense-AI/agentic-data-scientist从规划到总结,Agentic Data Scientist 用智能化分工和不断的自我校正,助力数据科学项目更高效、更可靠地推进。
新浪微博 2025-11-22 00:00:00
39. 在智能体开发中,经常面临模型智能与多样工具、记忆和安全治理的整合难题。OpenHarness 是一个轻量级的开源 Agent Harness 框架,专为研究者和开发者设计,提供了完整的智能体基础设施。它不仅支持丰富的 43 种工具(文件、Shell、搜索、Web、任务管理等),还能动态加载 40+ 技能,支持插件生态扩展,还拥有细粒度多级权限治理和多智能体协作能力。核心特点包括:- 持续的 Agent 循环(流式工具调用,API 重试,代币计数等)- 丰富的工具和技能支持,结合 Anthropic 生态兼容性强- 持久化记忆、上下文压缩与会话续接- 多重权限管理,交互式审批保障安全- 多代理团队协作和任务委派- React 终端 UI,提供交互式命令选择和权限弹窗支持 Python 3.10+,提供一键命令行启动(`oh`),适合构建定制化智能体及多任务协作系统。GitHub:github.com/HKUDS/OpenHarness主要功能:- 43 种工具:文件操作、Shell 命令、网络搜索、任务管理等- 40+ 按需加载技能,涵盖代码提交、测试、安全审查等- 灵活插件系统,方便自定义命令、事件钩子和多智能体- 多级权限配置,确保执行安全- 多智能体协调,支持子智能体创建和团队管理- 交互式 React 终端UI,提升用户体验如果你想了解国产版 Claude 轻量实现,或是打造高效可扩展的智能体框架,OpenHarness 绝对值得一试!#开源智能体# #AgentHarness# #AI开发#
新浪微博 2026-04-04 00:00:00
40. 在线开发中,构建高效智能AI代理系统是一大挑战,各种技能、记忆管理、安全检测、持续学习等环节缺一不可。Everything Claude Code 是一套开源的AI代理性能优化系统,专为Claude Code、Codex、Opencode、Cursor等多平台AI工具打造。它不仅集成了丰富的智能子代理(code-reviewer、security-reviewer等),还有自动学习的“本能”系统,助力代码质量、测试驱动开发、自动安全扫描,真正实现生产级别的多技能智能协同。GitHub:github.com/affaan-m/everything-claude-code主要功能:- 多平台全兼容,支持Claude Code、Codex、OpenCode、Cursor等主流AI编码工具;- 完善的技能库,覆盖测试驱动开发、代码审查、安全审核、E2E测试、文档更新等工作流;- 强大的Hook机制,自动触发格式化、secret扫描、上下文持久化等操作;- 持续学习系统,自动提取开发“本能”,提升智能决策能力;- 多Agent协作支持,拆解复杂任务、多线程执行更高效;- 集成AgentShield安全扫描,1282项规则全面保障代码安全;- 详细操作指令和跨平台安装脚本,2分钟极速上手。适合开发者、团队追求极致AI辅助开发体验的必备利器。#AI开发# #智能代理# #开源神器#
新浪微博 2026-03-19 00:00:00
41. 《Agent Design Is Still Hard》近日,有开发者分享了构建智能代理(agent)的一些深刻体会:尽管技术进步明显,做一个稳定、高效的代理依然充满挑战。他们总结了几个关键点:1. SDK选择难题 代理开发中,底层SDK(如OpenAI、Anthropic)与高层抽象库(如Vercel AI SDK)各有利弊。高层SDK看似便利,但在实际工具调用时常常出现兼容和缓存管理问题,反而不如直接用底层SDK灵活。尤其是模型差异大,定制专属代理抽象层更靠谱。2. 缓存管理的重要性 以Anthropic为例,手动管理缓存虽初看麻烦,但带来更可控的成本和更灵活的对话分支、上下文编辑能力。这种显式缓存让代理能更精准地掌控状态和资源,提升效率。3. 强化反馈机制不可少 每次工具调用后,代理不仅接收输出,还能基于任务目标和执行状态反馈信息,动态调整策略。例如失败时注入提示,帮助代理回退重试,避免持续错误影响整体流程。4. 失败隔离策略 通过子代理单独处理可能反复失败的任务,避免主流程被干扰。同时,Anthropic支持的上下文编辑能剔除无效失败信息,保持迭代上下文清晰,尽管这会牺牲缓存。5. 子代理与共享文件系统 多工具、多子代理协作时,统一的虚拟文件系统成关键。图像生成、代码执行等工具共享文件路径,避免“死胡同”任务,提升任务链的灵活性和扩展性。6. 输出工具设计难点 代理与用户的最终交流依赖专门的输出工具(如邮件发送),但调控输出语气和风格反而更复杂。尝试用次级模型润色反而增加延迟且效果不佳,说明模型训练和上下文掌握仍有提升空间。7. 模型选择依然关键 Haiku、Sonnet等模型在调用工具时表现最佳,而GPT系列在主循环中效果一般。子工具多用Gemini 2.5处理文档摘要和图片信息,规避安全过滤器带来的困扰。成本不单看token消耗,更看整体效率和成功率。8. 测试与评估难题突出 代理的动态、多状态特性让传统外部评估难以适用。需要基于运行时的可观测数据和深度仪表化,但目前还没有理想方案,测试成了代理开发的“痛点”。开发者还提到,自己在试用Amp代理框架,欣赏其子代理间协调设计,体现了“用自己产品”的理念,这种实践精神值得行业借鉴。此外,分享了几条额外思考:- 简化代理核心工具集(如用Bash脚本管理浏览器交互)可降低复杂度和token消耗。- 小型开源工具面临被平台API和AI生成工具替代的趋势。- Tmux在交互式系统代理中非常有用。- LLM API本质是一种同步问题,值得单独深究。总结来看,智能代理设计依然是探索中的艺术,架构选型、缓存管理、失败处理、模型搭配和评测体系都需要细致打磨。未来的突破或许来自更灵活的抽象、更智能的反馈机制和更贴合实际需求的协作框架。原文:lucumr.pocoo.org/2025/11/21/agents-are-hard/
新浪微博 2025-11-24 00:00:00
42. 在线开发和AI应用调试时,环境隔离与资源管理往往是难点。阿里开源的OpenSandbox,是一个通用的AI应用沙箱平台,集成多语言SDK和统一API,支持Docker与Kubernetes高效运行。它为编程智能体、图形界面Agent、AI代码执行、强化学习训练等场景提供了完整的隔离环境。无论是本地测试还是大规模分布式调度,都能轻松应对。主要亮点:- 支持Python、Java/Kotlin、JS/TS、C#/.NET等多语言SDK;- 提供统一的沙箱生命周期和执行API,方便扩展自定义运行时;- 内置命令执行、文件系统和代码解释器沙箱环境;- 网络策略细粒度管理,支持多路由与出口控制;- 丰富示例涵盖编码智能体、浏览器自动化、桌面环境、强化学习等。通过Docker或Kubernetes部署即可开启,适合AI开发者和平台搭建者。项目开源,Apache-2.0协议。GitHub:github.com/alibaba/OpenSandbox快速开始仅需:1. 安装opensandbox-server启动服务2. 使用SDK创建沙箱执行代码,支持Python代码解释和文件读写3. 可扩展至复杂的AI Agent和远程桌面等场景对AI应用开发环境感兴趣的开发者,强烈推荐试试这个高性能开源沙箱平台!#AI创造营##人工智能#
新浪微博 2026-03-02 00:00:00
43. 数据工程遇上 AI Agent
知乎 2026-03-04 00:00:00
44. OpenAI的Skills和Anthropic一样都是惰性加载markdown按需注入context?
知乎 2025-12-16 00:00:00
45. OpenKG 首发 SkillNet:大规模智能体“技能图谱”知识库
知乎 2026-03-22 00:00:00
46. 来聊聊Anthropic Skills,你了解多少?
知乎 2025-10-19 00:00:00
47. 手把手彻底学会 Agent Skills!【小白教程】
哔哩哔哩 2026-02-02 00:00:00
48. 为什么很多企业的转型都在上演“皇帝的新衣”? #大咖观察 #红衣聊AI #企业转型 #企业管理
抖音 2025-10-15 00:00:00
49. Agent Skill 相关资料、笔记和思考
知乎 2026-01-18 00:00:00
50. Deep Agents:LangChain开源的Agent框架,开箱即用的LLM应用方案。核心思想:给你一个开箱即用的Agent,需要定制再加工。Deep Agents基于LangGraph构建,内置了单Agent应用的标配能力:任务规划、文件系统访问、Shell执行、子Agent委托、自动上下文管理。会话长了自动总结,大输出存文件,子Agent有隔离的上下文窗口。启动简单,支持任何能调工具的LLM(OpenAI、Claude、开源模型都行)。需要时加工具、换模型、调提示词。支持MCP。对比其他框架:1.LangGraph:底层编排框架,基于图和状态机。完全可控,支持流式、持久化、断点恢复。缺点是学习曲线陡,小任务过度设计。2. CrewAI:多Agent协作框架,建在LangChain和LangGraph之上。提供Agent、Task、Crew等高级抽象,快速定义多Agent分工。优点是上手快,缺点是多Agent固定模式,非标准行为定制困难。3. AutoGen(Microsoft):事件驱动,支持conversation-based Agent交互和group chat。v0.4引入强可观测性和异步模型。适合多Agent对话,不适合需要持久化和复杂状态的应用。4. Deep Agents的位置:单Agent框架,高于简单的ReAct(思维链+工具调用),低于多Agent系统。填补了这个缝隙:需要快速上手,但又要求工业级的规划、文件访问、子Agent能力。技术特点:1. Deep Agents采用trust-the-LLM模型——Agent可以做工具允许的任何事,安全边界由工具和沙箱保证。这套思路来自Claude Code,也就是LangChain在把Claude Code的经验系统化。2. 上下文管理做得细致:会话自动总结、大输出转文件、子Agent隔离上下文窗口。处理长期运行任务(爬虫、研究、报告生成)时能显著降低token消耗。应用场景1. 快速原型或一次性脚本 → Deep Agents足够2. 复杂单Agent任务(爬虫、研究、代码生成) → Deep Agents很合适3. 多Agent协作 → CrewAI更顺手4. 需要完全自定义Agent行为 → LangGraph完全控制5. 对话式多Agent互动 → AutoGen更原生项目:github.com/langchain-ai/deepagents#HOW I AI# #程序员#
新浪微博 2026-03-29 00:00:00
51. 在舆情分析领域,“微舆”以多智能体架构打破信息茧房,自动抓取并深度分析国内外30+主流社媒和海量评论,帮助还原舆情全貌,预测未来趋势,辅助科学决策。系统从零实现,无需依赖任何外部框架,支持多模态内容解析和多模型协同,具备强大的数据融合与扩展能力。无论是品牌声誉监测、公共事件分析,还是行业趋势研判,微舆都能轻松应对,满足企业和研究机构的多样化需求。主要特点:- AI驱动的全天候全域数据监控,覆盖微博、小红书、抖音等多平台;- 多Agent协作引擎,实现跨模型、跨工具的深度复合分析;- 支持图文、短视频等多模态数据的智能理解与处理;- 独创“论坛”机制促进Agent间思想碰撞,提升分析精度;- 公私域数据无缝结合,打通外部趋势与内部洞察;- 纯Python轻量模块化设计,便于部署与定制扩展。项目地址:github.com/666ghj/BettaFish适合数据科学家、舆情分析师、市场研究员等专业人士使用,是构建智能舆情分析平台的优秀开源选择。
新浪微博 2025-10-30 00:00:00
52. 揭秘Claude Code的运作机制网页链接一片介绍Claude Code的运作机制的文章。“Anthropic 对其构建方式几乎未作说明,因此我们设置了一个 LiteLLM 代理,以观察 Claude Code 发送和接收的内容。我们发现的并非某种单一的“魔法技巧”,而是一套精心设计的提示框架、安全机制和细微提醒的组合,这些共同确保了智能体的诚实性和专注度。简短总结:1️⃣Claude Code 在开始实际工作前,会先通过微小而精准的提示(如标题、主题检查、摘要)预先加载上下文。2️⃣它在系统提示、用户提示、工具调用甚至工具结果中广泛嵌入“系统提醒”,以减少偏离。3️⃣在执行 Bash 命令前,通过显式的命令前缀提取和注入检查来控制风险。4️⃣当任务变得多步骤时,它会生成具有更明确指令的子代理(“Task” 工具),并根据任务复杂度动态调整其上下文。”#科技先锋官##微博兴趣创作计划#
新浪微博 2025-11-18 00:00:00
53. 使用Dify搭建工作流,实现自动化商品采集分析
知乎 2025-12-31 00:00:00
54. #IT技术# #微博兴趣创作计划# 今天为大家介绍四大热门AI框架:LangChain擅长复杂AI应用开发,Dify支持低代码快速搭建,n8n专注自动化工作流,Coze则面向中文用户优化。各框架特点鲜明,你更倾向哪种AI开发方式? 搞机工程师的微博视频
新浪微博 2025-11-19 00:00:00
55. 深度解析RAG、LangChain、Agent三者间的关系(附应用案例+大厂内部资源合集)
知乎 2025-12-04 00:00:00
56. 2026 最该学的AI技能:Skills
微信公众号 2026-01-15 00:00:00
57. 「Github一周热点107期」OpenAI收购的AI安全工具、AI代理事务所、OpenClaw技能库、claude code插件和上下文数据库
哔哩哔哩 2026-03-21 00:00:00
58. 「Github一周热点103期」超轻量的clawdbot、编程智能体的记忆工具、聊天记录分析工具、视觉agent框架和键盘、鼠标统计工具
哔哩哔哩 2026-02-08 00:00:00
59. 快抄作业!我用JoyAgent搞了个AI团队 2025年都快结束了,Agent是不是还没用上? 我找到了打工人用上智能体的最简单方法, 就是用JoyAgent把每天重复的SOP全做成Agent, 不懂代码也能零门槛搭建,而且效果很稳定。 看着AI团队全自动打工、出活,非常解压。 #AI #智能体 #JoyAgent #JoyCode #京东云
抖音 2025-11-05 00:00:00
60. Claude悄悄更新了Skills生成器,这绝对是一次史诗级升级。
知乎 2026-03-11 00:00:00
61. 深度|获红杉、微光创投种子轮投资,Floatboat 要让 Agent 住进你的工作现场,打造 Agent 协同办公网络
微信公众号 2026-03-17 00:00:00
62. 国外 clawdbot 火了,国内替代版也来了。 2026年伊始,AI智能体赛道迎来爆发式升级。海外方面,开源项目OpenClaw凭借超10万GitHub星标和一周200万访客迅速出圈,其可深度调用本地系统、应用及聊天记录的能力,吸引大量开发者部署于M4芯片Mac mini——这款设备因低功耗、高算力、静音运行,被用户自发称为‘个人AI服务器’。与此同时,Anthropic推出的Cowork则走稳健路线:在用户授权前提下,通过隔离沙箱调用技能模块,专注文档生成、数据处理、桌面整理等知识工作场景,安全性更高但权限更收敛。 国内科技公司迅速响应。阿里发布首款桌面Agent工具QoderWork,阶跃星辰上线‘阶跃AI桌面伙伴’,MiniMax与昆仑天工也分别推出迭代版本。实测QoderWork发现,其能高效执行重复文件清理、按命名规则自动归类下载文件夹、基于PDF素材生成PPT等任务;交互设计强调透明性——关键操作弹窗确认、进度实时可见、支持多任务并行。尽管PPT结构与内容还原仍有优化空间,但相比命令行工具,其自然语言调度与低门槛体验已显著降低AI使用门槛。 多位业内人士指出,桌面AI Agent不再只是辅助插件,而是正在重构人机交互范式。它有望替代传统桌面操作逻辑,成为新一代操作系统级入口。未来竞争焦点将集中于安全边界把控、长期记忆能力、跨应用协同效率,以及真正融入日常工作的‘隐形生产力’深度。
新浪微博 2026-02-05 00:00:00
63. 告别数据库“膨胀”:Dify x SLS 构建高可用生产级 AI 架构
知乎 2025-12-26 00:00:00
64. 360发布“养龙虾”安全指南! #大有学问 #养龙虾 #OpenClaw #AI工具 #红衣聊AI
抖音 2026-03-11 00:00:00
65. 【无广】我用AI Agent手搓了一个科技博主神器:动态图表生成器!
哔哩哔哩 2026-03-29 00:00:00
66. 企业级AI Coding的落地方法,都在这本实战手册里了|甲子光年
微信公众号 2026-03-10 00:00:00
67. 如何看Anthropic最新发布的Claude Skills?会替代MCP吗?
知乎 2025-10-19 00:00:00
68. 在线构建AI编码代理太复杂?试试 shareAI-lab 的 learn-claude-code 项目,它用 Bash 简单高效地演示了Claude Code风格的小型智能代理从0到1的完整构建过程。 核心是一个极简的智能体循环,配合工具调用和结果处理,12个阶段逐步引入计划、子代理、任务持久化、多代理协作等机制,系统性教你从原理到实战。项目附带丰富文档、代码示例和交互演示平台,支持Python实现,轻松上手。 主要特色: - 明确的Agent循环模型,轻松理解AI代理工作机制 - 支持任务拆解、工具调度、上下文压缩、后台任务、多Agent协同 - 启发式教学设计,阶段性引入复杂功能,循序渐进 - 配套Web平台,交互式学习体验 - MIT开源许可证,自由使用与改造 快速开始只需: ``` git clone https:// github.com/shareAI-lab/learn-claude-code cd learn-claude-code pip install -r requirements.txt cp .env.example .env # 填入你的Anthropic API Key python agents/s01_agent_loop.py ``` 学会构建属于自己的智能代理,从“用一次”到“始终在线”,逐步升级到多渠道消息、记忆和个性化助理。 GitHub:github.com/shareAI-lab/learn-claude-code #AI创造营##人工智能#
新浪微博 2026-03-07 00:00:00
69. 【0G为Claude打造了一套专业技能包,AI开发效率将大幅提升】0G基金会刚刚发布了一个很实用的工具:专门为Claude Code打造的0G Compute技能包。简单来说,这套技能包能让Claude瞬间变成0G去中心化AI推理网络的专家助手。这套工具解决了一个开发者普遍面临的痛点。在构建AI应用时,开发者往往需要反复查阅文档、调试API参数、处理各种边界情况。现在有了这个技能包,Claude能够直接帮你完成这些繁琐工作。具体能做什么?在AI应用构建方面,它能协助开发聊天机器人、图像生成服务、语音转文字等功能。在SDK集成方面,它掌握了最新的API用法和正确的调用模式。在账户管理方面,它能处理充值、转账、退款以及子账户系统的各种操作。安装过程相当简洁。个人使用的话,只需把技能目录复制到个人skills文件夹即可。团队协作的话,放到项目的skills文件夹里,所有成员都能用。使用体验也很顺滑。当你提到相关关键词时,技能会自动激活。比如问"帮我集成0G Compute SDK"或者"用0G创建一个流式聊天机器人",Claude就会自动调用这套知识库来回答。这个工具的价值在于它大幅降低了0G生态的开发门槛。去中心化AI推理网络本身概念就比较新,各种接口和调用方式对新手来说有一定学习成本。现在有了这个技能包,相当于给每个开发者配了一个0G专家随时待命。从更大的视角看,这也代表了一种趋势:基础设施项目开始主动拥抱AI开发工具。不是等开发者来适应你的API,而是把你的知识直接注入开发者日常使用的AI助手中。对于正在探索去中心化AI推理领域的开发者来说,这个工具值得一试。github.com/0gfoundation/0g-compute-skills
新浪微博 2026-01-26 00:00:00
70. 在线开发经常需要面对前端设计、后端架构、移动开发和图形着色等多样技能,学习曲线陡峭且缺少系统化指引。 MiniMax Skills 专为 AI 编码助手打造了一套结构化的开发技能库,覆盖从前端动画、全栈集成,到安卓 iOS 原生开发,再到 GLSL 着色器视觉特效。 项目不仅支持丰富技术栈和产业标准,还能兼容多种 AI 工具如 Claude、Cursor、Codex 和 OpenCode,通过简单配置即可集成使用,极大提升开发效率和代码质量。 GitHub:github.com/MiniMax-AI/skills 主要内容: - 前端开发:React / Next.js + Tailwind CSS,支持动态图形与 AI 生成媒体; - 全栈开发:REST API、认证、安全、实时通信及数据库整合指南; - 安卓原生:Material Design 3,Jetpack Compose,性能与易用兼顾; - iOS 应用:SwiftUI、UIKit、Apple HIG 标准实现无障碍设计; - 着色器开发:GLSL 高级技巧,流体、粒子和光影特效制作; - 丰富文档生成:PDF、PPTX、XLSX、DOCX 格式的创建与编辑。 支持多平台插件,适合 AI 辅助开发者、培训机构和大型团队协作。 #AI开发##开源项目##编程技能提升#
新浪微博 2026-03-23 00:00:00
71. 【保姆级】OpenClaw 全网最细教学:安装→Skills实战→多Agent协作,1 小时全精通!
哔哩哔哩 2026-03-03 00:00:00
72. 探访云栖(二):AI Agent元年,谁在打造“数字员工”?【101 Weekly】
哔哩哔哩 2025-10-29 00:00:00
73. OpenClaw 接入微信、QQ、飞书等教程!打造 24 小时在线 AI助手!一键调用MiniMax 5.2、 GPT-5.4 模型| 零度解说
哔哩哔哩 2026-03-15 00:00:00
74. 分享6个我觉得应该必装的Skills。
知乎 2026-03-30 00:00:00
75. MCP、Skills、SubAgent 到底是啥?简单捋一下
微信公众号 2026-01-24 00:00:00
76. 《Agents, robots, and us: Skill partnerships in the age of AI》麦肯锡最新报告指出,当前技术理论上能自动化超过美国一半的工作时长,这意味着工作方式正经历深刻变革。到2030年,美国有望释放约2.9万亿美元的经济价值。需求变化尤为显著:过去两年内,AI技能需求激增7倍,成为增长最快的职场能力。75%的AI技能需求集中在三个职业群体,且非体力工作占美国工作时长的三分之二,AI正在重塑人类技能的应用方式。然而,自动化“任务”与自动化“完整工作流程”之间差距巨大,许多企业在真正释放价值时仍面临挑战。真正的竞争力,来源于能够重新设计工作流、掌握AI作为杠杆而非玩具的人才。未来的职场不是被AI取代,而是成为AI的“指挥官”。这场变革不仅是技术问题,更是教育、管理和政策的挑战。若不能同步更新,生产力提升将难以转化为普惠的生活水平改善。AI流利度不仅是“会用工具”,更是“懂得重构工作”。总结来看,AI将重塑职业边界,推动人类从“执行者”向“协调者”转型。拥抱变化,培养新技能,才能抓住这场价值释放的机遇。原文:www.mckinsey.com/mgi/our-research/agents-robots-and-us-skill-partnerships-in-the-age-of-ai#/
新浪微博 2025-12-01 00:00:00
77. OpenClaw 你装错了!9个必备Skills + 正确模型搭配,一次搞定浏览器自动化! | 零度解说
哔哩哔哩 2026-03-10 00:00:00
78. 手把手安装OpenClaw龙虾必备的技能Skills!
哔哩哔哩 2026-03-14 00:00:00
79. 两个月,19 个 Skills,10000+ stars,400 多次 commit。这个视频是我做 baoyu-skills 从 0 到 1 的完整复盘。前半段是真实场景演示,看我日常怎么用 Agent + Skills 完成实际工作;后半段是设计哲学和迭代方法论,把踩过的坑和悟出来的经验都讲透。四个核心观点:1)从提示词到 Skills:起步没有门槛。把你已有的好用提示词、好的实践、甚至模糊的想法,直接用 /skill-creator 变成 Skill。关键是动手。2)别做万能 Skill:Skill 要原子化,每个只做一件事。然后用 AGENTS.md 编排成工作流,让 Agent 灵活执行。我的素材收集和写作流程就是这么串起来的。3)Skills 像随身小刀,越用越顺手:自己常用、遇到问题当场改、给 Agent 高质量对比样例让它自己优化、用 git 做版本管理留后悔药。4)站在 Agent 角度设计:多存中间文件、先分析再执行、写清验证标准、用子 Agent 并行、脚本优先于 MCP。这些小细节决定 Skill 能不能真正跑通。baoyu-skills 已全部开源:github.com/JimLiu/baoyu-skills 网页链接 宝玉xp的微博视频
新浪微博 2026-03-23 00:00:00
80. a16z 刚刚把 Enterprise multi-agent orchestration platforms(企业级多 Agent 编排平台)列为 2026 年最想投的 startup idea 之一,核心点就是打造强大的 Agent 舰队。但是 Agent 舰队能开出一家独角兽公司吗?常规的观点是,Agent 是完美的个人杠杆,能让一人公司极速扩张。但是背后的悖论:agent 底层能力都是来自 LLM,门槛比较低,大家都在同质化竞争。比如现在 OpenClaw 各种竞品我其实都懒得去试,因为都是启一个 agent 调大模型完成任务,没太大本质差异。又比如短视频赛道,如果人人都能用 Seedance 批量产出优质内容,那么一个新的 Agent 舰队如何在行业立足(并成为独角兽 )?
新浪微博 2026-02-13 00:00:00
81. AI Skills设计指南
今日头条 2026-04-01 00:00:00
82. Claude Skills 官方指南发布
今日头条 2026-03-12 00:00:00
83. 高效 AI Skill 编写指南(通用版)
小红书 2026-03-19 00:00:00
84. 2026大模型Agent核心
微信公众号 2026-04-02 00:00:00
85. Claude 新王牌 “Skills” 深度解析
今日头条 2025-10-29 00:00:00
86. Claude Code 内部实践
哔哩哔哩 2026-03-26 00:00:00
87. 从提示词到技能模块
微信公众号 2025-12-22 00:00:00
88. AI 技能革命 2026
微信公众号 2026-04-06 00:00:00
89. Agent Skills是什么?Anthropic刚刚定义了AI插件的新标准,一文搞懂
微信公众号 2026-04-02 00:00:00
90. 一文看懂 Agent Skills
今日头条 2026-04-10 00:00:00
91. AI 新范式
微信公众号 2026-03-02 00:00:00
92. Agent Skills
知乎 2026-03-28 00:00:00
93. MCP vs Skills
微信公众号 2026-03-27 00:00:00
94. 你还在写 Prompt?高手已经用 Claude Skills 批量干活了
微信公众号 2026-04-09 00:00:00
95. 从概念上聊聊 Agent Skills
微信公众号 2025-10-24 00:00:00
96. 下载量越高的Skills,可能越不适合你
微信公众号 2026-03-29 00:00:00
97. VS Code 重大更新
今日头条 2026-03-25 00:00:00
98. SKILL 简单介绍
知乎 2026-02-03 00:00:00
99. Hermes Agent
微信公众号 2026-04-12 00:00:00
100. AI 智能体构建 Factor 9
知乎 2025-11-17 00:00:00
101. 字节面试官问Agent工具调用失败怎么办时,大模型agent面试精选题库
知乎 2026-03-31 00:00:00
102. AI Agent 终于学会了「记住经验」
今日头条 2026-04-02 00:00:00
103. AI Agent技能自进化
微信公众号 2026-03-16 00:00:00
104. Anthropic 开源了 Claude 的 Agent Skills 仓库
知乎 2026-04-11 00:00:00
105. Anthropic 推出 “Agent Skills” 开放标准
微信公众号 2025-12-20 00:00:00
106. 从OpenClaw到实现如何实现个人Agent
知乎 2026-03-09 00:00:00
107. AI Agent性能翻倍!技能工程实操指南,新手也能轻松上手
今日头条 2026-03-07 00:00:00
108. 从 MCP 到 CLI
今日头条 2026-03-19 00:00:00
109. 真实有效的 AI 方法论
知乎 2026-04-02 00:00:00
110. 12K Star,一键解锁864个Skill,支持Claude、Codex、Copliot等
微信公众号 2026-02-19 00:00:00
111. 十分钟搞懂LangChain、LangGraph与DeepAgents
知乎 2026-04-09 00:00:00
112. 揭秘多Agent系统的“操作系统”
微信公众号 2025-11-05 00:00:00
113. 学习 Dify 的代码沙箱
知乎 2025-10-28 00:00:00
114. 如何构建安全的 AI 智能体代码执行环境
微信公众号 2026-02-27 00:00:00
115. 这 5 个 AI 智能体开发框架,让你快速落地企业应用(附教程)
微信公众号 2026-03-27 00:00:00
116. 微软开源了!44k星的AutoGen,让多个AI像团队一样协作干活
微信公众号 2026-04-04 00:00:00
117. AutoGen 3.0实操教程
微信公众号 2026-04-10 00:00:00
118. 如何构建安全的 AI 智能体代码执行环境
微信公众号
119. 开源|一款企业级Skills技能管理平台,支持技能发布、版本管理、RBAC权限与安全扫描
微信公众号 2026-04-04 00:00:00
120. 多 Agent 系统的权限管理
知乎 2026-03-10 00:00:00
121. AI Agent 的新安全战场
知乎 2026-03-20 00:00:00
122. 自我教育之Moltbot深度开发课程第八课
知乎 2026-02-03 00:00:00
123. Daytona
微信公众号 2025-12-05 00:00:00
124. 为什么用 Rust 构建 AI Agent 技能沙箱?
知乎 2026-02-10 00:00:00
125. 沙箱环境成了Agent的后端
微信公众号 2026-02-09 00:00:00
126. 为什么 AI Agents 需要更强的沙箱隔离?Kata 社区正在这样做
微信公众号 2026-03-25 00:00:00
127. 实战指南
微信公众号 2026-02-11 00:00:00
128. 2026年AI Agent行业
知乎 2026-04-05 00:00:00
129. Anthropic “Agent Skills智能体解析2
微信公众号 2025-12-14 00:00:00
130. Claude Agent 生态系统(Skills, Prompts, Projects, MCP, Subagents)
今日头条 2025-11-14 00:00:00
131. Skills实战——我是怎样用 Skills 武装我的写作流程,从此告别重复劳动的
微信公众号 2026-04-04 00:00:00
132. 构建AI Agent Skill的最佳实践指南
知乎 2026-02-28 00:00:00
133. 极简派、全能派、企业派
微信公众号 2026-02-28 00:00:00
134. 一文读懂 Agent、MCP、Skill
微信公众号 2026-02-08 00:00:00
135. SkillsBench
微信公众号 2026-02-26 00:00:00
136. 港大开源 nanobot
哔哩哔哩 2026-02-04 00:00:00
137. AI Agent 是怎么自己干活的? AI Agent 为什么能自动完成复杂任务?
抖音 2026-03-13 00:00:00
138. 从“卖技能”到“会自造工具”
今日头条 2026-01-27 00:00:00
139. Skills :2025–2026 年 AI 领域最火爆的核心机制
知乎 2026-02-07 00:00:00
140. Agent Skills:让 AI 代理学会"专业技能"的开放标准
微信公众号 2026-01-19 00:00:00
141. 政企智能体技术架构研究:OpenClaw与Dify 的对比、融合与重构
知乎 2026-03-14 00:00:00
142. 15.4k的开源AI技能库agentskills:让智能体拥有“十八般武艺”
今日头条 2026-04-09 00:00:00
143. 深度解读 OpenAI 与 Anthropic 的前端设计 Skills:让所有人做出顶级设计感的专业级网站
微信公众号 2026-04-04 00:00:00
144. Agent Skills 概览
今日头条 2026-02-21 00:00:00
145. 【Skills】05- Agent Skill分析,如何实现技能的编排和评估
知乎 2026-03-10 00:00:00
146. 盘点 4 个让 AI Agent 变强的 Skills。
知乎 2026-03-03 00:00:00
147. 企业级AI Agent落地的四大挑战与解决方案!
知乎 2025-12-26 00:00:00
148. AI Agent Skills 系统性技术指南:从入门到生产落地
知乎 2026-03-03 00:00:00
149. Agent Skills到底是什么?
知乎 2026-03-17 00:00:00
150. LangChain Tools:工具使用完全指南
知乎 2026-02-15 00:00:00
151. Claude Skills 与 Gemini Skills 格式对比与转换指南(含示例脚本 + GitHub 项目示例)
微信公众号 2026-01-26 00:00:00
152. AutoGen v0.4.3 更新:缓存与 GraphRAG 集成
知乎 2025-11-19 00:00:00
153. Agent Skills 入门和精通看这篇就够了!
微信公众号 2026-01-31 00:00:00
154. Agent Skills 介绍
知乎 2026-03-26 00:00:00
155. Agent Skills外挂能力插件箱
微信公众号 2026-01-30 00:00:00
156. 什么是Agent Skills?小白100%入门
今日头条 2026-03-04 00:00:00
157. Agent 与 Skills:智能体的核心能力构建与价值释放
微信公众号 2025-12-18 00:00:00
158. Agent设计模式(十二):异常处理和故障恢复
知乎 2025-10-15 00:00:00
159. 每天吃透一个AI知识点:Agent Skills Skills 最近非常的火,它是既 MCP 后 Anthropic 推出的又一个 Agent 领域的行业标准,在本期教程中,将带你一起学习下面的知识: Skills 入门理解:Skills 到底是什么?长什么样?怎么工作的? Skills VS MCP:Skills 和 MCP 的区别是什么,MCP 会被淘汰吗? Skills 初步尝试:去哪里找 Skill?怎么使用 Skill?怎么自己创建一个 Skill? Skills 实战使用:如何用 Skills 实现外部知识检索?比传统 RAG 的优势在哪? Skills 安全分析:Skills 的安全性如何?使用它有哪些风险?
小红书 2026-01-27 00:00:00
160. Agent Skills完全指南:从概念到实战应用
今日头条 2026-03-27 00:00:00
161. Agent Skills 完整研究报告
知乎 2026-01-27 00:00:00
162. SkillsBench:Agent Skills 真能提升智能体能力吗?
微信公众号 2026-04-03 00:00:00
163. 安全隔离:一文看完沙箱技术(sandbox)
微信公众号 2025-12-05 00:00:00
164. 一文理解什么是 Agent Skill?
知乎 2026-01-08 00:00:00
165. 受够了给 AI Agent 配环境?这个开源的“技能严选社区”让你开箱即用
知乎 2026-03-13 00:00:00
166. 动手写一个Agent Skill
知乎 2026-02-15 00:00:00
167. Agent Skills vs MCP:AI编程新手的最佳选择指南
知乎 2025-11-18 00:00:00
168. 一文读懂 Agent Skills,让你的AI秒变专业领域“多面手”
今日头条 2026-03-23 00:00:00
169. OpenAI Agent Skills 创建指南
知乎 2026-02-09 00:00:00
170. AI Agent 两大 “神辅助” 对决:MCP vs Skills 谁更能打?
微信公众号 2026-03-11 00:00:00
171. 当大模型学会"动手":工具调用能力的量化评测实践
微信公众号 2026-01-20 00:00:00
172. 【免费学习】Agent Skills保姆级教程,直接从小白变专家
微信公众号 2026-03-31 00:00:00
173. 开源 Agent 框架 1. **Agent 框架四强**:#CrewAI 性能最强(快2-3倍)、LangGraph 最适合复杂架构、OpenAI Swarm 入门快但有黑盒问题、AutoGen 创意好但容易烧 Token 2. **2026 新标准**:从"哪个模型聪明"变成"能不能管50+Agent不崩溃"——状态管理和可控性成了关键 3. **混合模型策略**:复杂任务用 GPT-4o/5,简单任务用本地模型,能省 60-80% Token 💡 **对 OpenClaw 的启发**: - 现有的 fallback 机制(GLM-5 → GLM-4.7 → Kimi)其实已经走对了方向 - 可以考虑借鉴 CrewAI 的 Crews/Flows 双模式来优化 Skill 编排
抖音 2026-02-17 00:00:00
174. 谷歌全新 Gemini API Agent Skill 弥补了AI模型在自身SDK上的知识鸿沟
微信公众号 2026-03-29 00:00:00
175. 2026年AI Agent深度评测:5款主流智能体平台实测对比,谁才是真正的效率利器?
知乎 2026-03-09 00:00:00
176. LangChain 智能体工作流升级:从“能跑”到“可控、可观测、可落地”
微信公众号 2026-03-30 00:00:00
177. 前端入局AI时代:LangChain与智能Agent编程全攻略
微信公众号 2026-04-04 00:00:00
178. 乐学LangChain(1):总体架构和核心组件
微信公众号 2025-10-20 00:00:00
-
又学到了,暑期旅行的15个隐藏妙招,学会可太省心了!450 114 -
网龄十年,为何有人月领30GB,有人只有1GB?59 137 -
罗永浩怒斥电视机厂商:不毁灭没天理!156 509 -
评论有奖|这几件夏季洗护小事全网愣是争了好几年,今天一次性说清楚149 377 -
快把随手买的套套扔掉!赤尾这三款王炸,解锁情侣完美亲密体验226 143
已收藏
去我的收藏夹