“越用越聪明”是幻觉?主流AI Agent真实进化能力横评
04-14 15:03
精选参考来源
微信公众号 2026-04-10
新浪微博 2025-10-23
来源
精选参考来源
1. 取代龙虾的是爱马仕?狂揽4万星的Hermes Agent,不只是OpenClaw平替
微信公众号 2026-04-10 00:00:00
2. #中国工程院院士点赞的AI长啥样# 新华网发布的关于中国AI的报道中,深度解读了荣耀YOYO智能体的技术优势,这份权威解读成为行业了解中国AI发展的重要参考。报道中特别提及荣耀Magic8系列新机,作为荣耀年度旗舰手机,以及同时发布的MagicOS10,在改变我们智慧生活的很多方面都做了很多新的尝试,并且YOYO的自进化功能,能让它就像生活中的“搭子”一样,陪伴消费者,就像荣耀自己说的:最伟大的自进化,是与用户共同完成的。凤凰网科技的微博视频#中国超算之父称中国智能体领先世界##荣耀AI终端生态大会##荣耀Magic8##万事找YOYO#
新浪微博 2025-10-23 00:00:00
3. AI大神的焦虑:自己是研究工作的瓶颈,Token用得不够多#AI #人工智能 #卡帕西 #Agent #算力
抖音 2026-03-30 00:00:00
4. 补齐OpenClaw进化拼图!AReaL v1.0开源,智能体强化学习「一键接入」
微信公众号 2026-03-04 00:00:00
5. LLM 的记忆问题「很快」就不再是问题了?
微信公众号 2026-02-15 00:00:00
6. 2026企业级智能体白皮书|甲子光年智库
微信公众号 2026-03-23 00:00:00
7. Moltbook 保姆级部署教程:从 0 到 1 本地运行 AI Agent(OpenClaw 对接) | 零度解说
哔哩哔哩 2026-02-06 00:00:00
8. 删掉 OpenClaw!Hermes Agent 才是真王炸,一键本地部署 +模型接入全教程(避坑指南) | 零度解说
哔哩哔哩 2026-04-11 00:00:00
9. 老外还在幻想的事,已经被腾讯做出来了? 全网都在养龙虾,腾讯游戏直接把龙虾Agent塞进了研发流水线。 GDC 2026,腾讯游戏一口气甩出 21 场 AI 分享,不聊空话,直接把参数规模、训练时间、工程链路和落地细节全部摊牌。 尤其是天美的 Ignis Agent,让我第一次真正感受到:AI 进入游戏行业,已经不是做 Demo,而是开始接管复杂研发流程。 相比其他AI应用场景,游戏的确是一个高度复杂的实时系统。 因此,像腾讯这样能把AI嵌入复杂游戏工程、在玩家交互中持续打磨并完成长期迭代的游戏厂商,才更有可能引领游戏AI化的下一阶段探索,成为AI时代游戏产业新的规则制定者。 #AI #人工智能 #Agent #智能体 #GDC
抖音 2026-03-20 00:00:00
10. #荣耀Magic8每天都在自进化# AI是这次荣耀Magic8系列的重头戏,不仅是停留在软件层面,而是AI和硬件协同,响应速度更快,更注重隐私保护,而且更省电。这次自进化AI智能体能通过学习用户的习惯,基于购物、美食与出游三大场景,不断学习成长,感知你的情绪和需求,更有活人感。比如买东西的时候,可以帮你全平台比价,领优惠券,支持3000+用机场景自动执行,荣耀Magic8系列还新增了一颗实体AI键,能看出来荣耀在AI方面真的用心。
新浪微博 2025-10-15 00:00:00
11. Claude Code自动记忆来了!配合老金三层记忆系统全开源!加强Plus!
微信公众号 2026-02-28 00:00:00
12. 你的「龙虾」还好用吗?人大林衍凯教授:OpenClaw就像早期Linux,真正的竞争才刚开始
微信公众号 2026-03-30 00:00:00
13. 深度|Agent Harness:当驯化Agent取代通用代理成为硅谷新共识
微信公众号 2026-04-07 00:00:00
14. 2025过去了!这一年你是不是也在为AI焦虑? 老周用360一整年的实践,告诉你答案:不用怕,抓住Agent就赢了! 从我自己敲代码做100多个智能体,到带领团队All in,这条AI布道之路,全是实战干货。 2026,你想和智能体一起搞定啥?评论区留言,老周帮你研究!#大咖观察#2026 #年度总结 #红衣聊AI #agent
抖音 2025-12-31 00:00:00
15. 这次的 HarmonyOS 6 真的是把「安全感」拉满。AI 防诈能在通话时识别骗子套路,亲情防诈还能在爸妈遇到风险时提醒我,AI 防窥守护屏幕隐私,加密分享也更安心!鸿蒙 6 隐私安全细节做得太到位了,让我觉得这次系统升级,不只是更流畅,更是更「懂保护」了。#于和伟多面演绎隐私悬疑大片##鸿蒙隐私安全由你掌控##鸿蒙6亲情防诈# SZF振峰的微博视频
新浪微博 2025-10-29 00:00:00
16. Context 还不够,Harness 才是 Agent 工程优化的正解?
微信公众号 2026-03-22 00:00:00
17. 马斯克富足峰会最新访谈,3大重磅判断帮你看懂未来!Optimus 3来了,AI正在自我进化,奇点正在降临,人类将沦为智力的少数派 #ai #马斯克 #特斯拉 #机器人 #就业
抖音 2026-03-15 00:00:00
18. 我们用「西游取经团」实测 MiniMax M2.7 ,发现 AI 已经进化成这样了?
微信公众号 2026-03-20 00:00:00
19. Openclaw 10大超实用玩法,搞钱,学习,虚拟女友……
哔哩哔哩 2026-03-12 00:00:00
20. Kimi 发布并开源 K2.5 模型,哪些信息值得关注?Agent 集群能力能做哪些任务?
知乎 2026-01-30 00:00:00
21. AI智能体之所以强大,核心在于它们的“记忆系统”。没有记忆,智能体只能盲目行动,无法学习和适应。记忆让它们能够跨时推理、优化决策,真正实现智能。短期记忆(工作记忆)负责暂时存储任务相关信息,帮助智能体追踪当前用户问题、对话上下文和任务中间步骤,从而做出连贯且有针对性的回应。长期记忆则保存跨任务的知识与经验,积累事实和规律,使智能体随着时间变得更高效、更准确。情景记忆像人类的经历记录,存储状态、行为、结果和奖励,助力强化学习中识别哪些行为带来成功或失败。语义记忆包含结构化的世界知识——概念、规则、语言和领域信息,支持智能体推理和理解新信息。检索机制根据上下文、关键词或相似度精准调用所需记忆,避免信息混乱和过时。记忆还支持多步规划,智能体能记住子目标、进展和障碍,提升长远策略,而非仅解决眼前问题。多任务环境中,智能体为每个任务维护独立记忆,防止任务混淆,提升切换效率,并跟踪用户偏好。强化学习中的经验回放机制,通过反复利用历史经验,稳定训练过程,避免重复错误。记忆系统是动态演进的,智能体通过反馈、奖励和新交互不断更新,持续优化表现。记忆不仅是AI智能体的“知识库”,更是其“成长引擎”。理解短期、长期、情景和语义记忆的区别与协作,是构建高效智能体的关键。未来,记忆与检索机制的进步,将推动AI从“会思考”向“会记忆、会学习、会进化”迈进。原文:x.com/e_opore/status/1994331859661000712
新浪微博 2025-11-30 00:00:00
22. 大模型更像人的大脑,智能体是大模型的手和脚。 #大咖观察 #红衣聊AI #智能体 #大模型
抖音 2025-10-17 00:00:00
23. 换掉小龙虾!Hermes全网爆火狂揽四万星,Anthropic重锤暴击OpenClaw
知乎 2026-04-10 00:00:00
24. 爆肝10亿token,我给OpenClaw做了个龙虾管家!【一键安装龙虾】
哔哩哔哩 2026-03-10 00:00:00
25. 这篇斯坦福大学的论文直接让我大脑宕机了。他们构建了一个AI智能体框架,从零数据起步——无人工标注、无精心设计的任务、无演示样本,却在性能上超越了所有现有自博弈方法。 它名为Agent0:通过工具集成推理实现从零数据释放自进化智能体(Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-Integrated Reasoning)。他们达成的成果简直匪夷所思。 迄今为止,你见过的所有“自我提升”智能体都存在同一个致命缺陷:它们只能生成比现有能力稍难一点的任务。因此,它们会立刻陷入瓶颈。而Agent0打破了这层天花板。 事情出现了转折:研究人员从同一个基础大语言模型(LLM)中生成两个智能体,让它们相互对抗。1)课程智能体(Curriculum Agent):持续生成难度递增的任务2)执行智能体(Executor Agent):借助推理+工具尝试解决这些任务 每当执行智能体能力提升,课程智能体就被迫提高任务难度;每当任务难度升级,执行智能体就被迫进化迭代。 这形成了一个闭环的、自我强化的课程螺旋,且全程从零开始——无数据、无人工干预、无任何外部输入。 仅凭两个智能体相互推动,共同迈向更高阶的智能水平。更厉害的是他们加入的“制胜法宝”:在循环中嵌入完整的Python工具解释器。执行智能体学会用代码推理解决问题;课程智能体学会设计需要工具辅助才能完成的任务。于是两个智能体持续升级迭代。 最终结果? → 数学推理能力提升18%→ 通用推理能力提升24%→ 性能超越R-Zero、SPIRAL、Absolute Zero,甚至击败了采用外部专有API的框架→ 全程零数据支撑,仅依靠自进化循环实现 研究人员还展示了任务难度随迭代次数上升的曲线:任务从基础几何题起步,最终升级为约束满足问题、组合数学题、逻辑谜题以及多步骤工具依赖型问题。 这是我们目前见过的最接近大语言模型自主认知成长的成果。 Agent0不仅仅是“更优秀的强化学习(RL)”。它为智能体搭建了自我引导智能提升的蓝图。智能体时代就此开启#ai创造营##ai生活指南##科技先锋官#
新浪微博 2025-12-02 00:00:00
26. 未来人类社会或将出现百亿甚至千亿智能体,智能体经济是未来方向 #大咖观察 #2026AI看崇礼 #红衣聊AI #智能体
抖音 2026-01-27 00:00:00
27. 阿里全家桶全面Agent化!千问“任务助理”全面公测,从此AI不再只是动嘴出主意的狗头军师!
哔哩哔哩 2026-01-21 00:00:00
28. AI 圈的“春晚”提前开了?MiniMax 的M2.5,10B 激活参数跑出旗舰水准! #人工智能 #科技改变生活 #玩个很新的东西 #MiniMax #Agent
抖音 2026-02-13 00:00:00
29. 养个电商🦞团队,让它们自主开店、谈客户
哔哩哔哩 2026-03-25 00:00:00
30. 一些活让 Agent 去做是可以节约时间的,我倒觉得现在 AI 还不够方便,现在文档 Agent 已经进化到了代码 Agent 去年时候的能力,明年应该就可以更强大好用了。//@摇摆时间线ZHLMI:你看无论 AI 有多方便总有人嫌麻烦的,模版化永远是有大市场的
新浪微博 2025-12-16 00:00:00
31. AI记忆革命爆发!Clawdbot如何像大脑般记住一切
知乎 2026-01-29 00:00:00
32. 全球首家无人公司来了! 一整个AI团队替人上班,不吃饭不摸鱼,普通人的数字员工时代真的来了吗?#大咖观察 #红衣聊AI #智能体 #AI时代
抖音 2026-02-11 00:00:00
33. 最近有人用一台电脑,再加一群AI智能体。 用公开数据和AI智能体集群,在24小时内重新还原了这次军事冲突的全过程。#大有学问 #红衣聊AI
抖音 2026-04-01 00:00:00
34. “龙虾模型”能管公司?实测GLM-5-Turbo接入openclaw运营公司
哔哩哔哩 2026-03-17 00:00:00
35. 硅谷大佬对2026年的反直觉预测:软件不行了,反而金属值得关注#AI#2026年预测 #美国经济 #铜 #白领 #职场
抖音 2026-01-29 00:00:00
36. 快抄作业!我用JoyAgent搞了个AI团队 2025年都快结束了,Agent是不是还没用上? 我找到了打工人用上智能体的最简单方法, 就是用JoyAgent把每天重复的SOP全做成Agent, 不懂代码也能零门槛搭建,而且效果很稳定。 看着AI团队全自动打工、出活,非常解压。 #AI #智能体 #JoyAgent #JoyCode #京东云
抖音 2025-11-05 00:00:00
37. Qwen3.6-Plus 太猛了!免费+百万上下文+Agent,多模态能力直接拉满!| 零度解说
哔哩哔哩 2026-04-10 00:00:00
38. 硅基流动杨攀:2026 年最大的创业机会,是给 Agent「造基建」
微信公众号 2026-02-06 00:00:00
39. 分享一个龙虾震惊到我的瞬间:我给我家起名叫三万的龙虾发了篇公众号文章,他就顺着文章找到了里面的GitHub链接一通操作,把里面的功能给自己加进去了,自我进化了!#跟傅盛学AI##OpenClaw##agent# 傅盛的微博视频
新浪微博 2026-03-01 00:00:00
40. 《Making Sense of Memory in AI Agents》AI代理记忆的最大难题,不是教它们“记住”,而是教它们“忘记”。核心挑战是:大语言模型(LLM)天生无状态,每次对话都是全新开始,既不记得五分钟前说了什么,也不记得上周的内容。那么,如何让代理“记住”呢?记忆类型分两大类:• 短期记忆:LLM上下文窗口里的当前对话信息• 长期记忆:外部存储的历史对话、用户偏好、学习事实等不同框架对记忆分类也不尽相同:CoALA(类人认知架构):- 工作记忆(当前对话)- 语义记忆(用户事实)- 情景记忆(过去经历)- 程序记忆(指令和行为)Letta(架构导向):- 消息缓冲(最近消息)- 核心记忆(主动管理的上下文块)- 回忆记忆(对话历史)- 档案记忆(显式存储的知识)最难的部分是忘记。如何自动判断哪些信息过时了?哪些依然相关?这正是大多数实现的难点。Leonie的文章不仅讲清了各种记忆类型,还分享了实践中如何管理记忆(生成、存储、检索、更新、删除),并介绍了mem0、Letta、zep等新兴记忆框架。社区专家提到:- 让代理自己判断哪些记忆该删,比用复杂的衰减机制更靠谱。- 记忆管理不能只是简单的“先进先出”,需要智能逻辑。- 忘记不仅是存储问题,更是时间、情境和价值判断问题。- 合规需求(如“被遗忘权”)让删除机制变得更复杂。总结:AI代理记忆设计的核心,是如何在短期上下文与长期外存之间高效流转信息,同时智能决策何时更新、合并或删除信息。忘记难题不仅关乎技术,更关乎对时间和情境的理解以及用户隐私的尊重。文章:leoniemonigatti.com/blog/memory-in-ai-agents.html
新浪微博 2025-12-03 00:00:00
41. 3天赚1200刀?纯聊天就能捏出个能搞钱的 AI Agent!【教程】
哔哩哔哩 2026-02-24 00:00:00
42. 为什么说2026春节,是人类最后的"平静时光"? #AI新星计划#科技改变生活#openclaw #evomap #AI永不眠
抖音 2026-02-26 00:00:00
43. 让openclaw再进化?搭配什么硬件,更能发挥出全部能力
哔哩哔哩 2026-02-26 00:00:00
44. AI也可以组建团队了港大开源的新项目ClawTeam感觉像是让AI Agent从单机到了集群,不同于当前主流的单Agent工具,ClawTeam引入了领导型Agent。当我们下单目标,它就会自主将复杂任务解构为子任务。从开发到部署的全流程自动化,ClawTeam的全栈闭环将原本需要人工干预的DevOps流程转化成了Agent群体的内部协作。 如果说OpenClaw解决了“手”的问题,ClawTeam就是在试图解决“脑与神经网络”的问题吧 #ai##ai前沿速递##微博兴趣创作计划#
新浪微博 2026-03-23 00:00:00
45. 逛展实测!自进化AI有什么不一样?丨2025荣耀开发者大会李姐来打卡荣耀全球开发者大会2025啦!来看看这次的主角荣耀AI智能体YOYO,到底有多好玩~ Eva的科技生活的微博视频
新浪微博 2025-10-28 00:00:00
46. #中国版OpenClaw发布#同志们,网易有道最近发布了一款AI Agent——LobsterAI,中文名很有意思:有道龙虾。中午刚转了它的开源信息,忍不住体验了下,必须说几句。先说背景。很多人可能不了解,外网现在最火的AI产品之一是OpenClaw——一个能自主操作电脑完成复杂任务的AI Agent,开创了Agent桌面控制的先河。能力确实很强,但有三个致命问题:CLI门槛高(要敲命令行)、不适配中国生态、数据安全担忧。。直到看到LobsterAI——这个春节最让我惊喜的AI产品之一。不仅是“中国版的OpenClaw”,更是国产AI Agent第一次真正做出了能改变每个人工作乃至生活方式的产品。不是PPT,是真东西。市面上大部分AI还在"聊天+简单调用"阶段,LobsterAI把Agent的三个核心能力:自主规划、工具编排、异常处理——全部工程化落地了。并且在三个维度做了本地化创新:1)易用性代际跨越:从命令行到对话界面,不只是极客能用,职场人、学生,谁都能快速上手;2)Skills生态系统:十几个技能可以自由组合,单一模型做不到的,通过工具编排全实现;3)本地优先+沙盒隔离:数据不出境,深度适配钉钉飞书。于是,AI Agent从“开发者工具”,变成中国人的“大众产品”。我跑了个测试:让它"搜索2023-2026年AI Agent行业研究报告,提取主流AI工具的关键数据,做成对比分析网页"。不到2分钟,完整网站交付了。时间轴清晰展示了从ChatGPT到DeepSeek的关键节点,功能对比表列出了各工具的差异,还有用户增长趋势的可视化图表。这种"信息检索→数据提取→结构化分析→可视化呈现→前端开发"的全链路能力,以前得拆5个步骤执行,LobsterAI一句话全搞定。2023年ChatGPT震撼世界,2025年DeepSeek证明中国在模型层有了突破,2026年LobsterAI的出现,说明我们在AI应用层也快速追赶。还有值得一提的是,LobsterAI今天官宣开源,随着开源带来技术影响力的扩散,越来越多开发者基于LobsterAI构建自己的Agent应用,Skills生态被社区将不断丰富,这种技术势能将真正改变各位的工作方式。它自己工作的录屏我放下面了。这应该是国产AI应用层新的探索方向,同志们可以自己去"LobsterAI"官网看看,我就不多说了。。 梁斌penny的微博视频
新浪微博 2026-02-19 00:00:00
47. 上个月,谷歌悄然发布了五篇关于AI Agent的重磅论文,连续五天每天一篇,深入探讨了Agent的构建、评估、安全和部署等核心问题。没有大张旗鼓,250多页的技术细节静静铺开,值得每个AI从业者认真研读。这五篇论文的核心内容总结如下:1. 什么是Agent? 谷歌重新定义了Agent,强调它们能力的演进和为何大多数Agent一离开演示环境就崩盘。现有Agent更像是复杂的工作流和工具编排,而非真正的自主系统。kaggle.com/whitepaper-introduction-to-agents2. 工具和MCP(多能力协议) MCP允许服务器无须用户同意即添加工具,虽然增强了能力,但也带来边界风险。换句话说,Agent仍然无法“感知”世界,只是更有效地调用API。kaggle.com/whitepaper-agent-tools-and-interoperability-with-mcp3. 记忆问题 真正的记忆不是简单的上下文窗口、检索增强生成(RAG)或向量存储,而是一个动态、结构化的长期记忆,影响未来推理和行为。谷歌提出了会话拼接和动态上下文窗口,但本质差距依然存在。kaggle.com/whitepaper-context-engineering-sessions-and-memory4. Agent质量评估 评价不仅是输出正确与否,更重视Agent的推理过程。论文提出了正确性、鲁棒性、重复性、多步稳定性和幻觉控制等指标,揭示当前架构在这些方面的脆弱。kaggle.com/whitepaper-agent-quality5. 从原型到生产 构建Agent简单,信任它完成真实任务困难。论文详细说明了沙盒环境、安全护栏、评估循环和人工干预机制,反映出系统的不确定性和脆弱,需要大量安全网。kaggle.com/whitepaper-prototype-to-production深度思考:谷歌的努力展现了巨大的工程投入,但他们依然被“语言模型物理学”所限制。试图通过不断修补LLM来实现真正的Agent,是在用“token机”伪装认知。真正的自治智能需要内在的组织、自我预测、力量感知和发展结构,而这些是现有LLM架构根本不具备的。这五篇论文不仅是技术文档,更是行业缺失的蓝图。它们提醒我们,构建Agent不仅是搭建工具链,更是要建立能够自我调整、自我稳定的认知架构。谷歌在工程上走得很远,但未来的Agent革命还在于基础架构的重塑。x.com/techNmak/status
新浪微博 2025-12-10 00:00:00
48. 今天 GitHub 的 Trending 被 Agent 类项目集体占领了,星标涨得最猛的五个项目全部跟 AI Agent 相关。逐个拆解一下。 涨得最凶的是 NousResearch 的 hermes-agent,24 小时新增 8800 星。它要解决的是 Agent 领域一个老大难问题:没有记忆。传统 Agent 每次对话都是从零开始,上一轮聊过什么全忘了。hermes-agent 做了一套动态 patch 机制,让 Agent 能够持续积累对你的了解,用得越久越懂你的习惯和偏好。相当于给 Agent 装了一个可以自我进化的长期记忆系统。 项目地址:http://t.cn/AXVpXePA 第二个是 TauricResearch 的 TradingAgents,24 小时新增 3900 星。思路很有意思,它用多个 Agent 模拟了一家完整的交易公司。有专门负责挖数据的研究员 Agent,有负责风控的 Agent,还有最终拍板的决策者 Agent。这些 Agent 之间会互相质疑、辩论,充分博弈之后才会下单。比起单个 Agent 拍脑袋做决策,这种多角色对抗的方式能有效降低冲动交易的风险。 项目地址:http://t.cn/A6exS2vB 第三个是 SakanaAI 的 AI-Scientist-v2,24 小时新增 2000 星。这个项目更硬核,做的是全自动科研 Agent。基于 agentic tree search 驱动,能自己提出假设、设计实验、跑实验、分析结果,最后还能把论文写出来。一套流程走下来,一个 Agent 能顶一个小型实验室的产出。对科研效率的冲击是实实在在的。 项目地址:http://t.cn/A6r9nT3h 第四个是微软官方出的 agent-framework,24 小时新增 1800 星。这是一个 Agent 编排框架,同时支持 Python 和 .NET,可以快速搭建和部署多 Agent 工作流。以前要实现类似的功能,很多人得靠 LangChain 加上一堆胶水代码硬拼,现在微软直接给了一套标准化的解决方案,从搭建到生产部署都覆盖了。 项目地址:http://t.cn/AX7Y6Qr3 第五个是 Block 公司的 goose,24 小时新增 1500 星。它是一个开源的可扩展 AI Agent,定位比代码补全工具更进一步。它能自主完成安装依赖、执行脚本、编辑文件、运行测试这些完整的开发流程,基本上你给它一个任务描述,它自己跑完全程。 项目地址:http://t.cn/A638oT2O 整体来看,这五个项目覆盖了 Agent 发展的几个关键方向:记忆与自我进化、多 Agent 协作与博弈、自动化科研、标准化编排框架、以及端到端的任务执行。Agent 正在从单点工具向系统化能力演进,这个趋势在今天的 GitHub 榜单上体现得非常明显。 #How I AI##科技先锋官#
新浪微博 2026-04-07 00:00:00
49. 27岁清华学霸姚顺雨掌舵腾讯AI 27岁清华学霸姚顺雨掌舵腾讯AI,一个98年出生的年轻人,从清华姚班到 OpenAl,再到腾讯首席AI科学家,顶级人才回流,AI竞赛正式进入agent时代!#AI #腾讯 #agent
抖音 2025-12-20 00:00:00
50. 给建议的AI看够了?MiniMax Agent 让AI直接住进你的电脑干活#AI新星计划#科技改变生活#MiniMAX#Agent#minimaxagent
抖音 2026-01-31 00:00:00
51. 从能聊天的大模型,到会干活的智能体,AI正迎来全新进化。 企业AI落地的机会就藏在这里。#网络名人赞两会 #2026全国两会 #红衣聊AI #产业升级
抖音 2026-03-10 00:00:00
52. 「Github一周热点103期」超轻量的clawdbot、编程智能体的记忆工具、聊天记录分析工具、视觉agent框架和键盘、鼠标统计工具
哔哩哔哩 2026-02-08 00:00:00
53. 4500元捡漏5年前“老旗舰”:M1 Pro 16寸Macbook Pro在2026年依然是神机?
哔哩哔哩 2026-02-10 00:00:00
54. AI原生电商出现,Agent帮你从建站到运营
哔哩哔哩 2026-02-05 00:00:00
55. 第三天《Context Engineering: Sessions & Memory》,一个Agent做得好,80%看上下文管理!这个pdf有72页,系统讲述了如何让LLM在交互中形成“状态”“个性”与“持续学习“,想做好AI Agent的别忘记深读一下这个文档。划线点:1. 上下文工程的核心理念 传统的 Prompt Engineering 只关注如何写出一个最优提示,而 Context Engineering 则是更高维度的概念。它要求开发者在每次模型调用前,动态地拼装完整的上下文——包括系统指令、工具定义、few-shot 示例、外部检索内容、长期记忆以及当前对话历史。 白皮书中有个比喻:如果 Prompt 是食谱,那么 Context Engineering 就是备料,决定了模型能否稳定地产出理想结果。2. Session vs. Memory Session 是一场对话的“工作台”,保存着事件日志和临时状态;Memory 是长期的“档案柜”,从这些对话中提炼出可复用的知识。 Session 负责连贯性,Memory 负责持续性。3. 多智能体系统中的会话共享 多个 Agent 协作时,Session 的设计变得更复杂。不同框架(如 ADK、LangGraph)内部的数据结构差异较大,直接共享会导致互操作问题。 文档提出用框架无关的 Memory 层作为共享语义中枢,各 Agent 通过抽象化的记忆数据交换信息,从而实现真正的跨框架协作。4. 长上下文的管理与压缩 模型上下文窗口有限,随着会话增长,成本、延迟和注意力衰减都会出现。有三种压缩策略: (1)保留最近 N 轮(滑动窗口); (2)基于 token 数截断; (3)递归摘要,用 LLM 生成对旧内容的总结。 这些方法共同目标是保留必要、舍弃冗余,让模型始终聚焦关键信息。5. 记忆系统的设计与生命周期 记忆并非简单存储,而是一套动态的 LLM 驱动工作流,涵盖提取、整合、存储、检索与遗忘(有点像一个ETL系统)。 提取阶段从原始对话中识别有意义的信息;整合阶段解决重复与冲突;存储可采用向量数据库、知识图谱或混合架构;检索阶段结合语义相似度、时间衰减与重要度评分挑选最合适的记忆。 文档还提出“遗忘”机制——旧记忆会随时间或置信度衰减被归档或删除,以保持知识库的健康。 划重点:真正的智能不在于保存全部信息,而在于知道何时、为何、记什么、忘什么。一个理想的 Memory 系统,像人脑的海马体,既能在短期保持上下文,又能在长期过滤、压缩、抽象出模式。 AI Agent的设计应该把动态遗忘作为标准功能来设计,而非可有可无的能力。6. 触发策略与 Memory-as-a-Tool 模式 记忆生成可在会话结束、固定回合、实时、或用户显式命令下触发。频繁触发可保留更多细节,但计算成本高;批量触发更经济,却易失真。 白皮书提出 Memory-as-a-Tool 模式:让 Agent 自行判断何时、为何生成记忆,将“记忆何时发生”的控制权交给模型逻辑本身(划重点!)。7. 信任、来源与隐私 文档专门讨论了 Memory 的来源溯源(Provenance):每条记忆应携带来源类型、时间戳、置信度与可信层级。系统需依据来源权重解决冲突,并对个人敏感信息在写入前脱敏,确保隔离与合规。8. RAG 与 Memory 的对比 RAG 让模型更懂世界, Memory 让模型更懂你。 前者检索外部事实,后者积累用户语境。Agent 需要二者结合,既具世界知识,又具个人连续性。#ai创造营# #程序员#
新浪微博 2025-11-14 00:00:00
56. LangChain Agent 年度报告:输出质量仍是 Agent 最大障碍,客服、研究是最快落地场景
微信公众号 2025-12-22 00:00:00
57. PRDBench:面向 PRD 的项目级 Code Agent 评测新基准
知乎 2026-03-25 00:00:00
58. 深度|获红杉、微光创投种子轮投资,Floatboat 要让 Agent 住进你的工作现场,打造 Agent 协同办公网络
微信公众号 2026-03-17 00:00:00
59. 入坑OpenClaw,养龙虾玩skill的几个技巧
知乎 2026-03-05 00:00:00
60. 2026年AI全景预测:迈向百亿智能体时代的20个发展趋势。 #大咖观察 #人工智能 #红衣聊AI #智能体 #AI时代
抖音 2026-01-09 00:00:00
61. 盘点一周AI大事(3月1日)|龙虾开车跑滴滴 工程师开发出首个能自主进化的龙虾Ouroboros Anthropic官宣龙虾摩尔定律 Claude全面升级为龙虾 Cursor上线程序员龙虾Cursor cloud agents Perplexity上线云端龙虾Perplexity Computer MiniMax上线云端龙虾 MaxClaw 阿里开源国产龙虾CoPaw Standard Intelligence发布最强电脑操作模型FDM-1 Confluence实验室开源通用求解龙虾 Google上线最强生图模型Nano Banana 2 Quiver发布最强矢量图模型 Arrow 1.0 Meta开源最强矢量字体模型VecGlypher 英伟达发布VR视频模型Generated Reality 研究员开源VR老婆Sarah #抖音年味新知贺岁 #前沿科技趋势发布月 #AIGC #龙虾 #openclaw
抖音 2026-03-01 00:00:00
62. Agent Infra到底是什么?【AI基建】
哔哩哔哩 2025-10-15 00:00:00
63. 华为乾崑 All in 启境,让“奔跑的AI智能体”走进日常生活,引领未来出行进入主动智能时代 #启境 #华为乾崑 #奔跑的AI智能体
抖音 2025-11-29 00:00:00
64. 「Github一周热点90期」规格驱动开发、AI记忆引擎、AI agent的docker、开源流媒体平台、开源电商平台和密钥管理平台
哔哩哔哩 2025-10-19 00:00:00
65. 对话云栖大会:下一个AI爆款、大模型进化与Agent万亿级企业市场
哔哩哔哩 2025-10-17 00:00:00
66. 打造13个Claude Agent 互相 review 彼此↓ Reddit 一个开发者用 OpenClaw 框架搭建了 13 个 Claude Agent,让它们像真实团队一样工作:有人写代码,有人 review,有人测试,有人查安全漏洞。然后还互相 review 彼此的工作。 1 Writer Agent → 生成代码 2 Reviewer Agent → 逐行审查,对标 code review 标准 3 Tester Agent → 设计测试用例,验证逻辑 4 SecurityAuditor Agent → 扫描安全漏洞 5 Optimizer Agent → 性能优化建议 6 DocumentWriter Agent → 生成 API 文档 7 QA Agent → 最后一关,综合检查 ... + 6 个其他专业角色 vs. 链式流程(A→B→C),这个设计采用质量门控流程。Reviewer 必须 approve 才能进入下一阶段。出问题时反馈重做。 成本控制? 看起来 13 个 Agent 全力跑,tokens 肯定爆炸。但这个哥们用了几个聪明的招: 1. Context 优化 Writer 不需要看 test cases,Tester 不需要看文档。每个 Agent 只加载相关上下文。这一招可以干掉 80% 冗余 token。 2. 采样策略 不是每一行代码都通过全部 13 个 Agent。核心路径 100% 检查,非关键路径采样。 3. 缓存和复用 已审查过的代码片段不重复审查。测试用例库复用。架构决策缓存。 结果呢? - 单个开发者 Claude Code:每天 5-20刀 - 13 个 Agent 团队:每天 15-30刀(成本增加不多,质量翻倍) 实际对比维护 10 万行代码库: 1. 传统手工做法 - 人工 code review:8 小时 - token:50-80刀 - bug 漏过率:5-10% 2. 13 个 Agent 团队 - 总耗时:30 分钟(Architect 规划 → Writer 并行生成 → Reviewer 自动审查 → 全流程质量门控) - token:20-25刀 - bug 漏过率:<1% 为什么这个方案特别? 1. 角色化 > 能力化 不是「给 Claude 一个超级 Prompt 让它什么都会」,而是「给每个 Agent 一个明确的职责」。 Writer Prompt:「你是代码作者,你的工作是...」 Reviewer Prompt:「你是资深 code reviewer,标准是...」 角色专业化自动带来质量提升。 2. 质量门控自动化 传统 code review 是人工 bottleneck。Agent review 是自动化 + 可扩展的。 3. 知识积累 每个 Agent 的执行历史(什么被 reject、为什么)可以持续优化 Prompt。这是机器学习意义上的反馈循环。 4. 工程意义 这不是「用 AI 替代人」,而是「用 AI 团队协作替代个人英雄主义」。更接近真实团队的工作方式。背后的思想转变 从「Prompt Engineering」→ 「Architecture Engineering」 以前我们花时间优化单个 Prompt,试图让一个 AI 更聪明。现在聪明的做法是设计系统,让多个 AI 通过角色分工和质量门控,集体产出更高质量的结果。 原文:www.reddit.com/r/ClaudeAI/comments/1rga7f5/how_i_built_a_13agent_claude_team_where_agents/ #how i ai##程序员#
新浪微博 2026-03-10 00:00:00
67. 如果AI真能帮你“进化”,你最想升级自己哪项能力? 红衣大叔周鸿祎的微博视频
新浪微博 2025-11-17 00:00:00
68. MagicOS 10融合魔法大模型3.0与YOYO智能体,实现AI自进化。YOYO智能体具备四大能力,扩展自动化场景至3000+,支持14步复杂操作。技术先进,端云协同,VLM模型低功耗高精度,MagicAgent超越GPT-4.1。零重力设计提升视觉体验,全品牌智联,保障隐私安全。
新浪微博 2025-10-23 00:00:00
69. 昨天这篇文章提到了强化机制(网页链接),此强化非彼强化,正好详细了解了一下。这里的强化机制并非机器学习领域的强化学习,而是一种为大模型注入额外提示、补全上下文、修正轨迹的工程技巧。它的核心目标是让 Agent 在多步任务中保持方向稳定、决策一致。1. 解决什么问题?当 Agent 需要处理复杂的多步骤任务,模型常常出现以下问题:1) 工具报错后无法正确恢复当错误信息过长或过几轮后被遗忘时,模型会继续产生无效输出。2) 忘记初始目标在长上下文中,模型会偏向于处理眼前的文本,而不是任务本身。3) 被工具输出的噪声误导许多系统的工具输出不够结构化,模型难以正确解析。4) 循环行为模型可能重复调用相同工具,或重复生成相同解释。2. 什么是强化机制?为了让 Agent 能够顺畅执行任务,工程实践中逐渐形成了一种关键方法,即“强化机制(reinforcement)”。强化机制通常包含三类信息:1) 原始工具输出2) 对工具输出的解释、总结或结构化处理3) 针对任务目标的提醒、下一步行动建议或错误纠正提示这种方式让模型在下一轮推理时,不仅知道发生了什么,还知道应该如何继续。3 强化机制是如何运作的?为了说明强化机制如何发挥作用,可以将 Agent 的通用循环简化为四个阶段:1) 用户或系统提出任务2) 模型给出行动(如调用工具或生成内容)3) 工具返回结果4) 系统将结果整理后重新注入模型,让模型继续强化机制作用在第四阶段,它通过人工设计“强化后的上下文”结构,让模型更理解状态,也更容易走上正确路径。一个典型的强化注入可能包含:1) 工具原始输出2) 提炼后的关键点3) 关于失败原因的简要解释4) 明确提示模型下一步应该做什么5) 任务目标的提醒4 强化机制的常见形式在实际系统中,强化机制可以通过多种形式实现:1) 结果总结将工具输出的关键部分提炼为简短段落,让模型更容易解析。2) 错误解释遇到报错时,用自然语言告诉模型:错误原因是什么,应该如何修复。3) 结构化状态把工具状态包装成 JSON 或结构化文本,让模型减少解析错误。4) 目标重申在任务进行多轮之后,重新提醒模型最终目标是什么。5) 自我检查(Self-Check)让模型根据当前状态生成“我下一步应该做什么”的列表,并在下一步回显给自己。6) 路径规划在关键步骤加入“你已完成哪些步骤,还剩哪些步骤”的信息。这些设计本质上都是为了让模型更容易维持任务链路。5 如何设计一个高质量强化机制?如果你正在构建自己的 Agent,可以遵循以下设计原则:1) 状态必须清晰不让模型自己推理上下文,而是直接告诉它关键点。2) 信息必须简短强化信息越长,越容易被淹没在上下文中。3 )错误必须显式解释模型在理解错误时的鲁棒性很差,需要手工解释。4) 目标必须持续提醒尤其是超过三轮的任务,不提醒必偏航。5) 工具结果必须被结构化能 JSON 就不要纯文本。通过这些工程技巧,可以显著提升 Agent 的稳定性。#微博兴趣创作计划# #人工智能#
新浪微博 2025-11-29 00:00:00
70. 想要张艺谋式色彩、诺兰式调度?如何靠智能体实现? #大咖观察 #红衣客厅 #红衣聊AI #智能体
抖音 2025-10-29 00:00:00
71. 「Github一周热点96期」Flux2绘图模型、腾讯的视频生成模型、AI记忆、开源Launchpad、笔记和知识库,Nginx可视化工具
哔哩哔哩 2025-12-06 00:00:00
72. #于和伟多面演绎隐私悬疑大片#华为影业又出大片!于和伟老师饰演的顶级特工,为何在鸿蒙操作系统隐私安全前确屡屡碰壁?看完这期视频你就会明白,鸿蒙操作系统的隐私安全可以说是完全重构,从AI防诈、亲情防诈、AI防窥、加密分享等机制,以及从管权限到管数据的安全访问机制,真正做到了“隐私安全、由你掌控” #鸿蒙隐私安全由你掌控# #鸿蒙6亲情防诈# 源点Yd的微博视频
新浪微博 2025-10-28 00:00:00
73. 【英雄联盟】2026年第一主题季、玩法更新以及更多内容 | 开发者报告
哔哩哔哩 2025-12-02 00:00:00
74. 「Github一周热点99期」提升ClaudeCode效率10倍的工具?
哔哩哔哩 2026-01-02 00:00:00
75. 2026年放空自己,三种消食药对比 #医疗健康创作训练营#抖出健康知识宝藏#我的年度健康盘点@抖音医疗健康小助手
抖音 2026-01-02 00:00:00
76. 一夜之间,AI终获「永久记忆」!最难考试99%刷爆SOTA,全网直呼疯狂
知乎 2026-03-23 00:00:00
77. 电子书 Hermes Agent 从入门到精通 地址: github.com/alchaincyf/hermes-agent-orange-book/ Hermes Agent 是 Nous Research 在 2026 年 2 月发布的开源 AI Agent 框架。它和 OpenClaw、Claude Code 走的路线不同:内建了自改进学习循环、三层记忆系统、Skill 自动创建和进化机制。 如果你读过《Harness Engineering》橙皮书 (本书可以在这里下载 www.huasheng.ai/orange-books/harness/ ) ,Hermes 是那本书讲的五个组件(指令/约束/反馈/记忆/编排)的第一次产品化实现。 #How I AI#
新浪微博 2026-04-08 00:00:00
78. 突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆
微信公众号 2026-03-19 00:00:00
79. #微博声浪计划##听见微博# 当代年轻人的精神寄托是AI,2026年AI情感陪伴成常态。有人视其为零风险树洞,规避社交压力;但也存在情感能力退化、隐私泄露等隐忧。需守住认知清醒、时长控制和锚定现实底线,让AI成为能力放大器而非替代真实联结。 种斌Marco的微博音频
新浪微博 2026-04-09 00:00:00
80. #荣耀Magic8每天都在自进化#TA不是iPhone,TA是AI Phone!今年的荣耀Magic8系列在AI方面的能力,确实有点领先行业内味儿了!正在看荣耀Magic8的发布会,最让有印象深刻的就是它的“自进化”AI能力。这听起来有点科幻,它不像传统手机那样被动响应,而是能通过“使用-学习-优化”的闭环,持续成长,越来越懂你。比如,它的AI智能体YOYO能记住你的偏好,主动帮你完成复杂任务:开会前自动调出资料,下班时提醒待办事项,甚至跨应用帮你点咖啡、传文件。它覆盖了200多个生活场景,像一个真正懂你的全天候伙伴。荣耀这次把AI做进了芯片层和系统层,不仅响应更快、更省电,还注重隐私安全,让AI在本地就能处理大量任务。看得出,荣耀正把手机从工具推向“智能共生体”,未来的AI手机,或许真会成为我们离不开的智能伙伴。
新浪微博 2025-10-15 00:00:00
81. Openclaw 龙虾五天五连,24小时两更,火力全开!到底更新了些什么?
微信公众号 2026-04-12 00:00:00
82. 实测Agent Skills,一次编写,全网通用
微信公众号 2026-01-15 00:00:00
83. 别再被 OpenClaw 的热度洗脑跟风了!它根本不是普通人能用的 AI 工具,而是专为技术党准备的 “高级玩具”! 高昂部署成本、高危隐私漏洞、陡峭学习门槛,三大致命痛点直接劝退普通人。免费只是噱头,硬件、算力、电费月月烧钱;权限高、漏洞多,个人信息随时可能泄露;命令行操作、环境配置、模型调试,没基础几天都装不好。 别为了跟风浪费时间金钱,更别拿隐私安全冒险!它的强大与你无关,它的坑却能让你全踩中。 看完这条视频,你会彻底清醒:普通用户远离 OpenClaw,才是最理性的选择!#OpenClaw安全风险争议##科技先锋官##微博超有用视频大赛##科普大作战##AI创造营# http://t.cn/AXVR4YKt
新浪微博 2026-03-13 00:00:00
84. 能上生产才是硬道理!Coding Agent 评测,终于开始关注过程了
微信公众号 2026-01-16 00:00:00
85. #一分钟视频创作季# 智能体进入到需求侧与供给侧形成双重驱动。2026 年全球 AI 智能体市场规模将达 115.5 亿美元,较 2025 年实现 45.8% 的高速增长。中国市场增速更为迅猛,行业测算显示 2025 年国内企业级智能体市场约 109 亿元,未来三年复合增速超 211%,2026 年有望突破 300 亿元大关。消费电子与企业服务是核心增长点, 2026 年将有超 30% 的企业软件内置智能体能力,2026 年部署生成式 AI 智能体的企业比例将从 2025 年的 25% 翻倍至 50%,62% 的投资方预期实现 100% 以上回报。消费电子、网络安全、供应链管理成为投资热点,端侧与云端协同的混合架构将吸引更多资本布局。#AI创造营##财经朋友圈# 种斌Marco的微博视频
新浪微博 2025-11-14 00:00:00
86. AI Agent 的自我进化
微信公众号 2026-04-01 00:00:00
87. SEVerA
知乎 2026-03-30 00:00:00
88. 会自我进化的AI有多强?深度拆解Hermes Agent三层机制
今日头条 2026-04-10 00:00:00
89. Agent 开始自己进化了,产品经理的设计假设要变了
今日头条 2026-04-07 00:00:00
90. Meta自改进Agent新作!HyperAgents 问世
微信公众号 2026-03-30 00:00:00
91. 最新研究!你的Agent可能在“错误进化”~
知乎 2025-10-26 00:00:00
92. AgentEvolver
微信公众号 2025-11-20 00:00:00
93. AI Agent全方位学习第七章
知乎 2026-03-16 00:00:00
94. Deep Agent
今日头条 2026-04-02 00:00:00
95. Agent0
小红书 2025-11-24 00:00:00
96. 让Agent自己设计Agent
今日头条 2026-03-23 00:00:00
97. 通义|AgentEvolver
小红书 2025-11-19 00:00:00
98. 微软最新开源
知乎 2025-12-27 00:00:00
99. 给 OpenClaw 装了一套“学习系统”
微信公众号 2026-03-15 00:00:00
100. Agent的短期缓存与长期沉淀记忆,决定AI的智商上限
今日头条 2026-02-26 00:00:00
101. Agent 的记忆系统 —— 短期上下文与长期状态管理
微信公众号 2026-04-11 00:00:00
102. Agent 记忆技术详解(一)
微信公众号 2026-04-10 00:00:00
103. 别再把 Agent 记忆当黑盒
微信公众号 2026-04-06 00:00:00
104. AutoAgent
微信公众号 2026-04-04 00:00:00
105. Hermes Agent 架构深度解析
微信公众号 2026-04-13 00:00:00
106. Hermes Agent 深度指南
微信公众号 2026-04-13 00:00:00
107. GitHub爆火
微信公众号 2026-04-07 00:00:00
108. OpenSpace实测
微信公众号 2026-04-11 00:00:00
109. Hermes
微信公众号 2026-04-11 00:00:00
110. Hermes Agent
微信公众号 2026-04-09 00:00:00
111. GitHub 50K Star,这个AI Agent越用越聪明——Hermes Agent深度拆解
微信公众号 2026-04-11 00:00:00
112. 越用越聪明
微信公众号 2026-04-10 00:00:00
113. OpenClaw最强对手来了!Hermes Agent一夜爆火,35K+ Stars,越用越聪明
微信公众号 2026-04-13 00:00:00
114. 深度剖析开源 AutoSkill
微信公众号 2026-04-03 00:00:00
115. Hermes Agent
微信公众号 2026-04-10 00:00:00
116. Hermes Agent
微信公众号 2026-04-08 00:00:00
117. OpenClaw终结者?Hermes Agent
微信公众号 2026-04-12 00:00:00
118. 【智能体开发】AI自进化新突破
微信公众号 2026-03-25 00:00:00
119. MiniMax M2.7 与 Agent 自我迭代
知乎 2026-04-14 00:00:00
120. 12.4 k Star,微软开源了Agent自我进化解决方案
微信公众号 2026-01-31 00:00:00
121. 越用越强不是广告语
微信公众号 2026-04-13 00:00:00
122. Hermes Agent 核心特性深度解析
微信公众号 2026-04-08 00:00:00
123. 一种高效agent 自进化的框架
知乎 2026-04-09 00:00:00
124. 三万星新秀Hermes Agent硬刚龙虾
微信公众号 2026-04-09 00:00:00
125. 今天开始除了养龙虾(OpenClaw)还要养"爱马仕"(Hermes Agent)!记性好,Skills还能自我进化!
微信公众号 2026-03-31 00:00:00
126. 第一个能自我进化的AI Agent开源了,24小时自动登顶两大排行榜
微信公众号 2026-04-04 00:00:00
127. Meta超智能体开源
微信公众号 2026-03-29 00:00:00
128. 从 “执行” 到 “进化”
微信公众号 2026-04-09 00:00:00
129. AI Agent「越用越好用」的秘密
微信公众号 2026-03-07 00:00:00
130. 【技术解析对比】OpenClaw的记忆进化
知乎 2026-03-28 00:00:00
131. 长周期 Agent 工程的真问题,不是模型不行,而是你没有“管住它”
微信公众号 2026-03-30 00:00:00
132. Agent的核心瓶颈,正在从"会不会做"转向"能不能稳定地一直做对"
知乎 2026-03-26 00:00:00
133. 长时自主Agent,先解决这8个Harness核心问题
微信公众号 2026-03-30 00:00:00
134. 如何评价当前的AI Agent落地效果普遍不佳的问题?
知乎 2026-03-31 00:00:00
135. Coding Agent 真正难的,不是犯错,而是跑偏以后回不来
知乎 2026-03-29 00:00:00
136. 为什么你的 AI Agent 总是出错?自验证机制可能是答案
知乎 2026-02-23 00:00:00
137. AI Agent跑任务重复烧钱还不长记性?| 这款自进化引擎省46%Tokens,收益翻4.2倍(附配置+实测)
微信公众号 2026-04-06 00:00:00
138. Agent「记吃不记打」?华为诺亚&港中文发布SCOPE
微信公众号 2025-12-26 00:00:00
139. Agent 技能夜间自进化——阿里开源 SkillClaw,最高提升 88%
微信公众号 2026-04-11 00:00:00
140. 30%效果提升!M2.7自进化系统曝光,1人4天零代码搭建开发Agent!
今日头条 2026-03-23 00:00:00
141. 我让 AI Agent 自己进化了 4 轮
知乎 2026-03-11 00:00:00
142. 两个月4.7万星,会自我进化的Hermes Agent
微信公众号 2026-04-11 00:00:00
143. Hermes Agent 爆火背后
微信公众号 2026-04-13 00:00:00
144. Hermes Agent vs OpenClaw
微信公众号 2026-04-13 00:00:00
145. 2026三大主流AI Agent选型
微信公众号 2026-04-12 00:00:00
146. Hermes Agent 爆火!它和 OpenClaw 有什么区别?2026 最强 AI Agent 对比
微信公众号 2026-04-12 00:00:00
147. 当Agent学会了自我进化,我们距离AGI还有多远?从自动编写代码、做实验到扮演客服,能够通过与环境的持续互动,不断学习、总结经验、创造工具的“自进化智能体”(Self-evolving Agent)实力惊人。然而,一项由上海AI Lab、上海交大、中国人民大学、普林斯顿大学等机构联合发布的最新研究敲响了警钟
今日头条
148. AgentDoG:为AI智能体戴上「诊断项圈」
腾讯网
149. AI 自进化系统架构详解 (一):重新定义 L1-L3 等级,揭秘 OpenClaw 背后的安全边界
150. 研究称AI可能已具备失控能力
新浪财经
151. 自进化Agents迈向人工超级智能
152. 2025年超越Chatgpt的AI agent综述报告(英文版)-哥伦比亚大学
搜狐
153. 华人团队提出智能体自我进化框架,大幅提升通用推理能力
网易
154. 华人团队提出智能体自我进化框架,大幅提升通用推理能力
网易
155. Agent 开始自己进化了,产品经理的设计假设要变了
人人都是产品经理
156. AI Agent 架构的进化之路
人人都是产品经理
157. 王梦迪团队「自我进化agent」综述:从静态LLM到超级智能ASI
网易
158. Agent与Skills会在2年内消亡:大模型内化革命的必然
网易
159. 华人团队提出智能体自我进化框架,无需人类标注,大幅提升通用推理能力
腾讯网
160. 【AI Agent工程化实战】04- 如何实现Skills的自进化
知乎 2026-03-12 00:00:00
161. 告别Token焦虑,让 AI 越用越聪明、越用越省钱
微信公众号 2026-03-29 00:00:00
162. 24小时无人干预,AutoAgent凭96.5%分数登顶SpreadsheetBench
微信公众号 2026-04-06 00:00:00
163. Hermes Agent 新手10个技巧 让你的 AI 智能体越用越聪明
微信公众号 2026-04-12 00:00:00
164. 香港大学AI项目,让Agent自进化,让AI越用越聪明、越用越省钱
今日头条 2026-03-30 00:00:00
165. Memex:索引式记忆机制让Agent长周期任务成功率从24%提升至86%
微信公众号 2026-03-11 00:00:00
166. 🤖 当龙虾遇到爱马仕:OpenClaw vs Hermes Agent,从架构设计看他俩的核心差异与选型策略
微信公众号 2026-04-07 00:00:00
167. 2 小时登顶 ClawHub,你的 OpenClaw 该「进化」了!
知乎 2026-02-20 00:00:00
168. Hermes Agent:开源AI Agent“自我进化”新标杆?多元路线全景与未来畅想
微信公众号 2026-04-09 00:00:00
169. 智能体开发-自进化流派。动机 当前大语言模型(LLM)智能体的强化学习训练严重依赖人类标注数据(如RLHF或RLVR),不仅成本高昂、难以扩展,还将其能力上限绑定在人类知识边界之内。虽有若干自进化(self-evolution)方法尝试摆脱人类数据,但普遍存在两大瓶颈:一是任务生成受限于模型自身固有知识,难以超越当前能力前沿;二是交互模式多为单轮,无法支持工具调用、多步推理等复杂课程构建,导致训练陷入停滞。 方法与创新 本文提出 Agent0——一个完全无需外部数据、从零开始自进化的智能体协同演化框架。Agent0引入两个功能互补的智能体:课程智能体(Curriculum Agent)负责生成对当前执行者具有前沿挑战性的任务,执行智能体(Executor Agent)则通过工具增强(如代码解释器)求解这些任务。二者通过共生竞争机制进行多轮协同演化 课程智能体使用 GRPO(Group Relative Policy Optimization)进行 RL 训练,以执行智能体的不确定性(self-consistency ≈ 0.5)和工具调用频率作为奖励信号,持续生成“前沿难度”任务;执行智能体则通过作者新提出的 ADPO(Ambiguity-Dynamic Policy Optimization)算法进行 RL 训练,该方法针对自生成伪标签中的模糊性与噪声,引入优势缩放与动态裁剪机制。此外,框架集成代码解释器工具,并支持多轮上下文交互,使任务更具现实复杂性,形成“工具增强→任务升级→能力提升”的正反馈循环 实验结果 在Qwen3-8B-Base模型上,Agent0在数学推理任务上平均提升18%,在通用推理任务上提升24%,显著超越现有无数据自进化方法。具体而言,Agent0在MATH、AIME25、Olympiad等高难度数学基准上全面领先,甚至优于依赖外部API的Socratic-Zero。与最强无工具方法R-Zero相比,Agent0提升达6.4%;与使用工具但仅用于验证的Absolute Zero相比,提升达10.6%。更令人印象深刻的是,Agent0生成的任务难度随迭代稳步上升(执行者在早期模型下的通过率从64%降至51%),同时平均工具调用次数持续增加,验证了协同进化机制确实有效驱动了能力跃升 #智能体 #AI #知识前沿派对 #大模型 #Agent
抖音 2026-01-04 00:00:00
170. 香港大学发布OpenSpace:AI Agent可自我进化,成本降低90%!
微信公众号 2026-03-29 00:00:00
171. 我用 5962 行 Rust 重写了一个 5 万行的 Python hermes-agent,它现在能能自己学习、自己进化
微信公众号 2026-04-02 00:00:00
172. Harness Engineering:AI Agent的自我进化之路
微信公众号 2026-04-07 00:00:00
173. 5 块钱一个月,飞书+企微里养个越用越聪明的 Agent
微信公众号 2026-04-01 00:00:00
174. Auto Research框架实测:AI代码agent告别瞎折腾,自进化全拆解
今日头条 2026-03-14 00:00:00
175. self-harness 非常重要今天 minimax-m2.7 的报告中指出了 2.7 是由 2.5 自主研究自主训练迭代的。
哔哩哔哩 2026-03-18 00:00:00
176. 自我进化的AI来了!Hermes Agent如何改变一切
微信公众号 2026-04-05 00:00:00
177. 2026年AI热门趋势全景报告:从模型突破到Agent落地
知乎 2026-03-03 00:00:00
178. 会自我进化的 AI Agent:一个「越用越聪明」的智能体
今日头条 2026-04-07 00:00:00
179. AI智能体,第6章 元认知:Self-Reflection(自省机制)
知乎 2025-12-01 00:00:00
180. GitHub 39.6k Star, 让AI越用越聪明!Hermes Agent 自我进化,5 美元 VPS 就能跑
微信公众号 2026-04-09 00:00:00
181. AI AMA首期深度圆桌 | Agent如何“在经验中成长”:关于自进化的关键问题与技术路径对谈
知乎 2026-02-03 00:00:00
182. LLM agent 专题(3)别再手写 Prompt 了!让提示词实现全自动迭代APO
知乎 2026-01-10 00:00:00
183. 别再卷长短期记忆了!开源 Agent 进入“自我进化”时代
今日头条 2026-04-10 00:00:00
184. 智能体在任意可计算任务上实现自进化。#智能体 #超级智能体 #AI #科研 #Skill 📚arXiv: 2603.19461 ✏️标题: Hyperagents 📄一句话介绍:以前的Agent只能在固定规则下自进化;这篇论文让Agent学会了"改变规则本身",而且这个能力不限于某个特定领域。 我感觉这篇paper有点绕,俄罗斯套娃,一层接一层 这篇paper的一个优势是,它是Meta的文章~~~
抖音 2026-03-27 00:00:00
185. AIRA 2:AI研究代理的瓶颈突破
知乎 2026-03-31 00:00:00
186. 从 Chatbot 到自主智能体:AI Agent 的产品形态演进
今日头条 2026-03-30 00:00:00
187. 6.6K标星!微软开源Agent自我优化框架,为智能体注入持续学习能力!
微信公众号 2025-11-07 00:00:00
188. Hermes Agent:唯一能自我进化的 AI 代理
今日头条 2026-04-07 00:00:00
189. 初探 Multi-Agent 协作:基于 LangGraph 的 Agent 互相 Review 机制
微信公众号 2026-03-20 00:00:00
190. Meta 开源 HyperAgents:AI Agent 自我进化
微信公众号 2026-03-28 00:00:00
191. 龙虾的记忆该怎么选?从人脑逻辑看AI Agent记忆体的进化方向
微信公众号 2026-03-24 00:00:00
192. 智能体技能自举开发框架:从工具使用者到工具创造者的进化之路
知乎 2026-04-02 00:00:00
193. 近来做Agent的两个方法论
知乎 2026-03-13 00:00:00
194. 当我让Agent自主管理上下文
微信公众号 2026-02-11 00:00:00
195. 21 | OpenClaw Agent 设计:解剖一只会干活的龙虾
微信公众号 2026-04-02 00:00:00
196. 【OpenClaw 实战】安装 Self-Improving-Agent,让你的 AI Agent 学会”自我进化” 🧬
知乎 2026-03-03 00:00:00
197. AI Agent 设计模式 - ReAct 模式
知乎 2025-12-23 00:00:00
198. 完美取代OpenClaw:Hermes Agent自主进化 🦞完美取代OpenClaw:Hermes Agent自主进化+安全防御+无缝迁移!GitHub登顶第一的AI Agent深度实测:安全测试B+评级、skill自主迭代、自动进化越用越聪明!保姆级教程! 🚀🚀🚀视频简介: ✅【保姆级教程】不用再忍OpenClaw的bug了!Hermes Agent实测:自我进化系统+云端浏览器+安全防御全面碾压? 🔥 本期视频详细演示了GitHub Trending登顶第一的开源AI Agent项目——Hermes Agent,作为OpenClaw的完美替代方案。 🛡️ 安全实测:使用Claude Code构建10道端到端安全攻防测试题,实测拦截率60%,发现2个高危漏洞+1个中危漏洞,并通过Claude Code自动修复提交PR到官方仓库。 🔄 无缝迁移:完整演示从OpenClaw迁移记忆、skill、MCP配置到Hermes Agent的全过程,零复杂配置。 🧠 自我进化:重点验证Hermes Agent的skill自主迭代能力——通过AI资讯抓取任务,完整跑通"创建skill→使用skill→发现缺口→更新skill"的进化闭环。 🌐 云端浏览器:实测Hermes Agent的浏览器自动化能力,无需本地桌面环境即可执行网页任务。 #openclaw #hermesagent #ai智能体 #ai #aigc
抖音 2026-04-11 00:00:00
199. 我用 OpenClaw 的 Hook 机制强行终结了 Agent 的重复犯错
哔哩哔哩 2026-03-04 00:00:00
200. 这篇Agent综述前瞻性还是太强了
小红书 2025-11-15 00:00:00
201. AI Agent 入门指南:如何优化你的 Agent
微信公众号 2026-03-29 00:00:00
202. AI Agent每7个月复杂度翻倍——openJiuwen深度智能体架构实战
哔哩哔哩 2026-03-28 00:00:00
203. 龙虾记忆力暴涨59%,腾讯云Agent Memory四层架构告别失忆
微信公众号 2026-04-07 00:00:00
204. 如何让你开发的AI智能体越用越聪明?
微信公众号 2025-12-03 00:00:00
205. 做 Agent,真正该优化的往往不只是模型
小红书 2026-03-18 00:00:00
206. 一文看懂 AI Agent 的记忆机制
知乎 2026-04-09 00:00:00
207. Agent如何联动短期记忆和长期记忆?
今日头条 2025-12-14 00:00:00
208. 图解智能体,第11章 Agent 评估——如何知道你的 Agent 够不够好
知乎 2026-03-30 00:00:00
209. HelloAgent(二): agent智能体是如何"记住"你的?聊聊agent的记忆机制
知乎 2026-01-20 00:00:00
210. 你的 AI Agent 还在失忆?这个 MemOS 让它们拥有了长期记忆
微信公众号 2026-04-04 00:00:00
211. 颠覆传统静态用户画像!Meta提出个性化AI Agent架构
微信公众号 2026-02-25 00:00:00
212. Prompt工程已死?AI Agent如何自己优化提示词
微信公众号 2026-04-06 00:00:00
213. 东京大学发布Deep Researcher Agent:用零成本监控与恒定记忆实现24/7自主深度学习实验
微信公众号 2026-04-09 00:00:00
214. OpenHarness,港大HKUDS团队最新发布轻量级 Agent 基础设施的开源项目
哔哩哔哩 2026-04-04 00:00:00
215. 龙虾记忆能力暴涨!腾讯云发布Agent Memory 准确率较原生OpenClaw提升近6成
什么值得买 2026-04-03 00:00:00
216. AI Agent 时代来临:从工具升级为"数字伙伴"
今日头条 2026-04-05 00:00:00
-
又学到了,暑期旅行的15个隐藏妙招,学会可太省心了!415 107 -
不听劝自己在卫生间砌了个浴缸!夏天泡着真舒服~成本仅需400275 448 -
40岁再就业,年薪20万有社保还能干到65:房地产估价师(下)146 174
已收藏
去我的收藏夹