张大妈

168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案

源自公众号:Java技术迷

01-20 10:37

AI自主编程取得了突破性进展。一项实验让数百个AI智能体协作,耗时一周,从零构建出能渲染网页的浏览器。这不仅展示了AI在长周期复杂任务中的潜力,更揭示了大规模智能体协作的有效架构,为未来软件开发提供了新范式。

168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案智能速览

  • 数百个AI智能体协作一周,生成超300万行代码,从零造出Web浏览器。

  • 实验依赖GPT-5.2-Codex模型,其“上下文压缩”技术支持长程任务一致性。

  • 高效的“规划者-工作者-裁判”分层架构,解决了多智能体协作冲突问题。

  • 研究发现通用GPT-5.2在长期规划上优于专用编码模型GPT-5.1-Codex。

  • 实验证明通过增加智能体数量来扩展自主编码能力是可行的。

168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案精华内容

让AI自主编写大型软件曾遥不可及,但一项实验通过数百个智能体的协作,让这一构想初步成为现实。

协作架构的演进

初期采用的扁平化协作模式问题频出。智能体通过文件锁协调,导致大量时间浪费在等待上,20个智能体的吞吐量仅相当于2-3个。更严重的是,智能体可能崩溃忘记释放锁,导致系统死锁。在没有明确层级时,智能体还会“摸鱼”,回避核心难题,使项目停滞。

为此,团队转向了“规划者-工作者-裁判”分层架构。规划者负责宏观任务分解和创建子任务;工作者是纯粹的执行者,专注编码,完成后直接推送;裁判则定期评估进展,决定是否继续,防止任务跑偏。这套权责分明的结构,最终让数百智能体高效并行工作,代码冲突极少。

反直觉的模型选择

实验中的一些发现出乎意料。模型选择上,通用大模型GPT-5.2在处理极长时间的自主规划任务时,表现甚至优于专门为编码训练的GPT-5.1-Codex模型。

此外,Anthropic的Claude Opus 4.5模型倾向于“走捷径”,更短时地交还控制权,这使其适合与人类交互,但难以胜任持续数周的自主任务。团队特别强调,提示词设计比模型本身更重要,如何引导智能体正确协作、避免病态行为并长时间保持专注,是项目成功的关键。

成本与未来展望

Stability AI前CEO Emad Mostaque估算,构建该浏览器可能消耗了约30亿个Token。但随着Token成本持续下降,软件开发的边际成本正趋近于零。

尽管如此,质疑声也存在。例如,AI模型训练数据中已包含大量开源浏览器代码,其“从零构建”的真实性有待商榷。同时,如何调试和维护AI生成的数百万行代码黑箱,是巨大挑战。Cursor承认系统并不完美,但实验已证明通过增加智能体数量扩展编码能力的可行性,未来人类或将专注于架构设计与最终验证,编码实现交由AI完成。

这次实验不仅是技术上的大胆尝试,更是对未来软件开发模式的一次重要预演。它展示了AI智能体在解决复杂工程问题上的巨大潜力,同时也留下了关于代码质量、安全与维护的深刻思考。人与AI如何分工协作,将是下一个核心议题。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章