张大妈

GPT-5.2连肝7天,300万行代码造出Chrome级浏览器

源自公众号:深度学习与NLP

01-19 10:27

一个AI模型连续运行7天,自主编写300万行代码,从零构建出一个功能完备的浏览器。这项实验不仅展示了AI在复杂工程领域的惊人潜力,更标志着AI编程工具从“分钟级”辅助迈向“周级”自主开发的关键转变,预示着软件开发的成本和模式将迎来颠覆性重构。

GPT-5.2连肝7天,300万行代码造出Chrome级浏览器智能速览

  • GPT-5.2模型不间断运行7天,自主编写了超过300万行代码。

  • AI从零构建了包含HTML解析、CSS布局及自研JS虚拟机的浏览器引擎。

  • 项目成功依赖于分层多智能体系统,实现了上百个Agent的高效协作。

  • 相比其他模型,GPT-5.2在长时任务中展现了更强的专注力和持续执行能力。

  • 该实验预示着软件开发边际成本趋近于零,AI正从工具转变为“数字劳工”。

GPT-5.2连肝7天,300万行代码造出Chrome级浏览器精华内容

让一个AI模型连续工作7天,它不仅能坚持下来,还能完成构建浏览器这类顶级难度的工程。这背后,是AI能力的一次质变,它开始理解并执行真正的“项目”,而非简单的“任务”。

极限的耐力

Cursor团队让GPT-5.2模型连续不间断运行了整整168小时,这期间AI自主编写了超过300万行代码,创建了数千个文件,执行了数万亿个token。这与传统以分钟或小时计算的AI编程任务形成鲜明对比。

实验对比发现,不同模型的“耐力”差异巨大。GPT-5.2能长时间专注执行,而Claude Opus 4.5则倾向“抄近路”并频繁中断。这表明GPT-5.2在处理长期运行任务上,已具备超越前辈的稳定性和持久力。

协作的奥秘

如此庞大的工程并非单个Agent所能完成,其背后是Cursor团队研发的多智能体系统。最初尝试的平等协作模式因“锁”竞争和沟通成本过高而失败,效率极低。

最终采用的高效方案是分层架构,包含负责决策的“规划者”、专注编码的“执行者”和质量把关的“评审者”。这套系统模拟了人类软件公司的组织结构,却实现了上百个Agent在数周内协同工作且几乎无代码冲突,展现出惊人的协作效率。

啃下硬骨头

从零构建浏览器内核的难度仅次于开发操作系统。谷歌Chromium项目代码量已超3500万行。GPT-5.2面临的挑战极其艰巨。

首先是实现规则极其复杂的CSS布局引擎,任何微小改动都可能引发连锁反应。其次,AI还必须编写一个安全可靠的JavaScript虚拟机,处理内存管理和垃圾回收。更难的是,这一切都使用以安全严苛著称的Rust语言,AI需在百万行代码规模下驾驭其复杂的编译器,这证明其已具备顶级的架构设计能力。

未来的序章

此次实验的核心价值在于“无中断”,意味着AI具备了“编写-运行-修复”的自主闭环能力。当任务复杂度提升到项目级别时,AI不再被动等待指令,而是能自我驱动解决问题。

这彻底改变了软件开发的经济学。原本需要数月人力成本的项目,AI一周内即可完成,成本可能仅为几亿token的费用。当算力成本持续下降,软件开发的边际成本将趋近于零,按授权付费的模式可能被淘汰,人类只需描述意图,代码便可自动生成。

这不再是一个简单的技术演示,而是软件开发范式变革的序曲。当AI能够独立承担长周期、高复杂度的项目,人类工程师的角色将重新定义。或许,我们真正应该思考的是:在意图可以被瞬间实现的时代,创造力将走向何方?

内容由AI生成
1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章