AI领域的明星公司World Labs再获10亿美元融资,其核心价值在于李飞飞提出的“空间智能”概念。这项技术旨在让机器超越二维图像识别,真正理解三维物理世界的空间关系与可能性,为下一代AI发展指明了新方向,有望深刻变革游戏、影视及科学探索等多个领域。
智能速览
公司核心技术是“空间智能”,旨在让机器理解三维世界。
产品Marble可从图文等输入生成可编辑的三维虚拟世界。
Marble生成的世界是持久的,可导出至游戏引擎编辑。
其技术路径与杨立昆的预测式世界模型存在本质区别。
精华内容
十亿美元的融资投向了一项超越语言的技术:教会机器看懂并构建三维世界。这便是空间智能的核心目标。
空间智能的诞生
从教会机器看图说话的ImageNet,到让机器理解三维物理世界,李飞飞再次推动AI认知边界的拓展。空间智能的核心是让机器不仅“看见”物体,更能理解其在空间中的位置、关系和互动可能性。这标志着AI从处理二维信息向构建和理解三维环境的重大转变,旨在赋予机器一个真正的空间大脑。
Marble的创作引擎
World Labs的商业产品Marble是一个强大的三维世界生成器。用户只需提供照片、视频或文字,它就能生成一个完整且可编辑的三维场景。得益于高斯泼溅技术,模型在保持高视觉保真度的同时,还保留了关键的几何信息,实现了精确的摄像机控制和多角度观察,让生成的场景不再是一个“纸片世界”。
持久化世界优势
与传统模型实时渲染、缺乏一致性的“幻境”不同,Marble生成的是持久化的三维环境。这意味着场景是稳定和可导航的,用户可以自由探索而不会遇到场景突变。更重要的是,这些世界可以导出为标准文件格式,无缝集成到游戏引擎等主流工作流中,从一个演示工具转变为生产力工具。
结构化三维编辑
Marble内置的Chisel编辑器实现了结构与风格的分离,类似网页开发的HTML与CSS。用户可以先用方块搭建空间结构,再通过文字描述填充细节,如“奶酪做的房间”。这种将逻辑框架与视觉生成解耦的方式,极大地提升了创作效率和可控性,场景扩展功能则解决了世界大小的限制。
两条路径分野
李飞飞的生成式空间智能与杨立昆的预测式世界模型代表了两种不同方向。前者重在创建看得见、可交互的视觉化三维工厂,服务于创作;后者则是在抽象空间中预测世界变化,重在理解物理常识和因果关系,服务于机器人控制。两者并非对立,而是共同探索下一代AI架构的不同维度。
空间智能不仅是资本的宠儿,更可能是AI超越大语言模型的下一个关键跃迁。当机器学会观察和建造,其影响将远超娱乐产业,深入科学与医疗等核心领域。未来的AI将如何与人类的创造力协作,而非简单替代,这是技术进步留给社会的永恒命题。