从AlphaGo到EVE Online:DeepMind这次不是要让AI赢游戏,是让它学"活下去"

源自228位全网作者

15:04

关注DeepMind的朋友,5月份大概率刷到过它入股EVE Online开发商的消息。但8月21日这件事性质不一样:DeepMind发了一篇叫《From Atari to EVE Online》的文章,把这个合作的完整研究路线图摊开了——AI的下一个实验场,正式定在了新伊甸。知乎

表面上看是"DeepMind又开始打游戏了",但仔细看他们要测什么,目标已经完全变了。

从AlphaGo到EVE Online:DeepMind这次不是要让AI赢游戏,是让它学

不再追求"赢",而是测"能不能长期活下去"

DeepMind把这次的研究目标拆成了4种长期能力:长期记忆、持续学习、长线规划、多智能体协作。B站

这四个词单独看都不新鲜,但放在一起,考验的就不是"回答一个问题的正确率",而是AI能不能在一个不断变化的环境里保持目标、记住经历、调整策略。

为什么非得找这么个环境?因为现在主流的AI评测有个绕不开的尴尬:文本基准基本饱和了。刷榜刷到最后,分数很高,但你还是不知道一个AI放进真实世界能不能扛事——真实世界没有标准答案,没有明确终点,对手还会骗你。

而EVE Online,恰好是一个现成的、已经运行了20多年的"数字文明模拟器"。数千名玩家共享同一个宇宙,供需、贸易、联盟、冲突、外交共同塑造它的运行方式。知乎它的经济系统20年没崩——2007年开发商CCP甚至专门聘了一位经济学博士当首席经济学家,工作性质接近央行研究员。微博围棋是完美信息、有明确终局;星际是不完全信息、但单局有终点;EVE是不完全信息、没有终局、而且你的对手是会撒谎的真人。环境复杂度这一格,确实跳得很高。

从AlphaGo到EVE Online:DeepMind这次不是要让AI赢游戏,是让它学

先泼冷水:AI暂时不会进你的游戏

路线图出来后,社区里最容易被带偏的说法有两种:一种是"Gemini要进EVE当NPC了",另一种更刺激,“AI要进新伊甸打金、冲击玩家经济了”。

都先别信。把官方路线图拆开看,节奏其实非常保守:

第一步,AI只在与真实玩家服务器完全隔离的EVE Online离线实例里活动,相当于安全沙盒,做实验和评估。微博

第二步,进入EVE Frontier。这个版本的特点是内置可编程的Smart Assemblies,世界规则本身可以被改写,DeepMind想在这里研究的是人和AI如何共处。知乎

第三步,只有能力验证成熟之后,才会考虑把AI带进EVE Online和第一人称的EVE Vanguard。也就是说,在线游戏根本不是第一阶段。

从AlphaGo到EVE Online:DeepMind这次不是要让AI赢游戏,是让它学

目前唯一已经落地的、面向玩家的成果,是一个叫Aura Guidance的新手引导功能:基于Gemini,用游戏里真实客服问答积累的知识帮新飞行员上手。知乎但注意,这跟"AI在开放世界自主行动"完全是两码事——前者只是围绕筛选过的问题提供答案,后者才是要在真实玩家、经济系统和社会关系里持续行动。官方目前也只宣布了研究路径,没有任何"通用自主AI进入EVE真实经济"的承诺。

放在15年游戏AI史里看,这一步才说得通

DeepMind自己给这篇文章定的副题就是"15年游戏AI研究的延续"。B站回头捋一下这条线就明白了:

DQN在Atari上学会打街机,解决的是"看着像素学会一个任务";AlphaGo解决的是完美信息下的深度规划;AlphaStar在星际里面对不完全信息和实时操作;SIMA再进一步,追求在多个3D环境里听懂指令、通用行动。

每一代,环境都更复杂,目标都从"赢下一局"往"在开放环境里行动"挪一步。EVE是这条线上复杂度的又一次跳级:世界是持续的、记忆要跨场次保留、规划要以月为单位、对手是几千个各怀心思的真人。所以与其说DeepMind在找下一个能上头条的对局,不如说它在找一张足够难的考卷——来测"持续世界里的持续智能"。

顺带说个背景:这个合作其实5月就落子了。当时DeepMind收购了Fenris Creations(EVE宇宙背后的独立工作室,前身CCP Games)的少数股权,并且强调只涉及所有权和治理,工作室保持独立运营。微博8月这份路线图,是既定研究的推进。所以最近DeepMind高层震荡、外界担心研究线受影响的朋友,至少从这条线看,研究节奏没有断。

这件事对不同人意味着什么

如果你是AI观察者:值得盯的不是"AI会不会玩EVE",而是这套实验能不能给行业提供"持续世界评测"的范式。接下来三个信号:一是EVE Frontier人机共处阶段有没有公开实验结果;二是四种长期能力有没有对应的论文和指标;三是Aura Guidance这类功能会不会从新手帮助扩展到更复杂的游戏内服务。这三个动任何一个,都说明项目在真推进。

如果你是EVE玩家:短期内不用担心AI冲击你的经济系统和日常PVP——官方路线明确把真实玩家世界隔离在外。有意思的反差是,EVE社区这些年一直在和脚本、外挂斗智斗勇,现在官方亲自下场做"正规AI",这个对比本身就值得围观。另外EVE最近自己也在大修,240万行代码正在往Python 3迁移,老玩家应该懂这个工程量。B站

如果你只是路过:记一个能当谈资的细节。EVE里有一套从2016年运行至今的公民科学玩法Project Discovery:玩家在游戏里做"解谜小游戏"式的数据标注——分类细胞样本、寻找系外行星,换取飞船涂装等虚拟奖励,这些被交叉验证过的数据直接送进实验室,成果甚至登上过《自然·生物技术》。知乎2017年,后来拿到诺贝尔物理学奖的系外行星发现者马约尔团队就曾和EVE合作,把真实望远镜数据放进游戏让玩家帮忙分析。微博

EVE官方统计,十年来玩家参与公民科学贡献的工作量,相当于一个人连续干471年。微博一个游戏的玩家群体能被这样使用,也难怪DeepMind会把它当成研究样本。

从AlphaGo到EVE Online:DeepMind这次不是要让AI赢游戏,是让它学

一句话收尾:AlphaGo时代,DeepMind问的是"AI能不能赢人类最强的棋手";EVE时代,它问的是"AI能不能在一个没人兜底的持续世界里,长期活下去"。这个问题的答案,可能比任何一场对局都更值得我们盯着看。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章