GPT-6 Astra 自主通关《传送门》,只烧约四千元

2026-09-08 10:07:01 0点赞 0收藏 0评论

GPT-6 Astra 自主通关《传送门》,全程 24 小时只烧了约四千元

OpenAI 的新模型又干了一件「不像是 AI 干的事」。一位技术爱好者用 GPT-6 Astra 跑通了 Valve 的经典解谜游戏《传送门》,全程 24 小时、3336 次工具调用,消耗的 token 成本折算下来约 571 美元,按当前汇率合人民币约 4111 元。这是第一次有主流大模型完整通关 3D 解谜游戏,而不是只在小游戏或文字游戏里刷成绩。

模型怎么「玩」的

GPT-6 Astra 自主通关《传送门》,只烧约四千元

实验的关键在于控制方式。GPT-6 Astra 通过 MCP 协议接入了游戏,配合一个改造过的暂停工具。游戏在模型思考时保持暂停,模型接收每一帧的截图和玩家位置信息,规划好一段输入序列后让游戏继续执行,执行完再暂停,如此循环。整段高光视频大约两小时,但完整直播素材加起来约 24 小时,思考时间占了绝大部分。

这个循环看起来简单,但考验的是模型的多模态能力。它需要理解 3D 空间结构、识别游戏场景里的机关和传送门,还要记住前面关卡里遇到的谜题解法。以前的 AI 玩《传送门》顶多过两三个教学关,这次直接通关全流程,说明模型对「空间推理」和「长任务规划」的理解上了一个台阶。

成本方面,571 美元的费用由实验者自己的订阅额度覆盖。折算下来,单位通关成本远低于雇人代打的市场价,当然这里算的是 API token 成本,不包含开发调试和人工审核的时间。

为什么这件事值得关注

游戏通关本身只是表象,背后是 AI 能力的三个进展。第一,多模态模型已经能长期稳定地处理复杂环境反馈,24 小时不掉线是工程能力的体现。第二,通过 MCP 这类工具协议,模型可以接入真实软件的操作流程,这对未来的智能体应用是重要铺垫。第三,这类「自主完成任务」的能力正从文本问答扩展到 3D 空间,距离真实世界的机器人控制又近了一步。

也有人冷静提醒,这毕竟是在一个规则封闭的游戏里,模型没有面临真实世界的物理约束和随机性。但放在几个月前,主流评测还在争论大模型能不能打好《国际象棋》,如今 GPT-6 Astra 已经能在 3D 解谜游戏里自主通关,进步速度确实超出预期。

对普通用户来说,这件事的意义没有跑分那么遥远。当大模型能自主完成这种需要规划、记忆、试错的长任务,意味着未来各类「帮我搞定一个流程」的智能体应用会越来越靠谱。一万块钱以内的 AI 完成一次全流程游戏通关,这本身就是一个有趣的时代注脚。

作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松