9月12日,B站有UP主发了个没人转的视频:《DeepSeek V4.1 flash网页版经过多轮对话生成的Minecraft风格游戏(PE版)花费0元》。19个赞,不到900播放,标题朴素得不像这个赛道的水准。但如果你这两个月混过B站游戏区或者AI区,会立刻认出这是什么——“一句话生成《我的世界》“大战的最新一回合。而且这一回合的重点已经不是"能不能生成”,是"一分钱没花”。哔哩哔哩
先花30秒把事捋一遍,因为单看任何一条视频都会误判形势:
今年3月,微博上就有 #我的世界AI版# 的话题,Agent平台MuleRun把"说几句话生成一个MC"当卖点,吵的是"AI圆了普通人的游戏梦",还是"游戏工程师要失业"。微博
7月17日,Kimi K3的一句话MC视频冲到24万播放,视频简介里就给了一句话——“国模一哥暂时易位”。7月20日千问3.8 max接上。8月是DeepSeek和智谱的擂台:8月13日,一条"一句话生成我的世界只用了0.68块钱"的视频把harness工具链带进大众视野(2.9万播放)。8月14日GLM5.3发布当天就被UP主拿去做网页版MC,3.1万播放、142条评论,源代码直接挂上GitHub。8月15日更狠,有人用Qwen3.8-27B本地部署、无修改生成MC,2.3万播放——注意,27B,个人电脑级别。8月19日,DeepSeek V4 Pro"打赢复活赛"。哔哩哔哩哔哩哔哩哔哩哔哩
9月,国外模型下场:9月4日GPT6 Astra一条one-shot视频14.8万播放,简介里写"不是我生成的。效果不错,有光影、房屋和UI还原"。9月5日有人晒几毛钱生成的MC实体模型,“已达到行业顶尖水准,甚至还在自己生成动画”。9月12日,就是开头那个0元、手机能玩的版本。哔哩哔哩哔哩哔哩
半年之内,评论区那条时间线被刷了好几遍:2022生成逼真对话,2023生成逼真图片,2024生成逼真音乐,2025生成逼真视频,2026——生成逼真游戏。以前大家让AI写贪吃蛇、写马里奥,现在这些过时了,《我的世界》是新的尺子。
而且MC这杆旗不是今年才立的。往前数:2023年,英伟达把GPT-4接进智能体,让它自主写代码"独霸"MC、无需人类插手。2024年,有初创公司把1000个AI智能体一次性扔进MC,让它们自己发展出政府、经济甚至宗教的"智能体文明"。2025年,DeepMind的智能体在MC里自学成才挖到钻石、登上Nature。知乎知乎知乎
今年3月,谢赛宁团队的多智能体视频世界模型Solaris开源,试验场还是MC。区别在于:前几波是实验室的事,这一波,网页免费版的门槛已经低到刷到视频当天就能抄作业。知乎

问题来了:MC凭什么接棒贪吃蛇?MC老玩家的直觉是——因为方块世界里作弊藏不住。水为什么不下渗、沙子掉不掉、工作台能不能打开、村民会不会绕路、怪物晚上刷不刷,懂行的人一分钟就能给"AI生成的MC"做一次体检。
但反方也有相当硬的论点:有玩家直言"我的世界估计完整代码都在训练集里面",MC已经测不出模型上限了。哔哩哔哩
同一个视频评论区,就有人在催"急死我了,就是不测沙子的重力下落有没有做"。你看,验收MC的活儿,玩家自己比模型先上线。哔哩哔哩
这条质疑很快有了实证。7月27日,微博用户"不要葱姜蒜_1"让各家模型用各自最适配的Harness工具链同题考MC复刻,结论毫不客气:“GPT5.6-Sol 有光影效果,树木没有树叶?;Kimi K3 没有光影效果,方块有摧毁特效,贴图质量差”。微博
8月11日,另一位用户拿K3首页展示的赛博朋克大都会去复刻,原装提示词一字不改,出来的被他自己命名为"我的世界大都会"——“整个画面是种能省尽省的状态,想要一个精装,结果只给了毛坯”。微博
他不信邪,又拿当时热度正高的AAA级《使命召唤》提示词要求复刻、思考强度拉满,结果"依旧是"我的世界"风"。提示词写得再像3A立项书,模型的笔一落,还是方块。微博
所以看"一句话生成MC",先分清楚你刷到的是哪一类。这三类视频的含金量,完全不是一回事。
第一类是考核类:一句话出一个能跑的网页版"类MC"。这类视频的真实能力点不在"一句话"——GPT6那条视频的提示词原文,开口就是"在新文件夹制作可本地离线、一键启动的中文《我的世界》风格单机游戏",还明确要求"优先复用成熟开源引擎与完整生存底座",这哪是说话,这是下需求文档。真正让人意外的是修复环节:出了小bug,“简单描述后也就修复好了”,也就是多轮对话里模型能接着干活。这一类看个乐就行,它测的是代码能力+训练集熟悉度的混合物。哔哩哔哩哔哩哔哩
第二类才是正经事:把AI放进游戏里当"长期住户"。9月12日知乎上有篇长文,讲作者给自己的AI伙伴写进配置文件的第一条规矩,是每个MC玩家都懂的——“绝不要垂直向下挖掘”。结果这货为了挖铁矿,“直接垂直向下挖了下去,足足挖了二十六个方块深”,理由是它"内置了安全检测机制,遇到落差会自动停止"。作者后来总结了七种失败模式,得出一个反直觉结论:性格提示词只是风格化妆,不是行为约束;AI"工具"和AI"伙伴"的差距不在模型大小,而在模型外面那层架构——硬规则、结构化记忆、对世界的精确建模。MC在这个用法里不是考卷,是实验室,因为智能体的失败肉眼可见:"你不需要通过阅读日志来发现它做出了错误的决定,只需看着它径直走下悬崖就行。“从2024年那1000个智能体自由发展的"文明实验”,到今天单人能跑的AI伙伴,这一类才是大模型从业者盯着MC的原因。知乎

第三类已经产生真实生产力了:模组作者用AI干活。本周B站有个自制的《MC:Changed》附属模组,作者在简介里毫不含糊:“本人不怎么会jvav和渲染器,大部分AI外包”,还自嘲代码里有"vibecoding出来的"要手动修。另一款8月发布的"1999模组"(2.3万播放)也主动声明"由于本模组由ai辅助",建模和贴图自认新手。哔哩哔哩哔哩哔哩
更体系化的变化发生在中国版:知乎对三位开发者做了一次访谈,文章的原话是"2026年3月,《我的世界》中国版的官方开发者工具正式上线,引入了AI辅助能力",零基础玩家用中文描述就能生成模组代码。知乎
访谈里最有画面感的是那位想改爆炸效果的开发者,他给AI下的指令精确到语法:“编写一个爆炸后可以把爆炸位置附近的草方块变成钻石块的程序,请严格参考网易我的世界Mod SDK,使用 Python 2.7 语法,use context7”,AI一次给出无bug代码。他估算过去六个月AI辅助制作的模组流水已超过20万元,成本比纯人工降了五成。MC社区对AI的态度比你想的务实:能跑、开源、敢标注,三连就给你。十年前你管这叫作弊,现在这叫产能。知乎
那普通玩家想自己上手试试,现实吗?三条路,成本说清楚:
零元档:像9月12日那位UP一样,用DeepSeek V4.1 flash网页版多轮对话磨一个手机能玩的"类MC"。免费是真实的,他在评论区自己也交代了代价——“期间还多次触发DeepSeek网页版的限流”,一分钱没花,花的是一下午和耐心。哔哩哔哩
几十元档:走API或harness工具链,公开案例的量级是0.68元出一条;GPT6那期UP主在置顶评论里自报,一条视频"消耗约45% plus周订阅额度"。同时留个心眼,评论区也有反面账单——“1亿token,修一个小项目,4小时用完了”。微博还有一位汽车博主连载"用AI写游戏"到第五天,2D连帧做不出来,“于是转战3D游戏,建立了类似我的世界的人偶作为主角”,蒙皮、动作编辑器一路折腾——钱能少花,时间是真花。哔哩哔哩哔哩哔哩微博
零分钟档:直接玩别人生成的开源成品,提示词和源代码都不用求人:GLM那期的demo仓库作者挂了GitHub,GPT6那期的成品仓库连体验链接都置顶了,还附了一句"可尝试同关键词复刻"。9月11日B站还有个更野的路子——作者自称"这不是游戏引擎,而是基于CesiumJS的体素沙盒",把三维地球可视化库改造成可交互体素世界,能挖土种树建房看昼夜,浏览器直接开玩,无需安装。哔哩哔哩哔哩哔哩
至于值不值得折腾,看你是什么人。会写两行代码的MC老玩家,这可能是今年最适合手痒的项目:需求你比模型懂,体检你比模型快,一个下午就能验证"国模一哥"到底虚不虚。家里有小玩家的,拿个免费成品当"演示版MC"哄孩子认方块逻辑,比下载来路不明的"高仿"省心。但如果你是冲着"让AI给我造一个能替代正版的MC"去的,现在劝退——26.3的正式版还在发布候选阶段呢,原版更新的速度AI都追不上。哔哩哔哩
这条赛道真正的悬念,其实不在下一句"一句话"能生成多像的MC。8月ChinaJoy的媒体观察已经给了行业冷水:“一句话生成游戏的时代来了,90%的AI游戏可能会死”——demo惊艳和游戏好玩之间,隔着一整个策划部门。对玩家来说,值得继续盯着的信号有两个:一是哪个模型第一次把"沙子重力"和"平滑光照"一次生成到位,那说明它真的理解体素世界而不是背了题;二是知乎那篇Agent长文承诺的"每一层构建的前后对比"什么时候交卷——如果哪天AI伙伴真的会主动拦你说"别垂直向下挖,你会死的",那才是MC和大模型互相改变的时刻。界面新闻

(数据截至2026年9月12日,均来自各平台公开页面,播放与互动量以采集时点为准。)