两轮AI做游戏天梯刷屏B站:最贵的翻车、最便宜的封神——掏订阅费前,先看懂这单额度账

源自185位全网作者

10-07 20:17

这个周末,B站游戏区变成了一口"斗蛐蛐"的锅:有UP让11家AI各做3款游戏打横评,有UP让12家大模型在虚幻引擎里跑同一个关卡。评论区一边"省流"一边认真讨论下个月该续哪个订阅。但对真打算用AI做点东西的人来说,这两轮天梯其实读反了——它们暴露的不是"谁是游戏开发之王",而是:选型的钱该怎么花,以及一个玩具离一款游戏到底差几步。

一、本周同时发生的三件事

第一轮是10月2日_voidmatrix_发的《【AI大横评】让11家AI做33款游戏,谁才是游戏开发之王?》,11家模型、每家做3款,播放13.5万、收藏4313、评论534条。评论区被顶得最高的是一张玩家自制天梯:“SS:Astra、Fable(双幻神);A+:GLM(稳);A:Qwen、DS;B:Kimi;其余都可以进垃圾桶”。哔哩哔哩

第二轮是10月5日_盒子姬_发的《虚幻引擎AI天梯:12家大模型做同一个游戏,最贵的竟然翻车》。这次不是纯网页小demo:用的是能直接操作UE5的开源智能体"虚幻盒子",让各模型在真引擎里做同一个平台跳跃关。3.2万播放不算顶流,但406条评论几乎全是用过的人在互相对答案。哔哩哔哩

两轮AI做游戏天梯刷屏B站:最贵的翻车、最便宜的封神——掏订阅费前,先看懂这单额度账

第三轮在圈外:GitHub仓库universal-modder于9月30日创建,六天刷到3895星。它把"给PC单机游戏做mod"的四层工艺——引擎侦察、逆向读码、资产制作、游戏内验证——打包成agent技能包,演示视频里甚至把《我的世界》缝进了GTA5。10月6日的知乎拆解文把它连同批评一起端了出来:没有正式release、issue里有人直接骂代码质量。知乎

三件事放在一起看,信号很明确:用AI做游戏已经从"演示视频"进入"要掏订阅费、要算额度账"的阶段,讨论的人群和纠结的问题都换了。

二、先给天梯结果加四道滤网:哪些能信,哪些是表演

两轮视频的评论区自己就在互相拆台,这比结论更值钱。把噪音滤掉,剩下四条判断规则:

1. One-shot不是开发,是抽大奖。 一条高赞评论说得直白:真实开发要看"一次给10个/50个/200个需求的完成率、bug率、有没有先跟你确认意料之外的问题",而不是喂一句提示词看谁做得多。天梯玩家也认这个账:“v4.1f吃了小模型one-shot能力不足的亏……受控落地的水平挺惊艳,one-shot就要抽大奖了”——同一个bug可以十几轮改不出来,也可以一轮搞定。哔哩哔哩

2. 给不给引擎,是两个不同的考试。 第一轮没让模型碰引擎,纯网页实现;有游戏从业背景的观众提醒"正经开发者最关注的是模型能不能熟练操作系统引擎"。第二轮才是带引擎的版本。看天梯时先问一句测试环境,不然结论张冠李戴。哔哩哔哩

两轮AI做游戏天梯刷屏B站:最贵的翻车、最便宜的封神——掏订阅费前,先看懂这单额度账

3. 渠道变量不归模型管。 Claude随时可能封号、部分国外模型只能走中转站,评论区已经有"一个国外模型只能用中转站的UP能测出什么"的质疑。成绩里有相当一部分是"钱包和网络"的波动。

4. 降智与稀释是月度变量。 评论区反复提到额度稀释和版本体感跳水——有人"太信任它,交给一个高自主性的活才发现已经降智"。这个月天梯的座次,下个月额度重置后就得重新验一遍。哔哩哔哩

所以这两轮天梯的正确用法不是抄冠军,而是认模型的气质。

三、评论区真正省流的地方:共识是分工,不是排名

把两个视频的高赞发言拼起来,社区其实已经自发形成了一套"组合拳":

  • 审美与关卡设计给Claude家族(Opus 5.5):哪怕这一轮它"门错位+通关不显示",评论仍然说"Claude的审美、关卡设计跟建模精度却是其他模型难以取代的,这个小bug随便丢给一个小模型就修好了"。哔哩哔哩

  • 执行与成本给DeepSeek v4.1f:那句流传最广的比喻是"饮料界的可口可乐,奶茶界的蜜雪冰城——比它便宜的没它强,比它强的没它便宜"。空间理解被点名夸(金币该放的平台、该开的门位置都合理),但它属于"神区二象性":给它定好详细计划、做好约束,“就是一个强得离谱的牛马,非常适合干脏活累活”。哔哩哔哩哔哩哔哩

  • 严谨交付给GPT家族:特征是"保护性编程拉满",提示写得生怕玩家是傻子,让它验证开箱概率会连开15万次自测;黑点是"墨绿色配色偷偷加"的审美执念。哔哩哔哩

  • 被顶得最高的组合方案:"Claude Code做规划,DeepSeek做执行,OpenAI做审核交付,无敌!“UP也接受了评论区起哄的"下期做团队赛”。哔哩哔哩

  • 其余国产选手的体感标签:GLM5.3"稳但无视觉"、Kimi K3"大参数但bug量对得起评分、疑似缺算力降智"、豆包则被玩成梗——一句"豆包:豆包"就是全场最高赞复读。哔哩哔哩

必须说清楚:以上全部是横评UP和评论区的实测口径与自称,不是任何官方基准。但它来自同一批真的在花钱烧额度的人,比参数榜单更接近你的使用体感。

四、订阅费之前,先算"做一个"的额度账

选型纠结的本质是预算。本周社区流出的三份账本:

做资产的账(来自10月3日《全网最细·AI生成3D游戏场景》教程区的实测,这条2.5万播放、2225收藏,囤积率是"有用"的最直接投票):做一个HD-2D场景资产,约等于"一周半GPT plus会员的额度";单拆一个建筑,约等于plus会员一个5小时窗口的50%。而且"建模目前除了GPT都不太行,生图可以换即梦seedream5.0pro试试"。换句话说:卡住你的不是代码能不能跑,是额度烧得完烧不完。哔哩哔哩

两轮AI做游戏天梯刷屏B站:最贵的翻车、最便宜的封神——掏订阅费前,先看懂这单额度账

订阅的账(评论区自报口径):OpenAI系135元档月额度折10亿token上下;Claude系月额度看着更大但随时封号,心理期望要打折;国产60元档月额度约60亿,还叠着免费渠道——"比它强的没它便宜"就是这条赛道的定价逻辑。

收入的账(自媒体自报样本):程序员小灰10月5日公开《无为修仙传》后台:上线30天,本体3191份+DLC914份,净营收5179美元(约3.48万人民币),中位游玩时长12小时28分钟,自称"在Steam独立游戏里能排进前10%"。但同一篇里也有反鸡汤细节:一个半月从0到上架是他"平均一天要迭代2-3个版本"磨出来的,战斗、境界、宗门这套系统框架是人定的,AI是力工。单一个案,别读成"AI做游戏能赚钱"的通式。知乎

反方向的证据也要摆:36氪10月4日在讨论"AI时代游戏小厂更难出头"——内容产能暴涨不等于爆款概率变高,省下的成本大多回流到打磨本身。36氪

五、从玩具到游戏,本周社区实际撞上的四堵墙

墙一:拼贴感。 10月7日知乎连开两问,提问者是在做像素小游戏的独立开发者:AI出图快,但角色、场景、UI合到一起"总像不同游戏里的",画风散。这也是天梯里各家"一眼AI塑料味"封面的同一个病根——出图模型语料趋同,风格锚点得人来定。做国风手游的那位微博作者讲得很具体:先让AI出100个效果图,选定后再去文字、修细节、排logo,而不是一张张单独开奖。知乎微博

墙二:玩法真空。 7月底一条被反复转的微博说得很冲:连玩法都要AI想,那这人是用来干嘛的。天梯已经证明模型能把需求做完,但"好玩"不在one-shot提示词的职责范围。做游戏卖的那条路,玩法、数值、反馈循环还是人类主策的活。微博

两轮AI做游戏天梯刷屏B站:最贵的翻车、最便宜的封神——掏订阅费前,先看懂这单额度账

墙三:代码维护。 同一个问题"AI生成的游戏代码好维护吗"下,一个做了24年游戏、常年主程兼主策的回答把AI降维得很干脆:把它当"手底下的小程序员"——功能明确化、模块化之后再分配任务。不搭管线直接甩大需求,就是天梯评论说的"偷偷挖无数个坑,深玩发现很多都不是自己想要的东西"。知乎

墙四:成品接受度。 10月5日知乎热问:"你能接受0经验制作人用AI完成绝大部分内容的独立游戏吗?"触发事件正是有玩家用AI生成几乎全部内容做了一款独立游戏并上架Steam、被批评缺少人工打磨。如果你的目标是卖,"AI味"本身就是商品风险——同期"AI生成的Steam游戏封面一看就没有点击欲"也在热榜上。知乎

六、不同人现在该干嘛

  • 只想试试创意能不能落地: 先什么订阅都别买。微博上做过BETA的老玩家讲得实在:新手"用什么不重要,得到快速的正反馈才重要",先花两周研究框架部署,大概率先凉。用免费档one-shot出个能玩的,再决定要不要投入。微博

  • 认真立项的: 按分工订阅而不是按冠军订阅——设计/审美档位一个、执行档位一个便宜的国产、交付审核靠GPT系的自测癖;开工前先把风格锚点和模块拆分文档做出来(这是给DeepSeek们"定计划派脏活"的前提);预算按"一栋建筑=半个5小时窗口"这种颗粒去估,别按"做一个游戏"估。

  • 想给单机游戏做mod/串游的: universal-modder先观察再上车——它真把验证做成了方法论(帧状态逐变量对表、泰拉瑞亚boss复刻一致到99.9%、《帝国时代2》贴图误差0.91/255才允许写盘、同一原因失败三次熔断),但无正式版、资产生成按量计费(作者自己都提醒先跑 um fal price 看价目)、只支持自有单机离线游戏。拆解文那句提醒值得抄在脑门上:“二十秒的展示视频证明不了长时间游玩稳定,社媒疯传的串游mod也不都出自这个工具。”知乎

  • 继续看什么: 盒子姬预告下期"团队赛"、难度升级;每轮额度重置后重验降智变量;虚幻盒子这类"能操作引擎的agent"会不会变成下一轮天梯的标配。

这两轮天梯最值钱的结果,不是排出一个王。它排出来的是常识的另一半:AI已经把"做完"的成本打到地板,"做好"依然是一条人类的管线——风格、玩法、版本迭代,一段都外包不掉。掏订阅费之前,先想清楚这三段里,你手里有几段。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章