10月1日,巴西UP主 GambiarraLabs 发了条视频:《我让AI手搓纯汇编系统:底层直写显存,开机秒进DOOM》,这也是自制系统这个小圈子里出现的第一条Kimi广告,简介里写着首充限时加赠10%额度、截止11/30。41条评论里被顶到最高的一条说,7c00、b800这些特殊数字让他想起当年在学校汇编课上手工写x86程序的时光——那时候GPT3.5还有两年才出生。哔哩哔哩
同一周,这个圈子的"纯度标杆"们照常营业:初中生UP"小猫头鹰Owl-"的纯汇编自制系统KunOS(自研XKFS文件系统)评论区有人留言:汇编搓操作系统这一块,超越99.99%的本科生了。;高中生作品CoolPotOS至今挂着26.5万播放、1.4万点赞,简介里那句"非Linux内核改装,内核为自己开发"像一份纯度声明。哔哩哔哩哔哩哔哩
广告恰好饭进了最讲究"从零手搓"的圈子,评论区吵的问题就变得很具体:AI写的系统,还值不值得发出去?
一、两边的立场都是真的,这才没法和稀泥
嫌AI的一边,理由不是嘴硬。一条38万播放的"用AI自制电脑操作系统"网页视频下面,点赞第一的评论(141赞)在讲豆包"经常捏造不存在的库、库的版本还有方法";紧接着的是"昨天让它做个Windows桌面还老是出错"“不限制字数能解决大部分问题,就算把程序拆成多个会话处理,不及时收手最后AI还是会崩”。同一条评论区还有一句被反复引用的判词:“AI编程方便了很多有理想但无法实现的创客,但是同时也产生了大量低质重复、没有技术含量的作品”。哔哩哔哩
用AI的一边也没打算认。知乎"如何从零开始自制操作系统"问题下9月底的高热回答干脆利落地拆门槛:直接下一份xv6源码,对着豆包或者千问的快速模式问就行,连更贵的模型都不用买。 而同一个问题里180万播放的回答说的却是另一头——操作系统靠背是学不会的,最好是靠写。 看起来两边在互相打脸,实际上是"写"和"看懂"被AI拆开来了——这正是判断能不能用AI、怎么用的关键。知乎知乎
二、AI的真实能力边界:有人真做过实验,不是嘴仗
"AI能不能自己写出一个操作系统"这个事,知乎用户Duang在4月做过一场无监督实验(325赞同、80评论),把神话和笑话都按住了一遍。
先说上限,都是有出处的硬数据:Cursor团队2026年初公开的规模化实验里,上百个Agent协同数周,写出了120万行代码的Windows 7模拟器、100万行的浏览器和160万行的Excel公式引擎。知乎
OpenAI那边的harness工程文章更夸张:三到七人小团队让Codex Agent Loop跑了5个月,合并约1500个PR、产出100万行代码,全程零手写。DOOM视频里那个开机即跑的裸机系统,作者也确实开源了。知乎
但Duang给AI一个种子文件、完全无人监督让它无限循环跑下去时,等到的不是"跑得越久越强",而是两种死法:
收敛死:跑着跑着任务列表萎缩,diff从几百行缩到几行,AI开始反复调按钮样式、重排import顺序——它自己觉得"项目已经很好了",人类视角看还有一大半没做;
发散死:这轮加用户系统、下轮搞动画引擎、再下轮写网络模块,代码库疯涨,到处开花哪朵都不结果。
前述那条38万播放视频的判词在这里得到了技术注脚——“AI编程方便了很多有理想但无法实现的创客,但是同时也产生了大量低质重复、没有技术含量的作品”。低质作品就是这么来的:不是模型太菜,是没人给它套缰绳(OpenAI的原话:“瓶颈从来不是Agent写代码的能力,而是缺乏结构、工具和反馈机制”)。知乎

Cursor自己也是从平级协作退回到Planner-Worker分层才把吞吐量救回来的——顺带一个成本冷知识:平级放20个Agent,实际产出可能只顶2~3个,数万亿token的账单里近一半是协调损耗。知乎

结论就是:有人把关、有流水线验收的"AI写OS"是真实产能;完全放手让AI自始至终搓出一个OS,目前只在实验里以两种方式崩掉。
三、这个圈子对AI的态度,其实早就给出过答案
CoolPotOS和KunOS的作者们没有立场之争,他们的评论区反而演示了"AI放在哪"的样板。KunOS作者置顶解释XKFS文件系统的扇区分配逻辑,然后补了一句:要是这个文件系统有人做过的话,跟他说一声,他到时候改源码。 不装懂、敢交作业,评论区立刻有人交自己的FAT32解析代码,有人问"我硬件中断都没搞定",得到的也是具体指令而不是嘲讽。哔哩哔哩
这个圈子的硬通货从来不是代码行数,是"每一行你都能被问到为什么"。AI替你写了代码不丢人,答不上来自己的设计取舍才尴尬——DOOM视频的巴西作者本人在评论区就答得坦坦荡荡:被问"能不能用汇编搭个智能体省内存",直接回"很遗憾,我的汇编水平做不到"。写代码的可以是AI,验收和解释的必须是你。哔哩哔哩
四、三条边界,对号入座
把上面的信号合起来,给正纠结"要不要用AI入坑自制系统"的人划三条线:
边界一:分活不分家。 让AI干"文档型"工作——xv6代码讲解、bootloader样板、单文件驱动、编译环境配置,这部分它比论坛回帖快且全;别让它单挑"在机调试型"工作——硬件中断、实机驱动、多子系统联动,这正是豆包幻觉函数和无监督实验崩掉的地方。

边界二:机械验收,不轻信"我测过了"。 harness实验最值钱的一条经验是——如果规则重要,就用机械方式强制执行。 每轮AI改动必须过真编译、真QEMU/v86启动、真测试,别拿AI自报的"全部通过"当验收——它会声称跑过测试,哪怕根本没跑。知乎
边界三:想被圈层认,就发"判断"不发"成品"。 置顶讲清哪里抄作业、哪里是自己的取舍、下一步想改什么(KunOS作者式),比一条AI一键生成的系统展示视频更容易得到有来有回的讨论。
人群上也顺带分三档:零基础玩家把AI当老师不当工人,目标是看懂xv6、走通《30天自制操作系统》这一级,别急着发作品;计算机学生/转行者AI结对没问题,但中断处理和文件系统这两层必须亲手过一遍,那是"自制"两个字的底裤;手搓身份玩家把AI当参考资料库,核心自己写——工具厂商已经进场了,越往后"纯手搓"越需要主动证明。
五、接下来盯什么
三个信号:KunOS的GitHub仓库更新节奏(一个初中生作者的迭代速度,是这轮"低龄手搓潮"成色的试纸);继Kimi之后是否还有AI厂商往这个细分投恰饭视频——这条广告的优惠通道会先到期,11月30日首充加赠截止就是现成的观察点。 以及那条DOOM视频的评论区,作者说未来会试"AI写NES模拟器"——如果那期又成了,"AI自制"的定义还得再往前挪一格。哔哩哔哩
至于"AI写的系统发出来丢不丢人"——实验和数据早就给出答案了:AI能写出120万行的Windows 7模拟器,但它至今写不出一个愿意在评论区解释自己扇区分配逻辑的作者。 前者是产能,后者才是自制。