国庆这几天,零刻评论区最吵的是495:GTR9 Pro挂29998,磐镭YO2挂49999,极摩客Evo-X5 Pro喊到5万。但如果你手里的预算是"一万出头"——既够不着495,又不想给涨疯的395接盘——那真正值得蹲的战场是另一条产品线:零刻7月底官宣的SEi13 AI / SEi14 AI,两台"M.2独立NPU+24GB专用推理内存"的迷你主机。8月14日首发实测视频下223条评论,8月21日测评视频下211条评论,9月29日又有UP主在SER9开箱视频里给"现在该不该信NPU"泼了第三盆冷水。吵点、数据、翻车点都摊在明处了,这篇把它们算成一笔完整的账。
第一本账:11895起,买到的到底是什么
先把官方口径摆出来:零刻7月29日官宣推出SEi13 AI与SEi14 AI,号称"为本地AI推理而生",售价11895元起。流出的配置报价单里,i7-13620H版挂11985、Ultra 9-185H同配到13988。贵的不是32G系统内存,而是那颗NPU——规格是插在M.2插槽里的独立算力卡,配24GB 192bit LPDDR5"专用推理内存",带宽153.6GB/s,算力标称160TOPS INT8——评论区有人查了制造商资料,把这卡认成后摩的存算一体方案。微博微博哔哩哔哩
单卡的外售价也对得上:一位用过这款加速卡的开发者留言,“这个加速卡不便宜啊,京东上卖8000”。 有评论直接给整机价开盲盒:“约1.2万,其中一半的价格是这个M.2的NPU”。 顺着这个口径往下推,甚至有观点认为"去掉NPU,这台185H的PC部分按8000块算没什么性价比"。这解释了首发时最多人的一句话:“这tm不得直接干到上万?”哔哩哔哩哔哩哔哩

首发视频的开篇把立项理由写得很直白:AI Max 395赶上内存和硬盘涨价,价格上天,所以才要这条"x86平台+独立NPU和专用推理内存"的折中路线。哔哩哔哩
“仅次于395"的真实语境也不是性能打赢395——首发UP主自己在评论区给的就是这个定调,性能和配置摆在那里,大概就是半个395的性能、半个395的价格。 它成立的前提,是395被涨价顶出了原来的价位带——有用户还在念叨"尤记得去年零刻395 128G才1.5W不到”,如今早已翻面。 在495挂到3万上下的市场里,它是"从0到有"的档位。哔哩哔哩哔哩哔哩
所以这台机器的本质不是"换了颗新CPU",而是把一张单卖七八千的推理卡,塞进一台本来五千块的迷你主机里,再打包卖一万二。值不值,全看这张卡在你手上是"资产"还是"摆件"。
第二本账:160TOPS的宣传账,和153.6GB/s的物理账
“独立NPU算力卡性能炸裂”“CPU内存全解放,仅次AI MAX 395”——这是首发实测视频标题的原话。但热评第一(111赞)直接开怼:“低功耗边缘计算的推理小卡,性能、算力都极其有限,优点是功耗极低,2000块一张2080Ti 22G直接碾压。”哔哩哔哩
两边谁对?评论区有个用户把推理圈的通行公式甩了出来,这也是这篇最想替用户"去噪"的一条信息:大模型推理速度吃的是内存带宽,不是算力——“理论最大TPS≈带宽/模型大小”。代入这张卡的物理账:153.6GB/s带宽跑27B稠密模型Q4量化,理论上限约11 token/s,实际评论测算"个位数",还有人称"还不如CPU跑";MoE模型(如35B-A3B)因为有稀疏激活,知乎实测评测给出的口径则是"输出23 tok/s往上"。哔哩哔哩知乎
至于24GB容量,被评价为"装27B可以,长上下文开不满,32G恰好是甜点"。哔哩哔哩
那位借AI做的总结被顶了25赞,把话说得很直:160 TOPS是真的,但营销意义大于实际LLM性能意义。哔哩哔哩

再看"碾压论"的另一头:拿2080Ti/3090对比的人,算的是台式机账。迷你主机箱里没有PCIe显卡位,走3090路线意味着外置显卡坞+二手矿卡+折腾直通——站内9月那篇"SER6Pro+天钡EG02+3090水神"的成本分析,算下来的结论是"配件大部分已有才划算"。对一台干净的万元级迷你主机来说,这张M.2卡是不用开盖、不用改线路就能装上的唯一本地算力。
第三本账:生态税——这台机器真正的账单在软件里
参数吵完,吵不过的人都去吵生态了。目前评论区拼出来的事实拼图:底层是llama.cpp的厂商定制分支,没进主线——“后续新模型也得靠NPU厂家去一点点支持”。官方支持LLaMA系列,不支持LLM Studio这类现成GUI;UP主先说"Win麻烦",隔了几天与厂家确认后改口"Windows支持,装官网的Win版驱动和推理框架即可,但最新版都优先给Ubuntu"——这个来回本身,就是生态成熟度的体温计。树莓派、Radxa、华为NPU加速卡的老玩家留下一句总结:“生态闭塞,想用新模型就得付费找官方技术支持。”哔哩哔哩
9月29日SER9开箱视频的观点则站在更远处:NPU跑本地模型不是正途,配合各家软件做本地AI协作才是,可商业软件更愿意把自家云算力打包成会员卖,懒得调用本地算力——所以"距离NPU真正登台唱戏,咱们还是得再等一等"。同一时间,知乎已经有人写了《小米玄戒AI Cube之外,另一NPU主机》,把它归进"第三套小主机上的AI算力解决方案"的讨论。哔哩哔哩知乎
所以,谁可以买,谁别碰

把434条评论吵完,落下来是三档:
可以现在买的:已经想清楚"我要一台24小时低功耗挂机干活的机器"的人。8月21日那位把它用进生产环境的UP主给的就是这个答案:把TTS/ASR这类固定小任务从主力显卡上摘出来,比如24小时不停把每天产生的上下文都做一个embedding。 他的判断是"带宽这件事是看需求的",不是无限用功率换带宽。 这个用法下,tokens免费+功耗极低+免维护,成立。哔哩哔哩
不该买的:想跑Qwen这类27B稠密模型当"本地ChatGPT"、或者拿它写代码的人。按热评那个带宽公式算,27B稠密Q4量化"最多就是6t/s,约等于没用"。 旁边还有补刀的:“这个钱拿去充API能用好多年”。哔哩哔哩
建议等的:想"一张卡通吃"的观望党。正如有评论说的,“目前买是前期趟水,不是版本答案”。 继续盯四个信号——48GB/双芯版本(纸面307GB/s带宽、320TOPS)何时落地、llama.cpp主线是否合并、官方模型库的更新频率、单卡价是否从7999往下走。这四条里任何一条兑现,这条路线的账就要重算一遍。哔哩哔哩
最后
这台机器真正的价值,不在它自己卖得动不动——"先买先得的是趟水的,不是版本答案"这句评论区的话同样客观。价值在于:内存涨价把统一内存路线(395/495)的价格顶到天花板之后,“独立NPU+专用推理内存"这条第三条路,被零刻第一次塞进了一个可以整机买回家的模具里,也成了知乎那句"第三套小主机上的AI算力解决方案”。 硬件的账社区已经算到小数点了,剩下的,就看软件栈什么时候配得上那160TOPS。知乎