8月14日,零刻SEi14 AI的首发测试上线,UP主给的结论相当直白:独立NPU算力卡性能炸裂,CPU内存全解放,仅次AI MAX 395。B站 三周过去,这台7月30日才发布的机器热度刚过首发期,但争论还在原地。
冲在最前排的是一条97赞的质疑:这种是低功耗边缘计算的推理小卡,算力极其有限,纯拼算力、部署环境、易用性,2000块一张2080ti 22g直接碾压它。B站 一边喊"仅次395",一边被顶到前排说"碾压这个"——我把4条首发/评测视频、2条开箱、官号笔记和400多条评论翻完,给准备把它当"AI挂机器"的人算一遍。
省流版:它不是"AIPC",更不是"平价395",是一台挂了24GB专用显存算力卡的专用后台推理机;160 TOPS这个营销数字撑不起你的带宽账,但如果你的需求恰好是"低功耗7×24跑一个已适配模型、不占主力机资源",它可能是现在一万块价位里唯一的官方成品。
一、先说它是什么:一台常规x86小主机插了张"M.2显卡"
7月30日零刻发布SEi13 AI、SEi14 AI两款,官方标题给得很收敛:搭载最高160TOPS算力独立NPU。B站 硬件逻辑很直白:常规x86迷你主机+M.2形态的NPU算力卡,卡上自带专用推理内存,模型加载后CPU、系统内存和核显基本不参与推理——知乎那篇拆机评测写得很清楚:这块NPU模块拥有自己的计算单元和24GB LPDDR5专用推理内存。知乎
拿测机的知乎作者那台SEi13 AI是i7-13620H+32GB内存,预装了一套 Ubuntu 系统,llama.cpp推理框架随机器就位。知乎 SEi14 AI高配按官方店铺上架标注为酷睿Ultra "185H"版本,还有OpenClaw联名红色款。

一个要交代清楚的点:零刻没有公开NPU芯片型号,评论区普遍考据为后摩智能的存算一体芯片(漫界M50系列),流传的参数是单芯片最高48GB内存、192bit位宽、153.6GB/s带宽,双芯版本带宽307GB/s。B站 价格面,卡单卖淘宝7000多,整机按评论区晒单有人标到13488元,商品图上还写着一个关键服务:30天试玩。B站 芯片考据、7000多和13488都是评论区见闻而非官方公开资料,下单请以商品页口径为准。
二、带宽账:为什么160 TOPS撑不起6 tok/s
一条20赞评论贴了段AI评价,比多数首发文案诚实:160 TOPS是真的,但营销意义大于实际LLM性能意义。B站 原因是跑本地模型的人都背得出来的规律:出字速度≈显存带宽÷每token权重字节数,算力只决定prefill快慢。153.6GB/s带宽跑27B Q4,理论上限约11.3 tok/s;实测的评论更直接——“速度最多就是6t/s,约等于没用”。B站 想开256k长上下文?首发视频回复区自己承认"太长的上下文,很难用"。
那这张卡的甜点在哪?MoE。上面那段AI评价的原话是:MoE表现尤其值得关注,Dense大模型受带宽限制。B站 拿到测试机的知乎作者给出的官方标称是能实现本地9b稠密、35b MoE架构的运行,输出23 tok/s往上。知乎 他自己的OpenClaw挂本地模型跑了一轮对话,实测19.79 t/s——截图如下。

8月21日那条《值得吗》测评的结论也很克制:把它叫AIPC是容易有误解的。B站 端侧AI有场景,不等于把"生产力大模型"的帽子扣在这张卡上。
三、吵点账本:双方都认什么,还在吵什么
400多条评论交叉下来,最有信息量的是共识与分歧各自长在哪。双方都认的第一条:低功耗、静音、不占主机是真价值——“更适合24小时挂机,省电,维护成本不高”,这句出自反驳阵营的回复。B站 双方都认的第二条:卡太贵——相对看好的测评评论区也在说"应该出那种亲民价格的算力卡,搞得这么贵,怎么普及"。B站 下面这块面板能直观看到"不占主机"是什么形态:NPU在干活,内存归内存,模型各跑各的。

吵完的没几条,但都关键。生态之争:有人拿树莓派、Radxa、华为加速卡的经历警告"国产NPU生态个个闭塞",博主回应"以llama.cpp为底层,迭代可期",而技术评论提醒的是第三种可能——虽然用的是llama.cpp,但支持没进主线,新模型得厂家一点点适配。B站 三句同时成立的话,合成一个结论:你常用的那份模型列表,决定这台机器的边界。
平台之争:有评论拿到厂家技术的答复,Windows支持、驱动和推理框架零刻AI官网都有,但最新版Ubuntu先行,LLM Studio暂不支持。B站 只用Windows的轻度玩家,在这台机器上不是一等公民。
路线之争:“有这个钱拿去充api能用好多年”(18赞)对阵"数据上不上云你不在乎吗";“省流一万出头不如买64g的395”(13赞)对阵"可玩和可当生产力其实是两码事"(29赞)。B站 谁也吵不赢,因为立场不同:有没有"长期挂机+离线+隐私"的真实任务,才是买不买的分水岭。
再泼一条反证:36氪5月的线下市场调研写过,线下市场的迷你主机,「龙虾热」也带不动。36氪 第一波Agent热度没拉动货架,这波硬件化能不能接住,值得先看一个月销量再下结论。
四、拿什么换什么:挂机油的成本模型
同一万块预算,四条路线各有各的账。零刻SEi AI,一万出头到13488元,买到存算一体能效和开箱即用,代价是定制模型库和新模型等待期。AI MAX 395整机,去年128g不到1.5万,内存硬盘涨价已把它抬上2万+。B站 395兼容性好是真,价格失控也是真。二手独显路线,2000块的2080Ti 22G玩9B模型有40-50 tok/s,CUDA生态完全不同量级,代价是功耗、噪音、占地和"敢不敢24小时开"的可靠性。B站 纯API路线,零维护零噪音,代价是隐私和长期token账单。
另外记一笔:SEi AI这批机器直接出了OpenClaw联名款,知乎作者也是用OpenClaw在跟本地模型对话——"agent挂机器"的官方形态已经摆出来了。同时留意小米玄戒AICube,知乎8月底已经有"M.2独立NPU主机不止一家"的讨论,这条赛道来了第二个玩家,对等等党是好事。
适合谁:跑OpenClaw类agent常驻任务(摘要、分类、盯盘、值守)的人;离线、涉密工作场景;已有主力机、只想加一台专用推理副机的人。不适合谁:想跑27B以上稠密模型当生产力主力的;必须追最新模型和CUDA生态的开发者;只用Windows的;预算紧想"花小钱办大事"的。
行动建议就一条:用好"30天试玩",带着你自己最常用的那份模型清单和agent任务去测三件事——跑不跑得起来、tok/s多少、上下文一长是否崩。三项全过再留,任何一项不过直接退,别拿首发的"仅次395"当自己的三个月。接入方式不神秘,面板里那个API地址就是你的agent该连的端口。

五、继续盯什么
三个信号决定这条线半年后的成色:NPU支持是否合入llama.cpp主线;单卡价格会不会跌到评论区喊的"亲民"档;395价格何时回落——395跌回1万5以内那天,"一半价格一半性能"的空位就塌了。
现在能对这台机器下的最重结论是"形态补位":市面上没见过这样外挂独立NPU的迷你主机,这是首发UP主自己的原话级事实——它卖的不是算力,是把推理任务从主力机里搬出去这个选项。搬不搬,看你的任务表,别看TOPS。