这周端侧AI硬件的热闹有点密集。英伟达RTX Spark这边,华硕的首批配额直接被渠道订空。IT之家几乎同一时间,国产大模型API集体涨价——DeepSeek-V4新定价8月17日零时起生效。微博有网友吐槽"真的要用不起了…token怎么那么贵"。微博云端越来越贵,本地越来越多人在找一台能7×24小时挂着的机器。
就在这个节骨眼上,零刻7月底上市的两台"新物种"迷你主机——SEi13 AI和SEi14 AI——的首批评测在8月中旬集中放出。哔哩哔哩测试视频动辄上万播放,但点开评论区,两派吵得挺认真。这台机器到底值不值,值得好好算一算。
一台机器,两套算力:一半的钱花在那张卡上
先说这台机器是什么。零刻SEi AI系列的思路很简单:x86处理器负责系统和日常使用,M.2插槽里再插一张独立NPU算力卡,专门干本地AI推理。官方叫它"双计算架构,系统运行与AI推理分离"。微博
具体型号和价格:SEi13 AI(i7-13620H + 24GB NPU + 32G内存 + 1T固态),首发11895元;SEi14 AI(Ultra 9 185H + 24GB NPU + 32G内存 + 1T固态),首发13988元。IT之家快科技两款机器的官方口径都是"为本地AI推理而生"。

核心就是那张NPU卡——后摩漫界M50,一颗存算一体架构的国产芯片:160TOPS INT8算力,24GB LPDDR5专用推理内存,192bit位宽,带宽153.6GB/s,典型功耗只有10W左右。微博
关键信息在价格。这张M50卡单独卖,某宝7999元、京东8000元左右。哔哩哔哩也就是说,11895元的整机里,PC部分只值4000元上下。
理解了这个成本结构,后面所有的争议就都好理解了。

好评的一面:它确实戳中了395涨价后的空档
先说首批评测里站队的理由。
8月14日首发测试的结论很抓眼球:SEi14 AI的本地AI推理性能"仅次于AIMax395",满载运行近一小时,整机安静又凉爽。微博因为推理完全跑在NPU上,CPU和主内存被彻底解放——模型挂着跑,这台机器照常当办公机用,这点是395那种"一跑模型整机起飞"的统一内存方案做不到的。
软件生态这周也有个实质进展。8月14日晚阿里正式开源Qwen3.8-27B,第二天后摩就宣布Day 0适配。知乎4bit量化版约占17GB,M50的24GB专用内存刚好塞下。后摩的工具链支持把编译产物转成GGUF、通过llama.cpp部署成OpenAI兼容API,官方宣称可以直接对接OpenClaw这类Agent框架。

这条路线的合理性,其实有个现成的参照:5月发布的联想AI主机P7,用的就是同一颗M50——300克、整机功耗30W、噪音35分贝以下,能跑122B模型,本地推理最高50 Tokens/s。雷峰网10W的NPU挂一整夜,电费和噪音都约等于零,这是395和独显方案给不了的。
再看大环境:395迷你主机原本是本地AI的性价比之王,但这波内存涨价把它推上了天——128G版本从1.5万元上下涨到2万+,个别型号挂到26000。知乎同时DeepSeek、智谱、Kimi的API集体提价,云端按量计费越来越肉疼。一头买不起,一头租不起,中间"一万出头、低功耗、能常驻"的SEi AI,确实卡在了一个真实的需求空档上。
差评的一面:评论区主要在吵三件事
但评论区泼冷水的也不是键盘侠,争议基本集中在三个点,每个都戳在要害上。
第一,带宽才是命门,160TOPS听着唬人。 大模型推理的解码阶段,速度主要受内存带宽约束,不是算力。M50的153.6GB/s,低于395统一内存的256GB/s,更远低于RTX 3090的936GB/s。有在M50上做过开发的评论一针见血:“160 TOPS是真的,但营销意义大于实际LLM性能意义”。哔哩哔哩另一条高赞评论更直接:“算力太低,显存太少,但凡是个64G内存、算力翻两倍,就可以用千问3.8这种能用的模型了。”
第二,生态是封闭的。 M50不像N卡那样随便丢个GGUF就能跑。模型要经过后摩自己的"大道"工具链量化编译,Day 0适配只覆盖重点合作模型,其他新模型得等厂商排期。哔哩哔哩LLM Studio暂不支持,Windows端工具链也落后于Ubuntu。一条评论概括得很准:"llama.cpp能用,但属于厂商定制生态。"对习惯了Ollama一键拉模型的玩家,这个迁移成本是实打实的。
第三,性价比要打个问号。 11895元,PC部分配的是2023年的13代i7-13620H。有评论把替代方案摆上了桌面:
加一点钱上64G版395迷你主机:统一内存跑大模型更从容,ROCm生态肉眼可见在变好(vLLM这个月刚迈出可用的一步)
魔改卡路线:一张2080Ti 22G魔改卡两千上下,两张就是44G显存+完整CUDA生态,折腾归折腾,纯推理性价比目前还是评论区公认的王者
轻度用户:11895元拿去充API,够很多人用好几年
还有一条总结很扎心:“总价格比不过395,性能比不过gb10,兼容性更加不如”。哔哩哔哩
到底谁能买?分三类说清楚
把两边论点摆完,我的判断是:这台机器不是智商税,但它是一台"场景机",不是"通用机"。
可以考虑入手的:需要本地AI 7×24小时常驻的人——挂Agent、跑自动化任务;数据绝对不能出本地的人——合规、隐私敏感场景;还有做边缘计算、存算一体开发的开发者。对这三类人,10W功耗、静音、不占PC资源、自带OpenAI兼容API输出的小盒子,市面上几乎没有第二个选项。
建议绕道的:想花一万多跑更大模型、追求速度的普通本地模型玩家——64G版395或者魔改显卡方案都更划算;喜欢尝鲜新模型的追新党——封闭生态的适配节奏会让你难受;至于只想办公看剧的,这台机器跟你没关系。
还可以再等等的:三个信号值得盯。一是9月4日IFA,AMD高级副总裁已确认出席做开幕主题演讲,业内普遍预计锐龙AI Max 400系列会发布,x86统一内存上限将推到192GB。知乎届时395全系价格大概率重新洗牌。二是M50本身还有48GB的双芯版本(带宽翻倍到307GB/s),如果零刻出高配版,24G这个最大短板能缓解一大截;三是后摩工具链的开放进度——哪天支持任意GGUF直跑,生态短板才算真正补上。

最后说句实在话:迷你主机这个品类,过去半年的剧本是"内存涨价+本地AI热"双轮驱动,价格一天一个样。这种行情里最贵的消费,是为一台不匹配自己场景的机器买单。NPU这条路本身值得期待——存算一体、10W功耗跑27B,方向是对的——但值不值得现在掏11895元,答案取决于你是不是那个需要它24小时开着的人。