一半的钱花在那张NPU卡上:零刻SEi14 AI是本地大模型的平替,还是新形态税?

源自6位全网作者

10:24

迷你主机圈这几天吵起来了。

一边是首发测评 UP 主的结论:独立NPU算力卡性能炸裂,CPU内存全解放,仅次AI MAX 395。小红书另一边,是评论区点赞最高的留言泼来的冷水:这种是低功耗边缘计算的推理小卡,性能、算力都是极其有限的,纯拼算力,2000块一张2080ti 22g直接碾压这个了。哔哩哔哩

吵的是零刻刚上市的新品 SEi14 AI——一台把独立 NPU 算力卡塞进机身的小主机。在内存涨价把一批 AI 迷你主机价格顶上天之后,这台机器用「外挂 NPU」的路子,把自己推上了风口。它到底是本地大模型的平价替代,还是新形态税?先把首批上手的人摸到的信息摆出来。

这台机器到底是什么

SEi14 AI 的思路有点特殊:主体是一台常规 x86 迷你主机(首发测试为 Ultra 9 配置),核心看点是插在机身里的那块 M.2 接口独立 NPU 算力卡——板载 24GB LPDDR5 专用推理内存,带宽高达 153.6GB/s,标称 160 TOPS 物理算力,这些规格都来自首批拆解。微博

为什么做这么一台机器?零刻官方笔记的标题把定位写得很直白:x86+独立NPU,零刻SEi AI带来的AI PC新方案。小红书但看看时间点就明白了:过去一年本地跑大模型的「标准答案」AI Max 395,今年撞上内存和硬盘涨价,整机价格直线往上走。首发测评 UP 主的原话是:之前有玩Ai的小伙伴抱怨,AI Max 395赶上内存和硬盘涨价,价格直接上天起飞,但是又对算力有些要求,普通x86 CPU不够力,有没有价格比395低些、算力又比普通CPU高些的机器可选呢?哔哩哔哩SEi14 AI 瞄的就是这个空档。

官方甚至把 OpenClaw 环境直接预装进了机器,摆明了是给本地 AI 玩家省搭建步骤。零刻官方商城

一半的钱花在那张NPU卡上:零刻SEi14 AI是本地大模型的平替,还是新形态税?

首测怎么说

首发测试的结论给得不低:Ultra 9处理器搭配外挂NPU,性能仅次于AI Max 395,价格却香不少,满载运行近一小时,整机安静又凉爽。微博有人在评论区问能不能运行 27B 256K,UP 主回复说能,视频里放了官方测试截图,只是他也承认比不了独立显卡哔哩哔哩

官方商城页还挂出了 NPU 卡的推理参考数据:9B 级模型约 19 tokens/秒,35B-A3B 约 27 tokens/秒。这两组数字是 64K 上下文下的解码速度,官方注明数据来自 Hermes/OpenClaw 场景,最高可支持 256K 长上下文的 AI Agent 应用。零刻官方商城

一半的钱花在那张NPU卡上:零刻SEi14 AI是本地大模型的平替,还是新形态税?

数字本身不算炸裂,真正的卖点是分工结构:推理全交给 NPU 卡,CPU 和系统内存完全解放,模型跑着,你照常办公、看视频。这也是它和「加一张独显」最本质的区别。

评论区已经吵成了四派

首发视频 130 条评论,基本就是本地 AI 玩家观点的一次抽样调查,捋下来是四派:

  • 独显性价比派(点赞最高的一批):「除非有特别需求,一般情况下,还是显卡性价比高」。有人直接算账:「两张2080ti不香吗,整机价格一半也就下来了」。

  • 云端 API 派:「有这个钱拿去充api能用好多年」,立刻被怼「怎么哪里都能看到这种何不食肉糜的发言」——对要隐私、要离线、要 7×24 挂机的人来说,API 这条路本来就不成立。

  • 生态质疑派(攻击最狠):虽然用的是llama.cpp,但支持没有进主线,后续新模型也得靠NPU厂家去一点点支持。哔哩哔哩还有人更直白:「总价格比不过395,性能比不过gb10兼容性更加不如」,甚至有已经上手的用户吐槽「npu根本调取不了」。

  • 观望提问派:问题都很具体——能装两块 NPU 吗(UP 主回了句「貌似这根NPU超级贵,玩不起」)?Windows 能正常用吗(UP 主和厂家技术确认过:Windows是支持的,使用LLaMA for Win版,但「最新版都是forUbuntu的」;另外「目前这款NPU支持LLaMA,LLM Studio这类是不支持的」)?

我最在意的一条信息:一半的钱在卡上

评论里有一条首批用户的爆料值得单独拎出来:这台机器售价约1.2万,其中一半的价格是这个m2的npu。哔哩哔哩这个数字目前只有单一社区来源,零刻还没公布过官方价格拆解,先当线索看。但如果大致靠谱,这台机器的性质就很清楚了:你买的不是「带 AI 功能的迷你主机」,而是「带电脑主机功能的推理卡」。x86 主机只是底座,真正的成本、卖点和风险,全在那块 NPU 卡上。

这也解释了零刻的产品逻辑:AI Max 395 贵在大容量统一内存,SEi14 AI 换了个思路——系统用常规内存,推理内存做成 NPU 卡上的专用板载,绕开了价格飞涨的「大统一内存」。官方商城页对这套双计算系统的说法是:x86 平台负责操作系统和日常应用,NPU 专门负责本地模型推理。零刻官方商城官方拆解图也印证了这一点:常规 PC 的部分——散热、主板、内存插槽、SSD 位——都很常规,钱明显花在了 NPU 那一边。

一半的钱花在那张NPU卡上:零刻SEi14 AI是本地大模型的平替,还是新形态税?

那到底谁值得买

先说结论:这不是性价比产品,按「每一块钱买多少算力」去衡量它,一定会失望。它是一台形态产品。

适合这几类人:

  • 想 7×24 小时挂在家里当 AI 节点,功耗、噪音、体积都在意的。官方规格写明 MSC 2.0 散热系统面向长时间负载设计,噪音对比图覆盖 29 到 60 分贝四个工况,首发实测满载近一小时「安静又凉爽」。

  • 需要「一边跑模型一边用电脑干别的」,受不了系统内存被推理吃光的。NPU 卡自带 24GB 专用推理内存,CPU 和内存完全解放,这是独显台式机给不了的体验。

  • 不想自己攒机、折腾驱动,想要到手即用整机的。官方预装了 Ubuntu + OpenClaw 环境,接受用 Ubuntu 的话,门槛确实低。

这几类人别碰:

  • 追极限性价比的:2080Ti 22G 这类二手改卡仍是这个价位的算力之王,每一块钱买到的推理速度,NPU 卡赢不了。

  • 追最新模型的:NPU 适配没进 llama.cpp 主线,以后新模型支持快不快,全看厂商适配节奏。这是这类产品最大的变数,比硬件参数重要得多。

  • 纯云端党:API 能满足你的话,这笔钱完全可以省下来。

一半的钱花在那张NPU卡上:零刻SEi14 AI是本地大模型的平替,还是新形态税?

三个信号,先观望的盯着看

  1. llama.cpp 的 NPU 支持什么时候合入主线、厂商适配新模型的速度——这决定这台机器「保鲜期」有多长。

  2. NPU 卡单独定价、会不会出双卡位版本——评论区已经有人在问「能装两块吗」。

  3. 第二波第三方实测,尤其首 token 响应速度和 Windows 环境的完成度。

x86 + 外挂 NPU 这条路,零刻在迷你主机圈是第一个走的。首测给了面子,评论区泼了冷水,两边都没说错——硬件是真的新,生态也是真的浅。真想买的人:走有退货保障的渠道,优先 Ubuntu,给生态一点成熟时间。只是想看热闹的人,记住这台机器——NPU 卡这条路要是走通了,半年后的迷你主机市场会全是模仿者。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章