这72小时,迷你主机圈有点密集得反常。
9月18日晚,B站UP主Jupit3r放出实测:两台E人E本EBOX G95迷你主机(AMD锐龙AI Max+395平台,128GB内存版),一根雷电线对连,拼出240GB的"显存池",把官方口径"原本需要4张以上4090"的DeepSeek V4-Flash 284B模型整个装了进去,生成速度超过10 tokens/s。代价是两台机器4万多块——UP主自己在评论区透露的数字。哔哩哔哩
9月19日,知乎"如何评价NVIDIA RTX Spark"的问题浏览量冲到33.5万。《微型计算机》同天发了一篇硬碰硬的对决文:9月底,第一批锐龙AI Max+ PRO 495迷你AI工作站上市;10月,NVIDIA的RTX Spark Windows PC正式开卖——AMD和NVIDIA第一次在"迷你AI工作站"这个市场迎面相撞。知乎微型计算机
9月20日,天钡NEX395上架:AI Max+395、64GB内存+1TB固态,12999元,卖点直接写着"做AI集群用"。知乎
三件事拼在一起,信号很明确:桌面本地大模型这台戏,9月突然从"极客自制"进入了"掏钱决策期"。现在买、等一个月、还是压根别碰?这篇把四条路线的账算清楚。
先搞懂三本账,再看机器
买"AI迷你主机"和买普通迷你主机,算的不是同一本账。普通主机看CPU跑分和接口,AI主机只需要搞懂三件事。
第一本账:内存大小,决定"能不能跑"。大模型跑本地,量化后的模型文件、KV缓存、系统开销,全都要塞进统一内存这一个池子里。天钡在NEX395的介绍里给了个朴素但实用的经验法则:模型体积不超过50GB,64GB内存版够用;超过50GB,直接上128GB版——它举的例子是Qwen3 Next 80B的Q4_K_M量化版,体积48.49GB,刚好卡在64GB版的天花板里。知乎
第二本账:内存带宽,决定"跑多快"。生成一个token就要把模型权重过一遍内存,所以出字速度基本被带宽锁死,395平台的四通道LPDDR5X带宽是256GB/s。E人E本那条集群视频底下,有人问"用内存推?那不比蜗牛还慢?“,立刻被回"这是四通道统一内存”——这个争论本身就是当前本地AI的核心矛盾:统一内存用容量换走了独显的速度。10 tokens/s是什么概念?聊天够用,干活嫌慢。知乎
第三本账:生态,决定"折腾多久"。CUDA、ROCm还是Windows on Arm,装环境的时间可能比跑模型的时间还长。一位DGX Spark机主在知乎连载了自己的踩坑史,其中一篇标题就叫《先解决"安装地狱"》。
把这三本账套到市面上的机器上,一张表就清楚了:
内存/显存池 | 能装下的模型量级 | 代表实测 |
|---|---|---|
24GB专用推理内存 | 9B~27B量化小模型 | 零刻SEi14(独立NPU卡) |
64GB | ≤50GB,80B级Q4量化 | 天钡NEX395跑Qwen3 Next 80B |
128GB单机 | 120B级MoE | 极摩客EVO-X3、FEVM FAEX1、芯盛美MAX395 |
192GB单机 | 300B级4-bit量化 | AI Max+ PRO 495,AMD官方口径 |
240GB双机集群 | 284B MoE | E人E本G95实测10+ tokens/s |
384GB三机集群 | 500GB级量化+卸载 | 3台DGX Spark跑DeepSeek V4.1-Flash,30+ tokens/s |
路线一:现在就买单台395,1.3万到2万
这是当下唯一"今天下单、本周开跑"的大内存路线。AI Max+395(Strix Halo)这一年已经铺开了一个机型矩阵:
天钡NEX395:12999元,64GB+1TB,拷机稳定120W,三个PCIe 4.0盘位、VC均热板加独立硬盘风扇,双USB4、双2.5G网口——接口规格明显是照着"以后组集群"设计的。顺带它还能打游戏:1080P高画质黑神话83帧、巫师3 73帧。知乎
极摩客EVO-X3:8月一条"立省70000!一台机器兼顾办公游戏和本地AI"的标题党视频,13.6万播放、777条评论——标题夸张,但播放量说明"一台顶多台"的叙事真的戳中了人。哔哩哔哩
FEVM FAEX1:1升体积塞160W的395,超大均热板,本周刚上的新品。哔哩哔哩
芯盛美MAX395、壹号本ONEXStation(128GB版)等:白牌到品牌各有档位。

坑在哪?两个。一是内存涨价正在直接推高395整机价格——8月零刻SEi14的评测视频开场白就是"AIMax395赶上内存和硬盘涨价,价格直接上天起飞"。这类机器内存全部板载焊死,买的时候容量定终身,没有后悔药。二是64GB和128GB版本的差价里含着内存涨价的水分,下单前先按第一本账算清楚自己常跑的模型清单。哔哩哔哩
适合谁:目标模型明确(70B级Q4或120B MoE)、要求x86原生Windows/Linux、不想等的个人开发者和隐私刚需用户。
路线二:双机集群,4万块的极客浪漫,评论区很清醒
E人E本那条视频的技术完成度不低:两台G95用雷电/USB4级联,分布式推理框架把284B的MoE模型切开装进240GB显存池,协作效率经过实测,回答生成速度超过10 tokens/s。但53条评论里,社区的反应值得每个心动的人看完:哔哩哔哩
DGX派点中了要害:那句"买两台DGX Spark不好吗?而且还有200G接口"的评论被顶了上来——USB4互联的带宽和DGX Spark的200GbE ConnectX-7不在一个量级,级联损耗直接吃掉速度。哔哩哔哩
成本派(8个赞):“这个价格降到2000以内我觉得才有购买的性价比,不然4万块才能做到实用。”
实用派:“理论上2台就能部署,但这玩意跑DS都不能用,更别说GLM了,买了纯属浪费钱,还不如多加2W买DGX。”
我的判断和评论区一致:双机集群目前是从0到1的验证,不是性价比方案。它证明了两件事——迷你主机可以堆、MoE大模型可以塞进去;但也暴露了两件事——互联带宽是瓶颈、4万块的10 tokens/s打不过云端API的性价比。这条路线只属于两类人:数据绝对不能出门的刚需场景,以及纯粹的极客快乐。
路线三:NVIDIA家——DGX Spark现货3万+,RTX Spark十月开卖
DGX Spark(GB10,128GB统一内存)已经积累了约一年的开发者社区,价格3万出头——在这轮AI硬件涨价潮里它反而涨得最少,有机主对比:“A4000从京东7000买的涨到20000+,DGX Spark还是3W+,6000 Pro从7万涨到18万”。它的护城河是CUDA生态加200GbE互联:知乎有机主晒出3台三角直连(不用交换机)跑DeepSeek V4.1-Flash,单流30+ tokens/s——这是目前桌面级方案里公开可查的最快速度。知乎知乎
但机主们的连载吐槽也很实在——一位折腾了一个多月的机主总结道,朋友们留言的共识是"一台不够使,起码两台起步"。另一位则把微调环境搭建写成连载,第一篇的标题就叫"先解决’安装地狱’"。知乎知乎
RTX Spark(N1X芯片)是10月的重头戏,也是Windows on Arm阵营迄今最受关注的产品:Grace 20核ARM CPU + Blackwell 6144个CUDA核心,最高128GB LPDDR5X统一内存,标称1 PFLOP算力。微型计算机

《微型计算机》的对决文点出了买前必看:RTX Spark本地模型规模停留在最高200B级别,官方主推的模型规模更是仅有120B;而且128GB只出现在高配版,低配版CUDA核心砍到5120个、内存上限更低。微型计算机
还有一个容易被忽略的坑:ARM Windows靠Prism转译跑x86应用,企业安全代理、行业外设驱动、硬件加密狗这类内核级驱动无法转译,部分游戏的内核反作弊也可能跑不起来——个人玩家也许无所谓,企业IT采购这是真金白银的兼容性成本。微型计算机
路线四:等等党的九月底,是"大年"
如果不是急用,未来30天有两个明确的等待理由。
其一,AI Max+ PRO 495(Gorgon Halo)月底上市。规格相比395是代际升级:192GB统一内存(395上限128GB),VGM可变显存最高可划拨160GB,AMD官方称这是"首款能够在本地运行3000亿参数(300B)模型的x86客户端处理器"。微型计算机

9月10日AMD北京沙龙上,联想、超聚变、铭凡、极摩客、七彩虹、阿迈奇等一次性亮出9款495新品,官方预告后续超过20款。小红书9月初就有一条"六款192GB内存AI Max+495迷你主机即将上市"的爆料笔记(FEVM、铭凡、极摩客、阿迈奇在列),118条评论里全是蹲价格的。海外博主也已经拿到192GB的AI Max实机测300B模型,中字版9月19日刚被搬上B站。微型计算机小红书哔哩哔哩

铭凡官方账号已经放出了MS-S1 MAX-P495的规格:192GB 8533MT/s统一内存、最高160GB大显存,本地跑284B参数的DeepSeek V4 Flash(Q4量化)推理约15 tokens/s,122B级模型Q8量化约27 tokens/s,9月内开售。翻译一下:单台新机的官方口径速度,已经超过那套4万块双395集群的10 tokens/s——这就是"再等三周"最硬的理由。小红书
关键悬念是定价:如果192GB版比现款128GB的395贵出30%以上,那内存涨价周期里的395现货反而可能是性价比之选;如果接近加量不加价,现在冲395高位版本就是接盘。这个答案月底揭晓。
其二,10月RTX Spark开卖。英伟达已官宣各大OEM厂商10月全面开售RTX Spark系列电脑。首发阵容有华硕、联想、宏碁、微星、戴尔、惠普乃至微软自家的Surface,国行价格和机型落地后,整个"桌面AI主机"的价格坐标系会被重新画一遍。知乎微型计算机

至于更远处的:小米AI Cube(三颗玄戒芯片、本地跑120B模型)8月底亮相时还是工程原型机。小红书
Mac mini M6则正被吐槽"两年涨2500,是AI税入门"。巨头都在挤进这个赛道,但它们都不是你明天就能下单的选项。小红书
还有一本参数表上不写的账:隐私
E人E本那条视频的热评第一(32赞)说的不是硬件:“智谱zcode再次给大家上了一课,本地部署对于注重隐私性的人来说有多重要”。这不是口号。AMD沙龙上落地的两个案例都冲着这一点:华东师大的蛋白质设计智能体要求未公开成果不出校门,上海财经大学的金融智能体则明确要求敏感数据不离开设备。如果你买这台机器的理由里有"数据不出门"这一条,那它的价值锚点就不是token速度,而是离线可用性——这本账,云端API永远给不了。哔哩哔哩微型计算机
对号入座:四类人,四个动作
现在就要跑、预算1.5万内:单台395。先列出自己常跑模型的量化体积,50GB为界选64GB还是128GB版(天钡NEX395的12999是64GB版参考价)。板载内存焊死,容量一步到位。
目标是284B级大模型:别学4万块集群。要么等月底495的192GB单机(官方口径约15 tokens/s),要么直接看3台DGX Spark的30+ tokens/s路线(预算10万级),要么承认云端API更划算。
工作流离不开CUDA/企业采购:现货DGX Spark,或等10月RTX Spark——但企业IT先做ARM内核驱动兼容性验证再谈批量。
预算3-5千也想玩本地AI:可以看零刻SEi14这类"独立NPU+24GB专用推理内存"的新形态。或者用普通32GB迷你主机跑9B~27B小模型——B站有用Geekom A9 Max+Ollama的完整实测可以抄作业。说实话,这个预算段云API订阅的性价比碾压硬件,除非你有离线或隐私刚需。哔哩哔哩哔哩哔哩
接下来值得盯的五个信号:①月底495首发定价(192GB版对128GB版395的价差);②10月RTX Spark国行价格与首发机型;③内存涨价是否持续(直接改写395整机的价格和保值逻辑);④DeepSeek V4.x权重更新节奏(284B的V4-Flash和500GB级的V4.1-Flash是当下"本地能不能跑"的两把标尺);⑤小米AI Cube量产版进展。
迷你主机这个品类,过去拼的是体积和接口,现在第一次开始拼"能装下多大的脑子"。九月这波新品潮把选择题摆到了桌面上——好消息是,答案三周后会更便宜。