知乎44万人在问「MAX395怎么没人提了」:128G迷你主机去年首发14999、今年普遍2万+,Flash模型又把它救活——64G版16400的账、Prefill太慢的坎、192G新机的赌,四条路一条条算

源自177位全网作者

02:39

去年被社区封为"巴掌大个人超算"的锐龙AI Max+395,这个9月在知乎被顶起来的问题却是"现在怎么没有人提用AMD MAX395去跑本地大模型了?",单条回答44万浏览。 旁边还挂着一个同样被反复顶起的问题:“AMD的锐龙AI Max+ 395迷你主机值得购买吗?“一边问"过气了”,一边问"还能买吗”,看着拧巴,背后其实是同一批人:2025年盯着首发价流口水、纠结到今天还没下手的本地AI玩家。到2026年9月,他们面前摆着三件事:内存暴涨、Flash模型爆火、192GB新机排队上市。这篇就把这团乱麻拆开,一条条算。知乎

一、它不是凉了,是先被内存价格"涨凉"了

先说一半结论:Max+395热度消退,芯片本身只占小头,大头是价格逻辑变了。

去年10月,铭凡MS-S1 Max(Max+395+128GB+2TB)开启预售,标配128GB+2TB存储组合,首发价14999元;极摩客EVO-X2作为当时首批Max+395迷你主机,官方起售价15,999元。 当时社区的故事是"一万五拿下一台128G统一内存加40CU核显8060S的桌面AI超算",比英伟达的方案便宜一半,性价比拉满。哔哩哔哩知乎专栏

现在呢?B站up主7月的行情视频说得很直白:受内存硬盘价格持续走高,标配128GB的StrixHalo平台AI迷你工作站,价格普遍都已涨至2万元以上。 还是那台铭凡MS-S1 Max,64GB+2TB版原价18599元,叠上减免、会员优惠和1500元国补,到手价还要16400元左右——记住这个数:64GB版现在的到手价,比一年前128GB版的首发价还贵一千多。芯片还是那颗芯片,涨的全是存储的账。哔哩哔哩

散件市场更夸张。9月11日的显卡日报记下了历史新高:双16GB DDR5涨至2594元,单日涨幅超过20%,双48GB涨至8498元。 安全圈老兵tombkeeper翻出自己一年前配迷你主机的订单,当时买16G的DDR5是190,1TB的SSD是470。 一年,九倍。知乎专栏微博

评测圈同期给的参考价是:单根16G DDR5的市价普遍在1700到1800元区间。 这也解释了为什么"怎么没人提了"——14999的性价比故事,已经讲不下去了。知乎专栏

知乎44万人在问「MAX395怎么没人提了」:128G迷你主机去年首发14999、今年普遍2万+,Flash模型又把它救活——64G版16400的账、Prefill太慢的坎、192G新机的赌,四条路一条条算

二、凉意的另一半:对手变多了

价格之外,Max+395面前的对手也换了一茬。

一头是英伟达DGX Spark真机落地。B站年初那条"DGX Spark、Mac Studio、铭凡MS-S1 Max谁才是个人超算最优选"的对比视频播放量9.3万,三台设备放在同一套测试标准下跑大模型推理、多模态和8小时高负载稳定性,评论区把这三种方案吵了个遍。 知乎做GB10/Strix Halo/M系列对比的硬核玩家口径更尖锐:去年卖13k左右时性价比很高,如今内存涨价后卖到20k+,明显不如加一点预算直接买Spark。哔哩哔哩知乎

另一头是AMD自家换代。锐龙AI Max+ PRO 495已经发布,它支持最高192GB LPDDR5X统一内存,其中最多160GB可以分配为显存,磐镭YO2 495版这类新机已经在路上。 极摩客这边,第三代EVO-X3今年6月22日在京东全球首发,起售价21,699元(128GB+1TB版本)。 128GB的老旗舰夹在中间:上被192GB新平台压着,下被Spark分流量,"没人提了"的另一半原因在这。知乎专栏知乎专栏

三、转折:Flash模型把统一内存救活了

但这个故事在9月出现了反转,而且反转来自模型侧。

44万浏览那条回答的核心信息是:本来感觉凉凉了,但最近几家一波Flash模型又给带活了,特别是Qwen3.8-Flash-Next,176B总参数,6B激活,高容量低带宽需求,简直SuperUMA圣体,单机跑Q4量化裸跑大概25token/s。 翻译一下:MoE加Flash这代模型的思路是参数塞大、激活压小,吃内存容量、不吃带宽——这正好是Max+395的形状。256-bit LPDDR5X约256GB/s的带宽跑dense模型捉襟见肘,但把176B的Q4权重(90GB上下)塞进128GB统一内存刚刚好。显卡党想凑90GB显存?4060Ti 16G得六张起步,这不是个人玩家的路线。厂商官方口径里,128GB版本最高支持Qwen3 235B、DeepSeek 70B等主流模型本地运行。知乎知乎专栏

生图这类负载就更不是问题了,磐镭YO2的评测里直接拿Procyon AI生图基准实测了整机吞吐,Max+395跑Stable Diffusion级别的本地推理早就是成熟场景。

知乎44万人在问「MAX395怎么没人提了」:128G迷你主机去年首发14999、今年普遍2万+,Flash模型又把它救活——64G版16400的账、Prefill太慢的坎、192G新机的赌,四条路一条条算

不过同一条回答也把死穴点破了:395问题主要还是Prefill太慢,300多token/s这个感觉没招。 什么概念:10万字的文档喂进去,光预填充就要等五六分钟起步。单轮问答无所谓,Agent多轮调用、长上下文场景就天天受折磨。知乎

还有一个值得围观的社群玩法:大部分Halo主机不支持PCIe扩展、插不了RDMA网卡,有高人搞了RDMA over USB4,一根雷电线互联两台主机,延迟从130µs骤降到7µs,双机张量并行就这么成了。 这条回答顺带解释了铭凡MS-S1 Max为什么卖得好——它是少数带PCIe扩展的机型,官方互联路线走得通,原话是"理念太领先了"。想玩双机TP的,选机型时先把这一条写进清单。知乎

四、现在下场的四条路,一张表

路线

代表机型/方案

大致价位

谁适合

谁别碰

64GB整机

铭凡MS-S1 Max 64G+2T

约16400元到手

70B级Q4模型、AI工具链日常用

想跑176B级MoE的

128GB整机

MS-S1 Max 128G、EVO-X2、磐镭YO2 395版

2万+

百B级MoE、长上下文、一步到位党

预算卡死1.5万以内的

等192GB新机

磐镭YO2 495版(PRO 495,最高192GB)

待公布,参考EVO-X3的21699起

300B级模型、Agent重度用户

追性价比的,新品首月必有溢价

转投NVIDIA

DGX Spark

高于同内存Halo整机

要CUDA生态、官方多机互联

穷究生成速度的

提醒一句,Spark也不是万能钥匙,硬核玩家的实测口径是:最大的问题是LPDDR内存的低带宽使得这台机器跑A10B以上的LLM都不算快。 换句话说,两万预算买谁都别指望"快",买的是"大"——大内存、本地、私有。知乎

五、下单前把三个问题问死

一问模型多大。70B Q4,64G版够用;176B级MoE,128G起步;300B级,直接等192GB新机或者考虑Spark。二问Prefill能不能忍。Agent党、长文档党慎入,300 token/s的预填充会天天折磨你;单轮问答、代码补全党无所谓。三问要不要扩展性。想玩双机互联、外接显卡坞的,优先选带PCIe/OCuLink的机型——这是MS-S1 Max比同价位机型贵还有人买单的核心理由。

知乎44万人在问「MAX395怎么没人提了」:128G迷你主机去年首发14999、今年普遍2万+,Flash模型又把它救活——64G版16400的账、Prefill太慢的坎、192G新机的赌,四条路一条条算

最后给三个比"现在买不买"更重要的观察信号:一是DDR5现货走势,有专栏文章引述首尔经济日报的消息称,三星已经把大约70%的内存产能通过长期合同锁定到2031年,这类消息如果持续落地,板载大内存整机只会更贵不会更便宜。 二是磐镭YO2 495版的最终定价——它是192GB新机的定价锚,直接决定128GB老款要不要清库降价。三是DGX Spark的供货和价格。至于硬核派"等明年384-bit LPDDR6再买"的建议,个人认为256-bit统一内存盒子这个品类要等到明年上384-bit LPDDR6才比较值得买,成立,但按硬件圈的规律,那是永远等下去的路线——预算内能干活的机器,才是好机器。知乎专栏知乎

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章