395机器从1.5万涨到2.6万,192GB新款9月4日见分晓:本地大模型机器现在买还是等,先把这三笔账算清

源自12位全网作者

03:00

过去一周,三件事接连砸在"想把大模型搬回家"的人面前:年初还在一万五上下的 AI Max 395 整机,被这轮内存涨价潮抬到了两万以上,部分机型摸到两万六;AMD 高级副总裁确认重返 IFA、9 月 4 日做开幕主题演讲,业内普遍预测 192GB 统一内存的锐龙 AI Max 400 将在这场活动亮相;社区版运行时则终于把 395 上的 vLLM 从"能运行"拖到了"真正可用",叠加 DeepSeek V4 大幅涨价,把一批想长期用模型的人又推回了本地路线。知乎 对想入坑这类机器的人来说,这可能是近一年最纠结的窗口期:现在买,怕接涨价的顶;再等等,又怕新机定价更贵。先把结论放前面:395 本质上是一台"容量机",不是"速度机",买或等,取决于你的模型清单,而不是心情。

一、这轮涨价潮,把 395 抬了多少

这轮涨价不是渠道炒作,是 AI 算力需求把存储产能从源头吸走了。DDR5 32GB 套装从 900 涨到 3800,DRAM 合约价单季涨 58% 到 63%,创近十五年最高纪录。知乎 消费端的体感更直接:硬盘翻三倍,内存翻五倍,显卡接近翻倍,不少 DIY 老玩家判断这一轮比矿潮更灾难。哔哩哔哩

AI Max 整机是受冲击最直接的一类:它的 LPDDR5X 统一内存全部板载,成本压力直接传导到整机。买家的实况是,发布时媒体测评主流机型在一万五上下,现在已经普遍过两万,有些机型到了 26000 左右。知乎 回看价格锚点:极摩客 EVO-X2 搭载锐龙 AI Max+ PRO 395 的预约价是 14999 元。哔哩哔哩 ROG 幻 X 2025 新增的 128GB 内存版补贴价 18999 元。哔哩哔哩 这两个价格放在今天,都算"去年的眼泪"。

395机器从1.5万涨到2.6万,192GB新款9月4日见分晓:本地大模型机器现在买还是等,先把这三笔账算清

对面也没有避风港:DGX Spark 因内存紧张官宣涨价到 4699 美元、整机直奔 4 万,和 395 整机站上了同一个涨价扶梯。知乎 这轮涨价里,比的不是谁不涨,是谁涨得少。

二、先认清两个数字:容量决定"装得下",带宽决定"跑多快"

关于 395 的所有分歧,都来自这两个数字。128GB 统一内存、最多 96GB 可划作显存,决定它能装下多大的模型;而内存带宽是 256GB/s,决定"模型跑多快"。知乎 这个带宽意味着每生成一个 token,都要把模型权重完整读一遍,稠密模型的输出速度被它死死卡住。

实测数据比口号诚实。知乎用户 Genima 在 395 小主机上跑 Qwen3.6-27B 稠密模型,实测 12 token/秒,非常符合预期,不虚标。知乎 把各家的自费实测摆在一起看(均为社区用户实机数据,非官方宣传口径):

  • Qwen3.6-27B 稠密模型:约 12 tok/s(知乎 @Genima)

  • qwen3.6:35b MoE、Q4_K_M、满 32K 上下文:57 tok/s,两个月稳态值(知乎 @奇虎南夏,自购铭凡 MS-S1 Max)

  • gemma4:26b Q4_K_M、16K 上下文:50 tok/s(同上)

  • Qwen3.5 122B Q5:能跑,用来指挥 Agent(知乎 @战忽局副局座)

  • 235B Q4:8-9 tok/s,“勉强能用”(知乎 @清泓)

这张表的读法很简单:MoE 小激活模型是这台机的甜点区,35B 级别能跑到 50 tok/s 以上;27B 往上的稠密模型进入"能读、但要有耐心"区间;235B 属于"装得下、吃不饱",更适合证明它能,而不是天天用。宣传页的"能跑 235B"和"跑得好 235B",是两件事。把 395 当生产力跑了两个月的用户,主力模型是 qwen3.6:35b,满 32K 上下文下实测 57 tok/s。知乎 所以在这台机器上,"MoE 优先、稠密兜底"应该当作用法守则,而不是妥协。

三、三笔对比账:你的对手是谁

对 DGX Spark:四万对两万多。Spark 有约 112GB 可用显存、CUDA 全家桶、能做 LoRA 微调、双机 200GbE 直连能跑 405B;395 的扩展能力几乎为零,单机跑 235B Q4 量化版勉强能用(实测 8-9 t/s),双机集群只能靠 10GbE、USB4 去拼。知乎 同时买过两台机器的用户,最后卖了 395、转头扩 Spark 集群——但他的需求是训练和集群。只跑推理和 Agent 的人,395 依然是消费级市场里"96GB 显存"最便宜的一张门票。

395机器从1.5万涨到2.6万,192GB新款9月4日见分晓:本地大模型机器现在买还是等,先把这三笔账算清

对 Mac Studio:苹果 M3 Ultra 最高也有 192GB 统一内存,Metal 生态和 macOS 工作流是它的护城河,工作流本来就在苹果全家桶里的人不必折腾迁移。对高端独显:RTX 5090 的 32GB 显存连 70B 的门都进不去,这和 395 本来就是两个方向,不存在谁替代谁。对云 API:价格战年代输入两块钱、输出三块钱每百万 token,谁都无法拒绝;但真实用户住进去之后才发现,真正的门槛是心理——如果每调一次都在计费,我会下意识地“省着用”,不敢让模型反复试、不敢开 thinking 慢慢琢磨。知乎 云端大模型涨价之后,这笔账又往本地倾斜了一格:本地机的反义词不是"贵的 API",是"不敢用满的 API"。

四、现在买,要准备踩哪些坑

先说清楚,这不是开箱即用的工具,是开箱就需要你参与调试的机器。知乎 有用户把两个月踩的 18 个坑整理成文:Ollama v0.30 托盘版不读命令行设置的环境变量,taskkill /F 会留下每个约 24GB 的显存僵尸进程,PowerShell 5.1 的 GBK 编码会把中文知识库不可逆地写乱——这些坑,没有一个是跑一次 benchmark 能触发的。

其次,形态决定性能释放,同一颗芯片不同命。1L 小钢炮受功耗墙限制,液冷版则能把 CPU 单烤峰值功耗推到 176W、持续 153W,稳态温度仅 73~74℃。小红书 所以横向对比测评数据时,先问一句:这是哪个形态的机器跑出来的。

395机器从1.5万涨到2.6万,192GB新款9月4日见分晓:本地大模型机器现在买还是等,先把这三笔账算清

395机器从1.5万涨到2.6万,192GB新款9月4日见分晓:本地大模型机器现在买还是等,先把这三笔账算清

第三,vLLM 是这个月才"能用"的。在社区开发者 CIRU 的 Strix 原生运行时之前,gfx1151 上的单流解码还停留在 0.269 tok/s 的上游兼容构建水平;CIRU 的发行版把它一路修到 26.23,从 0.269 到 26.23,累计 97.55 倍。知乎 128K 到 256K 的长上下文,也从"不可用"变成了"可用"。

但也别指望它当多人共用服务:多并发 + 长上下文的组合衰减剧烈,32K 双路聚合只剩 6.61 tok/s。知乎 “单流/双流 + 长上下文"或"多流 + 短上下文”,才是当下这台机的可用范围——它服务的是你和你的 Agent 队列,不是一个部门。

五、等 AI Max 400 的人,看三个信号

已确认的信息不多,但足够画出轮廓:8 月 6 日,AMD 高级副总裁 Jack Huynh 确认将重返 IFA 2026 柏林电子展,9 月 4 日做开幕主题演讲。知乎 业内普遍预测,锐龙 AI Max 400 系列会在这次展会上正式发布。

纸面参数是 x86 阵营第一次在统一内存这条赛道上追平苹果:192GB 统一内存、最高 160GB 可分配为显存,AMD 说这是全球首款能在本地跑 3000 亿参数以上大语言模型的 x86 客户端芯片。知乎 型号为 PRO 495/490/485,架构延续 Zen 5 + RDNA 3.5。

信号一,容量加了,带宽没官宣加。如果内存带宽维持同档,decode 速度依旧被那条 256GB/s 级别的天花板按住:192GB 解决的是"300B 装得下",不是"300B 跑得快"。等 400 要容量上限,合理;等它"跑得快",大概率失望。

信号二,好东西第一批不下放。按照惯例,首批上市的全是 PRO 商用版本,面向企业、工作站和专业市场,不带 PRO 的消费版预计今年晚些时候才出。知乎 内存涨价周期里,新品的首发价几乎注定不会像去年的 395 那样友好。

信号三,生态债要重新还一遍。gfx1151 这颗核心,社区花了一年才把 vLLM 拖到可用;新核心的运行时成熟度,同样需要以月为单位的迭代,早期用户注定要当一阵子运行时调试员。

六、收口:三类人,三条路

该现在买的,别犹豫:隐私、离线是硬需求;主力模型是 MoE 小激活、能接受稠密模型 10-20 tok/s;不碰训练、不做多人并发。两万出头,它仍是消费级市场里唯一"装得下 70B-122B、又不至于倾家荡产"的选择。

395机器从1.5万涨到2.6万,192GB新款9月4日见分晓:本地大模型机器现在买还是等,先把这三笔账算清

该等的,踏实等:想要 300B、想要更大显存余量,就等 400 的消费版,但把价格预期调高;还没想清楚自己跑什么模型的人,先用云 API 或一张二手卡把 Ollama 玩明白,别拿两万块进场接顶。

不该碰的,别硬上:要微调训练、要高并发、要极致速度,你的目的地是 DGX Spark 或专业卡,不是这里。

继续观察的信号也放在这:9 月 4 日 IFA 主题演讲的实测带宽数据;四季度内存合约价走势;395 渠道价会不会再涨一档;CIRU 这类社区运行时的迭代节奏。

知乎上那个"现在怎么没有人提用 AMD MAX395 去跑本地大模型了"的问题,到今天还活跃着,下面的人早已分成两派:一派每晚静默地排着十几个 Agent 任务跑到半夜,一派卖了机器转投 DGX。买过的值友,你是哪一派?现在跑的是什么模型?评论区聊聊。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章