内存涨价60%、下一代芯片还有20天发布,雷神26999元的AI工作站现在买还是等?

源自8位全网作者

04:49

今年PC圈有个反常识的事:数码产品不降反涨。年初1.5万就能买到的AMD锐龙AI Max+ 395迷你主机,现在普遍涨到2万往上。知乎DDR5 32GB套装从900元涨到3800元。英伟达DGX Spark也官宣从3999美元涨到4699美元。罪魁祸首是DRAM合约价单季度涨了58%-63%,创近十五年最高纪录。知乎

就在这个节骨眼上,后台一直有人问同一台机器:雷神的水冷迷你AI工作站,首发价26999元,现在这行情,是该咬牙上车,还是等9月的下一代?哔哩哔哩

这篇文章把8月刚发生的三件事捋清楚,再给一个能对号入座的判断。

这台机器到底是什么

先给不熟悉的朋友一个速写:雷神这台机器本质是"AMD锐龙AI Max+ 395平台+120W定制水冷"的组合。16核32线程的Zen 5处理器,集成40组CU的Radeon 8060S核显,配128GB LPDDR5X 8000四通道统一内存——最多可以把96GB划给显存,意味着120B级别的大模型可以完整塞进"显存"里跑。知乎宣传口径最高能运行235B参数的模型。哔哩哔哩

内存涨价60%、下一代芯片还有20天发布,雷神26999元的AI工作站现在买还是等?

它的差异化不在芯片(这颗芯片大家都在用),而在三个地方:一是散热,199mm见方、7.9L的立方体里塞了岛式水冷,烤机30分钟能稳住133W、峰值176W的性能释放,比同模具风冷方案高一截。知乎二是机身,全铝外壳6.5kg,做工走"桌面工作站"路线;三是接口,双USB4、双DP 1.4,还给了2.5G+10G双网口——10G口给多机组集群留了余地。

内存涨价60%、下一代芯片还有20天发布,雷神26999元的AI工作站现在买还是等?

内存涨价60%、下一代芯片还有20天发布,雷神26999元的AI工作站现在买还是等?

5月底雷神联合AMD一口气发了塔式、迷你、笔记本三种形态的Master系列AI工作站,这台水冷迷你版是其中声量最大的。知乎B站几条深度评测播放量都在10万到35万之间,评论区吵得比视频本身还热闹。

8月发生的三件事,改变了"等还是买"的算法

第一件:vLLM在395上终于能用了(8月11日)。

这不是小事。过去一年多,395用户跑本地大模型基本只有llama.cpp一条路,官方vLLM装得上但慢得没法用。8月初社区发布的Strix原生vLLM运行时,把单流解码速度从0.269拉到26以上,累计优化约97倍。知乎同一模型只换运行时,生成速度提升2.9到5.2倍,128K长上下文从"不可用"变成"可用",KV池实测能装下约145万token。

翻译一下:这台机器的硬件没变,但软件生态在它发布后的第三个月,第一次摸到了"能干活"的门槛。而且这个优化是所有395机型通用的,不存在"雷神独占"。

第二件:下一代确认在路上(8月6日官宣,9月4日发布)。

AMD高级副总裁Jack Huynh确认将在IFA 2026柏林电子展开幕做主题演讲,业内普遍预测锐龙AI Max 400系列会正式发布。知乎这一代最大的突破是x86首次做到192GB统一内存,最多160GB可划为显存——官方口径是"全球首款本地跑3000亿参数以上大语言模型的x86客户端芯片"。旗舰型号16核32线程、加速5.2GHz,核显升级到Radeon 8065S。

但有两个必须说清楚的细节:首批上市的全是PRO商用版,面向企业和工作站市场;不带PRO的消费版要等"今年晚些时候"。知乎也就是说,从发布到你能买到消费级整机,中间还隔着发布时间、铺货节奏两道关。

第三件:内存还在涨,"等降价"的逻辑不成立。

这是最容易被忽略的一点。很多人习惯性地等数码产品降价,但这一轮是成本推动型涨价:DRAM合约价单季涨了近六成,128GB统一内存本身就是机器成本的大头。DGX Spark因为内存紧张直接从3999美元涨到4699美元,国内整机从3万出头直奔4万。知乎换句话说,等AI Max 400,等来的大概率不是降价,而是"更大内存+更贵价格";而现款395在涨价周期里,价格能守住26999不动,已经算难得。

那到底买不买?分三种人

第一种:数据出不了门的,现在就是能买的成熟选项。

如果你的核心诉求是私有化部署——公司敏感文档、客户数据、法务财务材料不能上云API——那这台机器解决的是"能不能用"的问题,不是"值不值"的问题。128GB统一内存+96GB显存分配,配合刚成熟的vLLM运行时,长文档问答、本地知识库、私有Agent都能跑。这类需求等下一代意义不大:AI Max 400首批是商用PRO版,采购渠道和价格对个人用户都不友好。

第二种:想跑更大模型、更长上下文的进阶玩家,建议等,但要知道代价。

128GB这档有个圈内讨论很热的"量化悖论":千问3.6砍掉122B规格后,128GB内存往下跑27B/31B绰绰有余,往上够到229B级别就只能Q3甚至Q2量化,模型是装下了,上下文却装不下了。哔哩哔哩如果你盯的是200B+稠密模型或者超长上下文Agent,192GB的AI Max 400确实是更对的答案——代价是消费版时间未定,而且参考这轮内存涨势,首发价不会温柔。

内存涨价60%、下一代芯片还有20天发布,雷神26999元的AI工作站现在买还是等?

第三种:纯算经济账的,先别买,算完再说。

评论区有条被顶上来的测算很扎心:有人跑DeepSeek V4 Flash的Q2量化,只有6 token/s,一天才50万token,算上电费比调API还贵。哔哩哔哩按DeepSeek的API价格折算,26999元能换到的调用量是天文数字。纯比生成token的成本,本地机器永远打不过云端API——这台机器的价值在API之外:无限次调用、离线可用、数据不出本机、硬件还能当普通工作站用。如果你只是偶尔用用大模型,云API月费几十块,十年都花不完一台机器的钱。

几句劝退的实话

  • 395平台做不了训练。想跑LoRA微调、继续预训练的,ROCm生态在这颗芯片上是空白,直接看别的方案。

  • 速度上限受内存带宽约束。跑27B级别的稠密模型,实测只有12 token/s上下,比7900 XTX这类独显方案慢。哔哩哔哩它的甜区是MoE稀疏模型(比如GPT-OSS-120B、Qwen3.6-35B-A3B),装得下就能跑到几十token/s。

  • 想当多人共用的高并发服务也不现实。新运行时在长上下文+多并发组合下衰减剧烈,它的定位是"单人主力机+偶尔双流"。

  • 26999不唯一。abee有同模具的姊妹款卖25999,铭凡MS-S1 Max、磐镭的395小主机也可以横向比。哔哩哔哩雷神贵出来的部分是水冷释放、全铝机身、双网口和品牌售后,预算优先的话风冷395小主机两万内也有交易记录。

接下来值得盯的三个信号

  1. 9月4日IFA开幕演讲:AI Max 400的正式规格、定价和铺货节奏,当天见分晓;

  2. 9-10月内存合约价走势:如果涨势放缓,现款395才可能出现松动,甚至有促销空间;

  3. vLLM原生运行时的模型适配名单:目前深度优化集中在Ling-3.0-Flash,通用项优化能覆盖大部分模型,但适配名单扩到哪,这台机器的"能干活"边界就扩到哪。

一句话总结:这台机器不是给"所有人"的,它是给数据不能上云、需要一台24小时安静的桌面算力、并且清楚本地模型边界的人准备的。想明白自己要的是"私有"还是"便宜",答案就出来了。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章