二手1万、三个月后“越久越香”:雷神26499的水冷AI工作站,到底复活了什么?

源自163位全网作者

04:56

9月16日,热点科技给出了雷神水冷迷你AI工作站(Master D3950)的最新实测:128GB统一内存、最高划出96GB当显存,LM Studio里跑GPT-OSS-120B综合50.4 tokens/s,叠加国补后到手26499元。热点科技

同一周,知乎一个问题被刷到44万浏览:“现在怎么没有人提用AMD MAX395去跑本地大模型了?” 问题下的风向,过去三个月拐了一个大弯——6月雷神把这台机器推上货架时,正值二手锐龙AI Max+ 395整机跌到约1万元(128G无硬盘版)的历史底部,社区给395的嘲讽就一句黑话:“300多pp、15tg”。而9月中旬,同一批人在更新里写下"Strix Halo就像美酒,越久越香"。知乎专栏知乎

凉和热都发生在三个月里。犹豫要不要为雷神这台水冷机掏2.7万的人,先看懂这波涨跌,再谈值不值。

二手1万、三个月后“越久越香”:雷神26499的水冷AI工作站,到底复活了什么?

一、为什么凉:带宽是原罪,水冷静音救不了它

锐龙AI Max+ 395的账面很能唬人:Zen 5十六核、板载128GB LPDDR5X-8000四通道统一内存、官方最高划96GB做显存——三倍于桌面旗舰独显32GB的上限。但它只有256GB/s的内存带宽,而自回归解码每生成一个token就要把权重完整读一遍。算力59.4 TOPS、ROCm驱动早期稀烂,给它的判词是"除了显存什么都没有"。热点科技知乎专栏

稠密模型在它身上全军覆没:qwen3.6-27B跑15-20t/s,B站评论区有用户自测DeepSeek V4 Flash Q2只有6t/s,“一天50万token,机器100W功耗连电费账都倒挂”。今年coding和智能体任务兴起后,预填充速度成了硬指标,NVIDIA DGX Spark带着ConnectX-7网卡、NVFP4原生支持和近乎翻倍的prefill来了——首发36888元,把"本地算力"的王座直接搬走。395的二手价一度探底1万,"找人接盘"是半年来这个圈子的高频词。哔哩哔哩知乎专栏

雷神D3950恰好上市在这个至暗时刻:7.9升全铝立方体、6.5kg、12000平方毫米纯铜冷板压176W瞬时峰值。水冷把噪音和温度按住了(双烤154W时0.5米实测38.3dBA),但按不住带宽——这台机器上市第一个月,买的其实是一个"等风来"的姿势。热点科技

二手1万、三个月后“越久越香”:雷神26499的水冷AI工作站,到底复活了什么?

二、为什么又热:三件事全是软件层的,半个月内密集发生

反转不是硬件带来的,这正是判断这台机器未来的关键。

第一件:Flash系MoE模型成了395的"圣杯"。 知乎用户"金猪升级包"在44万浏览的回答里算过:Qwen3.8-Flash-Next总参176B、激活仅6B,高容量、低带宽需求——市面上只有96GB可分显存的395塞得下,也只有395的256GB/s撑得起6B激活的解码。单机Q4裸跑约25t/s,叠MTP后完全可用。此前"395跑120B"只属于gpt-oss-120b这一个幸运儿(128专家选4的超稀疏结构+llama.cpp死磕适配才有999 prefill/47 decode),现在这条路被模型架构本身铺平了。知乎知乎专栏

第二件:专用推理服务器halogen-flash-server迭代到0.11.1。 专栏作者逐版本Ghidra逆向排除后门才敢推荐,但它尚未开源;而且"专业用户kyuz0也只跑出750t/s prefill",作者建议拿glm-5.3-flash或deepseek-v4.1-flash帮忙部署——这是个还在磨合期的引擎,不是即插即用的福利。雷神这台机今天的50.4t/s(GPT-OSS-120B单路、首字延迟中位195ms、4路并发总吞吐71.6t/s、131K上下文吃进218页年报、内存实占超100GB),证明的是平台潜力,不是人人开箱即得。知乎专栏

第三件:社区解锁了RDMA over USB4。 Strix Halo主机不支持PCIe扩展,两台395组张量并行原本走TCP是"1+1<1"的死路;现在一根雷雳线做RDMA,延迟从130µs骤降到7µs,理论上有双USB4口的395机器都能TP=2。D3950背后恰好有2×USB4——雷神的水冷、双网口和USB4,成了这波软件复兴里少数"硬件早到了位"的样本。知乎

三件事都发生在软件/固件层。对老395用户是好消息:机器没白买;对想买新机器的人是坏消息:决定这台机器价值的,是下一轮模型和驱动,而不是雷神。

三、掏2.7万之前,先分清"装得下"和"用得爽"

宣传口径"最高运行235B参数模型",得拆成两句话看:100B级MoE在96GB显存里留足KV Cache、256K长上下文掉速极慢(halogen作者实测社区数据:64K后llama.cpp基本不可用时,395还能维持150pp/10tg),这是395真正的护城河;而284B级稠密DeepSeek V4在395上依然是"200多pp、15tg",在DGX Spark上才是风光无两。装得下,和能用,隔着一整个模型架构史。知乎专栏

二手1万、三个月后“越久越香”:雷神26499的水冷AI工作站,到底复活了什么?

顺手泼两盆冷水:游戏不是它的卖点——Time Spy 11447分、1080P赛博朋克86帧,核显水平,为27K买单的人别指望这个。Windows本地部署的坑远没填平——铭凡MS-S1 Max(同平台风冷3L,机主2026年2月自购价21599元)的主人自费跑满两个月,列出Ollama环境变量在Windows托盘版下失效、taskkill留下每个24GB的显存僵尸进程、PowerShell 5.1默认GBK编码毁文件等18个坑,他的判词值得抄在订单备注上:“不是开箱即用的工具,是开箱就需要你参与调试的机器。” 他统计过全网11篇中文英文评测,测试周期没有一篇超过一周——跑分文章给不了你的,恰恰是这台机器最贵的部分。热点科技知乎

四、三笔账算完,再决定抢还是等

账一:水冷溢价4900元,买了什么? D3950国补后26499,对的是同平台风冷新机的自购价21599。差价4900元买的是:154W持续双烤下38.3dBA(MS-S1机主原话——风冷性能模式"呼呼声放桌上不能忽略"、半小时80-87℃)、10G+2.5G双网口、内置400W白金电源、3盘位扩容。天天放桌面上7×24挂后台的人,这4900不是税;每天只跑十分钟的人,它就是税——1万的二手395干的是同一件活。知乎

二手1万、三个月后“越久越香”:雷神26499的水冷AI工作站,到底复活了什么?

账二:"比云端省钱"的故事成立吗? B站评论区有重度用户自报云端混合均价0.085元/百万token、月耗20亿token——对26499的机器来说,纯API账单要十几年才回本,还没算本地功耗。铭凡机主算得更透:本地经济账从来不在API费,在"每次调用都计费"的心理门槛——他15个夜间自动化任务里11个由本地qwen3.6-35B包办,零边际成本才敢让模型反复琢磨;他拿外包兼职3000元/月做参照,7个月回本。这笔账只对固定工作流、批量任务、数据不出内网、长上下文重度调用的人成立。 只是每天跟AI聊几句的人,API更便宜也更强:同一个跨技术栈docx任务,本地35B八连败,云端旗舰模型一次过。哔哩哔哩知乎

账三:这轮复活的脆弱性有多大? halogen没开源;Qwen3.8-Flash-Next的GGUF适配还在路上;竞品铭凡IFA2026展出的MS-S1 MAX-P495新机预告"9月内开售"。而二手DGX Spark在7月31日一度跌到2.1万、如今又涨回首发价——转售市场已经把这轮模型红利计价进去了,395新机没有这个缓冲。知乎知乎专栏

水冷系统本身无公开长期可靠性数据,目前唯一能兜底的,是雷神刚公告的笔记本、显示器、迷你主机三大品类保内免费取送机维修。前两轮"本地算力革命"留下的墓碑还在:ktransformer热潮时,“当初信这个的全部去组CPU平台,一年之后没几个还在用”。微博哔哩哔哩

结论按人来给:

  • 该出手:需要96GB+显存、放桌面7×24、要安静要内网、不愿碰二手的小团队和重度自动化玩家——D3950比Spark便宜一万、USB4可直连双机、噪音是实打实的38分贝,三点都落在刀背上。

  • 该等:已持有395整机的人——增量全在软件,等halogen开源和Flash量化包;观望双机方案的人——等RDMA over USB4教程和Windows支持成熟;铭凡P495潜在买家——等9月开售实测,水冷之争还没完。

  • 该避:为"235B"三个字来的、指望"回本"回本的、以及没准备好折腾Linux和Ollama配置的纯小白。

继续盯四个信号:halogen是否兑现开源;Qwen3.8-Flash-Next进不进主流推理框架;二手395价格会不会涨回1.2万(社区用真金白银对"复活"投票的地方,永远在闲鱼);雷神下一波国补库存的松紧。

雷神今年在5月和7月连开两场发布会,把故事从游戏本讲到"云-边-端"算力矩阵,这台水冷立方体是其中最像"家具"的一件。平台涨跌的风向已经转回来了,但2.7万的定价能不能站住,不取决于水冷压得住多少瓦,取决于下一个改变游戏规则的东西,从机箱里出来,还是从论文里出来。微博

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章