锐龙AI Max+395一年报:软件终于好用、整机涨了三成、192GB下一代20天后IFA预演——买还是等?

源自9位全网作者

02:34

最近这一周,迷你主机圈子里讨论度最高的,还是那颗"王炸"——AMD锐龙AI Max+ 395。今天(8月14日)有UP主发了阿迈奇M1A Pro+的新体验,标题直接就是"一年后变好用了"。B站两天前极摩客EVO-X3一条"立省70000"的推广视频,评论区盖了378层楼。再往前,8月11日知乎上有人发长文,说395上跑vLLM"终于迎来真正可用的一天"。知乎

锐龙AI Max+395一年报:软件终于好用、整机涨了三成、192GB下一代20天后IFA预演——买还是等?

这颗芯片是2025年初发布的,到现在刚好一年半。我翻了一圈B站、知乎、小红书的讨论,把价格、实测、新品节奏都核对了一遍,聊聊一个很现实的问题:现在这个时间点,395迷你主机到底是买,还是等?

先说结论:这一年它确实从"能跑"变成了"能用",但内存涨价把整机价格抬高了约三成,而20天后IFA上可能出现192GB的下一代。三股力量拧在一起,这是395上市以来最纠结的购买窗口。

这一年到底变好了什么

395的硬件一直很诱人:16核Zen 5、40CU的Radeon 8060S核显、最高128GB统一内存,GPU最多能划走96GB当显存。这意味着一张卡都插不下的200B级大模型,它能整个装进内存里。

但去年买它的人,大半时间都在跟软件生态搏斗。想在上面跑大模型,基本只有llama.cpp一条路,vLLM装是装得上,体验只能算"能运行"。

变化集中在最近几个月发生:

第一,ROCm 7.x之后,PyTorch 2.10已经官方支持、可以直接pip安装,不用再编译到半夜;Windows下的ROCm 7.1甚至有用户反馈比Linux还稳;ComfyUI春节后也能在395上跑了,生图、生视频的工作流算是打通了。知乎

第二,通过设置内核参数,GPU可用显存能从默认的96GB拉到120GB左右,128GB内存不再是摆设。知乎

第三,也是最关键的:8月份社区开发者CIRU发布了专门为Strix Halo打造的vLLM原生运行时,配合同期开源的ling-3.0-flash int4量化版,单流解码速度从之前官方wheel的0.269 tok/s一路爬到26.23 tok/s——累计97倍的提升,长上下文从"不可用"变成"256K还能保持两位数解码"。发布者的复盘里有一句话很扎心:之前是"gfx1151上每一步都走错",现在是一层一层掰回正道。知乎

换句话说,去年是"硬件超前、软件欠账",今年是账还得差不多了。这也是为什么今天的评测敢用"变好用了"当标题。

但物理瓶颈没变,先看清楚它跑不动什么

统一内存是把双刃剑。容量管够,带宽却只有256GB/s上下,社区的说法是"GPU带宽也就3070那个水平"。大模型推理的解码阶段恰恰是带宽瓶颈,所以395跑MoE模型(激活参数少)挺顺,跑Dense稠密模型就明显慢。知乎

几个来自用户实测的参考数字,都出自B站热门评测的评论区,比厂商宣传页诚实得多:

  • 有人用128GB配置跑DeepSeek V4 Flash的Q2量化,只有6 tok/s上下,机器持续功耗约100W;

  • 有人跑Qwen3.6-27B稠密模型,约12.78 tok/s,作为对比,一张7900XTX跑同模型能到40 tok/s;

  • 高赞评论给了个很实用的判断标准:“prefill没3000,不用考虑本地”。B站

极摩客官方页面也贴过一组EVO-X3的实测数据:Qwen3.6:35B能到60 tokens/s,GLM-4.7-Flash 59 tokens/s,gpt-oss-20b的Q4量化65 tokens/s,而换成满血Qwen3 235B只有11 tokens/s,DeepSeek-R1 32B只有10 tokens/s——官方数字和评论区口径完全对得上:MoE和中小模型飞起,大稠密模型爬。

锐龙AI Max+395一年报:软件终于好用、整机涨了三成、192GB下一代20天后IFA预演——买还是等?

还有一条26赞的评论,点出了128GB最尴尬的地方,我称之为"量化悖论":Qwen3.6砍掉122B这个规格之后,27B/31B级别的模型24-32GB显存就能跑,而下一个档位直接跳到229B级别——128GB统一内存卡在中间,跑200B级的Q4量化又装不下长上下文,不上不下。

所以395真正的甜区其实很明确:70B-100B级模型、235B级的深度量化(Q2/Q3)、以及各类MoE模型的长上下文场景。如果你的需求只是跑个27B、35B,那真用不着花这个钱。

更现实的问题:它涨价了

395整机本来就贵,今年更难绷的是内存行情。知乎上的数据是:DDR5 32GB套装从900元涨到3800元,DRAM合约价单季涨了58%-63%,创近十五年最高纪录。知乎395这种把128GB内存焊死在主板上的机器,成本全吃在这上面,有用户直言"涨价30%,现在谁买谁亏"。知乎

我把目前在售的主流395机型和价格捋了一遍(均为社区采集到的公开价格,以电商实时为准):

  • 风冷准系统门槛:18000元出头;

  • TOPC T03-395:主打4个硬盘位,准系统(不含硬盘)18999元;

  • 阿迈奇M1A Pro+:128GB+2TB,19199元,目前口碑里的"性价比之选";

  • 磐镭YO2:128GB+2TB,走国补渠道2万出头;

  • 极摩客EVO-X2/X3:128GB版本定价2万上下,X3主打更薄机身,8月刚开预售;

  • 雷神水冷AI工作站(abee同款模具):首发26999元,贵在水冷和120W性能释放;

  • AMD自家的Ryzen AI Halo开发者平台:3999美元起,视频里说国内约2万7。知乎

一个很清楚的规律:同样一颗395,风冷和液冷差出近一万,品牌溢价和模具差异比配置差异大得多。评论区有条17赞的话我觉得很中肯:"没必要用水冷,85W足以,风冷的395只要18000出头。“除非你对噪音和极限释放有执念,否则风冷版本的钱更值。极摩客官方页面给EVO-X3标了三档专属性能调校:54W、85W、140W,中间这档,正好就是这些用户口中的"足以”。

锐龙AI Max+395一年报:软件终于好用、整机涨了三成、192GB下一代20天后IFA预演——买还是等?

真正的变量:20天后的IFA

这是"买还是等"里权重最大的一项。

5月21日,AMD已经发布了锐龙AI Max PRO 400系列(代号Gorgon Halo):统一内存直接干到192GB,其中最多160GB可划为显存,官方口径是"全球首款本地跑3000亿参数以上模型的x86客户端芯片"。三款型号:旗舰Max+ PRO 495是16核5.2GHz+40CU的Radeon 8065S,往下是12核的490和8核的485。知乎

注意节奏:首批全是PRO商用版,面向惠普、联想这些OEM的商用工作站;消费版要晚些才出。而8月6日,AMD高级副总裁Jack Huynh确认9月4日在IFA柏林电子展做开幕主题演讲,业内普遍预测消费版锐龙AI Max 400会在这场发布。

也就是说,三周之内,下一代就要带着192GB来敲桌子了。隔壁英伟达128GB的RTX Spark也是今年秋天上市,苹果M3 Ultra顶配同样192GB——统一内存这条赛道今年秋天会挤满人。

所以,到底买不买

我的判断分四种人:

第一种,现在就该买的:有明确的大内存刚需,比如本地跑70B以上模型、处理不能上云的敏感数据、或者要7×24小时挂一台低功耗AI服务(整机功耗不到100W,这是它比独显机省心的地方)。这类人等不起,而且软件生态刚好到成熟点。建议直接选18000-19000元档的风冷版,阿迈奇M1A Pro+和TOPC T03都在这个区间,别为水冷多掏八千;走海外渠道的,零刻GTR9 Pro、铭凡MS-S1 MAX这两款同芯片机型也常被社区提起,有人用前者搭了全离线的本地AI栈。零刻官网铭凡官网

锐龙AI Max+395一年报:软件终于好用、整机涨了三成、192GB下一代20天后IFA预演——买还是等?

第二种,建议等的:需求没那么硬,纯粹是"想拥有一台本地大模型机器"。等9月4日IFA keynote之后再做决定——如果消费版400系列价格不离谱,395机型大概率要让位降价,那时候抄底更划算;如果400定价离谱,395的性价比反而立住了。等三周,换一个确定的判断,不亏。

第三种,别碰的:只想跑27B-35B级别模型的,24-32GB显存的方案(独显或者更便宜的NPU机型)便宜一半不止;纯游戏党,评论区说得直白:“一万五以上,买5070+9700X不好么”。知乎还有指望本地模型当全能Agent干活的,有折腾过几个月的用户泼了冷水:现在本地部署的agent,能稳定干好的也就是配个embedding和reranker。B站

第四种,算账党:有评论仔细算过,100W持续跑一天产出的token,折成API费用可能比电费还便宜。B站如果你每天调用量不大,云端API+数据脱敏的组合,经济上更划算。本地机器的价值在隐私、离线和无限次调用,不在单次成本。

接下来值得盯的三个信号

  1. 9月4日IFA keynote:消费版Max 400的定价和上市时间,这是决定395机型会不会跳水的关键;

  2. 内存合约价走势:DRAM单季涨了近六成,如果四季度趋稳,395整机价格才有松动空间;

  3. vLLM生态的后续版本:CIRU发行版目前适合"单流/双流+长上下文",多并发+长上下文还会剧烈衰减,官方也承认多流测试只覆盖到2K提示词。如果你有并发需求,先别把它当小型服务器用。

一句话总结:395迷你主机这一年是真的从玩具变成了工具,但它现在的价格,配的不是去年的自己,而是内存疯涨的行情。刚需现在就买风冷版,不刚需就把闹钟定在9月4日晚上——IFA会替你把这个决定做完。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章