这个月,三种"不用插显卡"的 AI 主机前后脚撞到一起。 9 月底,第一批搭载锐龙 AI Max+ PRO 495 的迷你 AI 工作站上市;10 月 8 日,华硕基于 NVIDIA RTX Spark N1X 的 ProArt 创 16 登场,官方口径是"全球首款智能体电脑";而更早出场的 DGX Spark 现货已经涨到 33550 元,官网无货。 再叠加 9 月 22 日云栖大会上通义千问负责人首曝的 Qwen4 家族——Max、Flash、Plus、27B 四个名字,其中 Qwen4-27B 摆明了是给本地部署玩家留的——但权重没发、日期没讲。 "现在掏钱还是再等等"这个纠结,正好砸在这个十月中旬的窗口上。知乎哔哩哔哩哔哩哔哩
先把产品清单摆平,别被发布会口径带节奏
锐龙 AI Max+ PRO 495 系 | NVIDIA RTX Spark(N1X) | DGX Spark | |
|---|---|---|---|
形态 | 迷你工作站/笔记本,联想、超聚变、铭凡、极摩客等 9 款 9 月 10 日首秀,预计上市超 20 款 | 10 月起陆续开卖,OEM 含华硕、联想、宏碁、微星、戴尔、惠普、Surface;首款明确档期是 10 月 8 日 ProArt 创 16(128GB 统一内存、12.9mm、1.77kg、99.9Whr) | 已有现货,33550 元、官网无货 |
架构 | Zen 5 全大核 16C/32T 5.2GHz,Radeon 8065S(RDNA 3.5,40CU),NPU 55 TOPS | 20 核 Grace(Arm)+ Blackwell 6144 CUDA,标称 1 PFLOP | GB10,已跑一年社区验证 |
内存 | 最高 192GB 统一内存,VGM 可变显存最高可拨 160GB 当显存,官标"首款本地跑 300B 的 x86 客户端处理器" | 最高 128GB LPDDR5X(低配版 CUDA 缩到 5120、内存上限更低),本地模型上限 200B 级、官方主推 120B | 128GB |
系统 | 原生 x86,Windows + Linux 双支持 | Windows 11 on Arm | DGX OS(Linux) |
清单本身是官方和合作伙伴公布的硬数字,没什么可吵的。 问题出在清单之外的三个口径差。知乎

第一个误会:把"装得下"当"跑得出"
192GB、“本地跑 300B”,这些是容量语言,不是速度语言。 上一代 395 平台已经把坑演示过一遍了:128GB 统一内存看着豪华,但内存带宽只有约 256GB/s、GPU 算力约 59.4 TOPS,被玩家社区总结成一句"除了显存什么都没有"。 同一个 Qwen3.8-27B,在这台机器上用 ollama 裸跑约 10 tok/s,换社区适配版 llama.cpp 约 20 tok/s,再上 Strix 特调的 ROCmFP4 权重加 MTP 投机解码,实测冲到约 36–40 tok/s——一个模型,三个速度,差的全是带宽和框架,不是容量。知乎知乎知乎
更早的例子也类似:gpt-oss-120b 在这台机器上 decode 从 33 到 47.5 tok/s,是 llama.cpp 社区拼了两个月适配抠出来的;上个月 halogen 引擎出来,才有人摸到 800 prefill / 30 decode 的体面数字。 代价是 Linux 限定、建议整机进入无头服务器模式,用另一台电脑远程调用。微博上做过本地 AI 评测的玩家有句话说得直白:一个 toks/s 背后限定条件太多了,上下文长度、是否带图、并发方式、量化配方、缓存配置,条件不齐的速度数字互相不可比。知乎微博

所以 495 发布"300B"的时候,你该问的是:27B 级模型在这台机器上,特定框架、特定量化、特定上下文下,decode 到底多少。容量决定这台机器有没有资格上桌,带宽和框架才决定它一天能给你干多少活。而 Qwen4-27B 真发权重的那天,你也不会遇到"装不下"的问题——现在 27B 已经有量化到 8.4GB 的版本。 你遇到的是 395 那个老问题:能不能跑快。哔哩哔哩
第二个误会:RTX Spark 卖的是芯片,附赠的是转译成本
RTX Spark 的参数表很能打:20 核 Grace + 6144 CUDA,标称 1 PFLOP。但它跑的是 Windows on Arm。NVIDIA 这边 CUDA Toolkit 13.4 开发者预览版已为 AArch64 原生重建、宣称 x86 的 CUDA 二进制可免重编译直接跑,微软 Prism 转译也在改善——方向是真的,代价也是真的:转译有性能损耗,企业安全代理、行业外设驱动、硬件加密狗这类内核级驱动转译不了,部分游戏反作弊可能直接躺平。个人玩家可能等得起生态补齐,但如果你是"机器要接单位业务软件"的人,这些兼容性风险就是真金白银。知乎

反过来,495 的 x86 原生和一年 35+ 款 OEM 产品攒出来的工具链、方案库,是 AMD 从 2025 年 CES 发第一代 Strix Halo 起单挑这个品类攒下的复利——这句话本身就出自一篇偏 AMD 立场的媒体横文,"这是AMD一年多生态经营的复利"是它的原话。 所以数字可以信,但"谁更有优势"四个字,建议等 10 月第三方实测再判。微博讨论里也有个有用的提醒:RTX Spark 笔记本形态本来就不谈多机高并发,别拿 DGX Spark 双机 ConnectX-7 跑 DeepSeek 那种 1700 prefill / 75 decode 的场面去要求一台 1.77kg 的笔记本——机器和机器解决的问题不同。知乎微博
第三笔:等还是买,看三条日期线
Qwen4-27B:云栖只公布名字,“在训练"不等于"已发布”,发权重没有日期。 如果你等的是"Qwen4 首发本地跑分",那现在买任何盒子都是在旧模型周期里做决定。哔哩哔哩
RTX Spark 实测:10 月 8 日 ProArt 创 16 只是登场,第三方速度表要等开售后;10 月速度表出不来,双十一对它打折也没有参照系。
495 首批:9 月底上市、超 20 款 SKU,第一批量产机的散热调度和驱动成熟度,按 395 的历史经验,要 1–2 个月社区才会交出一份可信成绩单。
另外一条背景线是价格:二手 3090 半年涨过 48%、DGX Spark 从 36888 跌到 2.1 万又涨回首发附近。 "等降价"这个策略在这个市场里最近半年经常是亏的。微博那条 657 赞的粉丝投稿问得很实在:电脑小白想买一台能兼顾游戏和本地部署 AI 的笔记本,但最近电脑一直在涨价,不知道现在入手划不划算、要不要等双十一。 评论区吵的就是这个:等,有踏空成本;买早了,有驱动和转译的踩坑成本。知乎微博

四条路,对号入座
已经有 x86 工作环境、要把智能体工作流现在跑起来的人(企业、接单位软件、私有知识库):盯 9 月 10 日首秀的那批 495 整机,但下单前向销售要三样东西——这台机器跑 27B 级模型的实测速度(注明框架/量化/上下文)、Windows 和 Linux 双系统支持、显存分配上限。拿不出来就再等等首批评测。
就想尝鲜"智能体电脑"叙事、机器主要干活不跑高并发的个人:可以等 10 月 8 日 ProArt 创 16 的第三方实测,重点看转译损耗和你想用的软件在不在 Arm 上活得好。
预算 3 万+、要单机 NVIDIA 全家桶:DGX Spark 现货 33550 且官网无货,第三方渠道价随时在动,它已经不是"等新货"的理由了,要么接受溢价要么归到第 1/2 类里等。哔哩哔哩
低频使用、主要是聊天和写文档:上面三条都不适用。小红书 9 月 26 日那篇"盲目追求本地部署是本末倒置"说得在理——先数清楚你每周真需要多少 token,跑不满回本线的配置,都是给桌面添一台耗电的摆件。小红书
值得继续盯的信号
10 月中旬前,三件事出结果就够你做决定:Qwen4-27B 的权重页有没有挂出来;RTX Spark 首台机器的第三方速度表(有没有人愿意按全条件报数);495 首批用户交出的散热与 ROCm 成绩单。三条里有两条落地之前,任何一个"现在买最划算"的说法,都值得先过一遍上面那笔带宽账。