10月2日,英伟达正式官宣了DGX Spark的64GB版:$4,999,预计10月23日开卖——距离今天正好12天。从规格上看,它和现有版本的区别只有内存容量的减半,其他规格都完全一样,内存带宽、NVLink、200G网络都没动。知乎
消息一出,评论区两个阵营当场撞上。手里有128GB首批机器的车主在对"韭菜账":去年发布时$3,999,今年2月涨到$4,699,现价已经调到了$6,950,比128GB首发价整整高出一千美元。这波调价被归因于全球AI内存短缺带动的整体行情暴涨,而不是厂商单纯背刺。知乎哔哩哔哩
车主的情绪也烧到了台面上,评论里最不客气的一句是:这年头穷鬼的钱黄仁勋也看得上?观望党打的算盘则完全相反:64GB新版定价,比128GB的现价便宜了快$2,000。哔哩哔哩
我在这12天里替你数的不是营销号,是交付一年后的车主账本。把近两个月B站、知乎、小红书上15条以上的DGX Spark车主实测帖汇总起来——从10.3万播放的整机长测,到27个赞的救砖帖——车主对完的账不止价格这一笔,是摞着的三笔:价格账、速度账、折腾账。
第一笔:价格账——$6,950是真的,"64G更划算"是个错觉
先把行情钉死再谈错觉。国内这条线,有车主给四台组网做的预算假设是每台约4.18万元,并且作者自己标注了"并非国内实时成交价"——引用时请连这条注释一起读。知乎
真正要算的是门槛账。评论区最扎心的一条不是情绪,是算术:冲着双机扩展部署全参数大模型去的人,128G版本双机能凑出256GB容量、网上优化后可以部署DS4.1,而64G容量大减、达不到门槛。哔哩哔哩
能装什么、装不下什么,搬运的Cloud Codes实测给了边界:64GB显存刚好能跑Qwen 27B或压缩版Flash-Next编码模型,但DeepSeek V4这类超大模型将直接爆显存。哔哩哔哩
同价位还有对手在旁边站着:64GB版Mac mini M5 Pro不仅便宜约$2,000,内存带宽还反超Spark。而两台64GB Spark合计近$10,000,凑出的128GB反而不如直接上单台128G或256G Mac Studio——这已经越过想要"双256G跑V4.1"那批人的预算线了。哔哩哔哩
64G也不是全无是处:知乎解读文算过,它跑Qwen3.8 27B的NVFP4版时,还能给上下文和KV Cache留出40多GB内存。所以这笔账的第一判断依据不是"比128G便宜$2,000",而是你派给它的活,参数量够不够它装。知乎
第二笔:速度账——“本地私有模型的token也会用完”,但真凶不是额度
10月9日,知乎车主guoyong zhou发帖:Hermes Agent挂着本地Qwen分析一篇长文,分析到一半,Agent给了他一个提示:用完了所有Token?他的第一反应和很多人一样:模型就装在自己机器里,怎么还有"Token余额"?知乎
拆开看,报警的机制跟"余额"无关:模型推理用掉的,是这一次允许生成token的上限——像这个月工资花光了,只能等下个月;Thinking过程中产生的推理token,和最终答案抢的是同一块上下文空间。本地AI给你的"无限",是不用买额度,不是单次无限生成。知乎
再算单次生成到底要多久。知乎车主虞大胆9月23日的27B实测给出的数:对内存带宽不行的这类设备,开MTP之后速度来到20 tok/s左右,上下文变长也不会掉得太厉害。而一旦不启用MTP,上下文变长后生成速度不到10 tok/s、只剩个位数,原因就一条:内存带宽不行。拿这两个数除一除:想让它一口气生成十几二十万字,按小时起步是物理决定的,不是设置问题。知乎
同一批机器上换个模型,账目又会变。小红书车主改之理的部署实测:同样nvfp4、启用Dflash加速,单线程Qwen3.6的35B大概80 token/s,27B约40 token/s,并发16以上效率更好。另一位车主Kagami的横向对比更扎心:“同样的模型好歹能跑 79tokens/s 这玩意儿居然才 27 tokens/s”——她拿来对照的是RTX 4070。小红书小红书
但单台不是唯一解。10月8日虞大胆转述的国外玩家方案:四台Spark组成环形集群跑DeepSeek V4.1-Flash,32并发代码请求下峰值生成速度达到494 tokens/s——注意这是峰值,普通文本并发峰值约280。小红书上有车主更直接,晒的是16台Spark的kimi-k3测试,附tp2、tp4和tp8的分级方案。速度账的完整结论:单台20-80 tok/s是常态区间,提速的路线是叠机器,而每叠一台,第一笔账要重算一遍。知乎小红书
第三笔:折腾账——翻车帖和真香帖,是同一批机器
翻车这边,样本很具体。Kagami在9月1日的记录里写明白:国内网络环境给这台机器做升级花了一整天,过程中还有一台变砖,她自己也反问普通用户能不能玩得转。同帖里还有两个数:原厂固件刷写本身约10~20分钟,而一个17G的模型,下载了8个小时。小红书
散热是另一位车主改之理的实测重点:CPU/GPU最大140W,实际单机使用场景80W顶天了;但低功率没换来安静——满功率温度直逼85℃,外壳烫手根本没法摸。评论区里还有借朋友机器"改个BAT改了一小时烫得要死"的体验者,和9月10日发"散热改善"帖、加完散热片才肯继续用的车主。小红书
真香那边同样具体,而且播放量更高:野生的装机宅10.3万播放、401条评论的整机长测,结论是"折腾起来没那么简单",但Qwen3.6、DS V4Flash、生图全跑通了;梅加雨的双机部署DS V4.1拿了382个赞;林亦LYi干脆把双机搬去酒吧做分布式,57.8万播放;FUN科技的双机"交火"实测33.9万播放。两拨人跑的是同一台机器,分水岭不在运气,在你是否预留了折腾的时间成本。
适配:这12天里,三类人三个答案
双256G跑DS V4.1的门槛党:别看64G首发,门槛账已经替你算死了——两台64G凑不出256G,284B/320B两个模型它单台都装不下。
单台27B干活党(编码、知识库、夜间批处理):64G的$4,999是这条赛道的合理入场券,但要先接受两件事:速度账里20-80 tok/s的现实,和折腾账里的时间成本。它适合"活派下去、早上验收",不适合"边问边等回话"。
"即买即用、不想折腾"预期党:变砖、8小时模型下载、85℃烫手这三条就是给你写的反面教材。Spark不是家电,这个预期下,Mac mini或API路线更省事。
观望党:盯三个信号就够了——①10月23日64G实发价与现货供应;②128G现价走势,内存短缺叙事不解除,$6,950就不是顶;③64G首批到手后,带宽和散热问题是否被再次复现。车主的账本还没对完,你不用急着去当下一页。
一句话收口:价格账涨的是行情,速度账卡的是物理,折腾账花的是时间。$4,999那张64G门票看起来便宜,但它砍掉的恰恰是决定"能派什么活"的那一半内存。掏钱之前,先查你的活记在哪一本账上。