9月27日刚刷到一条有画面感的新闻:黄仁勋在SpaceX星舰基地,把一台已量产的DGX Spark亲手递给了马斯克。而在地球这边的渠道柜台里,这台小盒子的身价正悄悄变脸。微博
往前翻几天:知乎9月21日挂出的问题里,现货价是33550元。8月25日有人晒单两台刚收货的Spark"每台涨了五百五",9月初又有人喊"半年不到,涨了4500?!后悔没多买一台"。小红书上一条渠道帖把价格链摊开:官方定价29999 → 渠道报到34899 → 有些渠道直接喊到39999。知乎微博小红书
一台巴掌大的桌面AI主机,炒出了理财的味道。但它的评测区里又同时挂着两个极端:官方合作伙伴实测跑出120B模型32.81 tok/s,而玩家自己跑稠密模型时生成速度连10 tok/s都不到。一边是"桌上超算",一边是"大号玩具"——想为本地大模型掏这3万块,或者手里已经有台在纠结出不出,先把下面三本账对完。

第一本账:价格账——这波涨价,一半是真的,一半是话术
把9月以来的晒单按时间排开,涨价轨迹非常清楚:
时间 | 信号 | 出处 |
|---|---|---|
8月25日 | 两台到手当天每台涨550 | 微博晒单 |
8月26日 | 官价29999→渠道34899→个别39999,"狼来了"争议 | 小红书渠道帖 |
9月4日 | “4月份买的,半年不到涨了4500” | 微博 |
9月21日 | 现货33550元,知乎挂出问题 | 知乎 |
渠道帖里那个判断框架比较清醒:官价短期内大幅暴涨不现实,但渠道溢价会持续存在,"喊涨促单"更是经销商惯用手段。小红书
它拆的买家画像也值得看:高校AI实验室、数据不能上云的私有化部署、做Agent和小模型的团队、加少数个人开发者——刚需在,但远没到当年抢4090的规模。换句话说,这台机器的溢价是窄而硬的刚需撑起来的:NVIDIA给渠道的量不大,而这些买家不会等。小红书
还有一条容易忽略的背景线:美光停产2GB颗粒、消费级内存收缩,野村这周还在喊芯片短缺加剧——Spark的128GB LPDDR5X统一内存正好踩在这条涨价链上。就算渠道不喊涨,它的物料成本也下不来。哔哩哔哩
第二本账:性能账——"32 tok/s"和"个位数"都是真的,因为它是两台机器
这是全网评测吵得最凶的地方,拆开其实只有一个变量:你跑的是MoE还是稠密模型。
知乎实测帖(9月23日):DGX Spark的算力约为RTX 5090的三分之一,128GB统一内存带宽只有273 GB/s;跑稠密的Qwen3.8-27B不开投机解码,生成速度个位数,131K上下文的首字延迟约4分钟。知乎
另一位入手用了一个多月的车主(知乎9月19日):跑MoE架构的Qwen3.6-35B-A3B,llama.cpp下约60 tok/s,“这一个多月用下来,日常任务完全够用”;他还提醒,稠密27B得靠开MTP投机解码才能把速度拉回到20 tok/s上下。知乎
超擎数智9月24日的TensorRT-LLM实测:跑120B的GPT-OSS(MoE),32.81 tokens/s,128GB装得下就是能装得下。知乎

那位博主还给了一笔好算的粗账:一个27B稠密量化模型约35GB,生成每个token要把参数过一遍,273 GB/s ÷ 35 GB ≈ 7.8次/秒——带宽本身就写死了稠密模型的理论上限。仓库够大解决"装得下",物流通道宽不宽才决定"生成快不快"。知乎
所以同一张桌子上,这台机器有两种面孔:
拿它当"聊天提速器"、指望它秒吐万字稠密长文的人——失望是注定的;
拿它跑MoE小激活模型、常驻双模型(实测把35B和27B同时加载到内存中后还剩不少)、或者吃长上下文Agent工作流的人——它最值钱的恰恰是别人嫌慢的那个阶段:prefill。几十万字上下文反复喂给智能体,换来的是7×24挂在桌上、不限量、不出隐私,这跟5090"快但装不下"正好是一对此消彼长的题。

第三本账:持有账——散热、集群和"闲鱼幻觉"
买之前没人告诉你、买了之后人人都在折腾的三件事。
散热是真实的坑。 微博9月23日那条18赞的帖子说得很直白:DGX Spark散热设计糟糕,玩家社区已经开发出各种用空气净化器强制送风的3D打印罩子。评论区更分裂:有人说华硕版顶着85度跑一天没问题,也有长三角用户哀叹"夏天气温接近标称的运行温度上限"。想长期挂机的,先想清楚你桌边的季节温度。微博
它的正确形态可能不是"一台",而是"几台"。 社区共识在快速收敛:2台互联是最省心的甜点档,买第三台之前一定要确认你要跑的配方是否支持3x,4台就是桌面小集群。9月25日之后还有人晒16台DGX Spark跑Kimi-K3的方案,微博上"GB10+LPDDR5这个幽默组合是垃圾,但CX7的存在改变了这一评级"的说法也有人来劲——多机叠带宽、叠内存、叠吞吐,这是它和"再买一张5090"完全不同的扩展思路。知乎小红书微博

警惕"理财产品"幻觉。 它跟5090D那种二手硬通货不是一回事:小红书上7月就冒出DGX Spark算力出租的帖子,主打多机集群、私有化推理按周租——手里有机的回血路径是出租这台生产工具,而不是挂闲鱼。真到渠道补货那天,"涨了一万"的报价不会变成你的回收价,"喊你快买"的人也不会来接盘。小红书
四种人,对号入座
数据不能出域的私有化需求 / 长上下文Agent玩家:该买。官价29999附近能拿就下手,超过35000的溢价部分,本质是在替经销商的"促单话术"付费——多问两家渠道,现货没有传说中那么稀缺。
就想本地跑得比手机快、主要用稠密大模型聊天写稿的:别买。带宽天花板摆在那,同样的钱租云token或攒台32GB显存的机器更对症;社区那句反方评语值得记住——“要生产力还是得云token”。微博
手里已经有机、纠结出不出:先算出租能不能覆盖月折旧,能就留;不能,又确实用不上多机扩展,趁现在渠道溢价在高位出掉也不是坏选择——这是它少有的"卖方占便宜"窗口。
纯等等党:值得等的不是它的降价,而是三件事——RTX Spark笔记本开卖前后本地AI硬件会多一批新选项和二手预期、NVIDIA承诺的固件与软件更新(官方评测明确写着高于FP4精度的模型仍在持续优化)、以及内存涨价周期什么时候松口。
接下来盯四个信号就够了:渠道现货价回不回落到3万以内、补货节奏、TensorRT-LLM对稠密模型有没有带宽层的实质改善、二手回收价(注意,是回收价,不是喊价)什么时候开始松动。
这台小机器值不值3万,跟炒不炒没关系——它像当年所有"生产工具"一样:用得着的人嫌它贵也得买,用不着的人白送都嫌占地方。先把账对完,再决定是掏钱、加购物车,还是干脆继续用云。