开学季,B站 UP 主牛顿顿顿发了一期视频,开头就是后台被问爆的两个问题:我想认认真真学AI,但是AI进化太快了,我该买什么配置的电脑呢?要很贵的配置才能学好AI吗? 这期视频8.6万播放、近7800赞,评论区一堆学生党和转行党在报预算等答案。哔哩哔哩
这个问题放在今年9月问,比以往任何开学季都要贵、都要乱:
一边是显卡还在涨。9月19日的显卡价格日报里,5080京东单日暴涨1500。 9月20日另一份日报里,5060到手2719、9070 GRE到手3499,甜品卡看着还行,但稍微往上够一点就是另一番行情。 连英伟达自家的入门开发板Jetson都在7月全线提价,部分型号涨幅直接翻倍。哔哩哔哩哔哩哔哩微博
另一边是"AI主机"扎堆上场。9月18日,AMD 锐龙 AI Max+ PRO 495 国内首秀,192GB统一内存、55 TOPS NPU,联想、铭凡、极摩客等9款新品同台亮相。 9月20日,天钡NEX395迷你主机12999元的测评也出来了,这台64GB统一内存的小盒子,就是"冲着AI去的"。哔哩哔哩知乎
一边涨价、一边上新,中间还夹着小红书上"两台DGX Spark跑满血DeepSeek,7个月回本?"这类让人心痒的帖子。今天这篇就把9月20日这个时间点能查到的真实价格、真实实测速度和真实翻车记录摆在一起,替你把这笔账算完。
一、先摆价目表:9月的"本地AI硬件"到底什么行情
不绕弯子,直接上这周能查到的数字(均为个人卖家/第三方报价,不同渠道有浮动):
游戏显卡路线:5060到手约2719元(8GB显存)、9070 GRE约3499元;5080上周京东暴涨1500;有玩家晒单,首发7700元入手的5080,现在二手能卖到一万多。小红书
大显存旗舰:有小红书玩家自述2.8万元买入5090D 32GB,"10W投资什么时候能赚回来"是他的原话——因为他后面又花7.6万买了两台DGX Spark。小红书
统一内存小主机:天钡NEX395(AI Max+ 395、64GB)12999元;同芯片128GB整机,8月的行情讨论给价"2.2万上下"。 而老用户懊悔的原话是"眼睁睁从1w5涨到2w2就应该买它十台"。知乎知乎
英伟达"小金砖":DGX Spark 128GB,淘宝真实在售价按最近一篇部署帖的数据,两台共73499元,折合单台约36750元。 更魔幻的是二手,有买家直言对方"卖的价格比全新未拆还贵"。小红书小红书
隔壁苹果:Mac Studio M5 Ultra 256GB版本,博主晒单"到了8万"。小红书

看清楚这张表你会发现一个反常识的事实:今年9月买大内存AI设备的理由,有一半不是AI,是内存。Jetson翻倍涨价的官方解释都没有,第三方分析指向的都是DRAM涨价;395主机从1.5万涨到2.2万,涨的也是那128GB统一内存。换句话说,现在买AI主机,某种意义上是在"锁定内存价格"——这也是为什么二手装好软件的机器敢比全新贵:它锁的是上个月的内存价。
二、"装得下"和"跑得快"是两回事:新手最容易踩的坑
价目表里128GB、192GB、256GB这些数字很唬人,但先泼一盆冷水——这是所有本地AI新手最重要的一课。
一位在DGX Spark上折腾了一个多月LLM的知乎作者写得很清楚:跑Qwen3.6-35B-A3B(MoE架构)只占用约22.8GB内存、token生成速度约60 tok/s,日常够用;但换成27B的稠密模型Qwen3.8-27B,速度就掉到20 tok/s左右。 他推导得很直白:27B量化模型约35GB,273÷35≈7.8,带宽本身就给出了7.8 tok/s量级的理论上限——“仓库够大,只解决装得下的问题;物流通道够不够宽,才决定生产设备能不能吃饱”。知乎

对照着看AMD阵营:AI Max+ 395主机跑Qwen3.8-27B实测30+ tok/s,比Spark快一半,因为395那套统一内存带宽是256GB/s起步、加上模型调度差异,同样"装得下"的前提下速度更好。 而395的代价是满载功耗——有实测显示本地模型一跑起来,GPU功耗从10W瞬间飙到130W左右,夏天这小盒子就是个小暖炉。知乎知乎
而传统显卡路线是反过来的:GDDR显存带宽高出数量级,速度快,但32GB就是32GB,装不下就是装不下,想扩只能再买一张卡。三条路线没有绝对赢家,只有取舍:
路线 | 代表 | 内存/显存 | 实测速度参考 | 适合 |
|---|---|---|---|---|
独显GDDR | 5090D 32GB(2.8万) | 32GB | 快,但装不下百GB级模型 | 视频生成、训练微调 |
AMD统一内存 | NEX395/395整机(1.3万-2.2万) | 64-128GB | 27B稠密模型30+ tok/s | 预算敏感的大模型玩家 |
英伟达统一内存 | DGX Spark(约3.7万) | 128GB | 27B约20 tok/s,MoE可达60 tok/s | 生态最全,愿意为CUDA付溢价 |
苹果统一内存 | M5 Ultra 256GB(8万) | 256GB | 静音省电,生态封闭 | 不折腾、预算无上限 |

顺便说一句"堆台数":三台DGX Spark用200GbE网线三角直连,跑DeepSeek V4.1-Flash的实测数据是单流28.5-35.4 tok/s、4并发67.5-75.8 tok/s。 两台EBOX G95(395小主机)级联能凑出240GB"显存池",跑284B的DeepSeek V4-Flash。 堆台数解决的是"装得下更大的模型",不是让速度翻倍——多机之间还有通信开销。别被"集群"两个字忽悠着多下单。知乎哔哩哔哩
三、"7个月回本"的账,别直接抄
小红书上最火的两个本地AI回本帖,值得逐条拆:

第一个:"两台DGX Spark,总投入73499元,跑1M上下文的满血DeepSeek V4 Flash,约7个月回本。"注意作者自己写在结尾的免责声明——“约 7 个月回本是 24×7 满载 + 100% 售出的理想上限,不是收益承诺”。 翻译一下:你的算力要7×24小时不间断跑满,并且生产出来的每一个token都能按市价卖出去,一分不剩。小红书
第二个更狠:“一台36600元的DGX Spark接MiniMax H3视频生成的活,网上说0.7个月回本”——原帖作者亲自鉴定,这笔账数学没错,但算的不是官方那件货,是一笔假账。小红书
这两个帖子其实代表了本地AI设备买家的真实心理:花几万块买"算力资产",幻想它像矿机一样回本。但现实是:接单渠道不稳定、模型迭代比硬件折旧还快、满载电费和散热都是成本。能让你回本的从来不是机器,是你已经拿在手里的订单。先有活,再买设备;没有活,这就是台最贵的聊天机器。
四、五类人对号入座
① 纯入门学AI的学生党:一分钱不用花。 学机器学习基础、调API、跑入门demo,云服务和免费额度完全够。知乎上一个高赞观点说得很实在——偶尔问几个问题当然是云端便宜,你花几十块钱订阅用完就走,没必要买一台几万元的设备。 等你真的卡在"需要本地跑"那一步再买不迟。知乎
② 想折腾本地部署的个人玩家:16GB显存或二手395起步,别上头。 你折腾的80%问题(装环境、量化、推理框架)在16GB显卡上都能学到,成本可控。真被大模型迷住了,蹲一台没有跟涨的128GB统一内存整机——但要接受27B稠密模型20-30 tok/s的速度,以及满载130W的功耗。
③ 隐私刚需党(律师、财务、医疗、企业内部资料):这才是统一内存主机的基本盘。 天钡那篇测评里一句话糙理不糙——重要资料的企业,一定要本地跑,不要用在线AI,因为你的资料一定会泄露的。 对你来说这不是消费决策,是合规成本,12999元起的64GB统一内存是最低门票。知乎
④ 想接AI活赚钱的创作者:把回本账按五折算。 24×7满载+100%售出的理想上限,你按50%负荷、70%售出率折算,还能接受再下单。视频生成优先选大显存独显(5090D级别),文本/Agent类优先统一内存。别忘了那位"10W投资什么时候能赚回来"的博主,他现在还没回。
⑤ 围观等下一代:盯两个信号。 一是AI Max+ PRO 495那批9款新机的国行定价——如果192GB版本定价激进,会直接把现在2.2万的395打下来;二是内存价格拐点——整机价格跟着内存走,内存不跌,AI主机不会便宜。
最后
9月20日这个节点,"学AI买什么电脑"的答案其实很清楚:先想清楚你要跑多大的模型、多快的速度、给谁用,再回头看那张价目表。装得下看内存,跑得快看带宽,回得了本看订单——三件事分开想,钱才不会白花。
接下来值得继续盯的:495新机国行定价、内存现货价、以及DeepSeek V4系列在Spark上的社区优化进度(deepseek-v41-flash-spark这类开源仓库的更新速度,比任何官方宣传都真实)。