九月的装机圈,钱的规则变了。
一边,是蓝戟那张8999元的Intel Arc Pro B65 TF,顶着"最便宜的32GB显存显卡"的名头,上手实测四天播放80万+;另一边,是英伟达DGX Spark——一台15厘米见方、128GB统一内存的小盒子,从创世版3999美元(国内约3.4万元)一路涨到官宣4699美元、整机奔4万,一个多月涨了接近20%,成了我见过的第一台"理财电脑"。知乎
而同一时间,大多数还在草稿里的装机单上,写着的依然是16GB显存的5070Ti。
这组矛盾在游戏里不存在,在本地AI里第一次出现:16GB显存被"官方淘汰"了。英伟达和微软刚给本地智能体(OpenClaw、Perplexity Portable Computer这些)定的一键部署门槛是24GB显存;上个月开源12小时冲上HuggingFace趋势榜第一的Qwen3.8-27B,Q4量化光权重就要17.1GB显存——还没算跑Agent至少要准备的128K上下文。
一、这个月到底变了什么:三组事实
1)Agent把"本地"变成了装机党的新需求。 GitHub上38万星的OpenClaw、数百万用户的Hermes Agent,加上NVIDIA在IFA 2026上官宣的RTX Spark桌面版10月出货、DGX Spark集群能跑DeepSeek V4-Flash——“让大模型7×24在你自己桌面上干活"这件事,从极客玩具变成了装机论坛的新论题。知乎它的硬件门槛不是"更快”,是"装得下"。
2)装机侧在挨刀。 DDR5的16G单条9月已经报到900+(金泰克长鑫颗粒渠道价),本地AI主机系统内存起步就是32G到64G,光内存比去年多掏三四千。显卡这边倒是涨不动了:渠道日报价直接写"8月A卡普涨10%-20%后销量难看,9月稳定为主",5060Ti 16G约5000、5070Ti约9300、5080约12000(9月2日渠道行情,波动按日)——注意,“涨不动"不等于"便宜”,5000元买到的还是16G,27B照样装不下。知乎
3)报价本身在打架。 9月上旬有人晒"内存暴跌800",同一周威刚总代的到货报价还是上午下午两个价,威刚还预测Q3内存闪存"将大涨";另一边,长鑫9月3日宣布LPDDR6全球首发量产、9月8日系统披露带宽+60%/功耗-20%的细节,B站那条首发新闻48万播放、4100多条互动。哔哩哔哩这一轮周期里国产高端内存第一次成了变量——虽然它眼下主要进的是手机和像小米AI Cube这样的新设备,还不是你的DDR5插槽。这篇文章不猜行情方向,只把路线摆清楚。

二、五条路线:钱花在哪,装的是什么
路线 | 代表 | 价格(现可查证) | 本地实测表现 | 硬伤 |
|---|---|---|---|---|
A. 游戏装机顺带AI | 5060Ti 16G / 5070Ti 16G | 约5000 / 约9300(9月渠道价) | 只装得下26B-A4B这类MoE,27B稠密模型OOM | 16G够不到24G门槛 |
B. 专业推理卡改装机 | 蓝戟B65 TF 32G(京东自营8999) | 8999 | Qwen3.8-27B在8K-64K上下文稳定22 tok/s;同场16G显存的5080(约12000)短上下文约10 tok/s、64K掉到约1 tok/s | 专业卡不主打游戏;生态比N卡折腾 |
C. 统一内存主机 | AMD 395/128G(铭凡MS-S1 Max 6月21599,7月行情两万到两万六);DGX Spark 128G+4TB(约3.4万→4万);京东在售此类超10款、两万到三万七 | 2.2万-4万 | 395调优后27B跑到20-36 tok/s(Ollama默认只有10);DGX官方定位单机约200B参数开发 | LPDDR带宽约256GB/s,短文本速度被同价N卡反超;内存焊死;DGX成"理财产品" |
D. NPU算力卡小主机 | 零刻SEi13 AI:i7-13620H+32G+独立M.2 NPU卡(24G专用LPDDR5、160TOPS) | 11895元起(7月上市价,IT之家/官方) | qwen3.5-9b约22.7 tok/s、35B-A3B MoE 16-23 tok/s,NPU满载时CPU占用约2%,预装100个模型 | 只能跑llama.cpp系推理,出图/视频无缘;整机价已接近"显卡+机箱"方案 |
E. 不买硬件 | 云API + 旧机复用 | DeepSeek V3约输入2元/输出3元每百万tokens;NVIDIA PAIR免费beta | 有5090机主n=5实测:本地H3视频5条0可用,云端单条可用约39元、混合流程约35元还要多花30分钟筛片 | 隐私场景受限;批量任务要接受排队 |

这张表里最扎眼的反常识在B行的对照组:长上下文推理上,12000元的5080输给8999元的B65T,不是算力输了,是16GB容量输了。B65和贵3000元的B70,厂商自己测的结论是27B以下、中小并发吞吐几乎一致(8卡vLLM口径,企业向,个人用参考有限)。换句话说,这轮买的是"装得下的资格",不是"更快的卡"。知乎
C行是另一种价格结构:小米8月24日发布会那台AI Cube——三颗自研玄戒芯片、80GB统一内存、约150W、目标本地部署120B级模型——传闻用的正是长鑫LPDDR6。小红书
工程机没定价,评论区已经在"不到一万就买"和"这玩意不便宜"之间吵了四百多楼。有人那句"我都不敢想,要是内存还是一年半以前的价格,这个玩意得有多香",基本概括了当下所有本地AI硬件的处境。小红书 不是设备贵了,是"每GB内存"这个过去二十年一直在降价的东西,突然成了涨价的主角。

三、三本账:算完再掏钱
1)装得下账。 27.8B参数×Q4≈17.1GB权重,再加128K上下文的KV缓存,32GB是入场券;只跑8-16B对话,16GB也够。先定模型,再定预算,顺序别反——今年"先装机再下模型"的人,最后都在Ollama日志里看显存溢出。
2)每GB价格账。 DGX Spark约312元/GB、395机器约169元/GB、B65T约281元/GB。三档差价买的都不是容量本身:DGX的溢价是CUDA生态(“1 PFLOP"还是FP4低精度营销口径,出图细节会打折);395便宜近一半,但要自己拉魔改版llama.cpp、打补丁焊参数,官方生态里它就是个"能跑”;B65T最便宜,代价是游戏基本别想。
3)回本账。 有395机主算过"21599元机器 vs 月付3000元的外包整理,7个月回本"——那是人力账。知乎纯算token差价基本回不来:云API输入输出每百万token个位数人民币,一台3万的机器跑五年也省不出3万的API费。本地部署的真实收益就三样:隐私(简历、客户资料不出门)、常驻(一个月几十块电费替你24小时值班)、不看额度。这三样你一样不用,就别买。
四、对号入座:谁现在花,谁等等看
只想让AI写周报、整理资料:云端够用,连内存都别急着加。
想挂常驻Agent、处理私密资料:24GB+是门槛。预算卡9千选B路线(8999的B65T),但接受它不陪你打3A;怕折腾驱动和命令行,选D路线那种预装模型库的整机——只是它11895起的价,已经站在"半张5080"和"395半价"中间,值不值全看你要不要那台安静的小盒子;抽屉里有台20系以上的旧电脑,先花零成本把PAIR装起来验证需求,再谈买不买。知乎
CUDA开发、微调、代码要部署到服务器:DGX Spark的贵有贵的道理——但"涨了20%"意味着你高位接盘的不只是内存。
以出图、AI视频为主:先把第三节那本账翻出来看。5090实测本地5条全废、云端39元一条可用,说明现阶段买最贵的卡不如先设计好工作流。
纯等等党:盯四个信号——RTX Spark桌面版10月首批定价(IFA上首批公布的还是笔记本,台式机价格一直没给,外媒已经开嘲"高到没人买得起");小米AI Cube的正式售价;长鑫LPDDR6量产之后,DDR5插槽内存的报价会不会松动;以及传闻9月16日就开打的"史上最早双11"。哔哩哔哩要记住过去三个月的教训:这轮行情里,“等大促"不等于"等低价”。

五、最后,说一句边界
B65T的22 tok/s来自媒体借卡单平台实测(LM Studio),厂商的8卡吞吐是企业口径;DGX"约3.4万涨到奔4万"来自用户晒单与多方转述,未见统一公告;AI Cube的一切参数出自发布会,价格是谜;5090那组视频实验n=5、单镜头,只能定方向,不是价目表。证据到哪儿,结论就到哪儿——但这不妨碍大方向成立:装机圈二十年"显卡是预算中心"的常识,正在被"模型装不装得下"重新排序。先回答你要装多大的模型、多长的上下文、它7×24替你干什么,再决定钱进五条路线里的哪一条。