RTX 5090一周涨4000元、老3060都没放过:想跑本地大模型,显卡买、等还是租?

源自16位全网作者

07:20

这几天关注本地大模型的人,应该已经感受到一种被两头夹击的滋味。

今天(8月17日)零点,DeepSeek的涨价正式生效:V4-Flash输出从2元涨到9元,V4-Pro从6元涨到27元,缓存命中输入一口气涨了11倍。微博不少人本来打的算盘是"API再贵我就转本地",结果回头一看,"本地"的门票也在涨价——显卡已经涨到一天一个价了。

这轮显卡涨价有多猛

先把各信源的数字摆出来。时代周报7月底实地走访华强北:RTX 5060 Ti 8GB从2800元涨到3400-3500元,RTX 5070从5000元左右涨到6000元左右,RTX 5090系列从30200元涨到34000元上下,一周涨了约4000元。时代周报知乎上的硬件价格跟踪更激进:RTX 5070从4500-5000元涨到6000-6500元,RTX 5080从8000元左右涨到接近12000元,两天普涨约三成。知乎

不止显卡。16G DDR5内存从去年的300-400元涨到现在千元以上,16G DDR4从200-300元涨到超600元,固态硬盘批发价也接近翻倍,今年暑假已经被装机商称为"最贵装机季"。时代周报老卡也没躲过:连RTX 3060 12GB都在跟涨,RTX 5060一周涨了800元,涨幅超过三成。知乎

导火索很明确:7月24日,英伟达向下游AIC厂商发出新一轮GPU套装(GPU+显存芯片)涨价通知,而且GDDR7和上一代GDDR6都在涨价范围内——这意味着连老卡的成本端也被波及。时代周报通知之后,各大品牌工厂干脆"封仓"暂停批量出货,华强北商户说"有钱也拿不到货"。知乎部分柜台干脆取消了早晨报价,改成随行就市,平均每天涨500-1000元。

RTX 5090一周涨4000元、老3060都没放过:想跑本地大模型,显卡买、等还是租?

二手市场同步躁动。8月17日,转转平台因给一块七彩虹RTX 5090 D V2开出13500元回收价被骂上热搜——这个价比转转自己平台上在售的二手RTX 4090(标价约19938元)还低6400多元。微博博主后来解释,片子是7月淡季拍的,没料到8月行情剧烈反弹。一周之间,连回收价都追不上行情了。

为什么这轮和矿潮不一样,等等党的老经验可能失灵

很多人的第一反应是:2021年矿潮不也这样吗?当年3080从5500元被炒到16000元,2022年中就跌回5500元,二手卡两千块,等等党大获全胜。知乎但这轮涨价的驱动因素不一样。矿潮是需求端炒作——挖矿需求说没就没;这轮是供给端的产能大挪移。

最直接的证据是HBM(AI芯片用的高带宽内存):单颗HBM消耗的底层DRAM晶圆产能相当于3-4颗标准DDR5芯片,它如今吃掉全球约25%的DRAM晶圆产能,毛利率60%-70%,而传统内存毛利率不到20%,存储原厂没有理由不把产能押给AI。知乎

供给也是刚性的:新建晶圆厂要18-24个月,2027年的HBM产能已被预订一空,多方判断这轮存储涨价至少持续到2026年底,高景气可能延续到2027年。时代周报

不止DIY市场在承压:小米17系列8月2日集体调价,三星S26系列国内普涨1000元,华为余承东也承认Pura 90系列单机成本因供应链涨价增加了1000-1500元;连苹果想给Mac导入长鑫存储的便宜内存,都被美方直接划了红线。知乎这轮涨价是全球性、结构性的。

说白了:指望像矿潮那样"暴跌回原点",风险很高。没人能保证永远涨,但这一轮"半年内回落"的概率,明显低于以往任何一轮。

回到正题:这些钱到底能买来多少性能

跑本地大模型的人买卡不是拿来供着的。以最近最热的Qwen3.8-27B为参照(上周开源,原生262K上下文,GGUF量化从2-bit到BF16都有),社区实测速度大致是:5090约157 tokens/s,3090约53 tokens/s,170HX矿卡约43,2080 Ti 22G魔改卡单卡约39.5,高端Mac约30。哔哩哔哩但Mac mini M4 32G只有5-6 tokens/s,属于"能跑难用"。微博

光看速度还不够。这一代模型的突出特点是思考链特别长。社区实测,32G显存机器跑Q6量化版,算一道线段距离问题,25 tokens/s的输出,足足思考了30分钟、烧掉50K上下文。哔哩哔哩有人让2080 Ti 22G写个坦克大战小游戏,"雷霆大思考"也要30分钟。所以真实体验≈速度×显存×是否开MTP推理加速。显存不够,模型可能思考还没结束,上下文就先满了。

RTX 5090一周涨4000元、老3060都没放过:想跑本地大模型,显卡买、等还是租?

也有把性价比榨到极致的玩法:有人收了两张2080 Ti 22G魔改卡用NVLink互联,vLLM跑Qwen3.8-27B的FP8量化,权重30G左右,开MTP后输出约80 tokens/s,上下文能拉到128K,被机主称为"性价比最高的本地推理机"。小红书代价是双卡整机功耗不低,电源和电费都得算进账。

RTX 5090一周涨4000元、老3060都没放过:想跑本地大模型,显卡买、等还是租?

这也决定了花钱的逻辑:优先买显存,而不是追新旗舰。

三条路,对号入座

路线一:刚需高频——买,但别追新卡高位。 如果你天天跑Agent、写代码,等待的成本比涨价更高,那就买。原则是避开新卡泡沫顶:优先二手大显存卡,比如3090 24G、2080 Ti 22G魔改卡。二手也在涨,但涨幅普遍小于新卡的30%-40%。设好预算上限,超线就降级去租。魔改卡、矿卡的风险说在前面:无官方保修、魔改显存存在故障率,知乎上有人直言4500元的4070 Ti Super小黄鱼货"是矿卡翻新"。知乎不懂行的建议找人验卡。买卖之前务必查实时行情——这轮涨跌太快,转转那个"7月报价、8月发布"的翻车就是现成的教训。

RTX 5090一周涨4000元、老3060都没放过:想跑本地大模型,显卡买、等还是租?

路线二:轻度尝鲜——先租,别买。 国内GPU云已经很成熟:潞晨云4090约1元/小时起,AutoDL的4090参考价约2.28元/小时,按秒计费、关机即停(价格随行情浮动,以官网实时为准)。小红书算一笔账:按2元/小时、每天用3小时,一个月大约180元,租一整年都不到一张5060 Ti涨价金额的零头。更重要的是租给了你"后悔权"——先用27B级别的模型试试本地部署到底适不适合自己。很多人的卡是三分钟热度后吃灰,涨价前吃灰是浪费钱,涨价后吃灰是双倍心疼。

路线三:换赛道。 Mac用户不必羡慕N卡:MLX量化小模型日常够用,大统一内存机器甚至能跑DeepSeek V4 Flash——有人在一台128GB内存的M3 MacBook上跑出约25 tokens/s。知乎如果你的需求只是"能用",7B-14B小模型加本地知识库能解决大多数场景,不必挤27B的独木桥;也可以混合用——重任务走API,轻任务和隐私任务走本地。

这三种人现在千万别买

  1. 想把显卡当理财产品的人。现在这个行情已经把显卡做成了"期货",经销商囤货赌涨,个人冲进去接盘,情绪逆转时最先被埋。"王思聪5年前的电脑现在估值129万"上了热搜,但那是当初采购价约102万元的顶配服务器主机。微博增值大头是服务器级内存和硬盘,别代入自己的消费级显卡。

  2. 想在家里跑2.4T Qwen3.8-Max的人。那是总参数2.4万亿、激活95B、92层、512个专家的数据中心级模型,官方模型卡写明这是面向高性能服务和研究的超大模型,不是普通个人电脑即开即用的本地模型。知乎别交想象税。

  3. 焦虑型囤货的人。需求没想清楚就"先买了再说",硬件没有早买早享受,只有使用率。

真要做等等党,盯住四个信号

这轮行情的变化都写在渠道的库存和报价单上,华强北从"封仓惜售"到"随行就市"的每一次切换,都是可以观察的窗口:

  1. 英伟达是否再发涨价通知、工厂是否解封出货——最直接的供给信号;

  2. GDDR7、DDR5的现货价格,以及每周更新的显卡行情跟踪,最近的结论一直是"价格都很高,不适合入手";

  3. 二手3090、魔改卡是否开始大量放量——供给集中出现,往往说明有人在离场;

  4. 存储原厂新产能投产进度和国产存储扩产节奏,这决定这轮周期的天花板,至少看到2026年四季度。

RTX 5090一周涨4000元、老3060都没放过:想跑本地大模型,显卡买、等还是租?

最后

本地大模型最舒服的状态,是"硬件贬值、模型变强":一张卡用三年,成本越摊越薄。这轮涨价把逻辑暂时颠倒了过来,买卡从消费变成了赌行情。对普通玩家来说,稳妥的策略就三句话:刚需买二手控成本,轻度先租再观望,没需求就别动手。

别让"怕更贵"的焦虑,替囤货商把单买了。

内容由AI生成

精选参考来源

1. DeepSeek8月17日零点涨价:V4-Flash输出2元→9元,V4-Pro6元→27元,缓存命中输入涨11倍

2. 实探华强北显卡涨价潮,有显卡一周暴涨4000元,商户:贵到我都不敢进货

3. 产业雷达第80期丨显卡两天涨30%:AI越火显卡越贵,为什么?

4. 7月底以来消费级显卡价格暴涨,RTX5060一周涨800元涨幅超三成,这一轮硬件涨价潮会持续多久?

5. 转转旗下博主回应显卡回收价争议

6. 最近内存、存储甚至显卡涨价,一个个都说自己要当等等党,等到2040年能成功吗?

7. 显卡行情更新(2026年8月18日)|显卡价格暴涨,近期无好价,各平台七夕券开始发放

8. Qwen3.8-27B本地实测:5090跑到157 Token/s!3090也有53 Token/s,Mac约30 Token/s,170HX达43 Token

9. 在Mac Mini M4 32G上测试Qwen3.8 27b:MLX 4bit版本能跑到5~6 tokens/s

10. 泼冷水!Qwen3.8 27B三宗罪:很强!很难伺候!很难用!

11. 2080Ti 22G X2 部署Qwen3.8 27b

12. 如何评价此次显卡涨价?

13. 国内GPU云三家怎么选

14. Deepseek v4 flash本地部署

15. 王思聪5年前配的电脑现在值129万

16. 阿里2.4T参数大模型开放权重!Qwen3.8把Max级能力推向开发者但部署门槛很高

1
扫一下,分享更方便,购买更轻松
2评论

  • 精彩
  • 最新
  • 等等党必胜

    校验提示文案

    提交
  • 你不买我不买 随便它涨几万块 [邪恶]

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章