海力士把SSD当"内存"卖,16G显存跑模型的你先别掏钱:这条赛道跟你没关系

源自175位全网作者

04:38

9月17日晚间美股开盘初段,SK海力士股价涨超5%,报183.875美元/股,市值重回1.34万亿美元。同一时间,花旗预计受服务器DDR5与HBM需求同步爆发的拉动,全球存储芯片市场的供不应求态势将贯穿2031年,这份报告在国内投资圈刷屏。东方财富网微博

也是在9月17日,有参会者转述,SK海力士在一场AI基础设施大会上展示了新一批AI内存方案,其中一个思路相当抓眼球:想办法让SSD也来帮GPU分担压力,把大模型的KV Cache从显存挪一部分到高速硬盘里。站内做AI工作站回收的商家已经跟上话术:“以前收机器先看显卡,现在服务器内存、ECC、大容量NVMe都得掂量。”小红书

看到这,很多拿16G、24G显卡本地跑大模型的朋友心动了:显存塞不下,加块SSD就能"扩内存"?海力士连"介于HBM和固态硬盘之间的新存储阶层"HBF都标准化了,是不是马上轮到我?

海力士把SSD当

先泼冷水:这波"SSD当内存"的风,是给数据中心的,不是给你家主机的。 想把钱花对,先看懂三个问题。

一、你家里的"内存不够",走的路径根本没有SSD这一级

本地跑过模型的人大多经历过这个场景:一位拿800块V100 16G跑27B量化模型的知乎玩家复盘,模型权重吃掉14G,KV Cache只剩2G容身。上下文一拉长,模型开始前言不搭后语、反复念第一页——不是变笨,是"记事本"被砍成了几页纸。数据溢出到系统内存的那一刻,速度从每秒二十个token直接掉到三五。知乎

关键在于溢出方向:家用的llama.cpp这类推理栈,显存不够是往系统内存卸,不是往SSD卸。原因看带宽阶梯就明白:

  • V100/3090级别的显存带宽:900GB/s上下;

  • DDR5-5600双通道内存:约90GB/s;

  • PCIe 4.0 NVMe SSD:约7GB/s,4K随机更只剩零头。

一级掉一个数量级。从显存卸到内存已经慢到能用"卡"来形容,卸到SSD等于让GPU蹲在那儿等硬盘转完——不是软件偷懒,是这条物理路径今天就不成立。

海力士、英伟达们做的SSD扩容,靠的是一整套专用协议栈:去年12月有报道称,英伟达正携手韩国存储巨头SK海力士,共同研发一款专为AI应用优化的新型固态硬盘,宣称性能提升可达10倍。今年2月,海力士与闪迪联合办起HBF规格标准化联盟,把自己卡位在"介于HBM和固态硬盘之间的新型存储阶层",按规划2027-2028年才会集成进英伟达、AMD和谷歌的产品。这些是给成千上万张卡"喂数据"的企业级工程,第一批客户只会是云厂商。你的主板和推理软件,今天没有任何一条通道能让SSD直接给GPU供KV。微博微博

所以第一个结论:"用SSD给AI扩内存"在可预见的两三年内,都是服务器用户的路线图,不是装机党的解法。 看到"AI PC专用SSD""HBF兼容"这类新话术要加钱的,先捂一下钱包。

二、真正该掏钱的那一级,恰好是涨得最狠的

排除掉SSD,家用本地模型真正有效的扩容路径只剩两条:换更大显存的卡,或者加内存给卸出留余量。而内存,正是这轮涨价最猛的品类。

9月中旬苹果与三星谈2027年一季度存储长约的行情被媒体透出来:DRAM接近2.0美元/Gb、NAND约0.33美元/Gb,较三季度报价再涨30%-40%——全球最强采购方主动接受涨价锁产能。社区报价同样咬合:一条32G DDR5内存条,去年九百块、今年三千八的晒单,这周还在刷新。36氪知乎

海力士把SSD当

对比一下:同样被AI需求拉动,NAND的涨幅明显比DRAM温和。这直接决定了预算的分法——如果你的需求是"装得下更多模型、数据集不爆仓",大容量NVMe该买还是能买,它是存储问题,不是内存问题;但如果你的需求是"上下文别一长就崩",唯一对症的是内存和显存,加再多2T盘都救不了。

三、但等等党等到的不是降价,是架构

还有一条多数装机帖没讲清的时间线:"上下文焦虑"最可能的解药,是下一次模型发布,而不是双11。

9月10日发布的DeepSeek V4.1-Flash,官方一句话把市场炸了:KV Cache只需要上一代的1/4 HBM、1/8 SSD存储,同时把缓存命中价打到未命中价的1/50。按这份技术报告的口径,恒驻显存的主KV已到890字节/token,而上一代V1还是389,120字节——近三年累计压缩437倍;消息当晚,美股SK海力士跌超4%。市场自己都说不清,这到底是存储的利空还是应用的利好。知乎微博

翻译到家用语境:过去需要24G显存硬扛的长上下文任务,正在被架构压缩到16G可及;再加上KV Cache量化(q8_0、q4这类设置)还能再抠出几G余量。你眼下的"显存不够用",大概率被下一代开源模型顺手解决。而你今天按峰值价囤进去的内存条,价格可不会顺着周期回来——花旗的"紧缺到2031年"说的是原厂扩产的钟,不是零售价的钟,这两个钟别混着看。

海力士把SSD当

四、分层给结论:谁现在动手,谁继续等

  • 靠本地模型干活、长上下文是刚需的(Agent多轮、长文档处理):别研究SSD概念,直接算内存/显存账。等得起就等V4.1这类压缩架构在你的模型上落地(跟踪Qwen、月之暗面等跟进同类KV压缩的发布),等不起就按需买,把它当生产力成本,别指望抄底。

  • 只嫌"模型和数据装不下"的:NAND涨幅比DRAM温和,2T/4T盘遇到合适价可以出手,但不要为"AI SSD""HBF概念"支付溢价——那些名词和你没关系。

  • 在16G卡上纠结要不要换卡的:先做免费的——上下文窗口设小、KV量化、别让推理栈自由顶天花板,很多"失忆"是配置问题不是硬件问题;确认是硬件上限再动预算。

  • 继续盯的三路信号:苹果之后安卓厂商接不接受下一季报价;NAND与DRAM合约价的涨幅差是否继续劈叉;以及HBF联盟、英伟达AI SSD有没有任何"下放消费级接口的说法"。哪天推理软件真支持GPU直读SSD了,这篇文章作废,再来重算。

一句话收尾:海力士把SSD抬进"内存赛道",抬的是AI服务器的价;对普通玩家来说,这轮浪潮里唯一确定的事是——概念可以围观,钱只能花在带宽阶梯上真实有效的那一级。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章