DeepSeek砍显存、英伟达退堆叠:省下来的钱,海力士转身拿去美国建SSD厂

源自309位全网作者

09-20 02:56

这周的存储圈,两条叙事撞到了顶点。

一条是"省显存"三件套:9月14日,DeepSeek发布V4.1-Flash,552B参数MoE,主打卖点是长上下文Agent成本进了新区间——KV Cache压到原来的1/4(显存)和1/8(SSD),非高峰时段定价1元/百万token。紧接着SemiAnalysis抛出那篇刷屏的《Short King: Why 4-hi HBM Wins》,说AI推理最经济的HBM不是堆12层、16层,而是4层的16GB;然后有人翻出英伟达路线图:标准版Rubin每卡288GB HBM,市场规划从一年前的16-Hi退到了8-Hi。知乎哔哩哔哩

另一条是海力士自己。9月17日,海力士美股涨超5%,报183.875美元/股,总市值1.34万亿美元,历史新高。9月18日,韩国KOSPI指数收涨2.66%,海力士收涨6.42%。证券时报中国基金报

也是18日,多家渠道确认:旗下子公司Solidigm正考虑在美国建设首座NAND闪存工厂,东海岸选址、就产品组合和量产时间表展开讨论。纽约州北部是热门选址,而目前Solidigm只在中国大连拥有生产基地。海力士自己的口径依旧是那句:评估各种选项,但尚未确认任何计划。华尔街见闻东方财富科创板日报

最顺手的读法是:省显存都卷到这份上了,HBM要过剩了,内存价要跌了,等等党赢了。

这篇要回答的就是这个等式成不成立。先给结论:效率革命是真的,它动摇的恰恰是"堆得越高卖得越贵"这条HBM叙事;但省下来的那部分需求没有消失,而是搬家搬到了下一层——海力士自己,就是这周给"下一层"投钱最勤快的人。

一、“短者为王”:先替你把带宽账算完

4-Hi这个判断不是嘴炮,底下是一道算术题,值得完整抄一遍。HBM4标准由JEDEC在2025年4月16日发布,最大的改动是每个stack的对外接口从1024位翻倍到2048位。知乎知乎

关键在于,这2048条数据通路要均分给stack里的核心DRAM die,而单颗die最多只能驱动512条——4颗die乘512正好是2048。所以4-Hi是能把全部通路跑满的最矮堆叠;再往上叠第五颗、第八颗、第十二颗,增加的可能只是GB,对外带宽一点都不加。知乎

再往消费端算一笔:SemiAnalysis的算例用的是32Gb的HBM4E核心die,4-Hi 16GB、8-Hi 32GB、12-Hi 48GB,每stack带宽约3,328GB/s;如果服务目标是每序列每秒100个token,每个token只有约33.28GB的带宽预算——4-Hi的16GB一个周期就读完了,12-Hi多出来的容量根本读不完,也就是所谓搁浅容量。知乎

需求侧推的是同一件事,只是方向从容量换到了带宽:预训练在总算力中的占比,已经从几年前的三分之二掉到了个位数,腾出来的部分基本被推理解码接走——而推理恰恰是带宽不够、算力用不满的那种负载。知乎

所以Rubin Ultra传出的每颗GPU 192GB、堆叠从16-Hi退到8-Hi,不是海力士自己减配,是买方先用真金白银投票了。堆高溢价,这轮第一次不成立。知乎

二、省下来的3/4显存,正在换形态找接盘层

但"省"和"没了"是两回事。KV Cache不是被删掉了,是被压缩、被分层、被挪走了——DeepSeek官方口径里那句"SSD降到1/8",本身就是给分层存储站台:软件能省的是最贵的那层,省不掉的总得有人接。

接盘的三件套,海力士这周全摆出来了。它近期连续介绍的三项技术,分别回答三个问题。哔哩哔哩

  • PIM(处理内存储):数据不一定非要搬到GPU再算,把部分计算搬到数据旁边;

  • SALT-KV:软件层面把KV Cache在HBM、DRAM、SSD三层之间做冷热管理——哪些KV值得留在昂贵的HBM里,交给算法决定;

  • HBF(高带宽闪存):这个布局最早——今年8月4日,海力士就和闪迪通过OCP发布了首套HBF标准规范。微博

标准覆盖8/16层NAND两种规格、最高512GB、带宽0.4-3.0TB/s、支持UCIe互联,谷歌和Tenstorrent都加入了联盟;闪迪给的节奏是2027年样品、2028年量产。高盛8月14日的研报维持闪迪"买入"和2200美元目标价,点名的新增逻辑正是HBF给AI存储带来的额外增长空间。微博微博

看清这个结构就明白了:堆叠轴上少掉的GB,正在层级轴上以SSD、HBF、大内存池的形式长回来。这也是为什么海力士评估美国建厂,建的偏偏是NAND厂而不是又一座HBM厂——HBF的介质就是NAND,Solidigm那条线,就是"下一层"的物理形态。

钱也在朝同一个方向流:瑞银上调AI资本支出预测,2026年全球总额逼近万亿美元,较2025年的5060亿美元几乎翻倍,而它认为增量的九成就是内存涨价贡献的。如果省显存真在杀死需求,这句话不会出自投行。华尔街见闻

三、反证做完,说说证据只够走到哪

不能被这轮"省显存"叙事动摇的东西,截至发稿都还摆在那:DDR5现货价格较去年同期飙升超过544%,创下有记录以来最大涨幅。 云服务商Nebius 9月17日公告GPU租价全线上调,H100从3.85美元/GPU小时涨到4.50、B300涨约21%。推理成本每降一个台阶,跑的token就多一个数量级——上一次有人喊"显存过剩"时,英伟达一天跌掉17%,之后美光营收涨到了4.5倍。小红书微博哔哩哔哩

同样,也别忘了证据的边界:3,328GB/s是纸面峰值,实际长时间高负载下会掉一截,只有实测曲线看得出来。4-Hi的前提是"容量已经够了",长上下文、高并发的服务,16GB会先撞容量墙,结论直接翻转;Rubin Ultra 192GB目前也只是产业链与研报表述,英伟达并未官宣。"增量九成来自内存涨价"同样是瑞银的归因——价格回落时,这部分开支也会自然缩水。这些判断,每一条都站在分析师或供应链信源上,不是站在原厂合同上。知乎

四、三类人,三本不同的账

盯海力士和存储股的人:把观察指标从"每颗GPU配多少GB"换成"每颗GPU要挂几个stack、卖几层存储"。4-Hi意味着单stack容量缩水,凑同样的容量要挂更多stack,interposer面积和封装产能反而成了新的瓶颈点——堆叠数和层数才是这轮叙事的真实需求计量。继续盯三个信号:Rubin Ultra规格何时官宣、HBF的2027样品节点守不守得住、Solidigm美国厂从"评估"到"确认"有没有下文。这轮周期真正的顶部信号,不是有人否认"缺货2030",而是"内存吃掉资本开支增量九成"这句话在下一份研报里松口。

跑本地模型、准备攒推理机的人:这轮效率革命真正给你的红利,是部署门槛塌了——有人实测3台DGX Spark三角直连就能跑V4.1-Flash、单流30+ tok/s,DeepSeek-OCR2塞进一张3060就能用。但另一半账本别忘了:DDR5和大容量NVMe每天都在创新高,Newegg上一套128GB服务器内存条,比一整台带128GB内存的AI电脑还贵。如果你不是全天挂机,省钱的方案是按量买token(1元/百万的非高峰价),而不是等"效率技术"把内存价格打下来——那个红利进了API定价表,没进内存条价签。真要攒机,先满足模型进内存的容量,再谈带宽和显存。知乎小红书

等SSD降价的人:9月中旬消费级SSD现货确实软了几个星期,NAND不是DRAM,这条线你可以让子弹再飞一会儿。但中期别赌"DeepSeek把SSD卷降价"——铠侠与闪迪拟在日本投资超310亿美元扩充闪存产能,HBF和KV分层正在给NAND凭空加出一个新的高带宽需求层,Solidigm美国厂如果落地,填的是2028年之后的坑。短期盘面等得起,但等"AI省显存"带来的长期降价,等错了对象。知乎

海力士这周做的事——股价新高、评估美国NAND厂、在硅谷设立风投机构SK Hynix Ventures——和DeepSeek那张省了3/4显存的架构图,其实是同一本账的两页。效率革命没把你省出这轮存储周期,它只是换了张账单:从前它按"堆得高"收钱,往后它按"分层存"收钱。

内容由AI生成

精选参考来源

1. DeepSeek发布V4.1-Flash:552B参数MoE,把长上下文成本压下来

2. DeepSeek 把显存砍到 1/4,HBM 还会缺货吗?

3. SK海力士涨超5%

4. 英特尔、SK海力士、闪迪,芯片股又涨了!

5. 报道:SK海力士旗下Solidigm考虑在美国建设首座NAND工厂

6. SK海力士子公司考虑赴美建厂布局NAND闪存产能多元化

7. SK海力士旗下Solidigm考虑在美国建设首座NAND闪存工厂

8. 怎么看 SemiAnalysis 说 HBM 不需要越堆越高,4-Hi 是目前 AI 推理的最佳设计?

9. 怎么看 SemiAnalysis 说 HBM 不需要越堆越高,4-Hi 是目前 AI 推理的最佳设计?(回答)

10. sk海力士最新推介:PIM、HBF和SALT-KV

11. SK海力士、闪迪联手推动HBF AI存储迎来新变量

12. 人工智能日报:SK海力士联合闪迪发布HBF高带宽闪存行业标准

13. 闪迪要赚翻?高盛点名闪迪:HBF技术将引爆AI存储下一轮涨价潮!

14. 瑞银上调AI资本支出预测:2026年逼近万亿美元,九成增量来自内存涨价

15. 价格失控!DDR5飙破544%

16. 云计算服务商Nebius全线涨价公告

17. 知乎-DeepSeek-V4.1-Flash三机DGX部署指南

18. 11款内存条 8款比整机贵

19. 铠侠与闪迪拟在日本投资超310亿美元扩充闪存产能,将如何影响全球闪存市场?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章