NVIDIA Rubin CPX 复活,改配 HBM4 弃 GDDR7
英伟达把之前搁置的「Rubin CPX」AI 加速器项目捡回来了,而且改了内存方案,从 GDDR7 换成了 HBM4。
供应链分析师郭明錤爆料,Rubin CPX 之前计划配 128GB GDDR7 显存,现在改成 168GB HBM4 内存。这颗 GPU 是给大规模 agentic AI 工作负载准备的,每个机柜能装 64 到 256 颗独立 CPX GPU。

它的角色很有意思。英伟达把 AI 推理拆成了「预填充」和「解码」两段,CPX 专门干预填充,也就是处理输入的上下文和 KV 缓存,普通 Rubin GPU 负责解码。一个 8 卡托盘能处理 1.34TB 的长上下文预填充,靠 HBM4 的高带宽把速度顶上去。
规格上,这颗芯片是单晶片设计,NVFP4 算力 30 PetaFLOPS,还集成了 4 个 NVENC 和 4 个 NVDEC 视频编解码器。封装大概率用台积电的 CoWoS-S 或 CoWoS-L。
背后的逻辑,是现在大模型参数量已经到万亿级,把预填充和解码分开,各用专用硬件,能更快地吐 token。英伟达还建议,解码机柜里 CPX 和普通 Rubin GPU 按一比一的比例配。
对普通消费者,这条线完全是数据中心的事,跟游戏显卡没关系。但它说明英伟达在 AI 加速器上的做法越来越细,连推理的两个阶段都要拆开用不同硬件优化。AI 抢产能这件事,只会更猛。
评论区聊聊,你对英伟达这种「把推理拆两段」的做法怎么看?
作者提示含AI生成内容。
