英伟达在CES 2026发布的Rubin平台,标志着AI从数字世界迈向物理世界。它不仅实现了性能的代际跃升,更通过六芯协同的系统级集成,重新定义了AI算力的架构。这篇内容深入剖析Rubin的技术突破、性能对比及其对AI产业格局的深远影响,为理解下一代AI发展方向提供了关键视角。
智能速览
AI发展进入第四阶段“物理AI”,让机器走进现实世界。
Rubin平台采用“六芯协同”设计,实现计算、存储、网络的深度整合。
相较Blackwell,Rubin推理性能提升5倍,训练性能提升3.5倍。
英伟达架构演进呈现三大主线:计算单元专用化、物理形态突破、软硬件协同优化。
算力效率的代际差距将直接转化为模型能力的鸿沟。
精华内容
Rubin平台的发布不仅是硬件的堆叠,更是AI算力理念的一次系统性跃迁。其核心突破与架构创新,正悄然重塑整个AI产业的竞争格局与未来走向。
物理AI时代
黄仁勋在CES 2026上提出,AI发展正进入第四阶段——物理AI。这一阶段的标志是AI不仅存在于数字世界,而是作为机器人、自动驾驶汽车等实体,真正走进并操作物理世界。从感知AI到生成AI,再到代理AI,最终迈向物理AI,这条演进路径明确了未来技术发展的核心方向,即让AI具备与现实世界交互并改造世界的能力。
Rubin平台正是为支撑这一宏大愿景而设计的算力底座,其性能与架构的革新均围绕着满足物理AI对实时性、高效率和复杂决策的严苛要求。
六芯协同设计
Rubin平台最核心的架构创新在于其“六芯协同”的系统级集成思路。Rubin NVL72系统整合了NVIDIA Vera CPU、Rubin GPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU及Spectrum-6以太网交换机六大核心组件。
其中,Vera CPU采用88核Arm架构,配备1.5TB LPDDR5X内存;Rubin GPU集成了3360亿晶体管并搭载8颗HBM4显存。这种深度整合打破了传统单芯片的性能瓶颈,通过NVLink 6实现72颗GPU的高速互联,单GPU带宽高达3.6TB/s,形成了一个高效协同的算力整体。
性能代际跨越
Rubin平台的性能提升是全方位的。与前代Blackwell相比,其在FP4精度下的推理性能提升了5倍,训练性能提升了3.5倍,而token生成成本则降至原来的十分之一。这种性能飞跃建立在具体的硬件优化之上。
内存带宽相比Blackwell提升2.8倍,互联速度实现翻倍。纵向对比Hopper系列,Rubin的训练效率提升近一个量级。支持FP4等极低精度计算,有效减少了数据存储空间和计算复杂度,使得GPU在相同时间内能处理更多运算,显著提升了计算效率和能效比。
算力格局重塑
Rubin的发布揭示了AI算力竞争的残酷现实:算力效率的代际差距将直接转化为模型能力的鸿沟。英伟达的架构演进清晰地呈现出三大主线:计算单元从通用走向专用,物理形态从单芯片走向系统级集成,软件与硬件从分离走向深度协同。
这种演进逻辑使其始终保持着对竞争对手的领先地位。对于国产算力而言,如果仍停留在对标数代前产品的阶段,那么由中美算力效率差距所引发的模型能力差距将持续拉大。在物理AI时代,算力、算法与场景的三位一体将成为新的竞争焦点。
Rubin平台的亮相,不仅是英伟达自身技术的又一次突破,更预示着AI算力竞赛进入了新维度。它系统性地展示了如何通过架构创新来突破物理极限。未来,当算力瓶颈逐渐显现,物理AI能否找到不困于算力的全新解法,将是整个行业需要共同探索的命题。