必须配核电站了!NVIDIA打造20亿瓦功耗的AI数据中心

源自公众号:硬件世界

02-18 15:09

面对大模型带来的算力与能耗爆炸式增长,如何从零开始构建高效、可扩展的AI基础设施成为核心挑战。英伟达发布的Omniverse DSX蓝图,为建设亿瓦级乃至十亿瓦级的“AI工厂”提供了一套从设计、规划到优化的全流程解决方案,旨在解决未来AI发展的基建瓶颈。

必须配核电站了!NVIDIA打造20亿瓦功耗的AI数据中心

必须配核电站了!NVIDIA打造20亿瓦功耗的AI数据中心智能速览

  • 英伟达发布Omniverse DSX蓝图,用于构建亿瓦级AI数据中心。

  • 该蓝图通过数字孪生技术,实现从供电到散热的全链路优化。

  • 两种配置方案:DSX Flex连接电网,DSX Boost提升内部能效。

  • 美国能源部将获得7台百亿亿次级AI超算,总计算力惊人。

  • 其中一台超算搭载超10万块Blackwell GPU,功耗达2亿瓦。

  • 未来Rubin架构将兼顾AI与高性能计算的高精度需求。

必须配核电站了!NVIDIA打造20亿瓦功耗的AI数据中心精华内容

面对大模型训练带来的巨大能耗与工程挑战,如何高效、可扩展地建设AI基础设施成为关键。英伟达的Omniverse DSX蓝图正是为此而来,试图为未来AI工厂的建设提供一个标准答案。

AI工厂蓝图

英伟达推出了名为“Omniverse DSX Blueprint”的参考设计,专为构建从1亿瓦到10亿瓦规模的AI数据中心而生,亦被称为“AI工厂”。该方案的核心是基于NVIDIA Omniverse框架进行全程设计与模拟,将数字孪生技术与现实工程数据结合。合作伙伴可以利用这套统一环境,对数据中心的供电、散热、计算、网络等所有环节进行精确规划与优化,确保从零开始的“AI工厂”具备最高效率和兼容性,并支持未来的Rubin等GPU架构。

内外兼修增效

为适配不同规模的数据中心,蓝图提供了两种关键配置。DSX Boost是一种内部配置,专注于数据中心内部的电源管理和工作负载分配,可实现约30%的功耗降低,或在同等功耗下将GPU密度提升30%,从而无需物理扩容即可增加token生成吞吐量。DSX Flex则是一种外部配置,它将数据中心与当地电网及可再生能源智能连接,通过动态平衡能源供需,能激活大约100吉瓦(1000亿瓦)的闲置电网容量,实现更广泛的能源协同。

必须配核电站了!NVIDIA打造20亿瓦功耗的AI数据中心

落地实践验证

这套蓝图并非纸上谈兵,它已在英伟达位于弗吉尼亚州马纳萨斯的AI工厂研究中心完成验证。更重要的是,它已为多个实际部署的大型项目提供了技术支撑,其中最具代表性的包括位于佐治亚州、功耗高达20亿瓦的Switch数据中心,以及位于得克萨斯州、功耗为12亿瓦的Stargate项目。这些实例证明了该蓝图在超大规模基础设施建设和优化中的实用性与可靠性。

美国七机计划

英伟达同时宣布,将与合作伙伴为美国政府打造七台百亿亿次(EFlops)规模的AI超级计算机,服务于美国能源部下属的国家实验室。首批两台由甲骨文承建,用于阿拉贡国家实验室。其中,“Solstice”将搭载超过10万块Blackwell GPU,功耗达到2亿瓦,两台超算合计FP4总算力高达2200EFlops,能够支持高达3万亿参数的AI大模型模拟。选择云服务商甲骨文来建造如此规模的实体超算,其具体实施和管理方式仍有待观察。

核武库的守护者

其余五台超算将由慧与(HPE)等合作方打造,其中代号为“Mission”的超级计算机专为美国国家核安全局(NNSA)设计,预计2027年上线。其核心任务是在不进行实际核试验的情况下,通过模拟确保美国核储备的安全性与可靠性。这台超算将采用下一代Rubin架构,说明Rubin GPU在强化AI性能的同时,并未牺牲高性能计算所需的高精度运算能力,标志着AI与经典HPC的深度融合。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
1评论

  • 精彩
  • 最新
  • 不可能,美国缺电

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章