随着AI大模型迈入万亿参数时代,如何构建高效、稳定的智算底座成为核心挑战。通过拆解新华三在运营商大会上展示的全栈解决方案,可以清晰地看到“算力×联接”的双轮驱动策略。该内容深入剖析了从底层硬件到上层应用的具体技术与实践,为理解和构建大规模AI基础设施提供了极具价值的参考。

智能速览
UniPoD超节点突破传统架构瓶颈,支撑万亿级大模型训推。
800G彩光交换机实现跨智算中心协同,破解资源碎片化难题。
LinSeer ICT智能体获最高评级,保障智算底座高效稳定运行。
Polaris X20000分布式存储以顶尖性能,有效避免AI训练“算力空转”。
精华内容
要释放AI的巨大潜能,不仅需要强大的算力,更需要高效联接与智能运维的协同配合。新华三的方案正是围绕这一核心理念展开,展示了从底层硬件到上层应用的全面布局。
算力突破
面对万亿级参数大模型的数据并发传输需求,传统计算架构面临单卡性能瓶颈与机间扩展局限。新华三推出的H3C UniPoD系列超节点产品,基于领先的Scale-up南向互联技术,在单柜内实现卡间全互联通信,为万亿级参数大模型的高效训推提供了强劲的算力支撑。
高效联接
智算资源碎片化和超大模型训练时的数据中心空间电力扩展问题,是另一大挑战。新华三展出的高密度800G彩光交换机,支持大缓存与IP+光融合等技术。其与移动研究院合作,在河北移动完成了80KM双智算中心协同训练场景下的性能测试,为解决上述问题贡献了新思路。

智能运维
为保障复杂智算底座的稳定运行与运维效率,LinSeer ICT智能体提供了关键支撑。该智能体已通过中国信通院的“可信AI运维智能体评估”,并荣获业内当前最高的4+级评级。它通过高度智能化与自动化的系统管理,有效减轻运维压力,保障业务流畅运行。

存储基石
H3C UniStor Polaris X20000新一代高性能分布式融合存储,旨在解决AI训练中的“算力空转”问题。在MLPerf® Storage v2.0基准测试中,其单节点带宽达158.92 GB/s,集群总带宽突破476.752 GB/s,登顶高性能RoCE AI存储解决方案榜首,可支持320个模拟加速器且GPU利用率大于90%。

新华三的方案清晰地勾勒出构建现代化AI基础设施的蓝图,即算力、联接、运维与存储的深度融合。从底层技术创新到生态合作,这种全栈式的布局思路,为AI技术的规模化落地提供了坚实保障,也预示着“AI+”时代产业协同共创的广阔前景。