近日,国产GPU企业摩尔线程在其首届MUSA开发者大会上,正式发布了新一代全功能GPU架构“花港”,并公布了基于该架构的后续产品路线图,这一系列发布在国产GPU领域引发了广泛关注。
新发布的“花港”架构是摩尔线程技术迭代的核心。根据会上公布的信息,该架构采用了新一代指令集,在性能和能效上实现了显著突破。其算力密度相较前代提升了50%,而能效则大幅提升了10倍,这意味着在同等功耗下能完成更多计算任务。在功能上,“花港”延续了其“全功能”的技术路线,不仅打通了AI计算与图形渲染两大核心赛道,还集成了AI生成式渲染架构(AGR)和第二代光线追踪硬件加速引擎,并完整支持DirectX 12 Ultimate,能够同时满足从复杂的大模型训练到高端3A游戏运行的多元化需求。

“花港”架构一个尤为关键的突破在于其对超大规模集群的支持。通过搭载自研的MTLink高速互联技术和新一代异步编程模型,“花港”架构为构建十万卡以上规模的智算集群奠定了基础。这直接回应了当前AI大模型训练对算力规模持续扩大的核心需求,也标志着国产GPU正在从单卡性能的比拼,转向更为复杂的集群系统工程能力的构建。
基于“花港”架构,摩尔线程同步公布了两款将于明年量产的芯片产品:“华山”和“庐山”。“华山”芯片专注于AI训练与推理一体化以及超大规模智能计算,支持从FP4到FP64的全精度计算,旨在为构建下一代“AI工厂”提供核心算力支撑。根据发布会信息,该芯片在访存容量等部分指标上,已能对标甚至超越国际主流产品。“庐山”芯片则主攻高性能图形渲染,与摩尔线程上一代产品相比,其在3A游戏、AI计算、光线追踪等方面的性能实现了数倍乃至数十倍的提升,应用场景覆盖游戏娱乐和CAD/CAE等专业图形设计领域。

此次发布不仅展示了硬件层面的进步,也凸显了摩尔线程在构建全栈解决方案和软件生态方面的决心。公司持续推进其自主研发的MUSA统一系统架构,该架构在理念上对标英伟达的CUDA,旨在通过统一的软件栈和“Musify”等代码迁移工具,降低开发者的使用门槛,吸引更多开发者加入国产GPU生态。同时,摩尔线程还推出了从云端的“夸娥”万卡智算集群,到搭载自研“长江”SoC芯片的AI算力笔记本MTT AIBOOK,展现了其覆盖“云-边-端”全场景的战略布局。

摩尔线程新架构及系列产品的发布,对国产GPU领域而言,具有多重影响。它在核心性能指标上进一步缩小了与国际领先厂商的差距,为国内智算中心建设和各行业的数字化转型提供了新的国产化选择,推动国产GPU从“能用”向“好用”阶段迈进。通过强调MUSA统一架构和开发者生态建设,摩尔线程正试图攻克国产算力最核心的软件壁垒,构建长期竞争力。其“云-边-端”的全栈布局,展现了国产厂商不再满足于单点突破,而是致力于提供系统级、全场景解决方案的产业雄心。

当然,从架构发布到产品大规模量产并经过市场实际检验,仍有漫长的道路要走。新产品的实际性能、稳定性、兼容性以及MUSA生态的完善程度,都将是决定其最终能否成功的关键。但无论如何,“花港”的到来,无疑为自主可控的算力发展注入了强劲动力,也标志着国产GPU产业进入了系统攻坚与生态破局的新阶段。