智谱GLM5凭借出色表现超越Kimi K2.5,暂时位列开源模型榜首。该模型不仅在文本和代码能力上表现优异,还通过引入DeepSeek的DSA架构和创新的强化学习策略,实现了性能跃升,且完美适配国产AI芯片,成为企业级应用的优质选择。
智能速览
GLM5暂列全球开源模型排名首位,超越Kimi K2.5。
采用DeepSeek的DSA架构,推理效率与性能显著提升。
运用跨阶段蒸馏技术解决强化学习中的能力退化问题。
重点强化智能体能力,支持搜索、终端命令及代码生成。
完美适配华为昇腾、摩尔线程等主流国产AI芯片。
支持免费商用,性价比极高。
精华内容
智谱GLM5发布后迅速登顶开源榜单,其背后的技术路线与性能提升逻辑值得深入探究。
排名与性能
2月19日数据显示,GLM5在全球开源模型排名中暂列第一,超越了此前的榜首Kimi K2.5 Thinking。相比之下,OpenAI的GPT 5.1 High已跌出前十,目前榜单前列多为Cloud、Google及字节等公司的商业模型。GLM5此前曾以“TonyAlpha”代号匿名发布,因表现优异被社区误认为是Claude或GPT新作,足见其技术自信。
架构与效率
GLM5在技术架构上采纳了DeepSeek的DSA(DeepSeek Attention)注意力机制,有效提升了推理性能和效率。此外,模型在训练过程中重点解决了强化学习常见的能力退化问题,通过跨阶段蒸馏技术,将上一阶段的模型作为教师监督下一阶段,确保了不同阶段能力的累积与保留。
强化学习突破
GLM5将强化学习细分为推理、智能体和通用三部分,并特别加强了智能体的强化学习训练。基于自研的slim框架,该模型在多智能体对话、工具调用、搜索引擎及终端命令行等场景下的能力大幅增强。同时,GLM5在文本写作和代码生成领域的实测表现也处于行业顶尖水平。
国产化适配
GLM5对国产硬件生态的支持是其一大亮点。模型技术白皮书明确指出,GLM5已适配华为昇腾、摩尔线程、昆仑、壁仞及沐曦等几乎所有主流国产AI芯片。这意味着国内企业可以在自有硬件设施上高效部署GLM5,兼顾了高性能与自主可控的需求。
综合来看,智谱GLM5在架构创新、训练策略及国产化适配上均展现出强大竞争力。随着开源模型的持续迭代,未来的竞争将更加激烈,但GLM5目前无疑为行业提供了一个高性能且低成本的企业级解决方案。