智谱AI开源的新一代大模型GLM-5,在多项核心测试中表现出色,性能已超越GPT-5.2并媲美顶尖闭源模型。其最突出的价值在于突破了传统AI的聊天局限,能够将文本直接生成可用的PDF、Word、Excel等办公文档,显著提升工作效率,为AI在办公场景的实际应用提供了全新的解决方案。
智能速览
GLM-5性能全面超越GPT-5.2,部分指标媲美Claude Opus 4.5。
新增一键生成PDF、Word、Excel等办公文档的实用功能。
模型参数规模扩展至744B,预训练数据量提升至28.5T tokens。
集成稀疏注意力机制,在降低部署成本的同时高效处理长文本。
在编码、推理、智能体等核心领域的多项测试中达到开源顶尖水平。
宣布支持华为昇腾、摩尔线程等国产芯片,拓展算力生态。
精华内容
GLM-5的强大并非空谈,而是建立在实实在在的技术革新和卓越的测试表现之上。接下来,将深入剖析其背后的技术升级与多维度的能力验证。
技术底座革新
GLM-5的参数规模从上一代的355B扩展至744B,激活参数提升至40B,预训练数据量也增加至28.5T tokens。这相当于为模型提供了更庞大的“大脑容量”和更丰富的知识储备,使其在处理复杂问题时能调用更多信息。
为了解决长文本处理与部署成本之间的矛盾,GLM-5集成了DeepSeek的稀疏注意力机制。这一技术使得模型在处理超长文本时更加高效,同时显著降低了部署成本,让更多资源有限的团队也能使用。
在强化学习方面,GLM-5团队研发了全新的异步强化学习基础设施Slime。它有效解决了传统强化学习效率低下的难题,能够精准优化模型的薄弱环节,是实现性能跃升的关键。
办公能力落地
GLM-5最引人注目的突破是其强大的办公文档生成能力。用户只需输入文字提示,模型就能自动将其转换为排版精美、内容完整的Word、PDF、Excel等格式文档,无需二次编辑,真正实现了从聊天工具到生产力工具的跨越。
无论是产品需求文档、教学教案,还是财务报表,GLM-5都能快速生成。实测显示,生成一份结构完整的股票研究报告PDF仅需约5分钟。这种能力直接解决了以往AI模型“能说不能做”的落地痛点,为日常工作带来了效率上的革命。
综合性能实测
在权威的学术测试中,GLM-5的表现全面超越了前代,并在多项指标上达到了全球开源模型的顶尖水平。在“人类终极测试”中,GLM-5在带工具模式下取得了50.4分,显著超过上一代的42.8分,甚至超越了Claude Opus 4.5的43.4分。
在编码核心测试SWE-bench上,GLM-5的验证集得分达到77.8分,逼近Claude Opus 4.5的80.9分。多语言编码测试也从66.7分提升至73.3分。此外,在考验长期规划能力的自动售货机基准测试中,GLM-5模拟运营收入从上一代的2377美元增长至4432美元,近乎翻倍,位列开源模型榜首。
生态兼容性
GLM-5的另一个亮点在于其对国产算力生态的支持。模型已兼容华为昇腾、摩尔线程、寒武纪等多款国产芯片。尽管仍需进行内核优化和模型量化,但这为国内用户摆脱对NVIDIA GPU的完全依赖提供了可能,对降低算力成本、推动国内AI产业发展具有重要意义。
GLM-5的开源不仅是技术参数的又一次飞跃,更重要的是它展示了AI与实际工作流深度融合的巨大潜力。它让“一句话生成PPT”不再是梦想,而是触手可及的现实。随着这类实用性更强的开源模型涌现,AI工具的门槛将进一步降低,未来每个人的工作效率都将被重新定义,AI的下一个爆点会出现在哪里?