智谱AI开源了一款名为GLM-4.7-Flash的混合思考模型,该模型仅用3B激活参数,就在多项基准测试中超越了20B量级的对手,且完全免费。它的发布,为寻求高性能、低成本AI解决方案的开发者和企业提供了新的选择,有望加速AI应用的普及和创新。
智能速览
智谱开源混合思考模型GLM-4.7-Flash,激活参数仅3B。
综合性能超越20B级别的开源模型,达到开源SOTA。
模型完全免费,大幅降低开发者使用门槛。
编码能力实测强大,可2分钟生成完整可用的应用代码。
在前端生成、角色扮演及办公创作等多场景均有优化。
精华内容
GLM-4.7-Flash的核心价值在于其实用性和广泛的应用潜力。它不仅在参数效率上实现了突破,更在编码、创作等具体任务中展现了超越同侪的实用性,为AI应用的落地提供了坚实支撑。
高效自动化编码
GLM-4.7-Flash的编码能力侧重于“任务完成”而非单点代码生成。在实测中,要求其编写一个“天气与日程助手”,整个生成过程耗时约2分钟。模型展现出清晰的思考链条:从分析需求、制定策略,到起草代码、完善功能,最后进行约束审查,能够自主完成从需求理解到多技术栈整合的全过程。
这种能力特别适合需要前后端联动、实时交互与外设调用的复杂场景。它能直接生成结构完整、可运行的代码框架,显著减少人工拼装与反复调试的成本,有效加速了原型验证与自动化开发流程。
多场景应用拓展
在前端开发方面,GLM-4.7-Flash对视觉代码与UI规范的理解得到增强,能够给出风格一致的默认方案,减少样式反复微调的时间,对低代码平台和快速原型设计尤为友好。
在角色扮演与叙事创作中,该模型能更稳定地遵循世界观与人设,剧情推进自然,文字表达更具画面感,适用于互动叙事和IP内容创作。此外,在办公创作场景下,它能稳定适配主流比例,生成内容接近“即用级”,减少模板感,提升了自动化内容生成的实用性。
技术内核与价值
GLM-4.7-Flash实现高性能的关键在于其“混合思考”架构。该模型总参数量为30B,但激活参数量仅为3B,在SWE-bench Verified、τ²-Bench等主流基准测试中,其综合表现超越了gpt-oss-20b等更大参数的模型。
这种参数效率的突破,加之完全免费的开源策略,构成了其核心价值。它为开发者和企业提供了一个低成本、高性能的选择,有效降低了AI应用的开发与部署门槛,有望推动AI技术在更多领域的快速落地和创新。
GLM-4.7-Flash的发布,不仅是开源社区的一个高性能选项,更是对小参数模型潜力的一次有力证明。通过“混合思考”架构,它在效率和实用性之间找到了平衡点。当强大的AI能力变得触手可及时,下一个颠覆性的应用会从何处诞生?