智谱AI发布新一代旗舰模型GLM-5,并确认其为此前引爆社区的神秘模型“Pony Alpha”。这款模型在编程与Agent能力上取得开源SOTA表现,使用体感逼近顶尖闭源模型,同时通过“悬念营销”和极具竞争力的价格策略,向全球大模型前排发起了一次强有力的冲锋。
智能速览
智谱GLM-5正式发布,确认身份为“Pony Alpha”,引发市场高度关注。
GLM-5在编程与Agent能力上达到开源SOTA,性能逼近Claude Opus 4.5。
模型采用744B参数基座、异步强化学习和稀疏注意力机制等新技术。
此次发布被视为“开源赶超闭源”转折点的重要标志。
智谱通过“悬念营销”成功拉动股价,展示了“技术事件驱动市值”的新路径。
GLM-5以40倍的API价格优势,凸显国产模型“性能平权、价格降维”的竞争策略。
精华内容
GLM-5的发布不仅是技术迭代,更是一场精心策划的行业冲击。其背后的技术路径与市场策略,深刻揭示了国产大模型发展的新动向与竞争格局。
一场悬念营销
2月6日,一个名为“Pony Alpha”的匿名模型突然上线OpenRouter平台,支持200K上下文窗口且完全免费,首日处理超400亿token,迅速引爆开发者社区猜测。面对“GPT-5偷跑”、“Claude 5内测”等猜想,多重证据链指向智谱AI:其输出风格与tokenizer行为与GLM系列高度一致,且“Pony”(小马)之名恰巧对应2026年马年。这一场精心策划的悬念营销,最终在智谱港股上市仅34天后,随着GLM-5的正式发布而揭晓,推动公司股价两日暴涨60%。
技术内核升级
GLM-5的强大性能源于其技术底座的全面革新。模型参数规模从此前的355B(激活32B)扩展至744B(激活40B),预训练数据量从23T提升至28.5T。同时,智谱构建了全新的“Slime”异步强化学习框架,支持更复杂的任务并持续从长程交互中学习。此外,GLM-5首次集成了DeepSeek Sparse Attention机制,在无损长文本处理能力的同时,大幅降低了模型部署成本,提升了Token效率。
对标顶流的编程实力
在编程能力上,GLM-5实现了对闭源顶尖模型的追赶。其在SWE-bench-Verified基准测试中获得77.8分,在Terminal Bench 2.0中获得56.2分,均为开源模型最高分,性能超过Gemini 3 Pro。内部评估显示,GLM-5在前端、后端及长程任务上的表现显著超越上一代GLM-4.7,平均增幅超过20%。它被定位为一个“系统架构师”,能够以极少的人工干预完成Agentic长程规划、后端重构与深度调试等复杂系统工程,使用体感已非常接近Claude Opus 4.5。
SOTA级长程任务执行
GLM-5在Agent能力上同样达到了开源顶尖水平。它不再局限于生成代码片段,而是能够端到端完成大型任务,实现了从“Vibe Coding”到“Agentic Engineering”的跨越。在BrowseComp(联网检索与信息理解)、MCP-Atlas(大规模端到端工具调用)和τ²-Bench(复杂场景下自动代理工具规划与执行)等多个评测基准中,GLM-5均取得了开源模型的最佳表现,展现了其执行复杂、长程任务的卓越能力。
重塑行业竞争格局
GLM-5的发布对国产大模型行业产生了深远影响。首先,它标志着“开源赶超闭源”可能迎来转折点,证明开源模型在特定维度上已具备与顶级闭源模型正面竞争的实力。其次,GLM-5大量采用DeepSeek的MoE架构和稀疏注意力等开源贡献,凸显了后者作为中国AI行业“公共基础设施”的角色,加速了整个行业的迭代。最后,智谱通过“上市+模型”双线叙事,示范了如何利用技术事件驱动市值管理,而其高达40倍的API价格优势,也让“性能平权、价格降维”成为国产模型的核心竞争策略。