AI编程服务智谱GLM Coding Plan上线后因需求过载而紧急致歉。这背后,是其新模型GLM-5的强劲表现与算力瓶颈之间的突出矛盾。此次事件不仅揭示了AI行业高速发展中面临的基础设施挑战,也展现了市场对顶级AI模型的迫切需求,引发行业对算力扩张与合作模式的深入思考。
智能速览
智谱因GLM-5需求过载,就新付费套餐问题向开发者致歉。
GLM-5模型性能逼近Claude Opus 4.5,引发用户抢购致服务瘫痪。
公司受灰产冲击及流量超预期,正分步开放GLM-5使用权限。
智谱推出退款及延期补偿方案,并启动“算力合伙人”计划以解困局。
智谱股价43天暴涨524%,市值已超携程、快手等巨头。
精华内容
一场因模型性能过于强大而引发的“甜蜜烦恼”,正考验着智谱的应变能力与行业智慧。
致歉原因
智谱在致歉信中坦承,新推出的GLM Coding Plan付费服务存在三大问题:规则透明度不足、GLM-5灰度节奏过慢、老用户升级机制粗糙。问题的根源在于新模型GLM-5的强劲表现超出了预期,导致需求量暴增,远超服务器承载能力。
在GLM-5发布次日,智谱同步上调了套餐价格,涨幅自30%起,但新套餐上线后迅速售罄,这种罕见情况也侧面印证了市场的火爆程度。
GLM-5的实力
引发此次抢购潮的核心是GLM-5模型的卓越性能。根据测试,GLM-5在代码能力和智能体表现等关键领域的开源模型评分中达到了SOTA(State-of-the-art)水平。
在真实编程场景中,其使用体感已非常接近顶尖模型Claude Opus 4.5,尤其擅长处理复杂的系统工程与长程Agent任务。正是这种领先的技术实力,才引爆了开发者的使用热情。
应对与补偿
面对服务器压力,智谱解释公司近期遭受了灰产号池和黄牛党的恶意冲击,占用了大量资源。同时,GLM-5带来的流量超出预期,扩容节奏未能跟上。
为此,智谱采取分批开放策略:Max用户已全面开放,Pro用户在高峰期可能限流,Lite用户将在节后非高峰期逐步灰度。作为补偿,受影响的Lite和Pro用户可申请退款,所有继续使用的用户将获得15天使用期延期。
寻求破局
为从根本上解决算力瓶颈,智谱于春节期间启动了“算力合伙人”招募计划,希望联合多方力量共建更高并发、更低延迟的推理网络。合作对象包括芯片厂商、算力伙伴与推理服务商等。
目前,GLM-5已完成与华为昇腾、摩尔线程等7家主流国产芯片平台的深度适配,这为后续的算力扩张与合作奠定了基础。
智谱的遭遇是当前AI大模型发展的一个缩影:技术突破速度正超越基础设施的建设步伐。如何平衡好技术红利与用户期待,构建稳固的算力底座,将是所有头部玩家必须面对的课题。未来,开放合作或许才是应对算力鸿沟的关键。