GLM-5.3 海外走红的这一周,我把 Cursor 的榜单、德国的报告和卖方研报摆成一页:哪些说法能转,哪些得改

源自64位全网作者

21:38

这个假期你的信息流大概被 #智谱GLM-5.3海外走红# 刷屏过:Cursor 上线了、德国人"偷"了、港股大涨了、"AI 反向输出"了。作为一路跟着智谱这轮剧情走到现在的用户——上个月还在算 ZCode 风波的授权边界、掰扯 118 元套餐续不续——我很懂这种"想转发但怕说错"的感觉。

先把结论摆前面:这条事件链的每一环都是真的,含金量也确实高;但热搜上流通的大部分说法,口径都被加过戏。下面按原文逐一核对。

72 小时里真实发生了什么

  • 10月3日,德国 AI 公司 Aleph Alpha 发布"主权 AI"模型 Kolibri:MoE 总参数 781 亿、每 token 激活约 34.6 亿、支持 100 万上下文、以 Apache 2.0 开放权重、约 768 块 B200 训成。 随模型公开的 189 页技术报告写明:在监督微调(SFT)数据生产环节,智谱 GLM-5.2、GLM-5.3 与阿里 Qwen3.8-27B 被列为生成数据以及重新生成部分开放数据的主要模型。微博微博

  • 10月5日,Cursor 官宣上线 GLM-5.3 与 GLM-5.3-Flash,并称 GLM-5.3 在 Max 推理设置下,取得其自有编程基准 CursorBench 4.0 的开放权重模型最高分 42.6%。同日,高盛把智谱(2513.HK)评级从"中性"上调至"买入",12 个月目标价 1560 港元,较最新收盘价有 149% 的上涨空间。智谱港股盘中涨超 6%,报 666 港元附近。微博东方财富网微博

  • 10月6日,亚马逊云 Bedrock 宣布接入 GLM-5.3,AWS 将基于模型调用量与智谱进行收入分成。智谱盘中涨近 7%,最高 702 港元,总市值 3423 亿港元。高盛还把智谱 2026 年底 ARR 预期从 27 亿美元上调到 32 亿美元,高于公司自身设定的 30 亿美元目标指引。第一财经东方财富网

核对一:“42.6% 超过了三大厂”?前半句真,后半句是话术

Cursor 的原话是"开放权重模型的最高分"——开放权重第一,不等于综合第一,而且这分是在 Max 推理设置(最重思考档)下取的。而且这条"海外走红"叙事所依赖的评测(CursorBench、Z.ai Code Bench)都是厂商自有基准,不是独立第三方。微博

更有意思的是智谱自己发布的六基准对比图:GLM-5.3-Flash 在 Terminal Bench 2.1 拿到 84.3,但在同一面板里 GPT-5.6 Terra 是 87.4、Kimi K3 是 85.0;DeepSWE v1.1 它拿 63.4,面板里的 OpenAI 是 69.6、Gemini 3.7 Flash 是 65.3。也就是说,官方图自己就写了答案:Flash 领跑的是开源阵营,不是把所有闭源前沿模型踩在脚下。

GLM-5.3 海外走红的这一周,我把 Cursor 的榜单、德国的报告和卖方研报摆成一页:哪些说法能转,哪些得改

能转的说法:"GLM-5.3 在开放权重模型里拿下 Cursor 编程基准最高分、进了 Cursor 官方模型列表。"别转的说法:“GLM-5.3 全面超越 Claude/GPT。”

核对二:德国人不是"偷"了 GLM,是公开拿它当教材

189 页报告白纸黑字写了 GLM-5.2/5.3 参与 SFT 数据生成,这是欧洲"主权 AI"项目在给政府、工业、航空航天这类受监管领域训练自家模型时,把中国开放权重模型当数据老师用。开放权重+商用友好的许可证,本来就允许这么干——Kolibri 自己也是 Apache 2.0 开源的,报告还主动做了披露。

所以"偷"是情绪化标题。准确的说法是:你花 118 元订阅、也能免费下载权重的这个模型,正在帮欧洲人训练他们"不用美国模型"的模型。这恰恰是开放权重路线的商业胜利——权重可以被拿走,但被拿走当教材,才是能力的证明。

核对三:涨的不是"人气",是渠道

把港股两日行情拆开看,驱动因素全在商业化侧:Bedrock 按调用量分成(Anthropic 已经验证过这条路:市场消息称其 2025 年约 46 亿美元收入中,约 21.6 亿美元、接近一半经 Amazon/Google 云市场完成)、华为云已上架 GLM-5.3、阿里云百炼有类似合作——智谱正在形成覆盖国内外云平台的模型分发体系。高盛上修的也是 ARR,不是情怀分。第一财经

但同一篇报道也点了反面:开放权重意味着企业拿了权重就能自部署,模型开放程度越高,生态扩张越快,但潜在的自部署也可能分流云 API 调用收入;海外企业对数据安全、合规、供应链稳定性的门槛,也还没为智谱放开。第一财经

还有底色别忽略:9 月底 36 氪的标题还是"三个月,智谱跌没 1 万亿",中国最贵 AI 公司,股价打了两折。 这两天是超跌反弹+真催化剂,不是趋势反转。高盛"149% 上涨空间"这句话本身,就是现价还趴在深水的数学表达。36氪

核对四:便宜是真的便宜,账单设计也是真的设计

为什么 Flash 敢把价格打下来?看官方架构图就明白:与旗舰 GLM-5.3 相比,Flash 大幅压缩了每层 KV-Cache 与注意力计算量(官方图标注旗舰为 Flash 的 4.44×/3.01×),把成本端优先级拉满——第三方实测发布初期输出速度只有 50 token/s 出头,低于同类模型约 67 的中位水平。慢,是省钱的另一面。知乎

另外值得每个还在用套餐的人看一眼:GLM-5.3-Flash 的 reasoning_effort 默认就是 max 档。按官方 Z.ai Code Bench 的 effort 曲线,low→high→max 的完成率约 21.5%→28.1%→29.0%,单任务平均输出 token 约 4 万→6.7 万→14 万——从 high 到 max,token 翻倍,只换回 0.9 分。不是模型分不清轻重,是默认档位替所有人选了最贵的那一档。想控账单,先去调这个参数。知乎

GLM-5.3 海外走红的这一周,我把 Cursor 的榜单、德国的报告和卖方研报摆成一页:哪些说法能转,哪些得改

GLM-5.3 海外走红的这一周,我把 Cursor 的榜单、德国的报告和卖方研报摆成一页:哪些说法能转,哪些得改

先别急着庆祝的两个理由

一是有博主把这轮"走红"拆得很清醒:海外热度里混着三种东西——真实技术评估、"又一个中国模型"的地缘叙事、以及一周的尝鲜。真正难的不是登上讨论区,是半年后还有人没把配置删掉。这周海外模型圈还有匿名模型"ox-alpha"冲到用量榜首、随后被指认为 GLM-5.3-Flash 未公开版本的插曲。 注意,这条从指认到数据都还是博主们的截图转述,别当官方事实引用。微博微博

二是官方自己也知道,榜单和真实好用之间隔着一条河:智谱早些时候发布的 CC-Bench-V2 真实工程场景图(GLM-5/4.7 这代数据,非 5.3)里,前端构建成功率 98.0% 很能打,但多步长链任务 52.3% 被 Claude Opus 4.5 的 61.6% 压着——这代际差距图恰好说明:被海外工具"选中"只是起点,"半年后还在用"才是决赛。

GLM-5.3 海外走红的这一周,我把 Cursor 的榜单、德国的报告和卖方研报摆成一页:哪些说法能转,哪些得改

另有一条单一线索记在这里备查:今天有 AI 日报称英伟达投资的 Reflection 发布了首款开放权重模型 Beam,性能直接对标 GLM-5.2 与 Qwen3.8-Max,被解读为对冲中国开放权重的低成本竞争。单一来源、未获第二信源证实,等证实了再兴奋。哔哩哔哩

这三类人各带走一条

  • 还在 GLM 套餐里或观望的:这轮事件不改套餐价格,但改"渠道风险"——Cursor、Bedrock、华为云、百炼都接入了,5.3 的权重本身还能免费下载自部署。你之前担心的"被限速、被暗改、一家独大",现在都有了替代出口:订阅照旧当主力,把自部署当逃生门备好。

  • 要给公司选型编程模型的:分发网络是现成的,但采购核对表里请继续放着两行——ZCode 风波后承诺的开源与第三方审计进展是否公开可查,以及海外云分成的数据留存条款是否覆盖你们的代码合规要求。数据主权敏感的项目,Kolibri 已经演示了标准答案:自部署,比托管调用更好谈。

  • 只需要谈资的:三个"第一次"够你讲一周——开放权重模型第一次在 Cursor 自家编程基准登顶;欧洲主权 AI 第一次在 189 页报告里承认用中国模型做数据老师;卖方第一次为"海外云分成"上修中国大模型公司的 ARR。别说"超越"“偷了”“反转了”,这三个词明天就会被评论区打脸。

接下来值得盯的信号

  1. CursorBench 之外,第三方独立评测把 GLM-5.3 放进真实仓库任务的表现;

  2. 智谱下一次财报口径里,ARR 兑现进度与海外云分成收入占比;

  3. Kolibri 之后,GLM 开放权重许可证会不会引来合规挑刺——目前双方都安静,这是开放权重路线要交的下一份作业;

  4. 聚合平台上"ox-alpha"们的留存率:热度是流量给的,站稳是使用给的。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章