10月6日这一天,GLM-5.3在海外拿到了两个"官宣":亚马逊云科技旗下大模型服务平台Amazon Bedrock官宣接入智谱GLM-5.3,AWS将基于模型调用量与智谱进行收入分成。 全球最火的AI编程工具之一Cursor,也正式上线GLM-5.3和GLM-5.3-Flash。微博微博
港股同步给反应,智谱(2513.HK)盘中涨超5%,消息面上它的GLM系列模型近期接连获得海外认可。 高盛也把智谱评级由"中性"上调至"买入"。财联社微博
而就在前几天,中文评论区还在骂GLM"变慢、降智"。骂声和订单,同时落在同一个模型上。这波"海外走红"到底是叙事还是生意?不管你不炒股,只要你是拿GLM写代码的人,这篇先把当天的消息拆成事实,再给你一张今天就能用的上手路线表。
一、先把时间线钉牢:这波走红不是今天才开始的
8月20日前后,一款匿名模型"Ox-Alpha"(中文社区叫"牛来")出现在OpenRouter和OpenCode上。短短几天内,调用量登顶并终结了DeepSeek在OpenCode长达56天的霸榜,单日处理Token量达62T,刷新双平台纪录。微博
8月26日晚,智谱官宣"牛来"就是GLM-5.3-Flash,正式发布并开源(320B总参数、18B激活)。36氪当时的报道标题给足了信息量:全部国产卡承载,价格仅为Opus 4.8的1/40。36氪
进入10月,海外采用名单越拉越长。Cursor称GLM-5.3在Max推理设置下、于其自有评测CursorBench 4.0中拿到开放权重模型最高分42.6%;德国主权AI公司Aleph Alpha的新模型Kolibri,披露使用GLM-5.2、GLM-5.3进行监督微调数据生产。东方财富
更细的颗粒度:比利时网络安全公司Aikido Security基于GLM-5.3推出开放权重安全模型Altar。 海外推理服务商Prime Inference把对外开放的首个公开端点,也给了GLM-5.3。东方财富知乎

匿名登顶→开源→被海外工具、云、主权AI和安全公司逐个点名,这条链路是两个月一步步走完的,不是今天一条新闻砸出来的。这是"走红"里最扎实的部分。
二、42.6%的最高分,哪能高兴、哪不能
先把措辞拆开,三个限定词一个都别漏:
类内第一,不是全场第一。"开放权重模型最高分"意思是:在Cursor的评测里,开源阵营它第一,闭源旗舰还坐在桌上。42.6%的绝对分,反过来读就是——按Cursor自己的业务题,超过一半的场景它还没搞定。
这是"考官的题"。CursorBench是Cursor自建的真实业务测试集,好处是贴近写码现场,提醒是它由采用方自己发布,等于"考官给你出了他的题,你考了个他认可的分"。
有交叉验证,但也有另一面。智谱8月的发布材料显示,GLM-5.3在Terminal-Bench 3.0上从上一代的4.6分升至28.3分(开源第一);NIST下属CAISI的评估,也把GLM-5.3列为网络安全能力最强的开放权重模型之一。 知乎有开发者拿35道TypeScript多步函数调用链自测,换算后加tokenizer差异,实际账单glm-5.3花了qwen3.8-max大约4.7倍的钱。微博东方财富知乎
一句话结论:"站进开源第一梯队"是事实,"海外用户无脑吹"是渲染。有条被转得挺多的反驳说得克制:走红是流量给的,站稳是用户一次次没卸载给的。微博
三、分润模式才是这天的重头戏
过去国产模型出海,打法基本是"便宜+私有化部署",卖一次算一次。Bedrock这次的模式不一样:AWS负责推理和销售,智谱按全球客户调用量收分成。据报道,智谱已与多家中外云服务商签了类似的分润协议,公司据此把年底ARR指引从24亿美元上调至30亿美元——而9月初的投资者纪要口径是全业务ARR已达16亿美元,收入结构正在从项目制转向token。 对照另一边:中报里"营收涨4倍、亏损20亿",产业订单和公司账面营收是两个口径,分润模式要填的正是这条从订单到确认收入的沟。36氪36氪

资本市场立刻给了价格反馈。深度回调后的智谱这两天迎来强势反弹,单日大涨8%,现价约720港元;从6月历史最高点2950港元算起,该股最大回撤80%。 这轮修复更像"海外收入通道打开"的新变量,对冲了前面降智投诉、架构负责人被挖角那一串旧消息。要不要在意股价是你的事,但分润数据是实打实的观察点——下季度财报里"海外云调用收入"那一栏,比今天任何一篇吹文都硬。微博
四、国内用户上手GLM-5.3:五条路的成本清单
路线 | 现状 | 成本参考 | 适合谁 |
|---|---|---|---|
① Cursor订阅内直接用 | GLM-5.3/5.3-Flash已上线,进模型选择器 | 已有Cursor订阅内消化;有无新模型促销、Max模式如何计费,以官网为准 | 主业在Cursor里写码、想做同环境A/B的人 |
② 智谱自家Coding Plan | 四档在售,Lite档118元/月最走量 | 续订前先看第二节的抱怨有没有被解决 | 已在智谱生态的重度用户 |
③ 官方API按token计费 | 稳定可得 | 计费单位有坑:同一段中英混合代码,智谱tokenizer切出的token比通义多约1.1-1.3倍 | 自建工具、认真做评测的人 |
④ 聚合平台(OpenRouter等) | model ID如 z-ai/glm-5.3,OpenAI兼容 | 换模型只改一个参数,不用维护两套SDK | 多模型横跳、想省钱比价的人 |
⑤ 免费与本地 | 商汤免费档可调GLM-5.2;llama.cpp社区已适配5.3-Flash混合推理 | 免费;本地跑不动(320B参数) | 尝鲜可以,别当生产力依赖 |

免费这条线值得多说一句:商汤SenseNova Token Plan公测,免费档¥0/月、注册就能用不用绑卡,官方列的7款模型里就有GLM-5.2。 但注意,那里是GLM-5.2,不是这次海外走红的5.3。知乎
付费这条线,智谱9月把自己摆上了天猫的货架,店铺上架的唯一商品是四种不同价位Token套餐。 四档从Lite到Max,月费118元到1078元不等,买完不发货、直接在账号里开通额度——大模型订阅第一次长得像话费充值卡。36氪

顺带提醒两个坑。知乎那位自测者记录:105次流式请求里GLM-5.3断了6次,tool_choice设了auto有时也被无视直接输出纯文本,生产环境要加重试;这是同一篇自测里的细节,样本小,当参考不当结论。10月6日知乎上还有用户投诉Zcode自行使用GLM周重置卡、至今未获官方实质性答复。 毕竟9月ZCode刚因为"被指偷传代码"闹过一轮回,智谱给出的方案是开源并接受第三方审计。知乎36氪
怎么选给句痛快话:已经在付Cursor钱的,路线①今天就能用,边际成本为零;主力是国产工作流的,先走聚合平台(④)低价试试,再决定续不续118元的Coding Plan;图省事的,商汤免费够你玩,但那是上一代模型。
五、接下来盯什么
Cursor后续是否放出GLM-5.3的调用占比/榜单表现——"半年后配置没被删"才是真正的考验;
智谱官方对降智、断流、tool_choice行为、Zcode重置卡事件的一揽子回应;
分润模式有没有第二家、第三家云跟进——跟进越多,说明这不是单点合作而是收入结构变化;
Kolibri这类"站在GLM上做微调"的衍生用法,会不会带出署名与许可证的新争议。
中国大模型走到今天,第一次以"别人技术选型清单上的选项"这个身份上头条,而不是"国产替代"。对普通用户来说,最值得高兴的其实特别实际:用GLM-5.3的路子,比去年多了、也便宜了。上面这张表,够你明天上班前挑定一条。