4.36万亿token、日增73%:GLM-5.3-Flash登顶OpenRouter这天,开源第一却被小米摘走了

源自43位全网作者

05:23

9月22日这天,国产大模型圈罕见地"一鱼两吃":下午,OpenRouter 最新日榜流出,智谱 GLM-5.3-Flash 单日调用量冲到 4.36 万亿 token,环比增长 73%,把 DeepSeek V4.1 Flash、腾讯 Hy4 Preview 和 OpenAI GPT-5.6 Luna 全压在身后,坐上平台模型调用量第一的位置,连马斯克都被报道"点赞"。 而就在当天凌晨,小米发布并开源了 MiMo-V2.6 系列,在 ArtificialAnalysis 综合智能指数上拿下 46 分,反超 GLM-5.3 的 45 分,成为 114 个开放权重模型里的第一名,雷军亲自发微博晒排名。东方财富网微博

一天之内,"用量第一"和"开源第一"两顶皇冠分属两家。刷屏归刷屏,对每天在 Claude Code、ZCode、KimiCode 里跑活、按 token 算账的 flash 党来说,真正的问题是:这两张榜到底各说明什么,默认模型该不该动?

先把 4.36 万亿 token 拆开看

OpenRouter 是全球头部 API 聚合平台,它家的日榜量的不是"谁最聪明",而是"谁被调用得最多"。 GLM-5.3-Flash 这次的数字有三个值得注意的点。微博

一是量级。4.36 万亿 token 一天,且较上一统计周期增长 73%。往前翻,这枚"炸弹"其实埋了快一个月——8 月底 OpenRouter 上出现过一个匿名模型 OxAlpha,6 天狂飙 62 万亿 token,社区挖了半天,官方揭晓:就是 GLM-5.3-Flash,代号"牛来",也是智谱第一个原生多模态模型,训练用的国产卡。哔哩哔哩36氪

二是对手名单。它超过的是 DeepSeek V4.1 Flash、腾讯 Hy4 Preview、OpenAI GPT-5.6 Luna——清一色各家主打"便宜大碗"的 flash/preview 档。换句话说,这是一场发生在"性价比档位"内部的王座争夺,不是旗舰智商的对决。

三是商业底账。这个调用量是有收入托底的:智谱 2026 上半年 API 收入 8.25 亿元,同比增长 2736%,占总收入比重从 15.2% 飙到 86.5%。 截至 8 月底,智谱 MaaS 平台按月度计算的 ARR 已达 16 亿美元,较 7 月上旬的 10 亿美元两个月内涨了 60%,周度口径甚至到过 20 亿美元。36氪

再叠上 9 月 13 日那笔约 50 亿美元融资(20 亿美元配售 + 30 亿美元零息可转债,转股价 892.50 港元、较市价溢价约 12.55%),智谱账上现金超 200 亿港元还要继续融,投的就是下一代 GLM、完全自训练体系和算力基础设施。36氪

用量第一 ≠ 最强,这张榜量的是"便宜 + 能扛活"

调用量榜的底层逻辑其实很朴素:agent 和编程场景是 token 消耗大户,谁便宜、谁稳定、谁能扛长上下文的脏活,谁就会被默认模型配置推上去。GLM-5.3-Flash 的卖点恰好对齐——100 万 token 上下文、原生多模态、国产卡训练带来的成本空间。

知乎上的用户口碑也能对上这个逻辑:GLM 系写代码"四平八稳、擅长处理屎山"。 也有人总结三家 flash 的格局是"便宜不如 DeepSeek V4.1 Flash,智商不如 GLM-5.3-Flash"。 翻译一下:论单 token 价格它不是最便宜的,论智商它不是最高的,但"每分智商的价格"和"扛屎山的稳定性"让它成了调用量之王。至于 GLM-5.3 正代,社区里"特别慢、也贵,目前流行的是 flash 模型"的声音一直没停过。知乎知乎

同一天的另一张榜:46 分对 45 分,一分的差距藏着不少水分

同一天,小米 MiMo-V2.6 以 AA 智能指数 46 分登顶开源第一(总榜并列第六),GLM-5.3 的 45 分被挤到第二,Kimi K3 的 44 分第三。 旗舰 MiMo-V2.6-Pro 是稀疏 MoE 架构,总参数 1.02 万亿、激活 420 亿,支持 100 万 token 上下文,同步开源的还有 MiMo-V2.6-Flash 和超高速模式 Ultraspeed,以及 MiMo Desktop 桌面端正式版。微博微博

但社区实测的口径要冷静不少。有重度用户直言 MiMo-V2.6-Pro “能力方面没有真正达到 GLM-5.3 和 Kimi K3 的水平,大体和 Qwen3.8 max 差不多”,属于"国模三四"。 Flash 版则被评价为"日常可用,稍微上点强度就差了那么点意思"。 还有个很实操的坑:官方 harness 拖后腿——在 MiMo 自家桌面端和 MiMoCode 里表现平平,放进 KimiCode 或 Claude Code 里反而明显更好。知乎知乎

flash 党的比价账:一张表看清该用谁

以 MiMo V2.6 Flash 的消耗成本为 1 元基准,知乎用户翔宇情按当天使用量粗算了一组数:DeepSeek V4.1 Flash 空闲时段 ≈ 1.42 元,MiMo V2.6 Pro 套餐价 ≈ 2.75 元,DeepSeek V4.1 Flash 高峰时段 ≈ 2.84 元。 官方 API 定价则沿用 V2.5 系列:Pro 每百万 tokens 输入 3 元、输出 6 元,Flash 输入 1 元、输出 2 元,缓存命中的价格还要再低一个数量级。知乎微博

这组数能直接推出策略:DeepSeek 高峰时段,用 MiMo V2.6 Pro 更强且更便宜;DeepSeek 空闲时段,V4.1 Flash 便宜 42%,闭眼选它。 GLM-5.3-Flash 的位置则卡在中间——智商口碑略胜各家 flash 一头,价格不如 DeepSeek 空闲时段狠,适合当"不分时段的稳态默认",这也是它能在 OpenRouter 上堆出 4.36 万亿调用的用户基础。知乎

两个补充细节:一是链路差价,MiMo 官方 API 对比第三方链路(如 OpenCode Go、Command Code Goat)最高能有 6 倍以上的价格差异,但不同链路的实测速度体验差得也不小,“一分钱一分货,想稳定就得多花钱”。 二是小米的 token plan 最低 39 元/月,额度用不完可滚存到下月抵扣,没有 5 小时/7 天限制,按 39 元档粗算约可用 V2.6 Pro 1.3 亿 token 或 Flash 3.5 亿 token。 GLM 侧的套餐、夜间免费和 FlashX 的账,此前已经单独拆过,这里不重复。知乎知乎

接下来盯三个信号

第一,OpenRouter 出的是日榜,单日登顶有脉冲成分——GLM-5.3-Flash 上线首日也曾刷新平台单日纪录,能不能在周榜上站稳一周,才是"用量第一"成色的验证。 第二,有分析认为 MiMo-V2.6 只是 V3 的分模块验证版本,MiMo Flash 的真实水平等各家跑分和"屎山修 BUG"实测再下结论不迟。 第三,智谱从 2 月到 8 月保持着约两个月一代的迭代节奏(GLM-5 到 5.3),照此推算 GLM-5.4 的时间窗在 10 月底前后,叠加 50 亿美元融资投向的"下一代 GLM 模型",下一次榜单变数大概率就在一个月内。36氪知乎

一句话收束:用量榜告诉你"大家都在用什么",智商榜告诉你"谁的分最高",而你自己的默认模型,应该由你的账单时段和任务强度决定。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章