全网爆火的牛马大模型,大概率是GLM-5.4V?
这两天 OpenCode 悄悄上线了一个免费模型,代号叫 Ox Alpha。
一上来就放出了 100 万字的上下文记忆,而且同时支持图片和视频等多模态输入。因为最近圈里关于 MiMo V3 的传闻挺多,不少人第一反应都以为这是 MiMo 要发新版本了。
不过,随着这两天各路玩家拿各种测试和抓包数据对比,真相已经基本明朗:这个 Ox Alpha 和 MiMo 没什么关系,而是智谱在正式发布前放出来做高压测试的全新多模态模型。
根据现有的实测数据,我个人推测:这个模型大概率就是智谱接下来的重磅多模态版本,暂且可以叫它 GLM-5.3V,甚至有可能是进一步做了速度和成本优化的 GLM-5.4V。

底层特征几乎完全吻合
为什么大家这么确定它是智谱?原因很简单,底层的技术特征基本完全对应上了。
分词逻辑高度重合
有测试者用了 25 组完全不同的提示词去跑原始 Token(模型理解和拆分文本的基础单位),发现 Ox Alpha 的计数和 GLM-5.3 几乎一模一样,每次都只固定多出 75 个 Token。这种底层的处理习惯重合度太高了。
接口与控制参数一致
这个模型强制开启了深度思考,而且思考深度只提供了 low、high、max 三档,默认全放在 max 上。当你尝试把温度参数(控制随机性的指标)设为 2.0 时,系统会直接提示限制数值范围[0,1],这也是智谱 API 非常标志性的提示语。
报错代码直接对应
在测试过程中触发异常时,Ox Alpha 直接抛出了1210这个状态码。了解国内大模型接口的都知道,1210 就是智谱专属的错误代码。
命名逻辑的延续
之前智谱在 OpenRouter 上测试匿名模型时,代号叫 Pony Alpha(小马),后来确认就是 GLM-5。这次换成了 Ox Alpha(牛)。小马配牛,命名脉络非常清晰。

为什么推测是 GLM-5.3V 甚至 5.4V?
很多人对智谱的印象还停留在文字和代码能力上,但实际上从 GLM-4.1V 到 4.5V,再到今年 4 月的 GLM-5V-Turbo,智谱在视觉多模态上一直在迭代。
这次的 Ox Alpha,更像是把智谱两条成熟的技术线做了一次融合:把 GLM-5.3 的百万级上下文和强推理能力,直接接进了 GLM-5V 的视觉架构里。
在实际测试中,无论是解读复杂视频,还是对金门大桥、箱庭小镇等生成画面的细节分析,它的长程任务表现都非常稳。
速度为什么反而更快
更关键的一个细节是生成速度。不少第一批用上的网友反馈,Ox Alpha 的响应速度比现有的 GLM-5.3 快了大约 30% 以上。
如果只是单纯加了一个视觉模块,速度通常很难不降反升。基于这一点,我个人倾向于两种可能:
推测一(GLM-5.3V):这是在 5.3 底座上直接整合视觉能力的标准多模态版本;
推测二(GLM-5.4V / Flash版):智谱在叠加视觉能力的同时,对底层算法和算力开销做了深度优化,推出来一个响应更快、成本更低的新一代架构。

匿名上线,为了拿真实的压力数据
大厂在正式发布前选择匿名上线,主要还是为了拿到真实的压力测试数据。仅靠内部跑分很难覆盖所有极端场景,比如之前 DeepSeek 在 V4 Pro 0813 上就出现过第三方评测与自家测试不匹配的情况。
智谱这种直接放出一个免费模型让全网用户跑真实工作流的做法,既能提前发现实际使用中的问题,也能顺便测试算力的承载极限。
如果大家最近有长文档分析或者复杂的看图需求,趁着 OpenCode 目前还在免费阶段,可以顺手拿去跑跑看。

