当前位置:
文章详情

全网爆火的牛马大模型,大概率是GLM-5.4V?

2026-08-21 21:16:22 0点赞 4收藏 0评论

这两天 OpenCode 悄悄上线了一个免费模型,代号叫 Ox Alpha。

一上来就放出了 100 万字的上下文记忆,而且同时支持图片和视频等多模态输入。因为最近圈里关于 MiMo V3 的传闻挺多,不少人第一反应都以为这是 MiMo 要发新版本了。

不过,随着这两天各路玩家拿各种测试和抓包数据对比,真相已经基本明朗:这个 Ox Alpha 和 MiMo 没什么关系,而是智谱在正式发布前放出来做高压测试的全新多模态模型。

根据现有的实测数据,我个人推测:这个模型大概率就是智谱接下来的重磅多模态版本,暂且可以叫它 GLM-5.3V,甚至有可能是进一步做了速度和成本优化的 GLM-5.4V。

全网爆火的牛马大模型,大概率是GLM-5.4V?

底层特征几乎完全吻合

为什么大家这么确定它是智谱?原因很简单,底层的技术特征基本完全对应上了。

分词逻辑高度重合

有测试者用了 25 组完全不同的提示词去跑原始 Token(模型理解和拆分文本的基础单位),发现 Ox Alpha 的计数和 GLM-5.3 几乎一模一样,每次都只固定多出 75 个 Token。这种底层的处理习惯重合度太高了。

接口与控制参数一致

这个模型强制开启了深度思考,而且思考深度只提供了 low、high、max 三档,默认全放在 max 上。当你尝试把温度参数(控制随机性的指标)设为 2.0 时,系统会直接提示限制数值范围[0,1],这也是智谱 API 非常标志性的提示语。

报错代码直接对应

在测试过程中触发异常时,Ox Alpha 直接抛出了1210这个状态码。了解国内大模型接口的都知道,1210 就是智谱专属的错误代码。

命名逻辑的延续

之前智谱在 OpenRouter 上测试匿名模型时,代号叫 Pony Alpha(小马),后来确认就是 GLM-5。这次换成了 Ox Alpha(牛)。小马配牛,命名脉络非常清晰。

全网爆火的牛马大模型,大概率是GLM-5.4V?

为什么推测是 GLM-5.3V 甚至 5.4V?

很多人对智谱的印象还停留在文字和代码能力上,但实际上从 GLM-4.1V 到 4.5V,再到今年 4 月的 GLM-5V-Turbo,智谱在视觉多模态上一直在迭代。

这次的 Ox Alpha,更像是把智谱两条成熟的技术线做了一次融合:把 GLM-5.3 的百万级上下文和强推理能力,直接接进了 GLM-5V 的视觉架构里。

在实际测试中,无论是解读复杂视频,还是对金门大桥、箱庭小镇等生成画面的细节分析,它的长程任务表现都非常稳。

速度为什么反而更快

更关键的一个细节是生成速度。不少第一批用上的网友反馈,Ox Alpha 的响应速度比现有的 GLM-5.3 快了大约 30% 以上。

如果只是单纯加了一个视觉模块,速度通常很难不降反升。基于这一点,我个人倾向于两种可能:

推测一(GLM-5.3V):这是在 5.3 底座上直接整合视觉能力的标准多模态版本;

推测二(GLM-5.4V / Flash版):智谱在叠加视觉能力的同时,对底层算法和算力开销做了深度优化,推出来一个响应更快、成本更低的新一代架构。

全网爆火的牛马大模型,大概率是GLM-5.4V?

匿名上线,为了拿真实的压力数据

大厂在正式发布前选择匿名上线,主要还是为了拿到真实的压力测试数据。仅靠内部跑分很难覆盖所有极端场景,比如之前 DeepSeek 在 V4 Pro 0813 上就出现过第三方评测与自家测试不匹配的情况。

智谱这种直接放出一个免费模型让全网用户跑真实工作流的做法,既能提前发现实际使用中的问题,也能顺便测试算力的承载极限。

如果大家最近有长文档分析或者复杂的看图需求,趁着 OpenCode 目前还在免费阶段,可以顺手拿去跑跑看。

全网爆火的牛马大模型,大概率是GLM-5.4V?全网爆火的牛马大模型,大概率是GLM-5.4V?
展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
相关好价
最新文章 热门文章
4
扫一下,分享更方便,购买更轻松