前天深夜,OpenRouter 上悄悄多了一个匿名模型:stealth/ox-alpha。36氪没有发布会,没有厂商认领,输入输出价格都挂 0——白嫖党瞬间炸了。
一夜之间,国内 AI 圈变成大型破案现场。这个被网友叫做「牛来模型」的家伙(Ox,牛),到底是谁家的?
先说结论:社区证据链基本指向智谱的 GLM-5.3 Flash,但官方没认领。下面把证据、玩法和坑一次说清。
这模型什么来头
先看 OpenRouter 页面上能确认的硬信息:
支持文本、图片、视频三种输入,是真·多模态;
约 100 万 token 上下文;
输入、输出价格目前都是 0;
36氪报道说它「性能超过 Fable 5?」——注意,带问号,属于媒体的期待,不是实锤。

真正引爆讨论的,是机器之心 Plus 的一条笔记:指纹测试之后,这模型的身份基本藏不住了。小红书2900 多赞、700 多转发,评论区成了大型认亲现场。
为什么全网都猜是智谱
先声明:截至发稿,智谱官方没有认领。以下是社区推理,但链条相当扎实:
第一,指纹测试指向 GLM。有人对输出做了模型指纹测试,特征指向国产 GLM 系列。36氪

第二,画像吻合。圈子里的判断是「小模型 + 多模态」——这正好补智谱的短板:GLM-5.x 系列到目前为止全是纯文本,一直缺一个多模态的 Flash 档。
第三,多方口径一致。有爆料人称已确认是 GLM-5.3 Flash,智谱相关群聊也有回应流出。小红书

第四,时间线对得上。GLM-5.3 主模型 8 月 14 日发布、19 日开 API,AA 智能指数 60 分,是国产开源模型第一次摸到闭源旗舰的门槛。知乎知乎主模型立完口碑,紧接着放 Flash 小版本,是智谱一贯的节奏。
还有个佐证:差不多同一时间,DeepSeek V4 flash 也曝出补齐了多模态。小红书国产第一梯队同周补「多模态 + 小模型」,这不是巧合——下半年卷的就是这个。
为什么匿名又免费
这种操作在圈里不算头一回,背后的算盘大概是三颗:
一是免费压测。真实流量先跑起来,稳定性、推理成本全测了,零宣发费用。36氪
二是低调炫技。让社区自发拿去和顶级模型对比,「神秘模型吊打一线」的传播效果,比开发布会便宜多了。
三是观察定价。先挂 0 元看需求,正式版怎么定价,心里就有数了。
对用户来说,这就是纯白嫖窗口。但注意:社区说法是免费一周,价格页面随时可能改。36氪
值得试吗,怎么试
值得,尤其三类人:
编程 / Agent 用户:100 万上下文 + 免费,把整个仓库丢进去跑长任务,社区已经有人用 opencode 接上开测了;
想试视频理解的:国产 Flash 档的视频理解是头一批免费的尝鲜机会;
成本敏感党:0 元价格,拿日常任务试错不心疼。
上手路径很简单:OpenRouter 找到 stealth/ox-alpha,接入任何兼容 OpenAI 格式的客户端就能跑。小红书

一个小建议:短平快的任务试不出差别,这代的强项在长程任务——多步依赖、跨文件重构、长视频长文档,拿这种活去试,再和自己的主力模型做个 A/B,你会得到属于自己的结论。
三个坑,先说在前面
身份不是官宣。「基本确认」是社区推理,参数规格、正式定价都没有,别把传言当通稿转。
别挂生产链路。免费窗口随时结束,价格可能一夜从 0 变正式价。尝鲜可以,写进正式业务流程不行。
敏感数据别喂。匿名模型 + 免费通道,数据处理规则不透明,公司代码、隐私数据一律不进——这是所有免费 API 的通识,不是针对它。
顺带一个背景:今年国产大模型集体涨价,智谱三次调价累计涨了约八成,DeepSeek 高峰时段缓存价涨了十几倍。知乎这个节骨眼上冒出来的免费窗口,含金量又高了一分。
接下来盯两个信号
智谱官宣认领。一旦认领,规格卡和定价会跟上,到时候再算性价比不迟;
8 月 28 日前后,GLM-5.3 权重计划开源(MIT 许可)。知乎开源前官方披露过一组数字:拿它审计 269 个真实项目,累计发现 2436 个漏洞,其中 1097 个属于中高危,部分已存在数十年。知乎这代模型的网络安全能力涨得有多快,可见一斑。权重一放,自部署阵营又多一个选择。
最后补一个窗口:ZCode 新用户送 1 亿 GLM-5.3 token 的第二轮活动,8 月 24 日早上九点截止,名额 5 万个。小红书小红书想连主模型一起免费试的,这是最后一班车。
这一周,大概是白嫖智谱的最好窗口。错过再等,可能就是收费页面上见了。