这两天,AI圈被一头"牛"刷屏了。
8月20日前后,OpenRouter上线了一个匿名模型,代号OxAlpha。知乎官方介绍基本就一句话:面向高效编程、长时间Agent任务和生产环境的前沿模型,100万token上下文,支持文本、图片和视频输入;参数规模、架构、基准成绩和开发团队全部保密。Ox就是"牛",国内网友直接叫它"牛来"。

OpenRouter官方页面显示,它的中位首token延迟约1.95秒,输出速度约每秒49个token,最近三天可用率接近100%。36氪
到8月22日,微博话题#新模型OxAlpha引大规模身份猜测#已经挂出来了。微博知乎上"如何看待OpenCode声称将在下周推出匿名模型OxAlpha?它会是MiMoV3吗?"的问题浏览量已超过40万。知乎而在所有猜测里,热度最高的之一就是:这是不是小米憋了很久的MiMo-V3?
作为替你看全网的人,我把36氪、知乎的指纹测试、微博上的爆料挨个对了一遍。先说结论:情怀上可以理解,证据上暂时站不住。但这件事对米粉来说依然值得花三分钟看完——因为它恰好把小米AI的两条线索串起来了。下面细说。
一、为什么全网第一反应是小米?三条线索都不是空穴来风
我理解米粉的直觉,因为支持"小米说"的线索确实硬:
线索一:时间点对上了。 8月18日,小米集团CFO林世伟透露,新一代MiMo模型正在训练,“很快会发布”。知乎两天后OxAlpha现身,很难不联想。
线索二:小米有"前科"。 今年3月,代号Hunter Alpha的神秘模型在OpenRouter免费上线,一度被外界猜测是DeepSeek的新模型,随后小米确认其为MiMo-V2-Pro,同样具备100万token上下文。知乎上线后它很快突破1万亿token调用量。36氪打法一模一样。
线索三:定位重合。 OxAlpha主打编程、长周期Agent、生产环境;MiMo系列的主攻方向也是代码、工具调用和长周期执行。Reddit上有位用户回答别人追问时写道,Mimo确实经常以100万亿Token为单位进行预算。36氪而OpenCode这次给OxAlpha准备的压测容量,恰好是每天100万亿(100T)token——又一个巧合。
所以Reddit、X上"这很可能就是MiMo-V3,趁它还开放赶紧用"的说法传得很广。B站有测评视频以"网传它就是MiMo-V3"为引子开测,播放量已超过1万,评论上百条。
二、但技术指纹不听情怀:三项测试全指向智谱
转折点在这儿。知乎有位用户不猜,直接动手做了三项指纹测试,每一项都指向智谱:
测试一:API报错格式。 故意传非法参数,OxAlpha返回`[1210] The temperature parameter is illegal.`这类中英文混排的报错——1210状态码加混排文案,是智谱开放平台API的标志性特征。知乎OpenAI系是纯英文JSON,DeepSeek是另一套错误码体系。
测试二:分词器指纹。 同一段中英混排加代码加emoji的文本,GLM-5.3和GLM-5.2都切出68个token,OxAlpha是143。差的75,正好是OpenCode套在外面让它自称"ox-alpha"的隐藏系统提示词——68加75等于143,严丝合缝。知乎
测试三:社区交叉验证。 有独立研究者用50组对抗性文本做分词器对比,OxAlpha与GLM-5.3的分词器匹配度最高,而Gemini、DeepSeek和Kimi的匹配度仅为18%到22%。36氪更微妙的是,有用户在它的思考过程输出里捕捉到过"trained by Z.ai"的字样残留。知乎

还有人换视频输入做探针:四段参数固定的测试视频,OxAlpha的token消耗与智谱GLM-5V-Turbo完全一致,且同时匹配三个独立的编码器设计选择;作为对照,小米自家的MiMo v2.5、通义Qwen 3.8 Max、GLM-4.6V的编码器签名都对不上。知乎注意最后这个细节:连小米自家模型的指纹都不吻合。
做DeepSWE测试的独立研究者本·戴维斯推测,OxAlpha有约99%的概率属于智谱GLM-5.x系列,另一份独立分析给出的置信度也有90%左右。知乎目前流传最广的说法,是智谱尚未发布的GLM-5.3 Flash,或其多模态版本。微博
再往前翻,智谱年初也玩过同一套:匿名模型Pony Alpha,后来被认领就是GLM-5。知乎
至于"问模型本人你是谁"得到的答案——有截图说OxAlpha自称Gemini——36氪讲得很清楚:模型回答"我是Gemini"“我是Claude"或者"我是某个OpenAI模型”,都不能作为归属证据。36氪8月22日又冒出新的说法,知乎出现了"怎么看谷歌的人集体暗示 Ox Alpha 模型是 Gemini ?"的问题。知乎还有"爆料指向Qwen"等说法,水越搅越浑。截至22日深夜,微博上相对收敛的口径仍然是:根据网友测试线索,大概率是智谱的GLM。
需要强调的是:智谱官方也还没认领,以上全部是技术取证推断,不是实锤。 只是目前所有可验证的证据都朝一个方向,而"小米说"目前一条硬证据都没有。
三、对米粉来说,这件事真正的信息量在别处
先别急着失望。把镜头拉远,这轮热闹对关注小米AI的人,其实有三个实打实的增量信息:
第一,MiMo-V3确实快来了,不用再焦虑"跳票"。 知乎上有个问题叫"小米 mimo v3 系列迟迟不发,具体原因是什么?“,浏览量超过10万,标题本身就说明等待的焦虑。知乎现在财报会给出官方口径"正在训练、很快发布”,节奏是清楚的。就算这次"牛来"不是小米的,小米自己的大版本也在路上了。
第二,小米已经验证过这条"隐身测试"路线。 Hunter Alpha当年就是先匿名压测、跑出调用量、再官方认领的。所以哪怕OxAlpha最后真不是MiMo,也别觉得"小米怎么不搞这种营销"——他们搞过,而且是第一个吃螃蟹的国产厂商之一。下次再出现神秘Alpha模型,先看有没有小米的指纹(比如那套API报错习惯),这是可以复用的判断方法。
第三,小米的AI基本面没变。 二季度财报里,AI相关业务还在投入阶段,含汽车售后服务在内的这部分营收才10亿元。微博单季研发投入达92亿元,同比增长18.9%。微博而MiMo-V2.5已登顶OpenRouter全球大模型调用量榜首,两个月调用量从1.5万亿涨到10.5万亿,增长超六倍。微博这些跟"牛来"是不是小米没关系,是基本盘。
四、这周免费期,值不值得上车?怎么上?
不管你站哪边,免费白嫖是真的——OpenCode宣布OxAlpha在其平台上免费开放一周。36氪平台为这次压测准备了每天100万亿token的容量,并承诺零数据保留。知乎
而且窗口期很短:按照此前几款匿名模型的发布节奏,免费测试可能在8月27日前后结束。知乎给一个实操清单:
怎么接入:去OpenRouter注册(Google账号或邮箱即可,不用绑卡),在Keys页面创建API Key;模型ID是`stealth/ox-alpha`。36氪免费档,支持任何兼容OpenAI协议的工具接入,Base URL加Key加模型名三件套。免费模型有限速,日常玩够用。
拿它干什么最值:它的长板是100万token上下文和Agent任务——喂它整个代码仓库、让它连续改几十个文件、跑长周期的自动化任务,这些是平时按token计费时舍不得干的活。B站已有实测:逻辑题顺利答对、3D赛车小游戏完成度很高,但指令遵循偶有失误(比如限定句数的任务结尾数字对不上),太空射击类游戏也有功能失效的情况。哔哩哔哩

外网还有人拿最难的AI测试题——“鹈鹕骑自行车"SVG生成——做了15组对照:低、高、最高三档推理强度各画5次,低档通常只需13到21秒,最高档的推理字段骤增到1.7万至6.2万字符、单次生成耗时拉长到124至355秒,画面提升却有限——典型的"过度思考”。36氪
三盆冷水:其一,它没有公布任何SWE-bench之类的官方跑分,网上"10项任务通过率80%、干掉Fable 5"的说法,来自戴维斯的个人测试,DeepSWE官方排行榜目前尚未收录OxAlpha,别当排行榜看。知乎其二,模型身份未确认,别喂敏感代码和隐私数据,平台承诺零数据保留,但背后厂商是谁你都不知道。其三,别把它接入生产环境顶替你现在的主力模型,免费期一过或者官方认领后,入口随时可能变。

五、接下来盯三个信号
谁出来认领:微博上有自称知情人士表示,这肯定是一个中国模型,并且下周就发布。微博如果下周真有官宣,回头看指纹测试就是对答案的时刻;
小米MiMo官方账号动不动:如果真是自家的,以小米对Hunter Alpha的先例,认领会很快;如果别人认领了,就安心等小米自己的官宣——财报会已经说了"很快发布";
认领后的定价:开发者选择MiMo,除了能力,就是极具竞争力的价格和全系列开源。微博新模型认领后如果延续这个定价策略,对天天烧token的开发者才是真正值得换的大事。
一句话收尾:这头"牛"大概率不姓米,姓智谱的证据链很硬但还没实锤;对米粉来说,免费的先用上,MiMo-V3该等继续等,财报会说了很快发布,耐心等官方答案。评论区聊聊:你觉得"牛来"到底是谁?