80%碾压Fable 5:这头匿名"牛"把AI圈搞懵了
80%碾压Fable 5:这头匿名"牛"把AI圈搞懵了

8月20日,全球最大AI模型聚合平台OpenRouter的目录里,悄悄多了一条,stealth/ox-alpha。
没有公司名,没有参数规模,也没有技术报告。价格栏写着两个零,免费[1]。
Ox在英文里是公牛。最近一部国产动画带火了牛来了这个梗,中文社区直接管它叫牛来大模型[1]。这头牛一上线就冲到OpenRouter榜首,刷新了平台单日模型调用量纪录[1]。
先看硬参数。上下文窗口104.86万token,单次最大输出13.1万token[2]。你可以把一整个中型代码仓库、几百页文档、或者一长串Agent执行记录一次性塞进去,让它一口气读完。
输入支持文本、图片、视频三种模态,输出文本。原生支持工具调用、函数调用和JSON结构化输出[2]。它的定位很清楚,写代码、跑Agent、干长周期任务,不是陪你聊天的。
实测成绩才让人不安。独立研究员本·戴维斯从DeepSWE软件工程基准里抽了10个真实任务,模型要读代码仓库、找bug、改代码、跑测试,不过还得回头修。Ox Alpha过了8个,通过率80%[1]。同一组任务里,Claude Fable 5是65%,GLM-5.3是62%,GPT-5.6 Sol是52%[1]。
Stripe的CEO亲自上手实测,就四个字,相当惊艳[1]。
一个免费匿名模型,在编码Agent任务里压过一线闭源模型。这事本身就够离谱的。
Ox Alpha的厂商身份至今没人认领。OpenRouter只标注了一句话,匿名第三方提供[1]。
AI圈于是开启了一场大型猜谜。技术指纹比对指向智谱GLM系列,相同的视频编码器、相同的文本分词器、风格也匹配[1]。独立研究员本·戴维斯甚至说,99%确定是GLM-5.x[1]。
另一边,多名谷歌DeepMind研究员发帖暗示,这可能是Gemini的新版本[1]。小米、腾讯也被网友列入怀疑名单,但都没有实锤。
厂家为什么不站出来?匿名上线是最干净的测试方式。没有先入为主的偏见,没有粉丝滤镜,好用就是好用,不好用立马被弃[1]。先隐身再亮相,既能收集真实反馈,又避免过早被架到火上烤。
长上下文与代码仓库示意Ox Alpha限时免费开放一周。上线四天,周调用量达到11.6万亿token,冲到全球第二[2]。前五大应用累计调用超过4万亿token[1]。
这账我熟。做零售IT的都知道,免费是最贵的获客成本。模型厂争的是开发者的习惯和生态位,不是这一周的API收入。
一个开发者这周把Agent工作流接到Ox Alpha上,如果效果真的好,下周收费了他也大概率接着用。迁移是有成本的,长上下文、多模态、工具调用这套东西一旦跑顺,谁愿意重新调一遍?
OpenRouter这个平台也乐见其成。调用量上来了,平台抽成就上来了。Ox Alpha、DeepSeek、小米MiMo、腾讯Hy3,中国模型已经连续十七周在全球调用量上压过美国[2]。这是开发者生态的重新洗牌,不止一家公司的胜利。
我试用新模型有个原则,可以拿公开代码、公开文档去测,绝不塞公司真实数据。
Ox Alpha是匿名模型,没有厂商背书,也没有服务协议[1]。你今天把客户名单、销售数据、内部代码扔进去,明天模型下线了,数据去哪了你都不知道。它还没有数据隐私说明。
尝鲜可以,但边界要划清楚。对普通开发者来说,它是白嫖跑分的工具。对企业来说,它还不是能接生产环境的选项。
牛来了,但牛是谁家的、会不会踢人,还得再看。
参考来源
[1] 腾讯新闻《"牛来"模型刷屏!匿名、免费、跑分碾压背后,藏着算力生意的下一步棋》(2026-08-24):Ox Alpha上线、免费、DeepSWE 80%通过、身份猜测、调用量纪录。
[2] 中国AI大模型调用量周榜(2026-08-24):Ox Alpha周调用量11.6万亿token排全球第二,104.86万token上下文,多模态输入,中国模型连续十七周领跑。
如果这篇让你重新想了一件事,点个「在看」让朋友也看到。每周一篇算账硬货 + 两篇AI快评,关注虾哥,不掉队。
你猜"牛来"模型到底是谁家的?智谱、谷歌、还是另有其人?评论区押个注。
#牛来模型 #OxAlpha #AI模型
