当前位置:
AIGC文章详情

Ox Alpha被"破案"是智谱的只用了24小时:报错码先招了,指纹全指向GLM,这一周的免费窗口值得冲吗?

源自37位全网作者

04:17

昨晚的AI圈,比发布会热闹的是破案。

8月20日深夜,OpenRouter的模型列表里悄悄多了一个新条目:OxAlpha,编号stealth/ox-alpha。知乎没有发布会,没有公司署名,没有模型卡,再加上Ox这个代号,中文圈很快给它起了个接地气的别名:牛来。比出场更精彩的是后续发展:不到24小时,社区基本把它破了案,从报错码到分词器,从缓存命中到思维链残留,指纹统统指向同一个地方——智谱。如果判断成立,这就是智谱拿一个还没发布的新模型,披着匿名马甲做全球压测,所有白嫖的人都是编外测试员。这篇文章聊聊这次羊毛:它到底是什么、怎么被实锤是智谱的、现在值不值得冲。

牛来到底是什么

先摆一份社区已经实测核对过的规格。小红书

  • 上下文输入1,048,576 token(1M),最大连续输出131,072 token(128K)

  • 多模态:文本、图片、视频都能吃

  • 支持工具调用、JSON结构化输出

  • 免费期价格$0/$0,推理强制开启

Ox Alpha被

OpenCode同步宣布限时免费一周,官方口径很大方:每天100T token的压测容量。知乎免费一周的消息传开,全网直接挤爆了。小红书

Ox Alpha被

提供方是谁?OpenRouter只说是第三方匿名运营。但自从这个平台上的匿名模型接连被证明是大厂发布前的真身预演,大家看到新匿名模型的第一反应已经不是用,而是猜爹。中国厂商先换个名字匿名跑一轮再亮身份,已经成了惯例,智谱GLM-5、小米MiMo-V2系列、蚂蚁、美团都这么干过。微博这次评论区迅速分成了两派。小米派的依据是,小米首席财务官此前公开说过新一代MiMo正在训练、很快发布,而且小米有前科:之前匿名上线的Hunter Alpha特征高度吻合,最后被小米认领为MiMo-V2-Pro。小红书

Ox Alpha被

但一天下来,智谱派逐渐占了上风,因为这次取证实在太硬核了。

三大指纹,个个像"报身份证号"

指纹一:报错码忘了换。有人故意传了非法参数temperature=2.0,上游回了一条报错"[1210] The temperature parameter is illegal.:限制数值范围[0,1]"。这个1210状态码加上中英文混排的报错文案,是智谱开放平台API的标志性特征。知乎OpenAI系报错是纯英文JSON,DeepSeek是另一套错误码体系,这就像有人戴了面具却忘了变声。勾选tool search工具选项时报的错,也和GLM5.2基本一样。知乎

指纹二:分词器DNA对上了。分词器是大模型的DNA,同一段文字,不同家的分词器切出的token数天差地别。有人把同一段中英混排加代码加emoji的对抗性文本喂给同平台的几个模型:GLM-5.3和GLM-5.2都切出68个token,ox-alpha是143。差的75,正好是OpenCode套在请求外面的一层隐藏系统提示词,就是让模型自称ox-alpha的那一段,68+75=143,严丝合缝。知乎每次响应里还带着cached_tokens: 64,正是那层固定不变的伪装包装——伪装身份的枷锁,反而成了验明正身的铁证。

交叉验证也有。独立研究者做过50组对抗性文本的分词器对比,Ox Alpha与GLM-5.3全部匹配,Gemini、DeepSeek、Kimi的匹配度只有18%~22%。知乎另一轮11次分词器探测,OxAlpha全部命中GLM,别人一个都对不上。知乎

指纹三:思维链被抓了现行。有人在它的思考过程输出里,捕捉到过"trained by Z.ai"的字样残留。知乎还有不少人发现,它的429限流报错文案跟智谱的长得格外像,社区有人一句话总结:你429的样子都是那么像。

再加上命名学:上一只匿名模型叫Pony Alpha(小马),后来被认领为GLM-5,这次是Ox Alpha(牛),动物系列延续。知乎而且不用想,用的名字OX这个牛来梗就很天朝了,几乎排除是国外模型的可能。知乎

反应和分数也对得上:从社区测试看,Ox Alpha与GLM 5.3的任务响应高度接近,流传的DeepSWE编程基准对比表里,两者得分也很接近。知乎

Ox Alpha被

但丑话说在前面:智谱官方还没有认领这个模型,以上全部是社区的技术取证推断。知乎具体身份也有细分版本:有人说是GLM-5.3的多模态加强版,也有人说是小尺寸的Flash,结合爆料人的判断(小模型+多模态)和流传的智谱群内回应,社区目前更倾向后者是GLM-5.3-Flash。小红书指纹能锁定"智谱家",锁不定"哪一款",官宣之前别把话说死。

这波羊毛值不值得薅

结论先说:值得试,门槛很低,三条路都能进:

  • OpenRouter直连:模型名stealth/ox-alpha,兼容标准OpenAI接口,脚本换个模型名就能跑;在Cursor / VSCode里,Base URL填https://openrouter.ai/api/v1,模型名填stealth/ox-alpha。{{{CUSTOM_HTML_TAG_17}}}

  • OpenCode CLI:直接执行/connect openrouter,然后/models stealth/ox-alpha。小红书

  • OpenCode Zen:模型名叫x-preview-f-free,但需要$21.23的首充激活。小红书小红书薅免费模型,这笔钱可以不花。

实测成绩确实能打。有人用API跑了四组:写线程安全LRU缓存给出完整实现还自带8线程并发测试,闭包陷阱题答对还主动给修法,"1%中奖买100张"的概率题算出63.40%没踩100%的坑,6万字中文里埋暗号3.8秒一字不差捞出来。小红书

Ox Alpha被

社区跑的10个agent任务它过了8个(80%),同场GLM-5.3是62%,Grok-4.6是62%,GPT-5.6 Sol是52%。小红书

不过翻车也有,薅之前避开三个坑:

  1. 默认max档爱过度思考。推理强制开启且默认max,有人的任务跑了一个小时还没出结果,把reasoning_effort设成high会好很多。小红书

  2. 翻车不全是模型的锅。社区确实有人遇到无限循环这类问题。微博部分体验不佳其实是OpenCode兼容层的锅,换个接入方式复测一遍再下结论。

  3. 别喂机密内容。宣传说Zero Data Retention,但OpenRouter页面原文是提示词由供应商保留、仅承诺不用于训练,一字之差差很多,公司机密代码别往里放。小红书

接下来盯什么

按之前匿名模型的惯例,这波免费窗口大约一周,压测结束后官方通常会出面认领再官宣。三个信号值得盯:

  1. 智谱认领的时间点:认领即GLM新多模态模型官宣,按惯例基准测试和定价会随后跟上;

  2. 如果真是GLM-5.3-Flash:Flash档历来是性价比担当,Coding Plan用户很快会多一个便宜的干活主力;

  3. 多模态军备竞赛:同一天DeepSeek也正式发布了多模态视觉模型V4-Flash-Vision-Exp。微博国产大模型这周集体给智能体装上眼睛,这场仗才刚开始。

免费期先薅为敬,官宣之后再聊排位,这是目前玩牛来最划算的姿势。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章