当前位置:
AIGC文章详情

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

源自129位全网作者

08:32

这几天刷AI动态的人,大概率被两个字刷屏过:牛来。

先澄清一下,此"牛来"不是那部动画电影《牛来》——虽然这外号确实沾了电影的热度。8月20日,一款代号OxAlpha的神秘模型突然空降OpenRouter,因为Ox在英文里是"牛",国内社区干脆叫它"牛来"。这模型比电影还有戏:没有公司名、没有参数表、没有发布会,价格栏输入输出全写着0,结果上线第一天就冲上OpenRouter调用量榜一,刷新平台单日模型用量纪录,把连续霸榜56天的DeepSeek挤了下去。微博上线4天,它已经冲到全球调用量第二,光是HermesAgent、ClaudeCode等前五大应用的累计调用就超过了4万亿Token。微博微博

于是全网开始"猜爹"。作为一个一直盯着智谱清言的号,今天不想跟着喊"智谱赢麻了",想把网上的信息分成三层给你捋清楚:哪些是实锤,哪些是强疑似,哪些只是梗,以及这波你到底能捞到什么。

一、已经能确认的事实

先说现在就能钉死的:

  • 身份标签:OpenRouter官方把它标成Stealth Model(隐身模型),意思是第三方开发运营,平台只负责路由,提供方主动匿名,并承诺零数据保留;

  • 规格:104.8万Token上下文,最大输出13万,支持文本、图片、视频输入(输出只有文本),支持工具调用和JSON结构化输出,暂不支持严格的JSON Schema;

  • 体验数据:首Token中位延迟约1.95秒,输出速度约49 Token/秒,近几天可用率接近100%;

  • 免费是限时的:OpenCode宣布免费开放一周,每天准备了100万亿Token容量。微博也就是说这个窗口这几天就要关,之后的定价没人知道。

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

要注意:OpenRouter没有公布任何官方基准成绩。"前沿模型"目前只是平台给的一句定位,不是成绩单。

二、四大"猜爹"方向,哪个最靠谱

猜测一:智谱GLM系。目前证据链最粗的一条:有用户用25个不同提示词测试,它的原生Token数量和GLM-5.3完全匹配;在50/50对抗字符串测试里,它的分词器和GLM-5.3匹配度最高,而Gemini、DeepSeek、Kimi只有18%~22%;加上罕见的API指纹,还有社区成员从报错信息里扒出过和智谱相关的线索。知乎知乎上还有人翻出旧账:智谱以前出过一个叫PonyAlpha的隐身模型,这次轮到Ox,命名路数都对得上。知乎但这些全是社区逆向推理,智谱官方至今一个字没认。

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

猜测二:小米MiMo V3。Reddit上出现频率很高的答案,逻辑是:小米CFO刚在8月18日的财报会上透露新一代MiMo正在训练;而且今年3月有先例——代号HunterAlpha的隐身模型在OpenRouter匿名测试,后来被小米官宣为MiMo-V2-Pro的早期测试版。知乎不过这些都是时间和先例上的推理,没有技术实锤。

猜测三:腾讯混元HY4。理由主要是"能撑起这种规模免费调用的厂商没几个",更接近一种信念,没有直接证据。

猜测四:Google Gemini。有人直接问模型本人,它自称Gemini。但玩过模型的和知道:模型"自报家门"当不得真,回答会受到训练数据和系统设定的影响,隐身模型的提供方本来就会刻意隐藏信息。

所以现在的真实情况是:嫌疑在往智谱方向收拢,但没有任何一家官方认领。直接开喊"智谱赢麻了"的,属于替证据把话说早了半步。

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

三、比"是谁"更值得盯的,是这种发布方式

说句实话,我觉得更值得注意的是"隐身发布"这件事本身:不开发布会、不贴跑分宣传稿,把模型直接丢进真实开发者扎堆的平台,让它吃真实任务、跑万亿Token,收集完反馈再决定怎么官宣。小米的HunterAlpha是这条路,DeepSeek之前的灰度测试也类似。知乎

对我们普通用户来说,这是个挺实在的变化:以后新模型的第一手体验,可能越来越多不在发布会,而在这样的免费窗口里。想摸到前沿,就得盯住这些匿名入口,而不是只等官宣。

还有一件连起来看才有味道的事:十天前,智谱刚发布GLM-5.3,同时把原定的权重公开时间往后推了大约两周,理由是模型在训练中展现出超预期的网络安全能力——漏洞复现测试CyberGym上的成功率高达84.5%,和Anthropic对照模型打平。知乎如果"牛来"真是智谱的下一步,你会发现它现在的姿态是:一边因为"能力太强"不敢开源,一边用匿名方式放出来让全世界帮它做压力测试。对一直吃开源红利的用户来说,这个转弯值得记一笔。

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

顺带提醒一句:社区实测分数现在也比较乱,有人说它碾压一线旗舰,也有人测出中规中矩,口径各不相同。微博在身份和稳定性确认之前,把它当"值得测"而不是"已经赢",是更稳妥的姿势。

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

四、你能做什么,分三类说

如果你是开发者,或者平时就玩OpenCode这类工具:一周免费窗口是实打实的福利,百万级上下文、视频输入、工具调用全免费,值得在窗口关闭前排几个真实任务进去测。但身份和稳定性确认之前,别直接上生产环境——社区目前的共识也是"可以试,别替换成熟模型"。

如果你是普通用户,不碰代码:别被"OpenRouter登顶"撩到,那是开发者的场子。你的入口其实在手边:GLM-5.3已经上线智谱清言,限时免费还在继续,复杂任务把"极致"思考模式打开。小红书这是同一技术线路上你现在就能摸到的公开版本。群聊功能拿来跑审核、纠偏这类多轮长任务也挺顺手,就是烧积分比较快,任务中心可以补一些。

「牛来」4天登顶、DeepSeek被挤下榜一:全网都在猜它是智谱的,先把该信和不该信的捋清楚

如果你只是想看热闹:记住接下来一周的三个观察信号——一是OpenCode免费窗口什么时候关(上线起算大约一周);二是会不会有厂商出来官宣认领;三是GLM-5.3权重公开的新时间点,按8月14日发布往后推两周,大概就是本周或下周初。这三个信号任何一个落地,这个话题都会有第二轮。

"牛来"最后可能真不是智谱的。但这一波免费测试、这一波全网关注,还有"前沿模型先偷偷干活、后开发布会"的新鲜感,智谱已经不亏。咱们把眼睛放亮一点:等实锤,再鼓掌。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章