神秘模型Ox-Alpha揭晓:10万张国产卡,价格只有Opus的1/40
这两天,海外大模型榜单上冒出一个神秘名字 Ox-Alpha——跑分一路冲进第一梯队,可没人知道它是谁家的、用什么训练的。今天,谜底揭开:它叫 GLM-5.3-Flash,来自智谱,跑在 10 万张国产卡上,价格只有 Opus 4.8 的 1/40。
这篇拆三层:它凭什么被全网追问、国产卡为什么能把价格打下来、以及这个"牛来"模型怎么一夜之间住进了你的办公软件。
一个"查无此模型"的神秘选手,凭什么让全场追问
Ox-Alpha 的火,是从一张张跑分榜开始的。综合能力与 Opus 4.8 持平,编程能力被评价为"最强开源模型之一",接近 Fable 5——这个成绩单放在任何一家顶级实验室身上都不丢人。
奇怪的是,它既没有发布会,也没有名字出处,连背后公司都查不到。榜单上一串字母,让开发者圈子和吃瓜群众一起开始猜:是谁在闷声放卫星?
智谱今天官宣认领,悬念才落地:Ox-Alpha 就是 GLM-5.3-Flash,原生多模态、开源。智谱官方文档里写得很清楚,这不是一个藏在实验室里的演示品——它已经在对外服务。
谜底比模型本身更狠:10 万张国产卡
性能强只是开胃菜,真正的反转在算力账本里:这个模型跑在 10 万张国产卡上,每天服务量达到 100 万亿 tokens 级别。
什么概念?这不是"国产卡能跑通一个模型"的实验室证明,而是"国产卡在撑起一个生产级大模型"的规模事实。第三方研究机构 SemiAnalysis 的评价很直接:英伟达的护城河,再受考验。
过去几年,行业默认的剧本是"大模型 = 英伟达显卡堆出来的"。Ox-Alpha 的揭晓,等于把这句话打了个问号:别人用 10 万张国产卡,一样跑出了第一梯队的模型,而且跑出了规模。
价格只有 1/40:算力成本结构被重算了一遍
性能持平、价格 1/40,这两个数字放一起,很多人第一反应是"亏本补贴"。拆开成本结构会发现,逻辑比补贴硬得多。
英伟达的定价里,相当一部分是垄断溢价——高端卡供不应求,市场愿意为"算力自由"付费。而国产卡的故事是另一条路:供给端,国产算力池子这些年越铺越大,边际成本被摊薄;模型端,GLM 系列本身开源,生态调用量大,单次推理成本被规模吃下去。
算力从"稀缺品"变成"可替代商品",价格自然就塌下来了。 1/40 不是慈善,是成本结构变了之后的必然结果。
顺带说一句,这类"低价不等于亏本"的算力账,也解释了为什么越来越多厂商敢打价格牌——不是烧钱换市场,是真的把单次成本打下来了。
"牛来了":神秘模型已经住进你的办公软件
对普通用户,这才是这则新闻里最实在的部分:榜单上谁家模型登顶,离你很远;但你的办公软件里,悄悄多了一个性能第一梯队、成本只有别人零头的 AI。 这才是技术叙事落到日常的样子。
尾声
Ox-Alpha 的身份揭晓,表面上是一个模型的认领公告,实际上是一次算力格局的公开表白:国产卡不仅能跑,还能跑出规模、跑出性价比。
下次再看到"神秘模型"上热搜,先别急着猜是哪个巨头——说不定,它已经在你打开的软件里,干完今天的活了。
如果觉得今天这篇有启发,点个在看,顺手转发给需要的朋友;想第一时间收到推送,可以星标我⭐。
关注我,每天陪你聪明看世界 —— 看懂热搜,玩懂AI。

作者提示含AI生成内容。作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
