当前位置:
AIGC文章详情

智谱GLM-5.3-Flash开源,同级智能性能价格仅为Claude的1/40

源自313位全网作者

10:54

精选参考来源

1
#智谱发布GLM5.3Flash#智谱GLM‑5.3‑Flash正式对外发布,就是之前在外网悄悄测试一周、引发全网猜测的匿名模型Ox Alpha,也就是大家口中的“牛来”,官宣当晚直接开放模型权重。 采用320B‑A18B的MoE架构,MIT协议开源。总参数规模和GLM‑4.5差不多,但实际激活参数、模型层数几乎砍半。作为GLM‑5系列第一款原生多模态模型,文本、图片、视频输入都可以支持,还给到100万token超大上下文。 混合稀疏与线性注意力架构,重点压低长文本处理的服务成本。先匿名跑真实环境压测,再正式开源,这种发布方式,也给行业提供了不一样的产品验证思路。
2
#牛来模型确认为智谱GLM系列#前几天,网上突然冒出来一个神秘的“隐身模型”:Ox Alpha(stealth/ox-alpha),引发了大量网友的关注。Ox Alpha的中文名“牛来”,它是一个匿名上线的“隐身模型”,主打 Coding + Agent + 多模态,目前免费开放,当时网上最热门的猜测是:智谱的 GLM。随着8月26日智谱官宣,匿名模型Ox Alpha(牛来模型)属于GLM系列新一代产品,这款模型此前低调登陆OpenRouter,凭借强悍的编码与智能体能力快速登顶平台榜首,调用量直接超过DeepSeek两倍。它支持文本、图像、视频多模态输入,面向编程开发场景,目前还能免费试用一周。从全网匿名盲测登顶,到官方正式认领,国产大模型用硬实力在全球开发者社区站稳脚跟,太牛了!
全部
来源
内容由AI生成

精选参考来源

1. #智谱发布GLM5.3Flash#智谱GLM‑5.3‑Flash正式对外发布,就是之前在外网悄悄测试一周、引发全网猜测的匿名模型Ox Alpha,也就是大家口中的“牛来”,官宣当晚直接开放模型权重。 采用320B‑A18B的MoE架构,MIT协议开源。总参数规模和GLM‑4.5差不多,但实际激活参数、模型层数几乎砍半。作为GLM‑5系列第一款原生多模态模型,文本、图片、视频输入都可以支持,还给到100万token超大上下文。 混合稀疏与线性注意力架构,重点压低长文本处理的服务成本。先匿名跑真实环境压测,再正式开源,这种发布方式,也给行业提供了不一样的产品验证思路。

2. #牛来模型确认为智谱GLM系列#前几天,网上突然冒出来一个神秘的“隐身模型”:Ox Alpha(stealth/ox-alpha),引发了大量网友的关注。Ox Alpha的中文名“牛来”,它是一个匿名上线的“隐身模型”,主打 Coding + Agent + 多模态,目前免费开放,当时网上最热门的猜测是:智谱的 GLM。随着8月26日智谱官宣,匿名模型Ox Alpha(牛来模型)属于GLM系列新一代产品,这款模型此前低调登陆OpenRouter,凭借强悍的编码与智能体能力快速登顶平台榜首,调用量直接超过DeepSeek两倍。它支持文本、图像、视频多模态输入,面向编程开发场景,目前还能免费试用一周。从全网匿名盲测登顶,到官方正式认领,国产大模型用硬实力在全球开发者社区站稳脚跟,太牛了!

3. #牛来模型确认为智谱GLM系列#Ox Alpha上线后没先亮身份,结果直接冲到OpenRouter使用榜首,调用量甚至超过DeepSeek两倍,现在才揭晓它就是GLM-5.3 Flash。能在不知道品牌的情况下被开发者用脚投票,至少说明模型在编程、Agent这些高频场景里确实有吸引力。更值得关注的是今晚还要开放模型权重。现在国产大模型竞争已经从“谁参数更大”,卷到了真实调用量、开发者生态和开源影响力。GLM这波如果后续价格也够有竞争力,热度可能还会继续往上走。

4. Vercel它是一个类似于网站部署的公司,会给很多小型网站提供免费的部署方案。我也有好几个网站部署在上面,非常好用。他们其实也很多地用到大模型。根据他们最近披露的一个数据,其大模型的使用从以前闭源模型占主导,到现在开源模型占主导,这个改变的进程其实非常短。因为随着技术进步的速度放缓,闭源模型的最强者已经不再是遥遥领先,而只是在某些部分领先。比如说 Anthropic 的 Claude Fable 5 这个模型,在前三四个月可能还是断崖式领先;但最近一两个月中国模型相继发布,比如智谱的 GLM 5.3、Kimi K3 模型,以及 DeepSeek 的 V4 Pro 等,都会或多或少挑战到 Fable 的绝对领先地位。同时,开源模型最大的优势就是便宜,意味着只要有自己的设备,就可以自己去部署运行。这也是为什么 Hugging Face 提到,公司使用的开源模型比例已经从之前的 28.4% 涨到现在的 62%,而闭源模型则从之前的 76% 相当于减半到现在的 38%。我觉得这可以说是攻守之势异也。

5. 【#新模型OxAlpha引大规模身份猜测#,#神秘牛来大模型OxAlpha火了#】近日,一款名为 Ox Alpha 的匿名模型突然出现在 OpenRouter。Ox 本身就是「牛」的意思,国内网友很快给它起了一个更接地气的名字:「牛来」大模型。根据 OpenRouter 披露的信息,Ox Alpha 拥有 100 万 token 上下文,支持文本、图片和视频输入,可以调用工具,目前完全免费。上线后不久,开发者就把它接入编码 Agent,扔进真实代码仓库进行测试。初步测试结果显示,这款来历不明的「牛来」大模型,能力已逼近当前顶级代码模型。与此同时,有网友爆料,一款名为 korrine 的匿名模型正在 Code Arena 上进行测试。有人猜它是 Kimi K3.1,也有人将其指向 Qwen 和 MiMo,说啥的都有。8 月的大模型圈,突然变成了一场大型猜谜游戏。「牛来」大模型表现抢眼Ox Alpha 真正引发关注,靠的是代码能力。开发者 Ben Davis 从 DeepSWE 中抽取 10 项任务进行测试,Ox Alpha 完成了其中 8 项,通过率达到 80%。其公布的对比结果中,Fable 5 Max 为 65%,GLM-5.3 Max 和 Grok 4.6 xhigh 均为 62%,GPT-5.6 Sol Max 为 52%。DeepSWE 考察真实软件工程能力。模型需要阅读代码仓库,定位问题,修改代码,运行测试,再根据报错继续修复。相比单轮编程题,它更接近编码 Agent 的实际工作。不过,10 项任务的样本很小。随后,其他开发者在另一组 DeepSWE 子集上测试,给出的结果约为 63%。两次测试的任务范围和运行配置并不完全相同,暂时无法据此确定 Ox Alpha 的准确排名。不过这些结果初步显示,这款匿名模型已经表现出很强的长程编码潜力,能力逼近当前头部模型。「牛来」大模型到底是谁家的?「牛来」大模型的身份,目前流传最广的说法是智谱尚未发布的 GLM-5.3 Flash,或 GLM-5.3 的多模态版本。有人还专门写了个博客进行分析:1. 最强证据来自视频编码器。四段不同帧率、时长和分辨率的视频中,Ox Alpha 消耗的视觉 token 与 GLM-5V-Turbo 完全一致。MiMo、Qwen 和 GLM-4.6V 都呈现出明显不同的结果。2. 文本 tokenizer 也高度吻合。研究者测试了 25 组提示词,Ox Alpha 与 GLM-5.3 的 token 数量始终保持固定的 75 token 差值。3. 其他特征也指向智谱。Ox Alpha 拒绝处理音频,与 GLM-5V 的路由方式相同;回答风格、Agent 执行步数和推理接口也很接近 GLM。智谱此前还曾用 Pony Alpha 匿名测试 GLM-5,具备相同操作先例。还有网友从对话中寻到蛛丝马迹。Ben Davis 认为 99% 确定这就是 GLM-5.x。这些线索提高了 GLM 说的可信度,但还不足以完成身份确认。截至目前,OpenRouter、智谱都没有公开回应。korrine 身份更扑朔迷离「牛来」大模型的身份还扑朔迷离,Code Arena 又出现了一个名为 korrine 的匿名模型。最初,不少人猜测它是 Kimi K3.1,原因是 Kimi K3 发布前,曾被认为以 kivine 的代号接受测试。kivine 与 korrine 结构相近,因此引发了联想。不过,最早传播消息的爆料者随后补充称,此前获知的 Moonshot 新模型可能对应另一个代号 adamant-ananke。korrine 也可能来自 Qwen 等其他中国团队。评论区中,还有人将它指向 MiMo V3。大模型厂商为什么喜欢「挂马甲」?匿名测试正在成为大模型正式发布前的重要环节。在 Arena 中隐藏厂商和型号,可以尽量削弱品牌带来的先入为主。用户看不到模型身份,只能根据实际输出进行选择,最终积累的对战结果,也更接近真实用户体验。OpenRouter 提供的是另一类测试环境。开发者会把模型接入各种编码 Agent,让它进入真实仓库,连续调用工具,处理长达数小时的软件工程任务。上下文能否保持稳定,工具调用是否可靠,模型会不会在长程任务中循环或跑偏,都能在高强度使用中迅速暴露。对模型厂商来说,这相当于一次公开压力测试。团队可以提前观察失败案例,验证推理服务的承载能力,也能在正式发布前积累真实口碑。此外,「猜模型」现在也越来越成为一种营销手段了,身份悬念确实可以拉长讨论周期。最后回到模型本身。如果 Ox Alpha 真是一款 Flash 模型,其代码能力已经逼近头部水平,那么资源投入更高、能力更完整的完整版,又会把上限推到哪里呢?(新浪)

6. #智谱发布GLM5.3Flash#GLM‑5.3‑Flash来了。正式亮相之前,它以匿名模型Ox‑Alpha在OpenCode、OpenRouter上完成测试,迅速登顶双平台,创下调用量新高,有意思的是,全部测试流量都跑在国产芯片算力之上,这也算是国产硬件一次很有分量的实战验证。320B总参数,综合能力超越前代GLM‑5.2,在Artificial Analysis评测拿到57分,对标Claude Opus 4.8。定价优势格外突出,是GLM‑5.3的1/10,限时折扣低至1/20,对比Opus4.8更是仅有1/40,前沿大模型终于不用小心翼翼省着调用。作为GLM‑5系列首款原生多模态模型,它可以自主判断何时调取视觉能力,再依据观察结果推进任务。可以无外部素材,连续运行16小时搭建完整建筑场景;在ZCode里穿梭代码、浏览器、图形界面,边产出边校验。同时还能输出PPT、研报、财报、法律文书,金融、法律内容还可以保留完整追溯痕迹。模型现已全球开源,接入ZCode,纳入GLM Coding Plan,API同步对外开放。不过在我看来,亮眼的演示和跑分只是参考,限时优惠结束之后的成本、复杂真实业务下的稳定性,依旧需要大量开发者实际上手,才能看清它真正的落地实力。网页链接

7. #神秘牛来大模型冲上榜一#现在大模型赛道早就不是拼噱头讲故事的阶段,实打实的代码工程能力、长文本处理能力才是硬通货。DeepSWE测试模拟真实程序员日常工作,读仓库、改bug、调试代码,难度远高于普通笔试刷题,牛来能拿到80%的通过率,说明它已经能深度介入真实生产开发场景,不是只能聊天的娱乐型AI。百万级上下文窗口,意味着可以一次性读完整份项目文档、长视频内容,处理复杂Agent任务的上限极高。 更有意思的是这场全网“猜身份”大戏。技术指纹高度贴合智谱GLM,之前智谱就有过匿名上线测试模型的先例,业内基本心里有数。海外大厂也下场蹭热度,反而侧面印证了国产大模型现在的实力已经具备全球竞争力。不限量免费一周的操作,直接让全球开发者蜂拥体验,算力储备雄厚到夸张,背后的技术底气确实足。

8. #Easy同学正在独立开发#智谱 Z.ai 今天正式发布 **GLM-5.3-Flash**,这是此前以 Ox Alpha 代号预览的模型,官方确认它完全运行在中国 AI 芯片上。GLM-5.3-Flash 是 **320B-A18B** 的 MoE 架构模型,以 MIT 许可证开源,原生多模态,支持 100 万 token 上下文窗口。权重已上线 Hugging Face,API 同步开放,官方还推出了对应的 Coding Plan 和 ZCode 产品。官方在评论区公布了 API 定价,按每 100 万 token 计算:**输入 $0.15,输出 $0.50,缓存命中的输入 $0.03**。对比 DeepSeek 当前的 V4-Flash 定价,GLM-5.3-Flash 的未缓存输入与输出定价均低于 DeepSeek V4-Flash 的低谷价,但缓存命中输入($0.03)高于 DeepSeek 的 $0.007-$0.014。性能方面,在 Z.ai 自家的 Code Bench 评测中,GLM-5.3-Flash 在各级 effort 设置下均优于 GLM-5.2,官方称与 Claude Opus 4.8 表现相当。发布配图对比了 GPT-5.6 Terra、Gemini 3.7 Flash、DeepSeek-V4-Vision-Exp 等多个模型的基准成绩,GLM-5.3-Flash 在 GDPVal-AA 指标上领先。博客:网页链接(由 流苏ªⁱ 撰写)#GLM-5.3-Flash##智谱AI##DeepSeek##开源模型#

9. 这张图表来自国际AI评测机构 Artificial Analysis,展示的是其“AA智能指数”对全球主流大语言模型的综合能力排名。图中红框标注的两款模型——Kimi K3 (max) 与 GLM-5.3 (max),均获得60分,并列开源模型第一,同时跻身全球前沿模型能力区间,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰模型处于同一水平。

10. 彭博刚刚把美中人工智能差距做成了一张图表,嗯,是的,美国正在被碾压:> Kimi K3 接近 Fable 的水平> 每任务成本便宜约 70%> Anthropic 认为中国落后 6–12 个月> 中国现在拥有前沿实验室集群> GLM-5.3 甚至还没包括在内,这将有利于中国一方美国实验室仍然占据前沿位置,但中国正让它们无法收取前沿价格。

11. 智谱 GLM-5.3:底座没换,性能却涨 50%,怎么做到的?

12. 智谱放出 GLM-5.3:出手便杀回开源、国模一哥!

13. 智谱 GLM-5.3 API 上线:纯后训练跑出开源第一,但权重还没开

14. 实测GLM 5.3,1/3参数量 + 后训练还能逼平GPT-5.6我也是服了

15. 智谱GLM-5.3 API正式上线   据媒体报道,8月19日,智谱GLM-5.3 API正式上线。   就能力而言,该模型Claude Fable 5、GPT-5.6 Sol等模型处于同一水平线,且与Kimi K3并列开源模型第一。   目前GLM-5.3已接入ZCode等编码平台,下周五官方将开源模型权重。

16. 智谱GLM-5.3 API上线,国产开源大模型首次冲进全球第一梯队

17. 后训练Scaling的又一次胜利:智谱GLM-5.3 深度评测

18. 国家超算互联网上线智谱GLM-5.3 API服务:编程能力提升50%,并列开源模型第一

19. GLM-5.3 跑分超 Opus 4.8,国产开源要反超了

20. 国产大模型新战场,被智谱GLM-5.3率先打开了

21. 智谱 GLM-5.3 发布,国产开源模型又进一步

22. 智谱新编程AI模型GLM-5.3网络安全能力超预期

23. GLM5.3实测 搭配zcode缓存命中率极高

24. 参数一个没动,GLM-5.3 凭什么能力大涨?

25. Kimi K3 vs GLM-5.3 vs DeepSeek V4-Pro:2026 年 Q3 三大旗舰模型深度测评

26. 智谱GLM-5.3:AI从写代码转向审代码

27. GLM-5.3上线,开源大模型开始\

28. 智谱 GLM-5.3 后训练都干了些什么

29. 智谱GLM-5.3 模型介绍

30. Arena榜单:GLM-5.3 排名第 8 今天,GLM-5.3在Arena上的排名刚刚出炉,目前在前端开发榜上排名第8,超过近期刚刚发布的Gemini 3.7 flash。 在Artificial Analysis模型智能评估中,GLM-5.3与Kimi K3分数相同。 不过两者参数量差异非常大: GLM-5.3:753B (7530 亿) Kimi K3:2.8T(2.8 万亿) 单就AA智能评估,GLM-5.3以小参数量追平Kimi K3,能效比表现相当亮眼! 价格方面根据官网,GLM5.3与上一代GLM5.2价格相同。 Arena 双盲评测大模型权威排行榜 arena.atease.dev

31. GLM-5.3上线实测:60分并列开源第一,我拿它和DeepSeek跑了一轮

32. 更强的GLM-5.3,为什么没有刷屏?

33. 智谱又送1亿Token了!GLM-5.3限时开抢

34. 同一套 DeepSeek Harness 实测三款国产模型,GLM-5.3为何在两个项目中胜出

35. ZCode送1亿GLM-5.3token、DeepSeek上V4-Flash-Vision、GPT-5.6 Sol降价20% | 8月22日 AI日报

36. GLM-5.3 · 其二|AI 自述:怎么做出这支视频和文章

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章