当前位置:
AIGC文章详情

性能对标Claude Opus,价格卷出新高度,GLM-5.3-Flash发布

源自47位全网作者

07:38

近日,智谱AI正式发布并开源了GLM-5.3-Flash模型,其前身是在开发者社区引起广泛关注的匿名模型“Ox-Alpha”(或称“牛来”)。该模型在匿名测试期间,凭借出色的表现迅速在OpenCode和OpenRouter等平台上登顶调用量榜首,引发了业内的广泛讨论。此次正式发布,揭示了其在性能、技术、成本和战略布局上的诸多看点。

性能对标Claude Opus,价格卷出新高度,GLM-5.3-Flash发布

在性能和功能上,GLM-5.3-Flash展现了强劲的实力。作为一个拥有320B总参数、18B激活参数的MoE架构模型,其综合能力全面超越了前代GLM-5.2。根据Artificial Analysis的评测,该模型获得了57分的综合智能指数,与Anthropic广受欢迎的Claude Opus 4.8持平,进入全球前沿模型行列。在编程和Agent能力方面,它同样表现出色,自研的Z.ai Code Bench评测显示其编程表现与Claude Opus 4.8相当。

性能对标Claude Opus,价格卷出新高度,GLM-5.3-Flash发布

更重要的是,GLM-5.3-Flash是GLM-5系列首个原生多模态模型,能够处理文本、图像和视频等多种输入,并支持长达100万token的上下文窗口。这一特性使其不再局限于纯文本交互,而是能将视觉能力无缝集成到任务流程中。例如,在代码开发等场景下,模型可以主动观察和理解界面截图、渲染结果等视觉反馈,并根据观察进行自我修正和迭代,实现了“边做、边看、边检查”的闭环工作流,这标志着模型从“回答问题”向“完成任务”的定位转变。除了编程,它还能胜任生成PPT、研报、财报和法律文书等复杂工作。

为了在实现高性能的同时控制成本,GLM-5.3-Flash在模型架构上进行了重要创新。它首次在开源前沿模型中采用了稀疏注意力与线性注意力的混合架构。其中,线性注意力用于捕捉局部依赖,而稀疏注意力则通过一个轻量级索引器高效处理全局上下文。结合IndexPool等技术,该架构大幅降低了模型在处理长上下文时的计算量和KV Cache(键值缓存),使其相比GLM-5.3,注意力计算量降低了约3倍,KV Cache缩小了约4.4倍。这种高效的设计是其实现极低服务成本的关键。

再次,该模型最引人注目的特点之一是其极具颠覆性的定价策略。GLM-5.3-Flash的官方API定价仅为GLM-5.3的1/10,在限时折扣期间更是低至1/20,与性能对标的Claude Opus 4.8相比,价格仅为其1/40。这一“价格屠夫”级别的定价,旨在将过去因成本高昂而使用受限的多模态、Coding和Agent等前沿能力,推广到高频调用的日常工作流中,让开发者和企业能够“不用小心翼翼省着调用”,极大地降低了前沿AI技术的应用门槛。

性能对标Claude Opus,价格卷出新高度,GLM-5.3-Flash发布

此次发布在战略层面也释放了重要信号。其一,匿名测试期间承载了巨量调用请求的算力,全部由国产AI芯片提供支持。这不仅是对国产芯片算力承载能力的一次大规模实战验证,也表明智谱在算力基础设施上实现了巨大突破,为模型的低成本稳定运行提供了保障。其二,智谱采取了“先匿名测试、后正式发布”的策略,直接通过产品实力在社区建立口碑,再公开身份承接热度,展现了其对产品能力的自信。同时,模型以MIT许可证进行开源,并得到了vLLM等主流推理框架的即时支持,有助于构建和繁荣开发者生态。

当然,也有观点指出,目前极具吸引力的低价是限时折扣,模型在复杂真实业务场景下的长期稳定性、以及折扣结束后的实际成本,仍有待广大开发者在实践中进一步检验。但GLM-5.3-Flash的发布,凭借其强大的原生多模态能力、创新的高效架构、极具竞争力的价格以及对国产算力的成功应用,为AI行业的发展带来了新的可能性和思考。

内容由AI生成

精选参考来源

1. GLM-5.3-Flash 首发 vLLM:稀疏加线性同框

GLM-5.3-Flash 首发 vLLM:稀疏加线性同框 🎉 恭喜 @智谱 发布 GLM-5.3-Flash。GLM-5 系列的首个原生多模态模型,也是他们第一次把稀疏注意力和线性注意力混进同一个

2. 【智谱又放大招了!GLM-5.3-Flash正式发布】从命名就能看出,这次重点还是一个字:快。Flash系列主打更低延迟...

【智谱又放大招了!GLM-5.3-Flash正式发布】从命名就能看出,这次重点还是一个字:快。Flash系列主打更低延迟... 【智谱又放大招了!GLM-5.3-Flash正式发布】从命名就能看出,这

3. #智谱发布GLM5.3Flash#GLM‑5.3‑Flash来了。正式亮相之前,它以匿名模型Ox‑Alpha在OpenC...

#智谱发布GLM5.3Flash#GLM‑5.3‑Flash来了。正式亮相之前,它以匿名模型Ox‑Alpha在OpenC... GLM‑5.3‑Flash来了。正式亮相之前,它以匿名模型Ox‑Alph

4. Ox Alpha匿名模型果然是GLM-5.3-Flash 的早期版本。智谱官方正式发布开源了。GLM-5.3-Flash...

Ox Alpha匿名模型果然是GLM-5.3-Flash 的早期版本。智谱官方正式发布开源了。GLM-5.3-Flash... Ox Alpha匿名模型果然是GLM-5.3-Flash 的早期版本。智

5. 智谱刚刚发布了 GLM-5.3-Flash (320B-A18B),即之前匿名的 Ox Alpha。划重点:之前在Ope...

智谱刚刚发布了 GLM-5.3-Flash (320B-A18B),即之前匿名的 Ox Alpha。划重点:之前在Ope... 智谱刚刚发布了 GLM-5.3-Flash (320B-A18B),即之

6. 大家好像已经习惯把前沿智能和前沿价格绑在一起,并认为这是技术进步必须支付的成本。但今天,GLM-5.3-Flash 来了...

大家好像已经习惯把前沿智能和前沿价格绑在一起,并认为这是技术进步必须支付的成本。但今天,GLM-5.3-Flash 来了... 大家好像已经习惯把前沿智能和前沿价格绑在一起,并认为这是技术进步必须支付

7. Ox Alpha 这头牛,被我们领走啦

Ox Alpha 这头牛,被我们领走啦 天才程序员们,伴随 GLM-5.3-Flash 上线将 GLM Coding Plan 额度提升至 3 倍,套餐额度也已为大家完成重置,一切安排妥当,请自由飞翔

8. #智谱发布GLM5.3Flash#之前AI圈刷屏的神秘“牛来”终于官宣真身,智谱GLM‑5.3‑Flash正式发布,作为...

#智谱发布GLM5.3Flash#之前AI圈刷屏的神秘“牛来”终于官宣真身,智谱GLM‑5.3‑Flash正式发布,作为... 之前AI圈刷屏的神秘“牛来”终于官宣真身,智谱GLM‑5.3‑Flash

9. #智谱发布glm5.3flash# 8月26日,智谱正式上线并开源 GLM-5.3-Flash,参数规模 320B-A1...

#智谱发布glm5.3flash# 8月26日,智谱正式上线并开源 GLM-5.3-Flash,参数规模 320B-A1... 8月26日,智谱正式上线并开源 GLM-5.3-Flash,参数规模

10. 【#智谱发布GLM5.3Flash#】智谱GLM-5.3-Flash于2026年8月26日正式发布,此前以匿名模型Ox ...

【#智谱发布GLM5.3Flash#】智谱GLM-5.3-Flash于2026年8月26日正式发布,此前以匿名模型Ox ... 【】智谱GLM-5.3-Flash于2026年8月26日正式发布,此前以

11. 盛唐再现!智谱认领Ox-Alpha,性价比高于DS

盛唐再现!智谱认领Ox-Alpha,性价比高于DS 天啊,大晚上的刚洗完澡就发现了个不得了的消息,Ox-Alpha 这个牛来大模型居然真的被智谱认领为 GLM-5.3-Flash 了!在我上一条笔记底

12. 怎么看 GLM-5.3-Flash 发布,有什么值得关注的?

怎么看 GLM-5.3-Flash 发布,有什么值得关注的? 前排提醒,glm 5.3 flash请直接使用官方api,不要购买套餐5.3f的api定价在两周折扣期间仅为5.3的二十分之一由于有文本、

13. 🐂ox-alpha揭晓,GLM-5.3-Flash开源发布!

🐂ox-alpha揭晓,GLM-5.3-Flash开源发布! 日前刷屏 OpenRouter 和 OpenCode 的神秘匿名模型 ox-alpha(国内开发者昵称“牛来”,身份正式揭晓:正是智谱 G

14. 确认!牛来大模型就是 GLM-5.3 Flash

确认!牛来大模型就是 GLM-5.3 Flash 据彭博社报道,智谱在接受彭博社新闻采访时,确认了最近非常火的“牛来”大模型(Ox Alpha)就是智谱即将推出的 GLM-5.3 Flash,并表示今

15. 牛来是多模态GLM-5.3-Flash?架构+实测总结

牛来是多模态GLM-5.3-Flash?架构+实测总结 📌 最近刷屏的神秘牛来大模型(Ox-Alpha)被智谱认领了,原来是 GLM-5.3-Flash (320B-A18B) ,关注点在于这是 GL

16. glm-5.3使用体验

glm-5.3使用体验 通过 GLM Coding Plan 使用,主要当主力编码智能体跑。 先说结论:这代模型给我的感觉是“能放手”。 以前的模型更像“你指挥一步、它做一步”,5.3 明显更接近

17. GLM-5.3-Flash 免费送

GLM-5.3-Flash 免费送 GLM-5.3-Flash来了:320B总参数,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(A

18. 🐮GLM-5.3-Flash 今天上线并开源

🐮GLM-5.3-Flash 今天上线并开源 大家好像已经习惯把前沿智能和前沿价格绑在一起,并认为这是技术进步必须支付的成本。 今天,GLM-5.3-Flash 来了。 发布前,它以匿名模型O

19. 智谱上线并开源GLM-5.3-Flash

智谱上线并开源GLM-5.3-Flash 智谱上线并开源GLM-5.3-Flash界面快讯1787754035 8月26日,智谱上线并开源GLM-5.3-Flash (320B-A18B)。据介绍,这

20. 智谱上线并开源GLM-5.3-Flash,系此前Ox-Alpha(中文社区称作牛来)模型

智谱上线并开源GLM-5.3-Flash,系此前Ox-Alpha(中文社区称作牛来)模型 智谱上线并开源GLM-5.3-Flash,系此前Ox-Alpha(中文社区称作牛来)模型北京商报1787756

21. 怎么看 GLM-5.3-Flash 发布,有什么值得关注的?

怎么看 GLM-5.3-Flash 发布,有什么值得关注的? 果然像之前预料的那样,前段时间在OpenCode上匿名的Ox Alpha,就是智谱的新斩杀线,多模态GLM-5.3-Flash。其实早在前

22. GLM-5.3-Flash还有一个我比较关注的变化:GLM-5系列首次原生支持多模态。以前我们跟AI聊天,基本就是一问一...

GLM-5.3-Flash还有一个我比较关注的变化:GLM-5系列首次原生支持多模态。以前我们跟AI聊天,基本就是一问一... GLM-5.3-Flash还有一个我比较关注的变化:GLM-5系列首次原

23. #智谱发布GLM5.3Flash#GLM‑5.3‑Flash的发布,给行业抛出一个很现实的问题:顶尖模型能力,是否一定要...

#智谱发布GLM5.3Flash#GLM‑5.3‑Flash的发布,给行业抛出一个很现实的问题:顶尖模型能力,是否一定要... GLM‑5.3‑Flash的发布,给行业抛出一个很现实的问题:顶尖模型能

24. 3亿token的GLM5.3使用体验

3亿token的GLM5.3使用体验 🚀 昨天GLM-5.3上线,第一时间从5.2换过来,聊聊真实感受 先说背景:这两个月我主要用glm5.2,补充一些dsV4flash。 5.3和5.2用的是同一个

25. ox-Alpha(glm 5.3 flash)创造新的斩杀线!

ox-Alpha(glm 5.3 flash)创造新的斩杀线! ox-Alpha 是中国实验室为何能在极小预算下如此令人印象深刻的一个绝佳例子。 看看 ZAI 是如何快速采用同行们的创新!!! 1

26. 科技佳ZHJ#智谱发布GLM5.3Flash#智谱今天正式发布了GLM-5.3-Flash,也揭晓了之前匿名测试的“牛来...

科技佳ZHJ#智谱发布GLM5.3Flash#智谱今天正式发布了GLM-5.3-Flash,也揭晓了之前匿名测试的“牛来... 科技佳ZHJ智谱今天正式发布了GLM-5.3-Flash,也揭晓了之前匿

27. #智谱发布GLM5.3Flash# 厉害啊,今晚AI炸开锅了,都是重量级的发布!智谱GLM-5.3-Flash正式发布,...

#智谱发布GLM5.3Flash# 厉害啊,今晚AI炸开锅了,都是重量级的发布!智谱GLM-5.3-Flash正式发布,... 厉害啊,今晚AI炸开锅了,都是重量级的发布!智谱GLM-5.3-Fla

28. 牛来了!灵犀Day 0 接入智谱GLM-5.3-Flash

牛来了!灵犀Day 0 接入智谱GLM-5.3-Flash 🐂走红的"牛来大模型" Ox-Alpha,身份正式揭晓——智谱 GLM-5.3-Flash 🚀灵犀已首发接入,打开灵犀,即刻体验。

29. 如何评价 GLM-5.3 ?

如何评价 GLM-5.3 ? 短的结论:天高任鸟飞 基本情况: 技术上的成功和商业上的领先,让智谱能以自己的节奏推进版本,2 个月,就是智谱一个版本的间隔。两个月前的 GLM-5.2 曾经是国产阵营第

30. 智谱的 GLM-5.3-Flash 正式发布,开源、极致性价比、运行在国产的 AI 芯片上。- GLM-5.3-Fla...

智谱的 GLM-5.3-Flash 正式发布,开源、极致性价比、运行在国产的 AI 芯片上。- GLM-5.3-Fla... 智谱的 GLM-5.3-Flash 正式发布,开源、极致性价比、运行在国

31. 智谱太会算计了

智谱太会算计了 GLM5.3和flash调用API价格差了20倍了 结果plan抵扣系数只是三倍吗,智谱真有你的😄。 粗略以缓存:输入:输出=90:8:2计算,glm5.3flash一亿token

32. 怎么看 GLM-5.3-Flash 发布,有什么值得关注的?

怎么看 GLM-5.3-Flash 发布,有什么值得关注的? 纯国产卡推理。这块大体有个时间线,先是有报道表示智谱收了一家做Infra的公司。然后晚点LaterPost表示智谱上线了5万张国产卡。同期

33. #智谱发布GLM5.3Flash#GLM-5.3-Flash来了,智谱这次又放大招了!GLM-5.3-Flash正式发布...

#智谱发布GLM5.3Flash#GLM-5.3-Flash来了,智谱这次又放大招了!GLM-5.3-Flash正式发布... GLM-5.3-Flash来了,智谱这次又放大招了!GLM-5.3-Fl

34. #智谱发布GLM5.3Flash#GLM-5.3-Flash是目前首个采用稀疏注意力与线性注意力混合架构的开源前沿模型。...

#智谱发布GLM5.3Flash#GLM-5.3-Flash是目前首个采用稀疏注意力与线性注意力混合架构的开源前沿模型。... GLM-5.3-Flash是目前首个采用稀疏注意力与线性注意力混合架构的

35. 全新多模态模型 GLM-5.3-Flash上线AutoClaw

全新多模态模型 GLM-5.3-Flash上线AutoClaw 适用于图文理解、代码生成和长程 Agent 任务执行💡现在体验新模型,享AutoClaw限时专属福利! 🌟活动时间:8.27-8.30(

36. #智谱发布GLM5.3Flash#智谱的这次升级确实亮眼,不更换基座,靠后训练就让编程能力暴涨50%,终端操作、长程软件...

#智谱发布GLM5.3Flash#智谱的这次升级确实亮眼,不更换基座,靠后训练就让编程能力暴涨50%,终端操作、长程软件... 智谱的这次升级确实亮眼,不更换基座,靠后训练就让编程能力暴涨50%,终端

37. 神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡

神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡 神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡量子位1787762357 金磊 发自 凹非寺量子位 | 公众号 Qbit

38. 智谱开源GLM-5.3:1/10价格,1亿token花3块

智谱开源GLM-5.3:1/10价格,1亿token花3块 8月26日晚,智谱把 GLM-5.3-Flash(代号 Ox Alpha)开源了。此前一直匿名跑分、被社区疯传的就是它。权重已经上 Hugg

39. GLM-5.3-Flash发布,没错就是那个牛来

GLM-5.3-Flash发布,没错就是那个牛来 [火R]炸裂,GLM5.3-Flash的价格只有DeepSeek七分之一。 刚刚 @智谱 公布 GLM-5.3-Flash 的价格: 输入

40. 把 GLM-5.3 接入到 DeepSeek Harness,夯爆了!

把 GLM-5.3 接入到 DeepSeek Harness,夯爆了! 大家好,我是程序员鱼皮。最近 AI 圈儿真是过年了,前脚 DeepSeek V4 Pro 正式版和 DeepSeek Harne

41. 实测 GLM-5.3:没吹牛,但有点吓人

实测 GLM-5.3:没吹牛,但有点吓人 昨天写了 GLM-5.3 发布,今天这篇是独立实测的五场景验证,数字很硬。 漏洞发现能力,CyberGym 基准 84.5%,开源第一,压过了闭源选手 Cla

42. 天天卖断货的 GLM-5.2,用起来到底值不值?

天天卖断货的 GLM-5.2,用起来到底值不值? 说实话,一开始你和我说国产模型能比肩 Claude、GPT,我是拒绝的。但是在世超蹲了三天,终于抢到了智谱的 Coding Plan 套餐,高强度蹬了

43. 如何评价 GLM-5.3 ?

如何评价 GLM-5.3 ? 梁文峰:LLM地方,历代大规模征战五十余次,是非曲直难以论说,但史家无不注意到,正是在这个古战场上,决定了多少代AI公司的的盛衰兴亡、此兴彼落,所以古来就有问鼎AGI之说

44. GLM 输出只比 DeepSeek 贵 1 块

GLM 输出只比 DeepSeek 贵 1 块 DeepSeek 8/17 涨价后,开发群都在算账:到底换哪家?我拉了一张实时价格表,结论先说——GLM 的输出价只比 DeepSeek 高峰贵 1 块

45. 如何评价 GLM-5.3 ?

如何评价 GLM-5.3 ? 我比了下对我来说,GLM5.3和DS的价格GLM的最高档个人套餐年付是754.6/月(算便宜的),非高峰期token量每周大概是0.87亿*14=12.18亿(官网有介绍

46. 如何评价GLM-5.2?

如何评价GLM-5.2? 前几天Elon Musk在X上说,智谱GLM模型达到Fable 5的水平大概在2027年Q1。智谱创始人唐杰回复说:won't take that long (用不了那么久)

47. 为什么GLM5.2总参数744B会这么强?

为什么GLM5.2总参数744B会这么强? 因为智谱也做出了“全自动沙盒环境模拟及奖励系统”*github上那么多的pr,那么多的分支合并都扒下来当预训练,然后再喂技术文档,然后在沙盒里面疯狂自我对抗
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章