智谱GLM-5.3-Flash开源,综合能力对标Claude Opus 4.8,价格仅为其1/40

源自426位全网作者

10:54

内容由AI生成

精选参考来源

1. 智谱昨晚开源了 GLM-5.3-Flash,中文社区管它叫「牛来」,就是之前匿名的 Ox Alpha。320B 总参数、18B 激活,AA 指数 57分,跟 Claude Opus 4.8 打平,定价是后者的 1/40。智谱 7 月 ARR 已经到 10 亿美金,DeepSeek 前 7 个月收入是去年全年的 10 倍,MiniMax 半年报 ARR 破 8 亿——国产模型厂商的军备竞赛已经从"比谁参数大"进入"比谁便宜还能打"的阶段。不过有意思的是,我发现网易 LobsterAI 是全网最快上线牛来模型的。昨晚智谱刚开源,10 分钟之后他就上线了。不用更新客户端、也不用去官网申请 key,打开LobsterAI 就能直接用。对普通用户来说非常方便!以前一个新模型出来,蹲 API 的开发者才能第一波用上。现在普通人打开 Agent 就能用上当天发布的前沿模型,办公 Agent 厂商们卷的速度利好新模型的普及。而且在 Agent 上,各种模型的价格非常透明。模型厂商都在打价格战,但是输入输出的定价其实普通职场人看不懂,也很难第一时间评估模型的性价比。我看 LobsterAI 上有每个模型的积分倍率,单价和用量摆得明明白白。#LobsterAI# #AI办公# #智谱# #GLM# #办公Agent# #大模型# #牛来#

2. 这一次,智谱用GLM-5.3-Flash实现了真正的智能平权。

3. GLM-5.3-Flash最狠的不是 1/40 价格,是它让你可以真正离开电脑

4. #智谱发布GLM5.3Flash#GLM‑5.3‑Flash来了。正式亮相之前,它以匿名模型Ox‑Alpha在OpenCode、OpenRouter上完成测试,迅速登顶双平台,创下调用量新高,有意思的是,全部测试流量都跑在国产芯片算力之上,这也算是国产硬件一次很有分量的实战验证。320B总参数,综合能力超越前代GLM‑5.2,在Artificial Analysis评测拿到57分,对标Claude Opus 4.8。定价优势格外突出,是GLM‑5.3的1/10,限时折扣低至1/20,对比Opus4.8更是仅有1/40,前沿大模型终于不用小心翼翼省着调用。作为GLM‑5系列首款原生多模态模型,它可以自主判断何时调取视觉能力,再依据观察结果推进任务。可以无外部素材,连续运行16小时搭建完整建筑场景;在ZCode里穿梭代码、浏览器、图形界面,边产出边校验。同时还能输出PPT、研报、财报、法律文书,金融、法律内容还可以保留完整追溯痕迹。模型现已全球开源,接入ZCode,纳入GLM Coding Plan,API同步对外开放。不过在我看来,亮眼的演示和跑分只是参考,限时优惠结束之后的成本、复杂真实业务下的稳定性,依旧需要大量开发者实际上手,才能看清它真正的落地实力。网页链接

5. 【国产模型“Ox Alpha”揭面:GLM-5.3-Flash用中国芯片硬刚硅谷】智谱Z.ai正式发布GLM-5.3-Flash,揭开了此前在OpenRouter上霸榜的神秘模型“Ox Alpha”的真面目。这是一款拥有320B参数但激活参数仅18B的混合专家模型(MoE),在编程和智能体任务上直逼Claude Opus 4.8,而成本仅为其十分之一。最耐人寻味的是,这波全球范围的高并发流量全是在国产AI芯片集群上跑通的,通过模型辅助代码优化,智谱把国产硬件的推理效率提升了3倍,生生在算力封锁中杀出一条“高性价比”的血路。这件事标志着大模型竞争进入了“算账时代”。当硅谷还在卷万亿参数和昂贵的H100集群时,国内厂商已经靠着极致的架构压缩(如线性注意力和稀疏注意力混合)和软硬一体优化,把“前沿智能”做成了“白菜价”。对开发者来说,这意味着本地运行300B级模型不再是幻梦,甚至能通过多模型组合——用昂贵的闭源模型做架构规划,用廉价的Flash模型跑24/7的自动化执行——实现ROI最大化。在生产力工具属性上,国产模型正凭借“量大管饱”的韧性,瓦解算力霸权的护城河。

6. #Easy同学正在独立开发#智谱 Z.ai 今天正式发布 **GLM-5.3-Flash**,这是此前以 Ox Alpha 代号预览的模型,官方确认它完全运行在中国 AI 芯片上。GLM-5.3-Flash 是 **320B-A18B** 的 MoE 架构模型,以 MIT 许可证开源,原生多模态,支持 100 万 token 上下文窗口。权重已上线 Hugging Face,API 同步开放,官方还推出了对应的 Coding Plan 和 ZCode 产品。官方在评论区公布了 API 定价,按每 100 万 token 计算:**输入 $0.15,输出 $0.50,缓存命中的输入 $0.03**。对比 DeepSeek 当前的 V4-Flash 定价,GLM-5.3-Flash 的未缓存输入与输出定价均低于 DeepSeek V4-Flash 的低谷价,但缓存命中输入($0.03)高于 DeepSeek 的 $0.007-$0.014。性能方面,在 Z.ai 自家的 Code Bench 评测中,GLM-5.3-Flash 在各级 effort 设置下均优于 GLM-5.2,官方称与 Claude Opus 4.8 表现相当。发布配图对比了 GPT-5.6 Terra、Gemini 3.7 Flash、DeepSeek-V4-Vision-Exp 等多个模型的基准成绩,GLM-5.3-Flash 在 GDPVal-AA 指标上领先。博客:网页链接(由 流苏ªⁱ 撰写)#GLM-5.3-Flash##智谱AI##DeepSeek##开源模型#

7. #智谱发布GLM5.3Flash#GLM-5.3-Flash是目前首个采用稀疏注意力与线性注意力混合架构的开源前沿模型。成功地平衡了顶尖性能与极低成本,为AI技术的广泛应用提供了新的可能。线性注意力捕获局部信息,稀疏注意力则高效处理全局上下文,它不仅能处理文本,还原生支持对图片、视频、文件等多种模态的视觉理解。可用于图像/视频分析、多模态内容创作、智能客户服务等需要结合视觉和语言信息的任务GLM-5.3-Flash视觉能力被无缝集成到编程流程中,能主动观察和理解界面、渲染结果等视觉反馈,结合其高效的架构,能够在处理超长文本时保持精准理解并控制成本。

8. #智谱发布GLM5.3Flash#智谱GLM‑5.3‑Flash正式对外发布,就是之前在外网悄悄测试一周、引发全网猜测的匿名模型Ox Alpha,也就是大家口中的“牛来”,官宣当晚直接开放模型权重。 采用320B‑A18B的MoE架构,MIT协议开源。总参数规模和GLM‑4.5差不多,但实际激活参数、模型层数几乎砍半。作为GLM‑5系列第一款原生多模态模型,文本、图片、视频输入都可以支持,还给到100万token超大上下文。 混合稀疏与线性注意力架构,重点压低长文本处理的服务成本。先匿名跑真实环境压测,再正式开源,这种发布方式,也给行业提供了不一样的产品验证思路。

9. #老柳杂谈# 国产大模型这周集体"掀桌子"了。智谱8月26日晚开源GLM-5.3-Flash,3200亿参数、激活才180亿,价格直接砍到Claude Opus 4.8的四十分之一,之前还匿名在OpenRouter登顶调用量第一。同一天字节甩出"豆包工作",一个能自己开电脑、拆任务、做PPT的AI打工人;DeepSeek把看图能力免费塞进最便宜的V4模型,单图成本压到对手的十分之一。工信部顺手补了句狠话:国产开源大模型全球下载破100亿次。翻译成人话——以前我们追着别人跑,现在别人开始用我们的轮子。价格战打到这份上,中小团队是真有福了。

10. “牛来”居然真是智谱。GLM-5.3-Flash昨晚正式开源,320B总参数只激活18B,原生多模态、100万Token上下文,MIT许可证。标准API价每百万Token输入0.15美元、输出0.50美元,首发期还打五折。我觉得它先藏起身份,让全球开发者用一周再揭晓,比开发布会念跑分更有说服力。匿名测试的所有流量还全跑在国产AI芯片上,这条挺重要。至于编程和Agent能力是否真接近Claude Opus 4.8,智谱自测先当参考,等更多第三方实测再下结论。#智谱发布GLM5.3Flash# 科技小参谋的微博视频

11. 今天,在AI行业里,火了整整一周的匿名神秘模型 OX Alpha,终于摘下了面具。它就是智谱刚刚发布的 GLM-5.3-Flash。虽然大家已经用各种分词啥的实锤是智谱了,但是看到晚上他们正式官宣的时候,我还是有点想笑。大家可能不知道,OX Alpha这玩意,在海外到底有多火。8 月 20 日,OX Alpha突然出现在了OpenRouter和OpenCode上,100万上下文,多模态,完全免费试用,然后就没有任何其他信息了。接下来几天,它直接冲到了两个平台的第一名。同时,也让整个AI圈,开始疯狂竞猜这个模型到底是谁家的。#智谱发布GLM5.3Flash# #数字生命卡兹克# 这一次,智谱用GLM-5.3-Flash实现了真正的智能平权。

12. #牛来大模型6天用掉数十万亿词元##牛来大模型来自北京# 8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox-Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时,大幅降低长上下文服务成本。智谱透露,为收集广大用户的广泛、专业反馈,在正式发布GLM-5.3-Flash前,团队以匿名模型Ox-Alpha在OpenCode和OpenRouter上进行了大规模测试。Ox意为“牛”,恰逢电影《牛来》走红,Ox Alpha也被中文开发者们称作“牛来大模型”。上线后,Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。公开信息显示,从8月20日匿名上线,到8月26日期间的六天,Ox Alpha已经让全球开发者用掉了数十万亿Token(词元)。值得注意的是,这些请求流量全部由国产芯片提供算力支持。智谱表示,这是其首次在大规模流量中尝试用国产芯片集群提供服务,这些芯片均通过自研高带宽互联网络连接。(来源:福布斯中文网)北京日报的微博视频

13. 昨晚智谱开源了 GLM-5.3-Flash,就是之前匿名测试的 Ox Alpha,「牛来」。说几个重点: 1、320B 总参数、18B 激活,写代码跟 Claude Opus 4.8 一个档(AA 指数 57 分持平);原生多模态,能看界面自己改前端;定价是 Opus 4.8 的 1/40。 2、我昨晚在 LobsterAI 上直接试的。这 Agent 是网易办公的,新模型上线是真快,智谱昨晚发,10 分钟之后就上线了。不用更新、不用装插件,切一下就用。我拿牛来跑了段前端调试,它看完渲染结果自己改代码,来回几轮,挺顶。 3、在 LobsterAI 上的定价是 0.06 积分倍率,是 DeepSeek V4 Flash 的 0.6 倍。价格也透明,模型单价、用量都明明白白,用多少扣多少,没有隐藏消费。 4、建议模型厂商多跟办公 Agent 大厂们绑定,利好新模型的快速普及。尤其是性价比高的。 #智谱# #GLM# #牛来# #LobsterAI# #办公 Agent# #大模型# #AI 办公#

14. 这次GLM-5.3-Flash让我比较在意的,其实不只是模型参数或者跑分,而是两个字:开放。320B-A18B架构,MIT许可证开放权重,同时还用了稀疏注意力和线性注意力的混合架构,重点就是想把长上下文的成本压下来。对于开发者来说,这些东西比一句“性能提升多少”更实际。因为模型再强,如果调用成本太高、部署太麻烦,最后也很难真正进入产品。现在开源模型越来越卷,我觉得这是好事。模型能力往上走,价格往下走,开发者手里的选择越来越多。最后真正受益的,还是那些每天拿AI干活的人。#智谱发布GLM5.3Flash#

15. 实测对比神秘模型-Ox牛来 和 DeepSeek-V4-Flash-Vision,谁是真牛?

16. 智谱放出 GLM-5.3:出手便杀回开源、国模一哥!

17. 实测GLM 5.3,1/3参数量 + 后训练还能逼平GPT-5.6我也是服了

18. 参数一个没动,GLM-5.3 凭什么能力大涨?

19. GLM-5.3 在 AA 14 模型对比中综合第 5,Agentic 第 2:双榜成绩出炉

20. GLM-5.3上线实测:60分并列开源第一,我拿它和DeepSeek跑了一轮

21. 2026年最炸模型来了?GLM-5.3编程提升50%

22. GLM-5.3、Grok 4.6同步升级,真能改变普通人的工作吗?

23. 更强的GLM-5.3,为什么没有刷屏?

24. GLM5.3实测 搭配zcode缓存命中率极高

25. 国家队下场:超算互联网上线智谱 GLM-5.3——算力自主可控,全球 AI 竞争进入新阶段

26. 国产大模型 GLM-5.3 上线!AA 60 分

27. 免部署一键调用国家超算互联网上线GLM-5.3API

28. 值得买OpenHubs上线智谱GLM-5.3,以领先模型生态驱动AI应用创新

29. GLM5.3实测|代码Agent能力卷疯了✨

30. 国家超算互联网上线智谱GLM-5.3 API

31. ZCode送1亿GLM-5.3token、DeepSeek上V4-Flash-Vision、GPT-5.6 Sol降价20% | 8月22日 AI日报

32. 智谱GLM-5.3 模型介绍

33. GLM-5.3 每日增量追踪(2026-08-23)

34. 使用GLM-5.3一周后体验

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章