智谱疑似再放匿名模型Omen Alpha,50万上下文加推理能力,定价4折可尝鲜

源自226位全网作者

12:07

内容由AI生成

精选参考来源

1. 「Github一周热点129期」一间agent的办公室、GPT-Image-2提示词、Codex Harness、Apache本地工作台和免费模型路由

2. 天猫把Token搬上货架了。9月3日,AI空间站(Token充值中心)正式上线,阿里云、智谱、Kimi、MiniMax四家首批入驻,Token Plan、Coding Plan、按量付费都开卖,支持卡密或直充。前一天智谱先一步在天猫开店,个人版Lite 118元/月、Pro 538元。一天前是"智谱一家开店",今天变成"平台开专柜、多家大模型集体入驻",门槛低到打开淘宝搜"token"就能买。智谱上半年营收9.54亿、净亏20.72亿,API业务占比飙到86.5%——天猫开店的逻辑很直白:开发者那点量撑不起增长,得用电商心智场去捞个人用户。东哥判断:Token上货架,等于AI订阅开始"消费品化",大模型的竞争重心,正从参数内卷、刷榜单,往渠道运营、计价分销上挪。能不能跑通,还得看一件事——个人用户到底会不会像充话费、买会员一样,为Token持续付费。现在大模型订阅的钱,大头还是企业、开发者掏的;搬到货架上卖给普通用户,这需求是真是假,还没人验证过。真要成,阿里、京东、拼多多抢的就不只是"AI消费入口"几个字,而是一个还没定型的类目。#东哥笔记#

3. #智谱上半年业绩#【#智谱上半年收入超去年全年#,API收入激增2736%】#智谱上半年营收9.539亿#智谱发布2026年中期业绩。业绩显示,2026年上半年,公司实现收入9.54亿元,同比增长近400%,超过去年全年。其中,智谱MaaS开放平台及API业务收入达到8.25亿元,同比增长2736%,占公司上半年总收入的86.5%。截至8月底,智谱MaaS开放平台Token调用量较年初增长超过40倍,付费日活用户增长603%,前十大客户日均调用量增长98倍。与此同时,API平均售价提升约101%。业务增长同样反映到用户和调用量上。智谱表示,随着模型架构和推理基础设施持续优化,公司单位Token推理成本较年初下降80%,单位算力投入(包括训练与推理)所对应的收入提升14倍,MaaS业务毛利率提升至24.6%。(新浪科技)

4. GLM 6 这么牛的吗?都能自训练了---智谱创始人唐杰:GLM-6.0定位全自训练技术路线8月31日晚间,智谱召开2026年半年度业绩发布会。智谱创始人唐杰在会上解读了智谱下一代GLM-6.0大模型的技术定位与研发方向。他将GLM-6.0定义为Full Self-Training(完全自训练,海外相关概念也称RSI),核心特征是模型具备自净化能力,可覆盖从预训练、中期训练到后训练的全流程,实现完全自主训练与自我进化。唐杰指出,全自训练范式的最大挑战并非单纯扩大模型规模,而是模型能否实现自我判断——自主把控训练停止时机、自主完成错误修正。这是该技术路线的核心难题,也将是未来模型研发的重点方向。唐杰进一步表示,在后续模型研究中还将把伦理、社会治理维度纳入考量,作为下一步技术演进的重要考量。

5. 刚才看了看国产大模型公司智谱的财报,顺便聊一聊。作为行业头牌,它上半年收入同比增长接近 400%。有人嫌总数不够高,我倒觉得正常,国产模型大规模商用也就最近几个月,高增长还在后面。智谱说,8 月单月收入约 1.33 亿美元,合人民币九亿多,年化下来 ARR 有 16 亿美元。信息量很大,挑几个重点说。先说模型。GLM-5.3 的提升全来自后续训练:训练任务从普通写代码,换成接近专家真实工作的完整任务,底座没动,任务完成率就提高五成以上。智谱认为,模型上限由基座规模、有效深度、训练深度、任务环境四要素决定,哪个环节空间大就先做哪个。所以 5.1、5.2、5.3 都长在同一个大基座上,先把底座榨透,收益见顶再换更大的。下一步他们打算同时做大总参数、控制推理时真正激活的参数量、提高有效计算深度。定价会出现两条曲线。一边,同智商水平的模型持续降价,GLM-5.3 Flash 就用更低成本提供接近甚至超过上一代旗舰的能力;另一边,能打开新任务边界的前沿模型依然有溢价。所以 5.3 冲智能上限,做复杂编程、Agent 和高价值任务;Flash 走性价比,扛高频大规模调用。还有个指标叫算力乘数,指每投一块钱算力能换回多少 API 收入,上半年同比涨了 14 倍。国产芯片也用起来了,GLM-5.3 Flash 背后是国产芯片集群,六天跑了六十多万亿 Token;重做推理引擎和底层优化后,同样的硬件端到端性能提升三倍,单位 Token 推理成本比年初降八成。智谱也直说算力受约束,只能靠数据、训练和工程效率补,出口管制反而逼出了国内极强的工程效率文化。模型会不会沦为商品?单次跑分第一维持不了长期定价权,基础任务上各家已没差距。真正拉开差距的是迭代速度、真实任务完成率、单位智能成本,还有能不能进入客户的工作流。任务越长差距越明显,答一道题可能只差几分,但连续跑几小时的软件工程任务,要调工具、处理失败、重新规划,能不能干完就高下立判。模型进了客户的代码库,换模型就不只是换 API 地址,迁移成本会越来越高。所以简单能力越来越商品化,能进真实工作流的前沿模型依然有定价权。智谱还想让模型参与训练下一代模型,比如用 Model vs Model 自动生成筛选数据,让 Agent 收集任务、搭环境、生成验证器,甚至优化推理系统。唐杰管这叫 Fully Self-training,也就是 OpenAI 说的 RSI。跑通以后,数据生产、环境搭建这些活都可能交给模型自己。#科技先锋官##How I AI#

6. #天猫上线Token充值中心# 像充话费一样买AI,阿里云智谱Kimi MiniMax首批入驻,大模型订阅正式进入电商货架 📱9月3日,天猫正式上线“AI空间站”(Token充值中心),用户可直接购买多家头部大模型订阅产品。首批接入阿里云、智谱、Kimi、MiniMax四家厂商,在售商品包括按周期订阅的Token Plan、Coding Plan以及按用量付费的充值方案,支持卡密或直充两种交付方式。→ 搜索“token”或“充值中心”即可进入会场,页面集合了四大模型厂商的订阅服务,涵盖编程辅助、AI对话、代码生成等场景需求→ 智谱已于9月2日率先入驻天猫开设官方旗舰店,开售GLM Coding Plan订阅套餐,开店首日搜索量环比暴涨40倍→ 业内人士认为,订阅制与电商天然适配,未来AI服务可能像话费、流量包一样被比价、发券和补贴,大促节点出现“AI服务分会场”并不意外把Token摆上货架,让消费者像充话费一样买AI——天猫这步棋把大模型从“技术产品”变成了“电商商品”。智谱开店首日搜索暴涨40倍,说明用户对“一站式买AI”的需求真实存在。但问题也来了:当Token Plan被比价、被发券、被补贴,大模型厂商的利润能扛得住电商内卷吗?未来双11会不会出现“AI服务满减专区”?这个答案,可能比模型本身更值得关注。🤔

7. 【天猫上线Token充值中心,大模型订阅服务进入电商消费场景】9月3日,天猫正式上线AI空间站(Token充值中心),用户可直接购买多家头部大模型订阅产品,首批接入了阿里云、智谱、Kimi、MiniMax等。此前一天,智谱已正式入驻天猫开设官方旗舰店,开售订阅套餐,首日搜索环比暴涨40倍。

8. 【美团王兴:AI用于支持主业,不会成为“Token工厂”】8月28日,美团CEO王兴在二季度财报电话会上明确,美团不会成为Token工厂,AI模型和产品将用于支持主业,提升用户、商户体验和公司经营效率。关键信息:AI战略围绕Building LLM、AI at Work和AI in Products三方向展开;6月发布的自研大模型LongCat 2.0是业内首个在全国产算力集群完成训练与推理全流程的万亿参数模型;二季度研发投入同比增长22.5%至76.7亿元;美团持有宇树科技7.61%股权、智谱3.86%股权。观察:当多数公司追逐AI模型本身的商业化时,美团选择将AI能力深植于本地生活场景——帮用户找到更合适的餐厅,帮商家提升经营效率。这场围绕“真实工作流”的AI改造,或许比卖Token更能守住护城河。#美团 #王兴 #AI战略 #Token工厂 #LongCat2.0

9. 那个在天猫卖“AI订阅套餐”的运营阿杰,某电商代运营公司的运营总监。9月2日,他看到智谱AI在天猫开出官方旗舰店的消息,第一反应是“AI也能在电商平台卖?”当天下午,他就接到一个客户的电话——一家做企业服务的公司,想在天猫上架AI订阅产品,问阿杰“怎么运营”。阿杰花了两天时间研究:智谱开店48小时搜索暴涨50倍、Token产品成交涨160%;天猫上线了“AI空间站”Token充值中心;Kimi、MiniMax也在排队入驻。他给客户出了一份方案:①把AI订阅套餐当成“数字商品”来运营,核心是“降低用户的决策门槛”——用通俗语言解释Token是什么、能干什么;②把88VIP会员作为核心目标人群——6400万会员人均消费是非会员的9倍;③用“免费试用+付费订阅”的逻辑做转化。客户采纳了方案。阿杰说:“以前我觉得电商就是卖货,现在我知道了——电商是卖一切可以被交易的东西。AI只是下一个被摆上货架的商品。”不是跨界,是进化。

10. GLM-5.2 官宣开源:智谱的豪赌,AI 行业的分水岭

11. 智谱发了上市后首份半年报,上半年营收9.54亿,同比暴增近400%。 开放平台及API收入从2910万暴涨到8.25亿,同比增长2736%,占总收入比重从15.2%直接飙到86.5%。与之对应的是本地化部署收入从1.48亿降到6704万,降了54.6%。说白了,智谱已经从“卖软件”彻底转向了“卖调

12. 算力板块的新催化剂?GLM-5.3首发适配海光信息,这个信号不一般 持仓科技股的股民朋友,今天这条消息值得多看一眼。智谱刚发布GLM-5.3,海光信息就官宣Day 0适配完成。很多人觉得这只是个常规合作,但放在投资视角,我关注的是"首发验证"这个层面——大模型厂商愿意在发布当天就把模型稳定性押在国产

13. 智谱GLM-5.3逆天升级,海光DCU神速适配,“国产大模型+国产算力”又亮组合拳! 今天必须吹爆一波!智谱刚刚甩出GLM-5.3这个开源核弹,最牛的地方在于,所有性能提升都来自后训练阶段,基座模型结构和参数量一点没动,全靠强化学习把潜力全挖出来了!   海光DCU立马就跟上Day 0适配,而且是深

14. 智谱上半年总收入大增近400% 智谱8月31日公告,上半年公司总收入约9.54亿人民币(约1.42亿美元),同比增长近400%。其中,开放平台及API业务收入约8.25亿人民币(约1.23亿美元),同比增长2735.7%。(界面新闻)

15. GLM-5.3刚发布,海光DCU又双叒叕Day 0了 智谱刚刚发布GLM-5.3,海光DCU的Day 0适配就同步来了。 看到这条消息,我确实很想说一句:你还说你不会武功? 而且海光与智谱的技术协同早就有迹可循。从GLM-5到GLM-5.1、GLM-5.2,再到这次GLM-5.3,海光DCU连

16. AI大模型周报:智谱认领“牛来模型”;传爱诗科技已秘交招股书

17. 「牛来」实锤智谱GLM-5.3-Flash:10万张国产芯片扛62万亿Token

18. 爆火海外的神秘模型\"牛来\"是国产!智谱开源GLM-5.3-Flash,10万张国产芯片扛流量 - 哔哩哔哩

19. 全网爆火的「牛来大模型」到底有多牛?匿名黑马AI屠榜,碾压多款旗舰模型

20. 匿名模型一夜爆火登顶全球,智谱“牛来”到底什么来头?

21. 匿名牛来揭了底,价格打到脚后跟,车能预判六秒后,AI伸手拧螺丝

22. 智谱匿名模型登顶海外全靠10万张国产芯片

23. 42万亿token的匿名测试,智谱亮牌了

24. 调用量达DeepSeek两倍才认领,智谱这步棋早就算好了?

25. 英伟达的大跌,个人觉得有条消息的影响被低估了,那就是智谱的新模型,测试代号牛来,以匿名形式在OpenRouter和OpenCode上免费开放测试,5天内流量累计超过50万亿token,刷新了两个平台的流量增长纪录,当前使用量已超过DeepSeek的两倍以上。 随后智谱的技术文档显示,调用超过10万张国产芯片集群用于该模型推理服务,“硬件效率及单token成本已经达到了与主流英伟达GPU相当的水平”。 这条消息的含金量在于,国产硬件已经不再仅是简单的适配和能用,而是大规模地商业化应用并跑出优秀的成绩,大家可以看看牛来模型(智谱glm5.3 flash)的帕累托曲线,简单说就是比我便宜的性能显著不如我,比我更强的价格显著高于我。 这种成绩的取得已经是难能可贵,而取得又是建立在使用国产硬件的基础上,这种进步快得都有点魔幻了,这显著提升了国产硬件的生存环境,国产替代慢慢成为现实;也让中美的“大模型之争”的天平发生倾斜,以后即便是硬件“禁售”,威胁也都小了很多。 观点仅记录思考,不代表股票推荐。

26. DeepSeek涨价后的那个周末,智谱用一头「牛」接走了10万亿Token

27. 过去一周 AI 又又又火了,有什么事? 过去这一周圈子里有个大新闻。海外开发者社区莫名其妙出现了一个匿名模型,没有任何厂商标识,代号叫 Ox Alpha,国内开发者直接顺着谐音管它叫“牛来”。当时这模型要啥没啥,没名字、没参数、没背景,就只有一个免费接口供大家随意测试。结果短短5天,它的 Token 调用量直接飙到了 62万亿,一举刷新了 OpenRouter 和 OpenCode 这两家主流聚合平台的历史纪录,直接把在 OpenCode 霸榜 56 天的 DeepSeek 给挤了下来。就在8月26号晚上,智谱官方出来认领了,原来这就是他们的 GLM-5.3-Flash。总参数 320B,激活 18B,是 GLM-5 系列的首款原生多模态模型,而且直接按 MIT 协议开源了权重。#每日ai

28. 如何评价 OpenRouter 匿名模型 OX-Alpha 被证实为智谱 GLM-5.3-Flash?这波操作对大模型行业意味着什么?

29. 牛来原来是智谱:GLM-5.3-Flash掀翻DeepSeek V4的8月势头之争——近期AI热点小结

30. 不用NVIDIA显卡也能降低80% AI成本 智谱已实现10万国产AI芯片推理

31. 神秘模型“牛来”引发热议,猜测是智谱? 8月21日,大模型路由平台OpenRoutor上线一款名为Ox Alpha的全新大模型,该模型被网友称作“牛来大模型”,上线后引发网络广泛讨论。该模型具备百万级上下文处理能力与多模态功能,平台将其免费开放至8月27日,每日可提供100T算力支持,相关算力规模约为Visa公司月度AI令牌使用量的100倍。 该匿名模型的开发归属引发国内外网友多方猜测,市场候选范围涵盖智谱GLM相关产品线、小米Mimo V3 Pro、谷歌Gemini 4等主流大模型。其中,小米方面已对相关猜测予以辟谣,谷歌、SSI等主体的可能性也基本被排除。从技术指纹特征来看,该模型与智谱GLM系列新模型匹配度最高,不过有业内消息指出,该模型的实际开发方是一家超出行业普遍预期的中国企业,目前其官方身份尚未公开。 企业匿名上线全新大模型,已成为当前AI行业的常见测试模式。据彭博社相关报道,该现象并非个例,字节跳动、Sea、阿里巴巴等企业在今年均有匿名发布新模型的操作,企业借此在更少约束的环境下完成新服务的测试工作。 行业内多款热门模型均曾采用匿名代号测试的方式上线,后续才公开归属主体。其中,Hunter Alpha被证实为小米MiMo-V2-Pro,Owl Alpha对应美团LongCat 2.0,Pony Alpha为智谱GLM-5,OpenAI也曾使用Quasar Alpha的代号测试GPT-4.1模型。

32. 匿名模型全球爆火,性能堪比旗舰却只卖白菜价,背后是谁?

33. AA指数57分=Claude Opus 4.8,智谱GLM-5.3-Flash价格仅1/40

34. 全球登顶大模型“牛来”!出自智谱!武清携手共建环渤海总部!

35. 一个匿名AI偷偷霸榜全球第一,揭面后全网炸了:中国造的,还免费 过去一周,全球程序员圈都在传一件事。 全球最大的AI模型测试平台OpenRouter上,突然冒出来一个匿名模型。没有公司名,没有背景介绍,只有一个代号:Ox,英文里是"牛"的意思。 结果它上线第一天,调用量直接冲上全球第一。 程序员们炸锅了:这到底是谁家的?这么猛还匿名?中国网友给它起了个外号,叫"牛来"。 8月26日晚,谜底揭晓。中国AI公司智谱官宣:"牛来"就是我们的GLM-5.3。 而今天凌晨,他们干了件更狠的事——把满血版GLM-5.3的全部技术家底免费开源,全世界任何人都可以下载、修改、拿去用。 这个模型到底什么水平?看第三方测评。 国际权威机构Artificial Analysis的智能指数,GLM-5.3拿了60分,超过了美国Anthropic公司最强的Claude Opus 4.8。在智能体能力测试里拿59分,压过了OpenAI的GPT-5.6。 翻译成大白话:全球AI最顶尖的第一梯队里,第一次有了中国免费模型的名字。 但最提气的不是分数,是另一个细节。 智谱披露,"牛来"这个模型所有的推理流量,全部跑在国产芯片上。 这意味着什么?前几年中国AI最憋屈的事,就是最好的芯片被人卡着买不到。现在中国公司拿出了一个跟美国最顶尖模型掰手腕的产品,而支撑它的算力,完完全全是自己的芯片。 自己的模型,自己的芯片,然后免费送给全世界。 当然,免费也有个小心机。模型7440亿个参数,下载文件755个G,普通电脑根本跑不动。而且协议里写了:年营收超过100亿美元的超级巨头,想拿它做生意,得先过智谱的安全审查。小团队随便用,大公司要报备。 说白了:技术我敞开送,但规矩得按我的来。 对比一下就很有意思。美国最强的GPT和Claude,闭源,调用按次收费,一年订阅费上千元。中国这边,DeepSeek年初开源震了一次,现在智谱又把顶级模型免费送出来。 中国AI的打法越来越清楚了:硬件上被人卡脖子,那就绕到软件和开源上,把桌子掀了重新定规则。 以前开源这场游戏,规则一直是美国人定的。安卓、Linux,都是别人的家底。现在轮到中国公司往外送顶级技术了。 你觉得开源这招,能不能帮中国AI换道超车?评论区说说你的看法。 #智谱GLM# #AI大模型# #国产芯片# #人工智能# #开源#

36. 免费AI工具,爆火一周,智谱认领了 最近AI圈最好看的连续剧:8月20日,一个叫Ox Alpha的模型突然出现在OpenRouter上。没有厂商、没有公告、没有名字来历,只有一条说明——免费、不限量。 然后它开始屠榜。代码生成、复杂推理、长时间Agent任务,全都强得不像免费货,一周冲上OpenRouter当周最受欢迎模型。全球开发者开启侦探模式:是OpenAI的藏牌?Anthropic的暗测?马斯克的新玩具?猜了一整周。 8月26日晚,谜底揭晓:智谱认领,Ox Alpha就是GLM-5.3-Flash,同时宣布开源。国产模型第一次用"匿名盲测"的打法出海——先把牌打出去让大家猜,效果说话,最后亮身份。 这招其实很聪明:如果一开始挂着"智谱GLM"的名字,海外开发者会自带滤镜;匿名裸奔一周登顶,含金量完全不一样。 实力部分说数据:代码能力DeepSWE v1.1拿了63.4分,上一代GLM-5.2是46.2,提升幅度很大;专门测"AI连续干活"的AutomationBench从26.2涨到48.8。用一句话翻译:它最长的板子是写代码和跑长时间Agent任务——正好是打工人最需要的两块。 对普通人的意义更实在:免费、上下文百万token、还开源。这意味着你可以零成本把它接到自己的工具里跑活,API价格(如果后续商业化)预计也是国产良心价。 一个冷静提醒:B站已经有评测指出"远没有X上吹的那么强,但现阶段免费"——盲测光环会放大情绪,等更多第三方评测出来再下结论不迟。适合现在就上车体验,不适合吹成"屠神"。 说实话,这件事最值得记的点不是模型本身,而是打法:中国AI公司开始用全球开发者的规则玩游戏了。以前是我们等别人发模型,现在是海外社区追着猜我们是谁。 你猜过Ox Alpha是哪家的吗?评论区报你当时的猜测,看看谁是真侦探。 (数据:智谱官方博客与AI前线8.27报道;分数为官方公布,第三方复现待核实) #智谱# #GLM# #DeepSeek# #AI资讯# #开源模型# #大模型# #AI工具# #免费AI#

37. 如何评价智谱开源的 GLM-5.3-Flash?

38. 【快讯】"牛来模型"真身确认!智谱GLM 5.3 Flash发布,周末送3亿Token

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章