大模型8月集中爆发,GLM-5.3-Flash价格仅为对手闲时价30%

源自315位全网作者

09-02 19:05

精选参考来源

1
日均Token破500万亿,智能体的大爆发,正在制造一场算力“海啸”,明天这几个方向有望继续“嗨”了……消息上:我国日均词元调用量破500万亿,中国大模型居全球第一梯队。竞争焦点转向智能体落地与生态建设,推理算力需求爆发,互联网大厂加速布局AI智算中心并锁定资源。(消息来源于央视财经)日均500万亿词元调用彰显真实需求爆发,指数级增长意味着整个产业链的盈利模式正变得清晰。从侧面也看得出我们的AI已从技术储备迈向市场规模化的商用。现在AI竞争焦点转向智能体落地,AI开始真正赋能千行百业,推动产业智能化升级。算力成为核心战略资源,大厂重金布局智算中心,预示基础设施投资浪潮正在加速阶段了。总的来说,此消息大利好四大方向:1️⃣最直接受益无疑是算力基础设施。词元爆发直接带来算力刚需,这是业绩确定性最高的环节。2️⃣算国产AI芯片/GPU以及光模块/PCB3️⃣ IDC/算力租赁和液冷4️⃣云服务与MaaS。云厂商正从租赁转向按词元消耗计费的MaaS模式,有望实现量价齐升。5️⃣AI应用与智能体(Agent)6️⃣电力
2
#牛来大模型6天用掉数十万亿词元##牛来大模型来自北京# 8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox-Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时,大幅降低长上下文服务成本。智谱透露,为收集广大用户的广泛、专业反馈,在正式发布GLM-5.3-Flash前,团队以匿名模型Ox-Alpha在OpenCode和OpenRouter上进行了大规模测试。Ox意为“牛”,恰逢电影《牛来》走红,Ox Alpha也被中文开发者们称作“牛来大模型”。上线后,Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。公开信息显示,从8月20日匿名上线,到8月26日期间的六天,Ox Alpha已经让全球开发者用掉了数十万亿Token(词元)。值得注意的是,这些请求流量全部由国产芯片提供算力支持。智谱表示,这是其首次在大规模流量中尝试用国产芯片集群提供服务,这些芯片均通过自研高带宽互联网络连接。(来源:福布斯中文网)北京日报的微博视频
全部
来源
内容由AI生成

精选参考来源

1. 日均Token破500万亿,智能体的大爆发,正在制造一场算力“海啸”,明天这几个方向有望继续“嗨”了……消息上:我国日均词元调用量破500万亿,中国大模型居全球第一梯队。竞争焦点转向智能体落地与生态建设,推理算力需求爆发,互联网大厂加速布局AI智算中心并锁定资源。(消息来源于央视财经)日均500万亿词元调用彰显真实需求爆发,指数级增长意味着整个产业链的盈利模式正变得清晰。从侧面也看得出我们的AI已从技术储备迈向市场规模化的商用。现在AI竞争焦点转向智能体落地,AI开始真正赋能千行百业,推动产业智能化升级。算力成为核心战略资源,大厂重金布局智算中心,预示基础设施投资浪潮正在加速阶段了。总的来说,此消息大利好四大方向:1️⃣最直接受益无疑是算力基础设施。词元爆发直接带来算力刚需,这是业绩确定性最高的环节。2️⃣算国产AI芯片/GPU以及光模块/PCB3️⃣ IDC/算力租赁和液冷4️⃣云服务与MaaS。云厂商正从租赁转向按词元消耗计费的MaaS模式,有望实现量价齐升。5️⃣AI应用与智能体(Agent)6️⃣电力

2. #牛来大模型6天用掉数十万亿词元##牛来大模型来自北京# 8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox-Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时,大幅降低长上下文服务成本。智谱透露,为收集广大用户的广泛、专业反馈,在正式发布GLM-5.3-Flash前,团队以匿名模型Ox-Alpha在OpenCode和OpenRouter上进行了大规模测试。Ox意为“牛”,恰逢电影《牛来》走红,Ox Alpha也被中文开发者们称作“牛来大模型”。上线后,Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。公开信息显示,从8月20日匿名上线,到8月26日期间的六天,Ox Alpha已经让全球开发者用掉了数十万亿Token(词元)。值得注意的是,这些请求流量全部由国产芯片提供算力支持。智谱表示,这是其首次在大规模流量中尝试用国产芯片集群提供服务,这些芯片均通过自研高带宽互联网络连接。(来源:福布斯中文网)北京日报的微博视频

3. #阿里发布Qwen3.8Flash# 阿里千问又扔了个炸弹——Qwen3.8-Flash正式发布,同时开源了Qwen3.8-Flash-Next。我看完第一反应是:大模型行业的竞争逻辑,真的变了。 先给大家翻译一下这玩意有多猛。Qwen3.8-Flash是个MoE模型,总参数125B,但每token只激活6B。什么概念?就是用一个小模型的算力消耗,干出了接近旗舰模型的活。 官方数据是:编程、智能体、专业工作、多模态这些评测,完爆Opus 4.6,逼近Opus 4.8。训练成本比上一代Qwen3.7-Plus直接降了90%,推理成本也大幅下降。 整个行业都在往这个方向走——过去大家比的是"谁的模型参数更大、谁的跑分更高",现在比的是"谁能用更低的成本,交付足够强的智能"。 阿里这波的生态布局。Qwen3.8系列不是单蹦一个模型,而是一套组合拳: - Qwen3.8-Max负责冲高,在复杂推理和编程上冲击SOTA,告诉业界"我们能做到多强";- Qwen3.8-27B负责铺生态,把高水平能力带到消费级硬件,让开发者能本地部署、二次开发;- Qwen3.8-Flash负责接最大规模的真实使用,办公、编程、Agent、高并发业务,全靠它扛量。 而且这次还开源了Flash-Next,这其实是Qwen4下一代架构的提前预演。把下一代技术路线开放给社区,让开发者提前做框架适配和部署优化,同时收集真实反馈反哺架构演进——这步棋走得很聪明。 还有个细节我很关注:千问办公已经上线了专属版的Qwen3.8-Flash,官方说能完成95%的日常办公任务。这就是"模A一体"的思路——模型团队和应用团队协同优化,不是模型做完扔给应用方就完事了,而是联合调,把Agentic能力拉满。 叠加Qwen全球超30亿下载、30万个衍生模型的底子,这波发布等于同时占住了模型能力、开源生态和商业落地三个位置。 最后说句我的判断:大模型行业正在从"军备竞赛"转向"实用主义"。

4. 【部分#国产大模型调用量暴涨6800%# 部分大模型#词元价格降至国外十分之一#】随着人工智能应用加速落地,截至今年6月,我国日均词元调用量已突破500万亿。央视财经记者了解到,当前全球大模型正处在竞争最激烈、迭代最快的阶段,而中国大模型已在全球竞争中位居第一梯队,词元调用量快速增长。国内一家大模型企业负责人介绍,其推出的大模型正式版上线第一周就比上一代模型增长了68倍的Token(词元)的调用量。业内人士表示,当前人工智能旗舰模型几乎以月为单位更新,竞争焦点从单纯的“模型智商”,转向智能体落地和生态建设的全面比拼。稀宇科技开放平台首席架构师冯雯表示:“我们现在模型输入价格是百万词元2.1元,输出是每百万词元8.4元,是国际某些模型价格的不到十分之一。词元价格的降低其实带来了应用的普及,也加速了词元整体调用量的指数级增长。” (央视财经)央视财经的微博视频

5. 牛来大模型来自中国!国产芯片大突破

6. 8亿美元ARR,市场需要重新认识MiniMax

7. #阿里发布Qwen3.8Flash# 阿里这次的Qwen3.8-Flash,算是把大模型的性价比卷到新维度了。没走堆参数的老路,从底层架构重新设计,125B总参数每次只激活6B,多项测试表现直逼旗舰模型,训练成本反倒降了近九成。说白了就是大模型的竞争逻辑变了:从前拼谁参数规模大,现在拼单位算力能出多少有效智能,这才是真正能规模化落地的方向。

8. 牛来大模型被认领是国产牛,打穿了Deepseek的价格线

9. 淘金热里最稳赚不赔的是谁?卖铲子的。 8 月 28 日,巴克莱发了一份研报,把 AI 行业的钱怎么流动,掰开揉碎算了个明白。 核心数字很有意思:AI 模型公司每赚 100 美元,大约 35 到 40 美元会以推理计算费的形式,流进 AWS、Azure、GCP 三大云厂商的口袋。 云厂商再从这笔钱里

10. 中美算力差10倍,模型为什么只差3分? #大有学问 #红衣聊AI #算力 #大模型

11. #DeepSeekV4多模态模型正式开源#DeepSeek这次直接把自家最新的V4多模态大模型给开源了,已经传到Hugging Face上了,用的是MIT协议,基本放开给大家免费用,限制很少。这是他们V4系列第一款带看图能力的版本,在原来文字能力的底子上加了视觉理解的本事,之前擅长的推理,写东西这些能力也都完整留着。DeepSeek模型现在格局是真的大,这么新的模型直接放出来给所有人用。

12. 刚刚,MiniMax剧透新一轮「斩杀线」!8亿美元ARR炸场

13. #中美AI大模型差距缩至2.7%# 斯坦福最新AI指数报告出炉,一组数据让人意外——中美顶尖大模型性能差距已缩小到仅2.7%,两国模型多次交替登顶榜单。几个值得关注的趋势:· 美国主攻通用AGI,Claude/GPT/Gemini在复杂推理、多模态上仍保持领先· 中国走「低成本+产业落地」路线,DeepSeek、Qwen、Kimi等中文场景和性价比全面反超· 2026年8月更出现戏剧性一幕:OpenAI旗舰模型降价33%,DeepSeek却涨价1100%,定价曲线历史性交叉一个有趣的反差:美国AI私人投资2859亿美元,是中国124亿的23倍,但差距反而在缩小。中国靠工程优化和场景落地,把「可用」做成了「好用、便宜、规模化」。你觉得这场竞赛的下半场,决胜点会在哪?是算力突破、行业落地,还是生态话语权? #微博AI创作季#

14. 在8月26日,阿里千问推出了Qwen3.8‑Flash大模型,以及同步开源下一代架构的Qwen3.8‑Next。这次发布重点是搭建完整的模型生态矩阵。 Qwen3.8系列分工很明确了。Max用来冲击能力上限,专攻复杂推理和长周期任务。27B面向开发者生态,支持消费级硬件本地部署,方便二次开发。主角Flash仅激活6B参数,性能超越Opus4.6同时逼近Opus4.8。训练和推理成本大幅降低,主打大规模真实业务落地。 现在智能体场景下,办公任务往往会触发几十次模型调用,成本与稳定性远比单次问答能力重要。现在千问办公已经上线Flash专属版本,可以完成95%日常办公所需。 Qwen3.8‑Next提前放出Qwen4前瞻架构交给社区验证。依托超30亿下载和30万衍生模型的积累,这次发布同时兼顾模型性能、开源生态和商业落地。大模型竞争逻辑已经发生转变,从此不再一味比拼最强性能,而是追求用更低成本输出实用能力,基于真实业务需求进行合理分配。#阿里发布Qwen3.8Flash#

15. “牛来”大模型身份曝光

16. 大模型之家2026年8月热力榜:涨价与降本齐飞,开源共普惠一色

17. 千问智谱连夜开源,都比DeepSeek便宜,国产大模型价格猛卷

18. 3.13美元修17个bug,腾讯把770B大模型开源了

19. 【8月27日】AI产业简报

20. 2026年8月AI模型大爆发!7款开源新模型全覆盖|大模型+长视频AI短剧全新升级

21. 一周登顶全球,“牛来”大模型真身曝光

22. 腾讯混元 Hy4 preview发布,稳居开源模型第一梯队

23. AI 早知道:开源大模型,这个 8 月杀疯了

24. 盘点一周AI大事(8月30日)|OpenAI年底实现AGI 智谱正式开源「GLM-5.3-Flash」 OpenAI完成下一代模型「Bel」预训练,参数规模10T 奥特曼透露OpenAI内部AGI最快年底达成 Anthropic发布硬件通用协议「MHS」 Qwen开源下一代架构Flash模型「Qwen3.8-Flash-Next」 鹅厂开源下一代混元模型「Hy4 Preview」 Google发布SOTA语音识别模型「Gemini 3.5 Transcribe」 Google升级「Gemini Omni 1.1 Flash」 Yutori推出SOTA电脑操作模型「Navigator n2」 Skild重磅发布机器人大脑模型「S1」 #抖音前沿科技首发计划 #vibecoding大赏 #AI新星计划 #AI #AIGC

25. 清华五道口AI俱乐部|大模型密集发布与AI能力边界拓展:腾讯混元Hy4、谷歌Gemini Omni 1.1 Flash、蚂蚁金融Ling-3.0-flash-Fin

26. 智谱免费送的周末3亿Token已使用过半 智谱免费送的周末3亿Token已经用了超一半了, GLM5.3-Flash还是能干活的,要我排个序的话,纯个人体验: Claude Fable5>GPT5.6>Grok4.6>Kimi K3≥GLM 5.3 Flash 预计下周四GPT6将发布,7-8月是国产大模型发布能力大幅提升的时期,进入9月,世界前沿模型都将都大版本发布,国产能否跟上让我们拭目以待。 #AI大模型 #智谱 #GLM #Kimi k3

27. 消息称字节跳动豆包大模型2.2将推迟发布,原计划8月推出

28. 韩国拟向全民免费开放生成式AI服务 不设词元使用上限

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章