当前位置:
AIGC文章详情

国内日均词元调用量破500万亿,国产大模型全球调用量连续17周第一

源自343位全网作者

08-28 08:53

精选参考来源

1
#美国大模型价格被中国打下来了# 这事真不是标题党。过去一个月,OpenAI连续三轮降价:GPT-5.6 Luna砍了80%,中端模型Terra降20%,连最贵的旗舰Sol也降了超20%,输出价格直接砍掉三分之一。Anthropic那边也没闲着,新模型Opus 5定价只有旗舰的一半,原定涨价计划也取消了。《金融时报》说得很直白:客户正在转向中国开源大模型,美国公司“不得不”降。几个关键数据感受一下:· OpenRouter平台上,中国模型Token调用占比从去年上半年的4.5%飙到现在的50%—60%· 调用量前五的模型,全部来自中国· DoorDash、Airbnb等美国企业公开表示在用中国模型控制成本· 硅谷数据机构统计,7月中旬以来美国模型均价已下降近25%有意思的是,中国模型这边反而在涨价——DeepSeek因为调用量太爆,开始实行峰谷定价。两边价格在互相靠拢。更深层的变化是,中国开源不只是给个模型权重,而是把训练方法、工程工具链都开放了,全球开发者都能低成本搭建自己的AI。这已经不是单纯的价格战,而是在重新定义“够用的智能应该卖多少钱”。不过也别急着宣布胜利。性能差距在缩小,但高端算力、芯片供应仍是短板。下一阶段的竞争,拼的不只是谁更便宜,而是谁的模型配得上它标出来的那个价钱。你觉得这场AI价格战,最终谁会笑到最后?#中国AI大模型##AI价格战##微博AI创作季#
2
【部分#国产大模型调用量暴涨6800%# 部分大模型#词元价格降至国外十分之一#】随着人工智能应用加速落地,截至今年6月,我国日均词元调用量已突破500万亿。央视财经记者了解到,当前全球大模型正处在竞争最激烈、迭代最快的阶段,而中国大模型已在全球竞争中位居第一梯队,词元调用量快速增长。国内一家大模型企业负责人介绍,其推出的大模型正式版上线第一周就比上一代模型增长了68倍的Token(词元)的调用量。业内人士表示,当前人工智能旗舰模型几乎以月为单位更新,竞争焦点从单纯的“模型智商”,转向智能体落地和生态建设的全面比拼。稀宇科技开放平台首席架构师冯雯表示:“我们现在模型输入价格是百万词元2.1元,输出是每百万词元8.4元,是国际某些模型价格的不到十分之一。词元价格的降低其实带来了应用的普及,也加速了词元整体调用量的指数级增长。” (央视财经)央视财经的微博视频
全部
来源
内容由AI生成

精选参考来源

1. #美国大模型价格被中国打下来了# 这事真不是标题党。过去一个月,OpenAI连续三轮降价:GPT-5.6 Luna砍了80%,中端模型Terra降20%,连最贵的旗舰Sol也降了超20%,输出价格直接砍掉三分之一。Anthropic那边也没闲着,新模型Opus 5定价只有旗舰的一半,原定涨价计划也取消了。《金融时报》说得很直白:客户正在转向中国开源大模型,美国公司“不得不”降。几个关键数据感受一下:· OpenRouter平台上,中国模型Token调用占比从去年上半年的4.5%飙到现在的50%—60%· 调用量前五的模型,全部来自中国· DoorDash、Airbnb等美国企业公开表示在用中国模型控制成本· 硅谷数据机构统计,7月中旬以来美国模型均价已下降近25%有意思的是,中国模型这边反而在涨价——DeepSeek因为调用量太爆,开始实行峰谷定价。两边价格在互相靠拢。更深层的变化是,中国开源不只是给个模型权重,而是把训练方法、工程工具链都开放了,全球开发者都能低成本搭建自己的AI。这已经不是单纯的价格战,而是在重新定义“够用的智能应该卖多少钱”。不过也别急着宣布胜利。性能差距在缩小,但高端算力、芯片供应仍是短板。下一阶段的竞争,拼的不只是谁更便宜,而是谁的模型配得上它标出来的那个价钱。你觉得这场AI价格战,最终谁会笑到最后?#中国AI大模型##AI价格战##微博AI创作季#

2. 【部分#国产大模型调用量暴涨6800%# 部分大模型#词元价格降至国外十分之一#】随着人工智能应用加速落地,截至今年6月,我国日均词元调用量已突破500万亿。央视财经记者了解到,当前全球大模型正处在竞争最激烈、迭代最快的阶段,而中国大模型已在全球竞争中位居第一梯队,词元调用量快速增长。国内一家大模型企业负责人介绍,其推出的大模型正式版上线第一周就比上一代模型增长了68倍的Token(词元)的调用量。业内人士表示,当前人工智能旗舰模型几乎以月为单位更新,竞争焦点从单纯的“模型智商”,转向智能体落地和生态建设的全面比拼。稀宇科技开放平台首席架构师冯雯表示:“我们现在模型输入价格是百万词元2.1元,输出是每百万词元8.4元,是国际某些模型价格的不到十分之一。词元价格的降低其实带来了应用的普及,也加速了词元整体调用量的指数级增长。” (央视财经)央视财经的微博视频

3. #神秘牛来大模型冲上榜一#最近AI圈突然冒出来一个叫Ox Alpha的匿名模型,因为英文Ox是"牛",中文社区给它起了个接地气的名字叫"牛来大模型"。8月20日它低调上线OpenRouter平台后,调用量直接冲上榜首,刷新了平台单日调用纪录——光前五大应用对它的累计调用就突破了4万亿Token,还终结了DeepSeek连续56天霸榜的局面。更关键的是,它完全免费开放,每天算力据说达到100万亿Token级别。性能也很能打:在软件工程测试中得分80%,超过了GPT-5.6的52%和Claude的65%。开发者直呼"非常困惑"——一个来历不明的模型,把几家头部大厂都压了一头。那它到底是谁家的?社区已经扒了24小时"技术指纹":tokenizer、视频编码、报错码全都指向智谱GLM系列,甚至有开发者说99%确定就是智谱的东西。但谷歌DeepMind那边也有人暗示可能是Gemini新版。最有意思的是,到现在没人出来认领。主动匿名、免费放量、技术这么强——这操作本身就挺值得琢磨。各家厂商似乎都愿意"让产品自己说话",而不是靠品牌先入为主。无论最后是谁家的,这场猜谜游戏本身已经说明:AI的竞争方式变了,实力藏不住,也装不出来。

4. 50 台 DGX + 万亿 Token 补贴:上影与筷子科技打造专业级 AI 片场

5. 牛来进军 AI 行业了。。。牛来 SOTA AI !!!Ox Alpha(OpenRouter 上的模型 ID 为 stealth/ox-alpha,也有 OpenCode 上的免费版)。上线时间:大约2026年8月20日深夜(北京时间21日凌晨)以“隐身模型”(stealth model)身份低调出现在 OpenRouter 等平台。主要规格:约100万 token 上下文窗口最大输出约13万 token支持文本 + 图片 + 视频多模态输入支持工具调用目前限时免费(约一周,到8月27日左右),调用额度很宽松(平台宣称日处理量可达100T token级别)性能表现(初步测试):Ox Alpha 通过率约 80%Claude Fable 5 Max 约 65%GPT-5.6 Sol Max 约 52%其他如 GLM-5.3、Grok 4.6 也在60%左右这让它在编程/Agent编码能力上引发大量关注,看起来逼近甚至局部超过当前头部模型。但注意:测试样本量较小(10道题左右),后续有人复测结果有波动。身份猜测:目前没有官方认领,完全匿名。社区通过“指纹分析”(比如视频token消耗模式、错误提示语言、审查口径等)做了大量对比:最主流猜测:智谱(Zhipu AI)尚未正式发布的 GLM-5.3 相关版本(可能是 Flash 版或带多模态的视觉版),证据匹配度较高。

6. 日均Token破500万亿,智能体的大爆发,正在制造一场算力“海啸”,明天这几个方向有望继续“嗨”了……消息上:我国日均词元调用量破500万亿,中国大模型居全球第一梯队。竞争焦点转向智能体落地与生态建设,推理算力需求爆发,互联网大厂加速布局AI智算中心并锁定资源。(消息来源于央视财经)日均500万亿词元调用彰显真实需求爆发,指数级增长意味着整个产业链的盈利模式正变得清晰。从侧面也看得出我们的AI已从技术储备迈向市场规模化的商用。现在AI竞争焦点转向智能体落地,AI开始真正赋能千行百业,推动产业智能化升级。算力成为核心战略资源,大厂重金布局智算中心,预示基础设施投资浪潮正在加速阶段了。总的来说,此消息大利好四大方向:1️⃣最直接受益无疑是算力基础设施。词元爆发直接带来算力刚需,这是业绩确定性最高的环节。2️⃣算国产AI芯片/GPU以及光模块/PCB3️⃣ IDC/算力租赁和液冷4️⃣云服务与MaaS。云厂商正从租赁转向按词元消耗计费的MaaS模式,有望实现量价齐升。5️⃣AI应用与智能体(Agent)6️⃣电力

7. OpenCode的CEO介绍 DeepSeek v4 Flash 正式版发布后,他们的的变化。因为这个模型最够好又便宜到离谱,所以他们一下子激增了大约10T Token/日。这大概需要1000 张 B300 GPU才能扛得住。所以也能知道DeepSeek为什么涨价了,单这一个渠道,就得占用大概7000张 H100的GPU。AGI还做不做了-----------好的,我来讲讲 DeepSeek v4 Flash 最近发生了什么。先补充一点背景。它在 8 月 1 日上线,在短短两周内,DeepSeek v4 Flash 在 OpenCode 上的日 token 使用量就从 3 万亿暴涨到了 18 万亿,足足增长了 6 倍,夸张得离谱。这个数字有多大?作为参照,这个增量差不多相当于再造了一个 OpenRouter 的全部日流量。而且据我们估计,OpenCode 这部分用量可能已经占到 DeepSeek 总调用量的 30%–50%。两周之内出现这种幅度的增长,绝对不正常。之所以会发生这种事,首先是因为这个模型便宜得离谱:它比 Fable 便宜大约 350 倍,比 5.6 Sol 便宜 175 倍,比 Sonnet 便宜 70 倍,比 Luna 便宜 7 倍。其次,相比上一代 Flash 模型,它的能力也有了非常明显的提升。我们的用户第一次真正感受到了一种“AI 便宜到几乎不用算成本”的体验。但随后,到了 8 月 16 日,DeepSeek 突然把价格提高了 5 倍;非高峰时段也涨了 2.5 倍。这一下基本直接把模型的增长势头打断了。现在它每天处理的 token 数,已经不到峰值时期的一半。用户显然对这种突然涨价非常不满。我们的判断是,DeepSeek 很可能确实扛不住这次离谱的 6 倍流量增长。另一方面,GPU 价格上涨也可能意味着,即便他们继续采购新的算力容量,以新增硬件的成本来看,也已经不可能再按照原来的价格提供服务。这里顺便解释一下,为什么 DeepSeek Flash 原本可以做到这么便宜。看起来他们使用了一套定制化的基础设施,可以缓存远多于普通方案的 token,而且缓存保留时间也长得多。这一点非常关键,因为 DeepSeek Flash 涨价之后,我们这边一直在拼命寻找其他供应商,希望填补它留下的接近每天 10 万亿 token 的巨大缺口。遗憾的是,目前真正能做到接近 DeepSeek 原始价格的供应商只有寥寥几家。而且他们之所以能做到这个价格,很可能也只是因为用了更新一代的硬件。这就说到了目前的情况。过去一周,我们几乎把能联系的人都联系了一遍,希望找到能够按照 DeepSeek 原始价格托管 DeepSeek 模型的供应商。问题在于,即使有人技术上能够做到这个价格,他们也很难拥有足够大的算力容量来承接我们的流量。按照我们目前的吞吐量计算,大概要用到约 1000 台 B300 服务器才能扛住。这也是为什么,如果你过去几天一直在 Go 上使用 DeepSeek Flash,体验可能不是特别好。很遗憾,我们这几天不得不连续切换了几个不同的算力供应商。不过,DeepSeek Flash 留下的这个每天约 10 万亿 token 的缺口,同时也是所有其他模型厂商的巨大机会。现在已经非常明确:市场确实非常需要一种模型,它的能力至少要达到 DeepSeek Flash 的水平,同时价格也要足够低。而且更夸张的是——DeepSeek Flash 这样的能力和价格组合,似乎还只是市场的最低门槛。这里最后一句 “And somehow that still feels like the floor.” 的重点不是“价格已经到底了”,而是说:即使一个模型已经做到 DeepSeek Flash 这么强、这么便宜,市场给人的感觉依然是——这可能只是未来竞争的起点/最低标准,而不是一个特别高的标杆。

8. #牛来模型确认为智谱GLM系列#前几天,网上突然冒出来一个神秘的“隐身模型”:Ox Alpha(stealth/ox-alpha),引发了大量网友的关注。Ox Alpha的中文名“牛来”,它是一个匿名上线的“隐身模型”,主打 Coding + Agent + 多模态,目前免费开放,当时网上最热门的猜测是:智谱的 GLM。随着8月26日智谱官宣,匿名模型Ox Alpha(牛来模型)属于GLM系列新一代产品,这款模型此前低调登陆OpenRouter,凭借强悍的编码与智能体能力快速登顶平台榜首,调用量直接超过DeepSeek两倍。它支持文本、图像、视频多模态输入,面向编程开发场景,目前还能免费试用一周。从全网匿名盲测登顶,到官方正式认领,国产大模型用硬实力在全球开发者社区站稳脚跟,太牛了!

9. 【万兴科技:上半年亏损6898.33万元】财联社8月23日电,万兴科技(300624.SZ)发布2026年半年报,报告期内,公司实现营业收入7.06亿元,同比下降7.09%;归母净利润亏损6898.33万元,去年同期亏损5280.91万元。报告期内,公司AI服务器调用量超9亿次,同比增长超80%,6月日均Token消耗量超千亿,用户AI使用频次与接受度持续提升,以Token消耗为核心的收入模式转变有望成为未来重要的增长驱动力。

10. #牛来大模型6天用掉数十万亿词元##牛来大模型来自北京# 8月26日晚,智谱上线并开源GLM-5.3-Flash (320B-A18B),这是GLM-5系列的首个原生多模态模型,已面向全球开源。同日,此前在OpenRouter(全球头部大模型聚合平台)、OpenCode(开源AI编程助手平台)上匿名爆火的模型Ox-Alpha,也被证实来自这家总部位于北京的大模型公司。前沿智能不需要省着用,成了智谱此次发布模型的一大亮点,GLM-5.3-Flash定价约相当于海外知名模型Opus 4.8的40分之一。智谱团队表示,这主要源于GLM-5.3-Flash同时实现的多项架构升级,通过采用稀疏注意力与线性注意力混合架构,技术团队实现了保持精准长上下文能力的同时,大幅降低长上下文服务成本。智谱透露,为收集广大用户的广泛、专业反馈,在正式发布GLM-5.3-Flash前,团队以匿名模型Ox-Alpha在OpenCode和OpenRouter上进行了大规模测试。Ox意为“牛”,恰逢电影《牛来》走红,Ox Alpha也被中文开发者们称作“牛来大模型”。上线后,Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。公开信息显示,从8月20日匿名上线,到8月26日期间的六天,Ox Alpha已经让全球开发者用掉了数十万亿Token(词元)。值得注意的是,这些请求流量全部由国产芯片提供算力支持。智谱表示,这是其首次在大规模流量中尝试用国产芯片集群提供服务,这些芯片均通过自研高带宽互联网络连接。(来源:福布斯中文网)北京日报的微博视频

11. 根据小米 MIMO 的调用量,这玩意儿估计非常有市场。但我指的不是个人,是大部分中小企业,批量购买这个当企业 AI 数据算力终端!毕竟 MIMO 即便宜又能用!当然还是得赶紧捶打一下雷总,速速更新 MIMO!我估计早就突破了 但是还没发

12. 中国AI大模型调用量连续十七周领跑:神秘“牛来”大模型上线四天冲至全球第二,DeepSeek-V4-Flash正式版连续三周第一

13. AI算力大事追踪:中国AI大模型周调用量连续十七周稳居全球首位

14. 以词元为引擎推动智能经济高质量发展

15. 日均 140 万亿 Token!大模型时代,算力竞争早已不是比谁显卡多

16. 最近安徽是真被带起来了。前一天刚落下词元联合创新实验室,第二天光合组织产业生态创新中心、海光(安徽)产业生态适配中心又接着揭牌。 几件事放到Token增长里看,逻辑其实挺顺。 2024年初,我国日均Token调用量还是1000亿;到2025年底达到100万亿,今年3月已经突破140万亿,两年增长超过1000倍。 调用量上来之后,模型、框架、数据库、行业软件和终端应用,都要在同一套技术体系中顺畅协作,Token才能稳定生产。 光合组织恰好能补上这部分能力。光合已汇聚6000余家生态伙伴,完成1.5万余项软硬件适配。这套积累落到安徽,相当于把全国范围的软硬件伙伴和适配经验接到本地。 海光提供自主算力平台和持续的技术牵引,光合则把围绕海光平台形成的成熟产品、解决方案与协作机制带进安徽。企业提出需求后,可以更快找到相应伙伴完成联合验证,量子信息、深空探测、制造和政务等场景,也能少走一段重复适配的弯路。 Token经济跑得越快,越考验底层技术与产业生态能否协同。海光和光合这次在安徽补上的,我看就是从“有算力”到“持续产出并用好Token”的中间一层! #光合组织# #Token经济# #海光信息# #安徽算力#

17. 从词元经济学到场景经济学,构建\

18. 词元日均140万亿,智能体重铺互联网?

19. 全球AI大模型,中美各有千秋,中国token调用量遥遥领先

20. 中国AI大模型调用量连续十七周领跑:神秘“牛来”大模型上线四天冲至全球第二

21. 上周全球大模型调用量出来了,中国这边已经连续十七周压着美国打。总盘子93.3万亿Token,我们占了40.48万亿,美国那边9.66万亿,还在往下掉。 最逗的是榜单里突然冒出个匿名模型,代号Ox Alpha,中文圈叫“牛来”。8月20号才上线,四天直接冲到全球第二,调用量11.6万亿Token,跟DeepSeek-V4-Flash正式版平起平坐。 上下文能干到104.8万Token,图片视频文本通吃,现在还免费。独立研究员拿DeepSWE测了一把,10个任务过了8个,Claude Fable 5才65%。 这玩意儿到底谁家的?技术指纹看着像智谱GLM那路,但谷歌DeepMind的人又在那儿疯狂暗示是Gemini新版。没一个厂商出来认领,就这么挂着。 DeepSeek那边前阵子涨价,高峰时段最高涨了11倍,但周末刚改成全天低谷价。V4-Pro调用量掉了三成,排第九。 这“牛来”是哪个厂在憋大招,估计很快就有信了。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章