2026年3月中国大模型Token调用量首超美国,全球AI应用重心加速东移

源自142位全网作者

04-07 16:45

内容由AI生成

精选参考来源

1. 火山引擎有了它自己的Token经济学

2. 每天120万亿Tokens:Seedance 2.0和ArkClaw龙虾,让豆包大模型调用量炸了

3. 《中国AI算力单周调用量4.69万亿Token登顶全球,摩根大通预测五年将激增370倍》全球领先的AI模型API聚合平台OpenRouter最新数据显示,截至3月15日,中国AI大模型单周调用量突破4.69万亿Token,连续两周稳居全球第一,更包揽全球调用量前三名。在人工智能领域,Token作为基础计量单位,既是信息处理的最小单元,也是衡量模型商业价值的重要标尺。无论用户输入的指令还是AI生成的代码,最终都将转化为Token进行运算处理。当前万亿级Token调用规模的背后,折射出金融、跨境电商、游戏、短视频等领域已形成规模化商用生态。据摩根大通预测,中国AI推理Token消耗量将呈现爆发式增长,预计从2025年的10万亿飙升至2030年的3900万亿,五年增幅高达370倍。

4. Manus被Meta收购,这是中国AI路线的一次胜利。 #大咖观察 #红衣聊AI #manus #Meta #agent

5. 芯片大咖访谈:英伟达最怕的不是AMD,而是华为,中国是半导体供应链最全的国家#AI #芯片 #半导体 #英伟达 #黄仁勋

6. #微博声浪计划##听见微博# 全球最大AI模型聚合平台OpenRouter最新周榜显示,中国大模型包揽调用量前四,周调用量达4.69万亿Token,连续两周超越美国。小米MiMo-V2-Pro以匿名测试的Hunter Alpha身份杀入前七,技术实力获国际认可。中国模型崛起得益于技术性能与成本优势,全球化开发者生态认可,同时也面临高端GPU国产化等挑战。 http://t.cn/AXftF0vO

7. 【5万亿!"电力变算力,中国靠绿电和AI技术,正在全球‘隐形’收割数字红利" 】2026年2月,全球AI行业迎来历史性转折——中国AI模型的周调用量首次超越美国,三周内增长127%,单日调用量超过5万亿Token,占比登顶全球。更惊人的是,全球Top 5模型中,中国独占4席,包揽85%的调用量。而这一切的根基,竟是中国将“电力”转化为“算力”的超级能力。 成本碾压:0.3美元 vs 欧美3美元 中国AI模型的百万Token成本仅0.3美元,是欧美价格的1/10。核心优势来自三大支柱: 1. 绿电革命:西部清洁电价低至欧美1/5,数据中心电费占比从70%压降至40% 2. 技术爆破:混合专家架构让显存需求降60%,推理速度提升20倍 3. 生态协同:国产芯片自给率突破+开源社区激进迭代,Hugging Face下载量反超美国 Token出海=电力出口 每生成1个Token,本质是消耗0.0003度电(以中国能效标准)。当海外开发者调用中国API时: • 相当于间接购买中国绿电 • 边际成本趋近于零(1次训练后,推理电费近乎忽略) • 打破物理电网限制,溢价率超300%(电力成本0.1元,服务售价0.3美元) 千亿赛道与硬仗 尽管中国厂商已占据全球70%的AI推理市场,但挑战同样尖锐: • 合规雷区:GDPR罚款可达全球营收4% • 芯片围堵:英伟达H100性能仍领先国产3倍 • 生态博弈:开源模型被快速复刻,价格战持续恶化 这场“电力-算力-数据”的三角战争,正让中国从资源输出国蜕变为规则制定者。当全球每天消耗越来越多多token时,西部的每一度绿电,都在重构数字时代的权力版图。 (以上内容综合自网络)#人工智能##算力##新能源#

8. OpenRouter 平台数据显示,3 月 16 日至 22 日,中国 AI 大模型周调用量达 7.359 万亿 Token(环比+56.9%),美国为 3.536 万亿 Token(环比+7.35%)。全球调用量前三均由国产模型占据。为什么值得关注:这是 AI 竞争格局从"模型发布"迈向"规模化应用"的分水岭。中国凭借"开源低价+亿级用户场景"路径实现弯道超车,但美国在基础模型创新和高端算力上仍有结构性优势,这场竞争远未终结。 #AI#

9. 谷歌每月 Token 消耗量达到千万亿级别,这会给 AI 大模型的运营和发展带来哪些影响?

10. 【#中国AI调用量首超美国#】#中国四款大模型霸榜全球前五# 2月,中国AI的模型调用量爆发式增长,首次超过美国。 全球最大的AI模型API聚合平台OpenRouter数据显示,9日~15日这周,中国模型以4.12万亿Token的调用量,首次超过同期美国模型的2.94万亿Token。16日~22日这周,中国模型的周调用量进一步冲高至5.16万亿Token,三周大涨127%,而同期美国模型调用量跌至2.7万亿Token。与此同时,全球调用量排名前五的模型中,中国模型占据四席,这股强大的增长动能,并非依赖单一爆款产品,而是中国AI厂商集群式崛起。Token是AI模型处理文本的最小单位。相比用户数,Token调用量是更能真实反映AI模型使用强度、用户粘性及商业价值的关键指标。中国模型厂商,正凭借快速迭代和成本优势占领全球市场,国产算力需求正经历指数级增长。(每日经济新闻)

11. OpenRouter最新测算,3月30日至4月5日,全球AI大模型总调用量达27万亿Token,环比增长18.9%。中国AI大模型表现强劲,周调用量升至12.96万亿Token,环比上涨31.48%,已连续五周实现增长并超越美国。从全球模型调用量排名来看,前六位均被中国AI大模型包揽。Qwen3.6 Plus (free) 以4.6万亿Token的周调用量位居榜首;小米 MiMo-V2-Pro 本周下滑至第二位,周调用量为3.08万亿Token;Qwen3.6 Plus Preview 排名第三,周调用量为1.64万亿Token;阶跃星辰Step 3.5 Flash (free) 排名第四,周调用量1.26万亿Token;MiniMax M2.7 排名第五,周调用量1.19万亿Token;DeepSeek V3.2 位列第六,周调用量同样为1.19万亿Token。

12. 中国第一,全球第三!Token日耗120万亿,直逼谷歌OpenAI

13. “灵光”爆火,AI应用井喷!杭州何成“中国硅谷”?#灵光 #杭州

14. 行业数据说,上周以全球口径,中国模型调用了5.16万亿token,美国模型调用量2.7万亿。预计很快中国跟美国的AI模型调用量会变成2:1的关系。目前全球调用量排名前五的模型中,中国模型占4个。有文章说,未来中国最大的出口产品,就是token,背后就是算力和电力。中国的算力、电力,是全球最便宜的。再加上工程师红利,token换句话说AI能力就是全球最便宜的。中国就是全球最大的AI基础设施提供国,最大的AI基建狂魔。符合一贯形象了。当全球AI基础设施是中国提供的时候,第四次工业革命赢家是谁就不用了了吧。对,没错,是东方某大国。真的赢麻了。。。。

15. 2026年2月,全球最大AI模型API聚合平台OpenRouter的数据显示了一项历史性转折:中国AI模型的周调用量以4.12万亿Token首次超越同期美国模型(2.94万亿Token),并在随后一周攀升至5.16万亿Token。在全球排名前五的模型中,中国占据了四席(包括MiniMax M2.5、Kimi K2.5、智谱 GLM-5、DeepSeek V3.2)。在AI领域,Token是模型处理文本和信息的最小基本单位,相当于AI时代的“燃料”或“电量”。相比于单纯的参数量跑分或注册用户数,Token的消耗量代表了开发者“用脚投票”的真实结果,直接反映了模型的实际应用落地强度、用户粘性以及商业价值。这一核心指标的反转,绝不仅仅是数字的超越,它对未来全球AI的发展走势将产生以下几方面深远的影响:1. 商业模式重塑:从“军备竞赛”走向“普惠应用” * 价格平权加速应用大爆发: 中国AI厂商凭借极致的工程优化、架构创新(如MoE架构的深度应用)和成本控制,将Token价格打到了极低的区间。万亿级的调用量证明了“低价且性能强大”的策略正在全球奏效。这将迫使全球AI定价体系进一步下调,打破少数巨头的算力溢价,大幅降低初创公司和开发者的试错成本,进而真正催生出杀手级的AI原生应用(AI-Native Apps)。 * 计费模式的演进: 随着Token消耗的剧增,AI的商业模式正从单纯的“按月订阅”向“按Token燃料用量+实际任务交付成果”双重定价演变,未来的AI服务将更加定制化和灵活化。2. 全球化角色逆转:中国模型成为“全球底层基础设施” * 突破地域圈层: OpenRouter平台上约47%的用户来自美国,而中国开发者仅占不到6%。这意味着,中国模型此次创造的庞大Token消耗量,绝大多数来自海外开发者的调用。 * 重构产业分工: 这彻底打破了以往人们对“美国做底层模型,中国做套壳应用”的刻板印象。当前的走势正在形成**“中国提供底层AI基础设施 + 全球开发者构建上层应用”**的新生态。中国大模型不再依赖单一爆款,而是以集群式的姿态,实质性地嵌入了全球AI产业链的最核心环节。3. 算力需求重构:重心向“推理侧(Inference)”剧烈倾斜 * 指数级的推理算力缺口: 过去几年,全球算力焦点主要集中在“炼丹”(预训练)。而以万亿为单位的Token调用量意味着庞大且高频的并发请求,标志着AI产业已经全面进入以推理(Inference)为主导的阶段。 * 倒逼底层硬件优化: 这种规模的调用需要极低延迟、高吞吐量的算力网络支撑。这将极大地刺激国产算力需求,并倒逼芯片设计厂商(无论是GPU还是定制化ASIC芯片)将重心转移到如何降低单Token的推理成本和能耗上,从而加速算力中心架构的迭代。4. 技术演进飞轮:基于海量真实反馈的加速进化 * 飞轮效应彻底启动: Token调用量的暴增,本质上是海量真实世界场景数据、复杂逻辑和用户意图的持续输入。如此庞大的实战并发调用,为中国大模型厂商提供了极其丰富的强化学习(RLHF/RLAIF)反馈数据。 * 向“智能体(Agent)”跨越: 掌握了开发者在代码生成、复杂文本解析、逻辑推理等高价值场景的真实使用数据,模型厂商能够更快地发现“幻觉”盲区并进行针对性微调,这将大大缩短AI从“对话聊天机器人”向能够自主执行复杂任务的“智能体(Agent)”进化的周期。总结而言,中国大模型Token调用量超越美国,意味着中国AI产业的竞争力已实质性地跨越了“追赶技术指标”的阶段,进入了“赢取全球开发者心智与生态”的新纪元。 您是否希望进一步了解本次霸榜的四款中国大模型(MiniMax、Kimi、智谱、DeepSeek)各自在技术路线和主攻的应用场景上有什么差异?

16. 黄仁勋,开启智元(Token)时代

17. 阿里开启 Token 战略,喊出云+AI 年收入破千亿口号,底气从哪来?

18. SpaceX的内部资料:1.5万亿的市值是泡沫还是货真价实#SpaceX #马斯克 #Starlink #星链 #星舰

19. 最近国家数据局给出的统计数据是,3月中国日均Token调用了超过140万亿。 昨天晚点LatePost又发了报道,字节豆包大模型的日均Token调用量在3月超过了100万亿。 我们假设两个数据都是成立的,那么岂不是豆包一家就占到了中国大模型整体消耗量的70%以上? 当然豆包大模型也可以有海外的调用量,但从市场表现来看,不会太多。 再就是口径问题,豆包的100万亿日均调用量,出自火山引擎,这个相对来说是比较清晰的。 国家数据局和其他政府机构一样,基本只给结论,不谈样本,用常识判断的话,它的信息是各家大模型公司上报过去的,没有自己的统计渠道。 所以就造成了解读上的不够精确: 全中国140万亿的日均调用量,是基于什么汇报口径? 同样是Tokens消耗,模型App是一个数,模型底座是一个数,云又是另一个数,而且云还得看是不是MaaS⋯⋯ 不说清楚的话,理解偏差就会很大。 当然豆包模型的消耗占比偏大的原因也有合理性,就是全模态,同样是用ChatBot,你搁那问五分钟的交互消耗,和跟豆包打语音开视频相比,区别不是一般的大。 这也是豆包比较「占便宜」的地方,按照AI时代的北极星指标要从月活/日活变成用量这个暴论的说法,豆包和其他国产大模型的差距,比月活/日活的差距是要更大的。 火山引擎还提了一个点,就是Seedance模型在被广泛用在AI漫剧产业,AI漫剧的制作商在投入上相对充裕,从即梦等2C产品用户使用Seedance排队越来越痛苦也能察觉到,字节是在优先保障企业级付费用户的使用,叠加起来就是「极大带动了Token的消耗增长」。 但Seedance应该不会算在豆包大模型的调用量里,这个可以排除。 总之豆包这闷声上大分的成绩,是有点细思恐极的,不怕兄弟苦,就怕兄弟开路虎啊。

20. 3 月我国日均token调用量破 140 万亿,两年增千倍,token经济为何突然出圈?释放哪些信号?

21. 2月,中国AI的模型调用量爆发式增长,首次超过美国。全球最大的AI模型API聚合平台OpenRouter数据显示,9日~15日这周,中国模型以4.12万亿Token的调用量,首次超过同期美国模型的2.94万亿Token。

22. #豫法关注##主播说联播#【#这就是中国AI产业链的硬核实力#】#词元Token是什么# 到今年3月,我国日均Token调用量已突破140万亿,相比2024年初的1000亿,增长超1000倍,较去年底三个月又提升了40%以上。日均Token调用量的大量增加,充分表明中国的人工智能发展进入了快速增长阶段,应用场景在不断深化。我国有完善的电力基础设施,能为AI大规模运行提供充足稳定的能源支撑,为海量算力筑牢底座,把电力转化成AI服务能力;同时,国产大模型在推理芯片、架构及系统优化上持续突破,能以更少算力、更高能效,输出智能服务。这种高性价比的发展模式,让中国AI展现出强劲竞争力。今年两会,“算电协同”第一次写进政府工作报告。政策“托底”,中国AI的竞争力,只会越来越强,高质量发展的“智慧引擎”,正越转越有力。 央视新闻的微博视频

23. 100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?

24. #微博声浪计划##听见微博# 中国大模型调用量包揽全球前四,周调用量达4.69万亿Token超美国。小米MiMo-V2-Pro等四款模型登顶,依赖全球需求驱动。技术上,万亿参数、MoE架构等突破显著,但面临硬件短板和商业回报压力,未来需突破卡脖子问题。 shijin1的微博音频

25. 中国科技企业在全球半导体舞台上,将发出越来越响亮的声音。 #大咖观察 #红衣聊AI #半导体 #芯片

26. 又……又赢麻了?[憧憬][憧憬][期待]//@郑昀:OpenRouter数据显示,2026年2月全球前五中占据四席,合计占比85.7%,一年前份额尚不足2%。爆发源于AI应用从 简单“对话式”向Agentic“流程型”切换,成本敏感度放大。中国开源模型凭极致性价比(价格仅为美国模型的1/6至1/13)吃到红利,行业正从价格战转向需求驱动时代。//@郑昀:全球最大的AI API聚合平台OpenRouter数据显示,2月9日~15日这周,中国模型以4.12万亿Token的调用量,首次超过同期美国模型的2.94万亿Token。2月16日~22日这周,中国模型的周调用量进一步冲高至5.16万亿Token,三周大涨127%,而同期美国模型调用量跌至2.7万亿Token。//@三个老爸实验室:稍微详细一点呗。。

27. 智谱昨天刚涨价,今天阿里云算力、存储等也涨价了[擦汗]原因之一就是token使用量暴涨。年初认为今年token消耗量会有十倍到百倍的增长,现在看只多不少。缺卡早已是现实,年初预计的算力荒是不是也快了。昨天看到一份内部研报,AI基建采购实际增幅之大,结结实实冲击到所有四平八稳的观念。杰文斯悖论近在眼前。

28. AI模型扎堆升级,国产算力需求狂飙,IDC将迎来新一轮爆发?

29. 黄仁勋规划下一代科技版图,普通人机会在哪里 黄仁勋 GTC 大会揭秘:AI正在重构 100万亿美元经济,普通人却可能被彻底淘汰?不!这才是我们唯一能翻盘的机会 #AI #英伟达 #黄仁勋

30. 全球AI应用月活排行2025年12月全球AI应用使用排行,ChatGPT月使用人数达8.85亿人,位居榜首。TOP15应用中,中美两国应用竞争激烈。中国的豆包排名第二,月活1.63亿人。DeepSeek排名第三,月活1.31亿人。

31. #一分钟视频创作季# 中国电力优势可推动稀疏计算等节能技术研发,催生轻量化 AI 创业浪潮。依托新能源加储能加特高压体系,企业还能拓展 AI 加节能垂直应用,打开千亿级市场。美国科技巨头因电力成本飙升,或被迫向能源充裕地区转移算力。而中国企业可获 3 至 5 倍算力成本优势,推动全球 AI 产业重心向中国倾斜。中国数据中心 PUE 远低于美国,能吸引全球 AI 基础设施投资,改变全球算力布局。中国电力保障让 AI 企业无需顾虑电网限制,可集中资源推进技术创新。中国 AI 企业有望主导全球产业规则制定,推动行业从算法竞赛迈入能源加算力协同竞赛新阶段。#科技先锋官##财经朋友圈# 种斌Marco的微博视频

32. 新加坡放弃美国AI模型,改用中国开源模型#据新加坡媒体报道,11月25日,新加坡国家人工智能计划宣布了一项重大技术路线调整:在其最新发布的、旨在服务整个东南亚的旗舰大模型中,放弃了美国开源体系,转而采用中国企业的开源架构。有分析认为,这一事件在全球AI版图上投下了一颗重磅信号弹:中国开源AI模型正在从技术追赶者,变为全球信赖的“技术底座”。与此同时,中国AI风暴也刮到了美国。英国《金融时报》报道称,美国麻省理工学院的研究发现,过去一年,中国团队开发的开源AI模型下载量占比上升至17%,首次超过美国同行,在AI技术的全球应用中取得关键优势。 超维界的微博视频

33. 【字节跳动豆包大模型调用量第一 发布豆包新版本】字节跳动旗下AI大模型豆包调用量和AI应用双双登顶。12月18日,字节跳动公布截至今年12月,豆包大模型日均Token使用量突破50万亿,较去年同期增长超过10倍,而相比豆包大模型在2024年5月刚推出时1200亿的日均调用量则增长了417倍。字节跳动豆包大模型调用量第一 发布豆包新版本  火山引擎称,目前其已有超过100家企业客户的累计Token使用量超过一万亿,OpenAI和亚马逊云科技(AWS)分别有超30家和超50家客户达到这一规模。  科技界预期Token将成为智能社会不可或缺的“新型资源”,谷歌在10月披露自身各平台每月处理的Tokens用量达到了石破天惊的1.3千万亿,相当于每天43万亿,对比一年前,谷歌月均处理的Tokens只有9.7万亿;三季度,微软则处理了超过100万亿Tokens。

34. deepseek r1发布后的十个月,中美AI大模型之间的差距为什么拉大了?(个人使用感觉)?

35. 重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个

36. 见证中国AI的“诺曼底登陆”,AI的游戏规则改了!唱衰中国AI的人脸被打肿了#科技风向标##人工智能##ai 创造营# 郝智伟的微博视频

37. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】

38. 中国大模型偷了老美的家,原因竟然是电多? #燃起来了大国重器 #春节世界观察 #新年囤点专业货

39. #小米大模型调用量升至全球第一#小米MiMo大模型调用量跃居全球第一?小米终于在AI领域实现逆袭!#中国大模型调用量连续三周超美国# 因为小米MiMo和Deepseek等国产大模型的成功,中国在大模型调用量方面连续三周超过美国。很高兴看到像小米公司这样的中国科技企业越来越强。

40. 摩根大通最新发布的《中国互联网与AI行业研究报告》预测,中国AI应用爆发,算力需求将迎370倍增长;2025-2030年间中国AI推理token消耗量将实现约330%的年复合增长率,从2025年的10万亿token激增至2030年的3900万亿token,增长规模达370倍。这一预测基于对用户行为变迁和AI应用场景深化的深度研判。Seedance2.0的横空出世,让国内视频创作进入一个token消耗的指数增长阶段。估计会很快形成一个全球的趋势。

41. #阿里巴巴成立Alibaba Token Hub事业群# CEO吴泳铭亲自挂帅,全面迎战AI Agent时代 🚀3月16日,阿里巴巴正式成立Alibaba Token Hub(ATH)事业群,建立以“创造Token、输送Token、应用Token”为核心目标的新组织,由阿里巴巴CEO吴泳铭直接负责。这是阿里巴巴面向AI Agent时代一次重要组织调整,旨在强化AI业务战略协同,全面推进AI战略落地。【评论】从“散点布局”到“集团军作战”,阿里正用组织力构筑AI时代的“水电煤”当AI从技术概念走向基础设施,单点突破已不足以支撑战略野心。Token Hub的成立,是阿里将散落在各处的AI能力(千问、通义、钉钉、夸克)拧成一股绳的关键落子。“创造Token”是研发底座,“输送Token”是平台生态,“应用Token”是场景落地——三者闭环,直指AI Agent时代的核心命题:谁掌握Token的生成与分发,谁就掌握下一代人机交互的入口。悟空事业部的出现尤其值得玩味:B端AI原生工作平台,意味着阿里正用钉钉的To B基因,切开企业服务市场的新蛋糕。这是从“AI工具”到“AI劳动力”的升维竞争。

42. 全国首个!超3万卡国产AI算力上线,喂饱万亿参数大模型

43. #傅盛说中国AI应用迎来要爆了时刻# 从基础能力达标到落地成本下降,AI应用的爆发逻辑越来越清晰!技能五子棋的实现只是一个缩影,未来肯定会有更多意想不到的场景被AI解锁,中国团队在应用创新上的爆发力真的藏不住了~ #技能五子棋被AI实现了#

44. 2025年,到底有多少人在用AI?

45. 2026英伟达GTC:“推理之王”的ASIC反击战与Token经济学【硅谷101】

46. 央视信息,OpenRouter 最新数据显示,中国 AI 大模型周调用量达到 4.69 万亿 Token(3 月 9 日至 3 月 15 日),连续两周超越美国。全球调用量排名前三的位置也被中国模型包揽。Seedance2.0一段15秒钟的视频token消耗量就达30万token以上,OpenClaw和各种龙虾最近的繁荣,带动了中国大模型的调用增长。摩根大通预测,中国的 AI 推理 Token 消耗量将从 2025 年的约 10 千万亿增长至 2030 年的约 3900 千万亿,五年间增长约 370 倍。

47. 刚知道,“Token”中文名定了:词元。前段时间还在讨论给“AI”取个中文名,现在“Token”的中文名确定了,“词元”。Token——是排行榜上大模型调用量的评估标准,也是大模型厂商销售套餐的计费单位。3月23日,在中国发展高层论坛2026年年会上,国家数据局局长刘烈宏表示,Token“词元”不仅是智能时代的价值锚点,更是连接技术供给与商业需求的“结算单位”,为商业模式的落地提供了可量化的可能。这给出了Token的中文翻译:“词元”。我国日均词元(Token)调用量突破140万亿人民日报记者从国家数据局获悉:2024年初,中国日均词元(Token)调用量为1000亿;至2025年底,跃升至100万亿;今年3月,已突破140万亿,两年增长超千倍。什么是词元(Token)?词元(Token)是大模型处理信息的最小信息单元,具有智能时代可计量、可定价、可交易的特征。

48. 经常用大语言模型辅助开发时,面对命令行输出信息冗长,导致消耗大量Token,真是头疼。rtk(Rust Token Killer)是个高性能CLI代理,可以过滤、压缩常见开发命令的输出,在LLM上下文中帮助减少60%-90%的Token消耗。它支持ls、git、cargo、pytest等众多命令,能把冗长输出变得简洁明了,比如git push原本几十行输出,用rtk只需要一行“ok ✓ main”,既省Token又高效。优势:- 单个Rust二进制,零依赖,安装轻量- 自动hook命令,实现透明优化,LLM完全不用担心上下文爆Token- 支持token节省统计和历史分析,精细监控效果- 跨平台支持macOS、Linux、Windows- 丰富Commands覆盖主流开发流程(git、cargo、npm test、docker等)- Tee机制保留完整失败日志,避免重复命令执行浪费Token安装也简单,macOS/Linux直接brew一键安装,或者用脚本快速部署。推荐给使用Claude Code或其他LLM代码助手的开发者和团队,大幅降低Token费用、提升交互效率必备!GitHub:github.com/rtk-ai/rtk#AI创造营##人工智能#

49. #阿里CEO直接负责TokenHub事业群#阿里成立TokenHub,说白了是这5个核心原因: 1. 抢AI时代的“铸币权”Token就是AI的“通用货币”,未来AI Agent干活、企业用AI服务,都按Token计费。阿里把通义、千问、MaaS、悟空全整合到TokenHub,就是要统一AI的“生产-分发-收费”标准,把Token做成AI世界的硬通货,掌握定价权。2. 解决内部“各干各的”以前AI团队分散,模型、产品、商业化目标割裂:研发追技术指标,产品追用户数,没人盯着“Token成本和变现”。现在以Token为唯一抓手,所有人目标一致——让Token更便宜、更好用、更能赚钱。3. 押注AI Agent爆发未来百亿级AI Agent会替代大量人工,它们24小时跑,Token消耗量会爆炸。阿里判断AI Coding、企业服务已过临界点,云服务正从给人用转向给AI用。TokenHub就是为这个“超级需求”建的总枢纽。4. C端+B端双线收割千问抓C端个人助手,悟空事业部主攻B端,把AI嵌入钉钉、企业工作流。从模型研发到MaaS平台,再到C/B端应用,形成完整闭环,不让对手在任何环节卡位。5. 组织彻底换引擎互联网时代靠“产品+流量”,AI时代靠“Token+算力”。TokenHub把组织基本单位从“产品”换成“Token”,CEO吴泳铭亲自带队,就是要把AI从“技术部门”升级为集团核心战略,和电商、阿里云平起平坐。 总结起来,TokenHub是阿里在AI时代的“总指挥部”,用Token统一技术、产品、商业化,抢下未来AI生态的主导权。

50. 官方终于给Token定名了!那个被叫错无数次的AI术语,原来叫"词元"

51. 阿里发布千问3.5,性能媲美Gemini 3, Token价格仅为其1/18

52. 谁能掌握能源、算力,还有应用生态,谁就能定义未来。 #大咖观察 #红衣聊AI #能源 #算力

53. 东大和漂亮国,AI实力的全面对比#AI #Deepseek #chatgpt #Gemini #AI技术

54. 这帮90后中国工程师太牛了!460万美元干翻了1.4万亿 中国AI有自己的登顶策略!只用了1%的资源逆袭美国,又一个DeepSeek时刻的背后到底是什么?#AI #kimi #OpenAI

55. Token出圈!日均调用量突破140万亿, 带来哪些思考?

56. #小米新模型媲美DeepSeekV3.2##小米发布新模型#小米新发布的开源自研大模型是 MiMo-V2-Flash,有点儿强呀!MiMo-V2-Flash总参数3090亿,活跃参数150亿,采用专家混合架构(MoE),性能可与DeepSeek-V3.2和Kimi-K2等头部开源模型媲美。推理速度达到150 tokens/秒,每百万token输入成本0.1美元、输出0.3美元,性价比极高。采用5比1的激进比例,5层滑动窗口注意力搭配1层全局注意力交替使用,减少KV缓存存储量近6倍,支持256k上下文窗口。能并行预测多个token,推理速度提升2到2.6倍,训练阶段也能加速采样,减少GPU空转。通过后训练阶段的多教师在线策略蒸馏(MOPD),效率提升惊人,只需传统方法1/50的算力,学生模型即可达到教师性能峰值。在AIME 2025数学竞赛和GPQA-Diamond科学知识测试中排名开源模型前两名,编程能力出色,SWE-bench Verified得分73.4%。在τ²-Bench分类得分中表现优异,支持深度思考和联网搜索功能。与主流开发环境无缝配合,256k超长上下文窗口支持数百轮智能体交互与工具调用。#小米#

57. 把发电炼成世界的算力,Token 是否是中国未来电力出口的核心形式?

58. 最近老有人问我中美AI到底谁更厉害? 但我觉得,这个问题本身就有问题,因为美国和中国在AI上走的,根本就不是一条路。#红衣聊AI #大有学问 #中美博弈 #开源

59. OpenClaw养龙虾,到底要花多少钱?

60. 国产AI应用再加一分,一键生成"技能五子棋"人人都能开发AI应用了#跟傅盛学AI##谷歌##技能五子棋##蚂蚁灵光# 傅盛的微博视频

61. 【#字节跳动赞助OpenClaw# AI视频和“养龙虾”促豆包大模型调用量激增】字节跳动赞助OpenClaw AI视频和“养龙虾”促豆包大模型调用量激增 4月2日上午,OpenClaw(俗称“龙虾”)创始人Peter Steinberger出现在火山引擎武汉发布会的大屏幕上,用流利的中文号召“大家在武汉多吃龙虾。”通过这段由Seedance 2.0生成的AI视频,火山引擎宣布赞助OpenClaw,并合作共建ClawHub中国官方镜像站。连同OpenAI、百度、腾讯和腾讯云一起,火山引擎也出现在了OpenClaw官网的官方赞助商名单中。在这轮“养虾”热中,中国云厂商和AI模型公司迅速承接了激增的智能体部署需求,至今仍在持续推出安全解决方案、开发技能(Skill),并向生态内的应用开放。而OpenClaw自上线后至今,也已超越了所有GitHub开源软件项目的星标数(Star)。

62. Ben Todd 对 GPT-5 运营成本与盈利能力的深度分析:- Gemini 每月处理10^15个token,假设 OpenAI 是其2倍,即约每秒8亿token。- B200芯片预计能输出3000 token/秒,需约31万块芯片(80%利用率)支持GPT-5推理。- 以每块芯片2.5美元/小时计,单算算力成本约5.6亿美元/月,含员工等额外成本后约8.4亿美元/月。- OpenAI月收入约16亿美元,推理端看起来极具盈利潜力。核心观点是:OpenAI现在亏损,主要因70%算力投入GPT-6研发,关键是这巨额研发投入未来能否带来回报。推理本身已经高度盈利,但研发开销极大且持续加码。讨论中指出推理效率、芯片性能预估存在不确定性,实际token生成速率可能低于3000/秒,也会有大量请求被分流到更小型蒸馏模型降低成本。GPU租赁价格可能低于2.5美元/小时,且运营成本中还需考虑带宽、存储、安全等开销,实际利润空间较分析略窄。另有观点强调,模型更新速度极快,训练新模型是必要且持续的开支,研发摊销成本极大影响整体盈利。若GPT-6未能带来显著性能提升,投资风险巨大。同时,市场竞争、开源模型的兴起也可能压缩未来利润。即便如此,领先企业凭借更优模型和品牌效应,仍能保持较高利润率。总结: 推理环节已趋近盈利,但AI研发是长期高投入、高风险博弈。OpenAI当前亏损反映的是对下一代模型的押注,未来盈利取决于新模型能否持续引领市场。AI行业的“烧钱”本质,既是创新驱动力,也是商业挑战。唯有技术持续突破,用户才会为顶尖体验买单。原推文链接:x.com/ben_j_todd/status/1987502460198441325

63. 美国注定会在这次中美ai竞争中落败吗?

64. 黄仁勋喊出“推理拐点”,边缘推理的机会窗口打开了吗

65. Token调用量连续三周超越美国!我们正在见证AI的“中国时刻”

66. 历史性领跑!中国AI周调用量 9.86万亿Token连续四周超美国

67. 历史性反超 中国AI Token调用量碾压美国!国产大模型彻底改写全球格局

68. 全球AI格局逆转!中国模型Token调用量反超美国

69. 里程碑时刻!中国AI大模型周调用Token量首超美国,全球TOP5独占四席

70. 词元Token调用中国大模型霸榜!前六全部是中国的大模型!最新数据仍然暴增,中国调用量居然是美国的4倍多!

71. 中国AI算力需求井喷

72. Token调用量爆发深度研究报告

73. 中国 AI 大模型调用 Token 量何以连续霸榜?

74. 中国AI逆袭!Token周调用量超美,低价电力铸就全球新霸主

75. Token战争

76. AI大模型排名大洗牌豆包日调用100万亿Token,中国首超美国

77. 刚刚,中国AI调用量超美国2倍!140万亿Token/日,这个数字让硅谷彻夜难眠

78. 历史性反转!中国AI调用量2月首超美国,4万亿Token背后意味着什么?

79. 【早报】AI大模型4月战报

80. 7.36万亿Token领跑全球!中国AI大模型连续三周反超,背后逻辑全解析

81. 61%!中国 AI 首次反超美国,看不见的算力出海,到底有多牛?

82. ​中国Token出海

83. 别被数据误导

84. OpenClaw爆火,日均token调用量破140万亿,两年增千倍,释放了哪些信号?

85. Token,正在成为新的生产资料

86. 字节跳动的Token战争

87. 120万亿Token日耗背后

88. 日均120万亿Token!豆包再刷新高,正式迈入全球第一梯队

89. 如何看待大模型正从训练时代走向推理时代

90. Token战打响!AI进入推理时代,中国资产将迎价值重估

91. 中国AI大模型调用量环比增逾31%,连续五周超越美国

92. 中国大模型调用量环比增57%,连续三周超越美国!

93. 中国大模型调用量环比增近34%,连续四周超越美国

94. 中国AI大模型调用量连续五周超越美国

95. 中国信通院秦思思等

96. 3 月30日,公有云重磅更新

97. Token经济崛起与Agent元年共振

98. 当AI发展重心"东移",亚洲凭什么改写全球格局?

99. 4.69万亿Token!中国AI连续两周反超美国,算力版图正在“东移”

100. 博鳌报告

101. 中国电力通过Token跨境交付

102. AI Agent 基础设施投资地图—从 GitHub Trending 看中美 AI 应用层差距

103. 博鳌亚洲论坛报告称

104. 中国AI应用量首超美国,全球AI格局迎来新拐点

105. 全球AI重心转向亚洲,职场人面临什么?

106. 全球AI重心东移

107. 全球AI格局变天了!OpenAI被反超,中国模型拿下超半壁江山

108. 商务资讯 | 报告称

109. 中国AI模型调用量爆发式增长

110. 中国AI调用量首次超越美国

111. 中国AI模型调用量领跑全球

112. AI调用量爆发式增长!两周暴涨127%,首超美国,改写行业格局

113. 狂飙!3月AI Token用量彻底反转,中国已是美国3倍多

114. 历史性时刻!中国AI首次登顶

115. Token

116. 深度观察 | 移动通信Token化

117. 4.69万亿Token!中国AI大模型这波"调用量反超"有点东西

118. 日均140万亿次还在涨,AI世界的“Token”究竟是什么

119. AI调用的Token到底是啥

120. AI基础设施需求爆发:日均Token调用量千倍增长背后的投资逻辑

121. 中国大模型调用量连续三周全球领先,周调用达7.36万亿Token

122. 首超美国!中国AI调用量激增127%,电力成本占比高达70%,三大核心赛道成最大赢家!

123. 全球调用量排名前三的AI大模型,被中国包揽

124. Token调用量指数级增长 行业用户AI基础架构投资重点向业务系统重构演进

125. “技术迭代—成本下降—应用爆发” 读懂4.69万亿Token背后中国AI大模型价格优势

126. 中国AI大模型Token调用量超过美国的核心优势是什么?

127. 2024-2025年AI趋势的范式跃迁与Token经济重构

128. token暴增后的投资机会

129. 中国AI调用量首超美国;今年国内手机价格预计迎全面普涨

130. 大模型推理和训练阶段的不同点在哪里

131. 4.69万亿Token!中国AI大模型调用量连续两周领跑全球

132. 中国AI调用量超美国,国产大模型免费提效已验证,普通人一看就会

133. 中国Token调用量首超美国!AI时代,选对Token入口就是抢占先机

134. 50万亿Tokens背后的AI变局,火山引擎点燃规模化落地“引擎”

135. 中国日均Token调用量突破140万亿——背后的Token经济

136. 4.69万亿Token!中国连续两周领跑全球

137. 中国信通院发布公有云大模型服务性能监测(2025Q3)结果

138. GPU训练与推理的核心差异与优化策略

139. 大模型的训练和推理是什么?

140. Token 消耗与哪些因素相关?全面解析 AI 模型的成本构成

141. 中国AI模型全球调用量首超美国 万兴科技全年调用量增超140% - 哔哩哔哩

142. 大模型中token的含义是什么意思?人工智能token的含义

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章