国家数据局一天140万亿次,有人把账单砍掉88.9%

2026-09-23 09:06:16 0点赞 0收藏 0评论

同样 100 万 token 的输入,交给 GPT-6 Luna 是 0.10 美元,交给 Claude Opus 5.5 是 4 美元,差 40 倍。一次 Agent 任务跑 20 遍调用,这个差额就是 78 美元,而多数人从来没给这串调用装过计价器。

数比我想的大。国家数据局披露,2026 年 3 月我国日均 Token 调用量已经超过 140 万亿,比 2024 年初涨了 1000 倍以上。

140 万亿这个数离普通人远。但云栖大会企业级 Agent 实践峰会上,基元律动的联合创始人兼 CTO 韩凯讲了一句更近的话。一次复杂 Agent 任务,往往涉及十几次乃至几十次模型调用。

按一次按钮,账单上添的不止一笔。

同一个人给了另一半答案。他们那个开源项目 OpenSquilla 在特定测试配置下,保留了固定旗舰模型基线 99.96% 的任务质量,成本降低 88.9%。在另一组 DRACO 深度研究评测里,多模型一起上的得分超过了该组最强单模型基线,成本大约只有它的三分之一。

质量几乎没掉,钱少了将近九成,差在哪。

差在每一步都有人替它挑了模型,而路由这件事,多数人从来没管过。

9 月 22 日这天,两家头部公司同时把新价格挂了出来。OpenAI 的 GPT-6 Luna,每百万输入 token 0.10 美元,输出 0.50 美元;同一天发布的 GPT-6 Sol 是输入 2 美元、输出 10 美元,比上一代的促销价又低了一半。Anthropic 的 Claude Opus 5.5 是输入 4 美元、输出 20 美元,单价比 Opus 5 降了 20%,缓存读取价降了 60%。

我把这几组数摆在一起算了一下。Luna 的输入价 0.10 美元,Opus 5.5 是 4 美元,40 倍。输出价 0.50 对 20,也是 40 倍。

换成能落地的数。同样 100 万 token 的输入,交到 Luna 手上是 0.10 美元,交到 Opus 5.5 手上是 4 美元,差 3.9 美元。一次 Agent 任务跑 20 遍调用,这个差额就成了 78 美元。

一次任务调 20 次模型,就是 20 次选择。选错一次,那一次贵 40 倍。

国家数据局一天140万亿次,有人把账单砍掉88.9%

以前这件事不太要命。你问一句,答一句,一次调用就是一整笔开销,心疼也是疼一下。Agent 把这个流程拉长了,同一件事拆成十几步,每一步单独看都不贵。

韩凯还提了一个判断。多模型长期异构并存、算力资源多元供给,会成为大模型产业的长期结构。换成日常说法,就是以后不会只剩一家模型,你手里同时开着三四个模型账号会变成常态。

选项越多,挑错的代价越大。三家价格表摆在一起,单价差 40 倍,没有哪一家会替你把这件事算清楚。

这就是那笔钱溜走的地方。这条流水线我每周都会回看一次。关注虾哥,等账单涨的时候你手上有个参照。

账单为什么现在才开始疼

IDC 在 AICC 2026 大会上发布的报告写了一个变化。Agent 让算力调用从脉冲式变成持续负载,不再是问一下、停一下的节奏。

它给的两个预测更直接。2026 到 2030 年,全球 Token 消耗量的年复合增长率是 4822.6%。全球 AI 算力需求的满足率会从 2024 年的 79% 往下走,到 2030 年算力缺口绝对值达到 3809 亿美元,接近 2024 年的十倍。

缺口越大,定价权越硬。

训练这一侧的钱也摆出来了。小米开源的 MiMo-V2.6,不到 6 天的在线强化学习训练,Flash 版成本约 85 万美元,Pro 版约 262 万美元,累计约 75 万条轨迹。这还只是后训练那一段。

硬件那一侧同一天也在加码。阿里旗下的平头哥发布真武 V900,算力是上一代 M890 的 3 倍,单一集群可以扩展到 50 万卡,计划 2027 年第一季度量产。阿里 CEO 吴泳铭在云栖大会上说,未来机器思考总量会达到人类的 1000 倍以上。

算力要把 1000 倍供出来,账单就得按 1000 倍来算。这就是为什么判断模型贵不贵,比判断它强不强更值钱。

云这一侧的定价也在跟着变。阿里云在云栖大会上发布 AgentCore、Agent Sandbox 等一批产品,CTO 李飞飞的说明是,模型正从万亿参数往十万亿参数走,云底座要解决毫秒级弹性和百万级并发。落到钱上就一句话,过去按台数买服务器,现在要按调用次数结算。

国家数据局一天140万亿次,有人把账单砍掉88.9%

反向的例子也有。AI 视频平台 Higgsfield 借 GPT-6 Astra,一天之内就把新功能开发和上线做完了。同一个工具,在会选的人手里是小钱办大事。

那会儿我在门店盯电费,空调其实花不了几个钱,最费的是那排没人关的灯。每一盏灯都不贵,贵的是没人管这件事。

模型调用现在就是那排灯。单次调用便宜得让人不在意,一个月下来汇成一笔谁也没算过的数。

计价器得自己装

我把这条流水线从头到尾数了一遍。选题、查资料、写稿、跑门禁、生图、推草稿,一天要过十几个环节,每个环节都在调模型。

以前我真没在意。每次调用看着都不贵,一天几十次也就是几毛钱的事。看到那个 40 倍差价之后,我回头把每一步的调用都标上了价钱。

标完发现三步可以换。摘要和分类这种活,不需要旗舰模型来做,换成最便宜那档,质量差不出人能看出来的区别。真正需要旗舰模型的地方只有一个,是那步要下判断的地方。

我的判断是,Agent 烧钱的钱,漏在没人给它装计价器上。装的方式也不复杂,就是把每一步该用哪一档写死,别让默认设置替你做决定。

落到手上是三件事。第一步按任务定档,把格式化、摘要、分类这类活固定给便宜模型。第二步把默认模型改掉,很多框架的默认值都指向最贵那一档。第三步每个月把调用记录导一次,对着账单看有没有哪一步在偷偷烧钱。

模型公司不会主动帮这个忙。它每一档价格摆在那里,是让你按需求挑的。挑这一步的活,现在还在你手里。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松