9.9元1000万词元看着白菜价,一句"你好"却烧掉5万token:OpenAI高管自己承认,AI比价别按token单价比

源自181位全网作者

07:09

AI这行正在把token当手机流量卖,但本周接连发生的三件事,正在提醒每一个真金白银付费的人:比价的尺子,可能从一开始就不对。

16日,Stripe被曝已敲定以超过70亿美元收购全球最大的"Token中转站"OpenRouter,一家支付巨头把AI调用的计量入口买了下来。36氪18日,中国移动发布中期业绩,宣布将在Token使用上做大产品规模,面向公众市场和政企市场推出全国统一的Token套餐资费,运营商的"词元套餐"生意正从试点走向全国统一盘子。微博19日,OpenAI Codex负责人Tibo则在X上罕见地"自曝行业底牌":同一段文字扔给两个模型,一个切成766个token,另一个切成1170个。

都标5美元,账单差三成

Tibo的对比很直接:同一段文字(覆盖英文、技术文本、多语言和数字内容),GPT-5.6 Sol的分词器用掉766个token,Claude Opus 5的估算结果是1170个。36氪而两家的输入单价,都是每百万token 5美元。单价一模一样,这段文字在GPT-5.6 Sol上少切出34.5%的块数,输入费用也就跟着便宜了三成。

为了讲明白这件事,他打了个披萨的比方:两张一模一样的披萨,第一家切8块,每块2美元;第二家切16块,每块1.25美元。第二家招牌看着更便宜,可整张吃下来要20美元,第一家只要16美元。"你的胃并不关心你刚才吃了几块。"切得越碎,单块越便宜,整张反而越贵。

9.9元1000万词元看着白菜价,一句

为什么差异这么大?因为token不是克、千瓦时那样的标准计量单位,每家厂商自己训练分词器,各有一把"刀法":the、and、is这种高频词,一个词独占一个token;unbelievable这种长词,要拆成un、believ、able三四块。你的内容在这家训练语料里越"常见",消耗的token就越少。

更反常识的是,同一家公司,新旧模型的计数也不能通用。Anthropic官方文档写得明确:Claude 4.7及之后的模型换了新分词器,同样的输入文本,产生的token数量比早期模型大约多30%。36氪官方给出的建议是,把同一个请求按两个模型各跑一遍,比对返回的input_tokens,别拿早期模型量出来的数字估算成本。自家两代模型之间计数都不能复用,跨厂商拿"每百万token单价"直接对比,就更谈不上标准化了。

改写账单的4个地方,都不写在价目表上

就算把分词差异对齐,账单至少还受另外几个变量摆布。

第一处是缓存。GPT-5.6 Sol的缓存输入价是0.50美元/百万token,只有标准输入价的十分之一,重复前缀多的用法,这一项就能改写整个账单结构。第二处是输出,输入5美元只是开胃菜,GPT-5.6 Sol输出30美元/百万token,Claude Opus 5是25美元起,在AI反复查、反复改的Agent工作流里,输出token的权重往往比输入更狠,前面省下的34.5%很可能在这里被吐回去。第三处是长上下文的小字:GPT-5.6 Sol的输入超过272K token时,整次请求的输入按2倍计价、输出按1.5倍计价。36氪注意,不是超出的部分加价,而是整次请求换到更高倍率,同一段代码在27万token的上下文里问和在28万token的上下文里问,单价就换了一档。

9.9元1000万词元看着白菜价,一句

还有一个更隐蔽的坑:买到的"窗口"可能会缩水。官方规格写GPT-5.6 Sol有1.05M上下文,但有用户实测发现,特定版本的Codex客户端里,这个模型的窗口被卡在372K,实际可用353.4K,买的是百万窗口,用起来只剩三分之一。这份实测有明确的版本和账户限定,不能代表所有用户的现状,但Tibo随后专门发帖教大家手动把窗口开到100万,本身就说明默认值和标称值不是一回事。

顺带一提另一种计费方式切换的代价:GitHub Copilot今年6月正式从固定订阅切换成按Token消耗量计费,有人的月账单从50美元变成了3000美元。微博订阅制改成计量制,账单就有了放大器。

越像"流量套餐"的东西,越要弄清它到底按什么计费

回到国内场景。今年中国移动、中国联通、中国电信纷纷推出面向个人、政企用户的词元(Token)套餐产品,"1000万词元只卖9.9元"的宣传摆在那里,定价逻辑看上去完全就是我们熟悉的手机话费。微博

9.9元1000万词元看着白菜价,一句

但每日经济新闻记者实测发现,这类套餐的计量方式和流量完全是两回事:“9.9元买千万Token”“1元体验AI算力套餐"听着白菜价,单单是输入一句"你好”,就会烧掉大约5万Token(约合0.125元);不到1小时,15元的套餐就已见底。微博有开发者折算后的结论更直接:月成本是现有主流AI订阅套餐的五六倍。更尴尬的是,记者走访多地营业厅时,不少工作人员说不清自家的token套餐,“办不了,现在只是一个概念”"你是要装宽带吗"都是现场得到的回答。

这些不是说token计费本身是坑,恰恰相反,它是更精确计量算力的方式。但它们提醒普通消费者:越是包装成"流量"“语音分钟数"这种熟悉形态的套餐,下手前越要弄清三件事——实际调用的是哪个模型、什么算输入(系统提示词和历史上下文算不算)、超出部分怎么计价。宣传语里的"1000万token”,和你用法里的"1000万token",可能根本不是同一个东西。

要比的不是单价,是"干成一件事多少钱"

Tibo那两条帖子里,有一句被数字盖过去的话:真正重要的是每次成功结果的成本。这个锚点,值得换过来。一个分词更省的模型,如果推理啰嗦、返工次数多,账单照样能反超"更贵"的对手。基准测试只能当起点,真要知道谁便宜,得拿自己的活儿去跑一遍:挑一个你真的常做的任务(修一个bug、写一份周报、翻一篇文档),用同样的提示词在两家各跑一次,看各自接口实际返回的input_tokens和output_tokens,再算上缓存命中、输出长度、有没有触发长上下文加倍,最后比谁把这件事干完花得更少。

9.9元1000万词元看着白菜价,一句

对不同人群,我的建议是:

  • 订阅党(已订ChatGPT Plus、Claude等):固定月费本质是重度用户的"保险",适合天天用的人,但要盯住用量限制,别一次性囤多个会员。

  • 轻度用户:一周用不了几次,免费档或按量付费就够,不必为"看起来便宜"预充大额套餐。

  • 运营商套餐党:下手前先确认上面三个问题,客服答不清楚的,把"搞不明白"也计入成本。

  • API开发者:别复用旧的token计数,别直接信比价表,拿自己的工作负载跑一遍;同时盯紧短期折扣窗口,比如GPT-5.6 Sol目前正在OpenRouter、Vercel AI Gateway等第三方平台做限时半价,这种折扣有截止日期,不能写进长期预算。知乎

最后说三个值得持续观察的信号。一是OpenAI首席财务官近期表示,预计OpenAI将在2027年成为一家上市公司。知乎上市前定价策略可能更激进,价格战或许还有得打。二是全国统一Token套餐资费落地后,“词元民生化"会是长期趋势,运营商套餐的计量规则大概率会被倒逼优化。三是"每次成功结果的成本"会不会取代"每百万token单价”,成为新的行业比价锚点,如果会,现在所有的比价表都得重做。

下次再有人拿比价表告诉你"这个模型更便宜",你可以先问一句:干成同一件事,它到底花多少钱?

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章