小米罗福莉谈Token价格战:建议LLM公司不要盲目压低价格

2026-04-08 18:39:50 5点赞 6收藏 11评论

2026年4月6日,小米MiMo大模型负责人罗福莉在社交平台X发文,将Anthropic封禁OpenClaw等第三方工具与小米刚推出的Token Plan放在一起分析,系统阐述了她对Agent算力分配与定价逻辑的思考。

小米罗福莉谈Token价格战:建议LLM公司不要盲目压低价格

Anthropic的"止损"之举

事情的起因是4月4日Anthropic的一纸公告:Claude正式切断OpenClaw等第三方框架通过订阅服务调用的通道。

官方解释很直白——成本倒挂。部分重度用户每月仅支付200美元订阅费,却消耗了价值5000美元的算力资源。为了缓解财务压力,受影响用户必须切换至按用量付费的API模式。

罗福莉对此并不意外。她指出,第三方框架因上下文管理效率低下,产生的Token消耗往往是原生框架的数十倍。

她以OpenClaw为例说明:单次用户查询会触发多轮低价值的工具调用,每轮均作为独立API请求并携带超过10万Token的上下文窗口,实际API请求次数是原生框架的数倍,折算成本可达订阅价格的数十倍。

"这不是一个小差距,是一个巨坑。"她写道。

价格战的陷阱

罗福莉向大模型厂商发出明确警告:在未理清订阅定价逻辑前,盲目陷入"Token价格战"并放任第三方工具接入,无异于自掘坟墓。

她解释了这个陷阱的机制:低价卖Token+对第三方框架开放,看似对用户友好,实则是Anthropic刚刚爬出来的坑。如果用户在劣质框架、不稳定推理服务、降配模型上反复碰壁,最终什么都没做成,用户体验和留存都不会好看。

"我想劝大模型厂商们,在没想清楚如何给coding订阅定价、不至于大出血之前,不要盲目卷到价格底部。"她写道。

更深层的问题在于计费结构。Coding Plan本质上是按订阅周期加请求次数的粗放额度包,开发者买的是一段时间内的粗略使用权,感受不到单次请求的真实成本。当第三方框架接入时,上下文管理粗放、冗余请求、低缓存命中率造成的算力浪费,成本完全由平台默默吸收。

罗福莉认为,这种订阅制切断了用量与成本之间的信号传导,重度用户通过低效框架透支的算力,最终迫使平台要么封禁第三方,要么靠降速、限流、降配模型来止损。

短期阵痛是好事

Anthropic的封禁引发了不少开发者的不满,但罗福莉认为这是必要的阵痛。

她指出,第三方框架并非被彻底封禁,用户仍可通过API调用Claude。短期内,这些Agent用户将直面成本压力,费用轻松跳涨数十倍。

"但正是这种压力,会推动框架开发者去改进上下文管理、最大化prompt缓存命中率,复用已处理的上下文、削减无效的Token消耗。痛苦最终会转化为工程规范。"她写道。

有网友认同这一观点:"我们正走向一个人工智能单位经济效益不再由模型本身决定,而是由模型、应用和上下文管理三者共同决定的世界。Anthropic的举措无意中对智能体应用施加了自然选择压力。"

小米的解法:Token Plan

在点评友商举措的同时,罗福莉也介绍了小米的方案——4月3日刚上线的MiMo Token Plan。

这套方案的核心是按Token额度计费、支持第三方框架。每一个被浪费的Token都直接扣除用户额度,使用量与成本的关系重新透明化。

MiMo提供四档套餐,从39元/月到659元/月不等,支持MiMo-V2-Pro、MiMo-V2-Omni等模型,兼容OpenClaw、OpenCode、Claude Code等主流开发工具链。

"因为我们追求的是长期稳定地交付高质量的模型和服务,而不是让你冲动付款,然后弃船而去。"罗福莉强调。

这种定价策略与市场上部分厂商的低价策略形成对比。有分析指出,MiMo套餐价格相对其他厂商同等套餐偏贵,但罗福莉间接回应了这一点:在其他选手亏损搞Token倾销的时候,小米选择了更贴近成本的定价策略。

行业的真正出路

罗福莉给出了自己的宏观判断:全球算力供给已经跟不上Agent产生的Token需求增速。

在她看来,行业真正的出路不是更便宜的Token,而是"更高Token效率的Agent框架"与"更强大、更高效的模型"之间的协同进化。

"Agent时代不属于烧掉最多算力的人,而属于用得最聪明的人。"她写道。

这一观点与当前行业的"Token价格战"形成鲜明对照。2025年以来,国内大模型厂商纷纷下调Token价格,部分甚至推出免费额度,试图以低价抢占市场。但罗福莉认为,这种策略若未厘清成本结构,最终只会导致恶性循环——平台为弥补亏损被迫降配模型、限流或降低推理稳定性。

Anthropic的封禁和MiMo Token Plan的推出,或许标志着大模型行业正从"流量至上"回归到"效率优先"的商业本质。

罗福莉是谁

罗福莉是95后"AI才女",曾是DeepSeek关键开发者,2025年12月加入小米,出任MiMo大模型负责人。

加入小米四个多月后,她完成了首秀。2026年3月27日,在2026中关村论坛年会上,她透露MiMo大模型调用量已突破1万亿Token,并预言今年Token增长可能达到100倍。

在全球最大API聚合平台OpenRouter上,MiMo-V2-Pro的API调用量一度登顶,超越Claude、阿里千问、谷歌Gemini等主流模型。

从DeepSeek到小米,从技术研发到产品定价,罗福莉正在试图为Agent时代的算力使用建立一种更可持续的模式。

展开 收起
11评论

  • 精彩
  • 最新
  • 喜欢这种真的技术专家

    校验提示文案

    提交
  • 确实这样,龙虾类对teken的浪费特别夸张,现在算力也不到普及的时候

    校验提示文案

    提交
  • 商人

    校验提示文案

    提交
  • 小米不搞价格战??

    校验提示文案

    提交
  • 你每用一次就把你的token數放大10倍20倍的........

    校验提示文案

    提交
  • 国家层面不来个提token降费吗,不然怎么能超过🇺🇸

    校验提示文案

    提交
    指望连token承担不起的人超过🇺🇸?

    校验提示文案

    提交
    收起所有回复
  • 你说什么小萝莉?

    校验提示文案

    提交
  • 学学deepseek,从根上降低训练成本

    校验提示文案

    提交
    你还没看明白这篇文章在讲什么,这里说的是推理不是训练

    校验提示文案

    提交
    没法学,所有文章都默契忽略的是,她只参与到 V2 为止,然后刻意营销成 V3 关键开发者。

    校验提示文案

    提交
    收起所有回复
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
6
扫一下,分享更方便,购买更轻松