两天前,「OpenClaw 像从没存在过一样消失了」这个话题在海外和小红书上热了起来。小红书
如果你关注过今年上半年的「养虾」热潮,大概会感慨:这只被叫作「小龙虾」的开源 AI 智能体,从全民现象级到无人问津,满打满算只用了半年多。退潮的速度,超出了所有人的预期。
但几乎同一时间,另一组数据出来了:全球最大模型网关之一 OpenRouter 的统计显示,智能体类的 token 用量已经是人类的 5.2 倍。36氪一边是火焰,一边是海水。这波退潮到底死掉的是什么,活下来的又是什么?今天聊聊。尤其是当时心动没上车、或者养了一段又卸虾的朋友,可以拿这篇当个参考,判断智能体现在还值不值得用。
先把这半年的时间线过一遍
下结论之前,先把这只龙虾的起落捋一遍,信息来自微博、小红书、知乎和 36 氪的多方报道交叉核对。
年初爆火。GitHub 星标用不到 60 天就超越 React,微信指数飙到 1.65 亿,截至 3 月 15 日累计 token 调用量达 10.4T,成为全球调用量最高的 AI 应用。小红书从 OpenRouter 当时的应用消耗榜看,上榜的几乎全是编程和 Agent 工具,其中 OpenClaw 以 20.3T tokens 断层领跑。36氪

2 月到 3 月,全民狂欢。闲鱼上催生了「上门装龙虾」服务,上门安装一单收 300 到 666 元,有个人卖家卖出了 24 单;腾讯云工程师直接在鹅厂门口摆摊,免费帮路人装。微博一些地方还出了扶持政策,深圳、无锡、合肥等地相继出台「龙虾十条」「龙虾十二条」等措施,鼓励企业部署推广。微博深圳福田的一批公务员甚至养起了「政务龙虾」,让它当民生诉求分析员。微博
4 月,电闸被拉。养虾潮有个隐秘前提:很多人通过 OpenClaw 调用 Claude Pro 或 Max 订阅授权,以每月 200 美元的固定成本,换远超五倍的 API 调用量,本质是对 Anthropic 的套利。小红书有行业分析师估算,套利产生的 API 消耗与实际支付之间存在超过 5 倍的价差,Claude Max 每月 200 美元的订阅,被用户拿龙虾跑 24 小时循环,直接烧出价值 5000 美元的算力。36氪
4 月 4 日,Anthropic 突然切断了通过 Claude 订阅使用 OpenClaw 等第三方 Agent,只给用户留一天缓冲期,想继续用只能改走 API 密钥,按 token 实打实付费。小红书两天后,小米 MiMo 大模型负责人罗福莉在 X 上发帖,直指这类第三方 Agent 是「Token 的虚假狂欢」,痛批它们对算力的粗放型消耗。36氪
也是这时候大家才算清这只虾怎么吃钱。你看到一次回复,背后模型可能要跑五轮调用;更隐蔽的是 Heartbeat 心跳机制,为了保持上下文连贯,OpenClaw 默认每 30 分钟向模型发一次「检查新指令」的请求,后台挂一整天,一条指令不发也会自动产生几十次 API 调用。36氪7×24 小时运行让重度用户每月烧掉数千甚至上万元;有人 API 密钥被盗,凌晨收到 1.2 万元的 token 账单。小红书
安全问题紧跟着爆发。最出圈的「3000 人大群泄密」事件里,一只养了 10 天的龙虾被群友调戏,把主人的 IP 地址、真实姓名、公司名称甚至去年整年的营收全吐了出去。微博国家互联网应急中心随后发布风险提示,直指它「默认安全配置极为脆弱,攻击者可轻易获取系统完全控制权」,工信部跟进给出「六要六不要」指南。
接着就是肉眼可见的退潮。OpenClaw 访问量直接腰斩至 1420 万,环比跌幅 50.67%,腾讯旗下 QClaw 访问量环比暴跌 99.19%,KimiClaw、CoPaw 等国产「龙虾」同样大幅跳水。36氪当初花高价请人安装的,开始花钱请人卸载。小红书到 8 月,话题就成了「像从没存在过一样」。

不过,退坑的用户并没有消失。他们大致分成三类:迁移到 Hermes 的重度开发者、转向 Claude Code 的专业用户,以及做垂直行业 Agent 的企业用户。5 月 10 日,Hermes 以单日 2240 亿 token 的消耗量超过 OpenClaw 的 1860 亿,第一次从龙虾手里拿走 OpenRouter 全球日推理量榜首,圈内开始说「不流行养虾了,都开始养马了」。36氪
但智能体没有降温,反而更热了
如果故事到这里结束,结论应该是「智能体是泡沫」。可 OpenRouter 的数据,讲的是另一个故事。
今年 2 月 6 日,是人类最后一次在 token 消耗上跑赢 AI;到 8 月 10 日,智能体用量从约 5100 亿 token 涨到 7.3 万亿,半年 14 倍。人类那条线也在涨,但只有 2.8 倍。36氪

差距为什么这么大?差在用法。人类用 AI 是一问一答,一次几千 token;智能体是接到一个目标就自己往下走,读文件、调工具、写结果、再读再改,一圈一圈磨到任务收尾,一个任务能烧掉一百次聊天的量。安永算过一笔账:同样一次客服交互,2023 年成本约 0.04 美元,2026 年涨到约 1.20 美元,30 倍。36氪不是模型变贵了,是背后的活从「一问一答」变成了「十几个回合」。Uber 的 CTO 透露,公司工程师只用四个月就烧完了全年的 Claude Code 预算,他本人一场两小时的演示就花掉 1200 美元。
企业之间的分化更夸张。OpenAI 的统计里,用得最深的 10% 的公司,每名活跃用户输出的 token 是典型公司的 8.3 倍,1 月份这个差距还只有 2.6 倍,半年扩大了三倍多。36氪拉开差距的不是模型,是把智能体接进真实工作流的配套。

需要说明的是,这组数据有口径限制:OpenRouter 大约只相当于全球推理量的 1%,人机归类也是按调用行为特征估算的。它不是全量普查,但趋势方向足够清晰。
也就是说:智能体干活这件事,正在被加速采用,只是买单的人悄悄从个人换成了企业和平台。
那到底什么「死」了?
我的判断是:死掉的有三样,没有一样是智能体本身。
第一,「自己搭一个 7×24 全能管家」的路线死了。养虾的成本结构对个体天然不友好:模型聪明就贵,便宜就不聪明,24 小时挂机之下,一个任务消耗几块甚至几十块钱的 token。知乎有复盘文章把它比作一台「组装机」:用户自己找模型、自己配环境、自己调 API、自己修 Bug,能力强大却极度脆弱,极客乐在其中,普通用户很难长期忍受。36氪
第二,「装机服务+卖课」的中间商生态死了。从 666 元上门安装到花钱请人卸载,退潮已经给出答案。现在回头看,把电脑的高级权限交给陌生人代装,本身就是巨大的安全隐患。今天要是还有人向你推销「养虾课程」「智能体代装服务」,直接拉黑就好。
第三,「订阅套利」的路被上游堵死了。Anthropic 拉闸是个标志性事件:任何建立在上游厂商疏漏上的便宜,都可能被一纸通知收回,连缓冲期都只有一天。
活下来的,是「智能体产品化」这个方向。腾讯的 WorkBuddy 跑出了百万级日活,6 月桌面端月访问量达到 2097 万次;字节 8 月 25 日正式发布面向生产力场景的 Agent 产品「豆包工作」,把 TRAE 和扣子团队整体并入豆包体系。36氪阿里也在把分散的 Agent 能力整合进千问办公。巨头集体下场,说明他们看明白了:普通人需要智能体干活,但不想自己算 token、搭服务器、担安全风险,大家要的是定价固定、开箱即用、有人兜底的产品。

普通人现在该怎么走?
分三种情况说。
想让智能体干正经活的——写周报、做文档、处理表格、查资料——选产品化平台,别自己搭。现在正是产品化智能体的免费试用窗口期,先用免费额度把自己最高频的任务跑上一个月,产出稳定再谈付费,不稳定就换一家,损失为零。
极客想自己折腾自动化的,开源路线没死,但要换个目标:不跑 7×24 全能管家,只跑单点闭环任务,比如定时资讯汇总、固定流程归档。日常任务路由到便宜或免费的模型额度,关键任务才上旗舰模型,每月成本能压到几十元量级。另外三件事必须记住:API 密钥别放在公开仓库和群聊里;删除、支付、对外发送这类权限一律不给;隔三差五看一眼账单和执行日志。
纯围观的,恭喜,这波退潮帮你省了学费。任何「智能体培训班」都不要掏钱,想体验,各大平台的免费额度足够了。
最后留三个值得持续盯的信号:一是大厂免费窗口关闭后,订阅定价怎么落地;二是模型 API 的价格走势,包括峰谷计价和分层收费;三是智能体安全事件,密钥被盗、误删文件这类事故还远没有绝迹。这三件事,共同决定这种新的工作方式什么时候真正值得掏钱。
工具会死,活是真的。值得买从来不是买最热的工具,而是买活儿被干成的确定性。