最近 OpenAI 干了一件很反常的事:新发布了一个不太爱说话的 API。10 月 10 日,OpenAI 的 Decisions API 进入公测,这款产品 9 月 29 日 DevDay 上才和 Dot、GPT-6.1 Sol 一起亮相,热度却完全不在一个次元——OpenAI API 产品负责人 Nikunj Handa 发布会后上播客访谈被直接点破:这个产品是看到 Jev 火了才立项的,起初根本不在开发计划里,团队大约一周就完成可运行的原型,模型都没重新训练,直接沿用 Luna 的权重,把输出约束成结构化结果,专门优化"第一次决策返回"的速度。知乎36氪
能让 OpenAI 一周抄作业的东西,确实值得停下来看 5 分钟:它不是又一个大模型,而是 AI 行业第一次把"判断"本身做成了一个按分计费的商品。
一个"不会聊天"的模型,凭什么值 75 亿美元
先说清楚什么是决策模型。有一类模型,从来不写一句话:你给它一个情况和几个选项,它只回答 A 有 70% 的可能、B 有 20%,几十毫秒返回;这类模型就叫决策模型,三周前由 TypeSafe AI 的 Jev 带火。圈内叫它 “System One 模型”(取自卡尼曼的"快思考"),也有人直接叫它哑巴模型。今日头条新浪微博

这条赛道是创业公司先点着的:9 月 16 日,前 OpenAI 研究员、自述 ChatGPT 联合发明人的 Diogo Almeida 发布 Jev,官方口径是速度快 40–200 倍、输入成本便宜 5–238 倍、输出接近免费。资本的反应比技术圈还快——10 月 9 日,母公司 TypeSafe 宣布完成 8.7 亿美元融资,估值 75 亿美元,距模型发布才几周,36氪的说法更是三周估值暴涨 37 倍。微博 AI 官方账号专门做了 Jev 玩法合集,小红书上的开发者已经在算账:AI 做一次决策,只要 4 分钱。今日头条36氪新浪微博
于是过去一周,大厂全部下场,而且先打的是价格战:微软 10 月 10 日官宣自研 Decision-1,官方博客写明"我们基于Qwen3.5-9B做了后训练",基座不是合作多年的 OpenAI 而是阿里,纳德拉亲自在 X 转发称正在微软内部大规模测试。Cloudflare 当天跟进降价,把 Clef-flash 从 0.09 美元砍到 0.038 美元,代价是托管版上下文从 64k 砍到 24k。今日头条小红书
玩家 | 产品 | 输入价 | 输出价 | 延迟(自报) | 关键限制 |
|---|---|---|---|---|---|
微软 | Decision-1(10/10 发布) | $0.042/百万 token | 免费 | 中位 85ms | 仅文本,上下文约 3.2 万 |
Cloudflare | Clef-flash(当天降价) | $0.09 → $0.038 | 极低 | 中位 38.8ms | 托管上下文 64k 砍到 24k |
OpenAI | Decisions API(公测) | $0.10/百万 token | 低 | 未公布 | 支持文本+图像,走 Luna |
TypeSafe | Jev | 约 $0.042 | 接近免费 | 约 70–500ms | 权重开源(Apache 2.0) |

对比锚点:Anthropic 的 Haiku 5.5(已是轻量档)输入也要 $0.10/百万 token,而且聊天模型的输出是按 token 计费的——让一个聊天模型每次输出几百字"分析过程"再给出判断,和微软这种"输出免费、只回一个 JSON",根本不是一种成本结构。微软这条还有个细节值得 OpenAI 用户细品:微软同时表示,未来还会把基座换成自家 MAI 模型和 OpenAI 模型,The New Stack 直接用了 “skipped OpenAI” 的说法——这更像给供应链上保险,而不是跟 OpenAI 决裂。
替你算一遍账:你的 Agent 哪一步值得换
如果你只是在用 ChatGPT 聊天、写周报,这波跟你没关系,订阅价格不会因此变动。真正受影响的是自己在给 Agent 掏 API 账单的人:客服分流、工单路由、内容审核、优先级排序、评估打分——这些活儿每天成千上万次调用,每次其实只需要一个"选哪个"的答案。
拿一个典型场景粗算(示例口径,按上表公开价格):客服工单分流 Agent,每周 10 万次调用,平均输入 1500 token,即每周 1.5 亿输入 token——
用微软 Decision-1:约 $6.3/周(输出免费)
用 Cloudflare Clef-flash:约 $5.7/周,还能拿 Apache 2.0 权重自建
用 OpenAI Decisions API:约 $15/周,换来图文输入和 Luna 能力
继续用聊天模型:输入同价档 $0.10,但每次还要为那几百字"分析小作文"付输出费、多等几秒
小红书开发者 CooperCode 的估算更直白:以前 Agent 每一步都要调大模型、烧钱,现在"决策"这一步可以用 4 分钱的专用模型,做客服分流、内容审核、工单路由这类 Agent,成本直接降一个数量级。这就是 OpenAI 为什么坐不住:Dot、Codex 这类给智能体派真活的产品越铺越开,智能体每走一步都要判断,判断层的钱省不下来,Agent 规模化就是伪命题。小红书
但是先别上头:三周从神坛到白菜价,泡沫和真需求是同时存在的
热度背后,反证信号一样密集,值得每条都记下:
"独立品类"本身存疑。 社区里相当一部分质疑认为,所谓决策模型就是把分类、路由、打分这些老任务重新包装——OpenAI 计算机操作产品负责人 Ari Weinstein 也承认,这个 API 用的模型更小、不做思考推理,处理执行周期较长、比较复杂的任务时能力稍弱。它是裁判,不是选手,别指望它替你干完整的活。36氪
王座三周就换人。 Jev 爆火不到一个月,10 月 3 日就被中国团队开源的 StartLux 挤下榜单,一口气放出 0.8B、2B、4B、9B 和 27B 五档版本,并提供支持本地部署的量化模型。紧接着有人以 MiniCPM5-2B 为底座对 Jev 风格的选项决策模型做了可复现的后训练(ReJev 仓库),10 月 10 日又流传出 8GB 显存即可本地训练决策模型的免费 notebook;到 10 月 11 日,不会写字的模型已经一周冒出一百多个。供给爆炸的速度,和当年"小模型蒸馏"热几乎一样快。36氪新浪微博
降价的代价藏在参数里。 Cloudflare 把上下文从 64k 砍到 24k 才换来 $0.038;微软"83.5% 准确率最高"是自测口径;各家延迟数字都是官方宣传值,第三方评测还没有跑出来。
公测价≠终局价。 OpenAI Decisions API 现在 $0.10/M 是公测价,GA 后是否调价、是否并入套餐额度,官方没有承诺——参考 Codex 额度"20 倍砍到 10 倍"的前科,这家的账你最好按最保守的一档算。

这波怎么跟:三档人的行动清单
普通 ChatGPT/OpenAI 订阅用户:不用动。短期决策模型不改变你的聊天体验;中长期唯一可感知的是,Agent 类产品(Dot、Codex)会更快、更便宜,等产品成熟再付费不亏。
在搭 Agent 的开发者/效率玩家:可以上车,但只换"判断步"——把分类、路由、打分这类调用切到决策模型,长链路推理仍然留给大模型。先拿 Cloudflare 或微软的 $0.038–0.042 档跑影子流量,用两周真实数据对比准确率再切正式;OpenAI 生态绑定深的再等 Decisions API 的正式定价页。
想自己玩的本地党:门槛已经很低——Qwen3.5-4B 仅需 8GB 显存即可在本地生成决策而非文本,StartLux 2B 档也是消费级显卡的量级,适合先感受一下"只出概率不出话"的输出形态,再决定要不要接进自己的工具链。新浪微博
接下来值得盯三个信号:OpenAI Decisions API 的 GA 定价和额度政策;微软什么时候兑现"基座换回 OpenAI/MAI"的承诺——换了就说明这只是一次议价姿态,不换就说明 Qwen 真的站稳了;以及第一批第三方"决策 vs 聊天"成本实测什么时候出来。价格战打到 4 分钱一次,赢家大概率不是模型最大的那家,而是最懂你那个"选 A 还是选 B"场景的那家。