「不会聊天」的Jev一周刷屏AI圈:只做判断不写一个字,5美元额度已对所有人开放——注册之前,先分清三件实锤、三个争议和四类人的玩法,再盯两个信号

源自216位全网作者

00:58

这周AI圈最出圈的事,是一个"不会说话"的模型。9月15日上线、9月21日全面开放注册的Jev,在微博、知乎、小红书连刷了整整一周屏,小红书热评里一句"近期爆火的Java,开发者已经拿它干活了"拿了98个赞,梗图满天飞的同时,Vercel、LangChain、Cloudflare这些平台已经排队接入了。如果你也被刷屏搞懵了,不知道这东西和自己手里20美元的ChatGPT订阅有什么关系,这篇帮你把"它是什么、为什么火、你用不用得上"一次讲清。

一、先分清三件实锤

实锤一:Jev不生成任何文字,只做判断。你问它"这封邮件紧急吗",它不会先给你写一段分析,而是直接告诉你「是,概率 95%」,选择题、打分题、是非题三种题型,每个答案都附带概率和置信度。 它由TypeSafe AI发布,创始人Diogo Almeida是GPT-4、ChatGPT与InstructGPT/RLHF论文的共同作者,2024年离开OpenAI后进入长达两年的隐身研发。知乎专栏微博

实锤二:数字确实夸张。官方定价每百万输入Token 0.042美元、输出不收费,端到端延迟70到500毫秒。 发布不到36小时,约14万开发者排队申请内测,Vercel、LangChain、Cloudflare等平台迅速接入。 上线24小时内被Vercel AI Gateway近13%的付费团队采用,创下该平台历史最快采用纪录。微博微博微博

「不会聊天」的Jev一周刷屏AI圈:只做判断不写一个字,5美元额度已对所有人开放——注册之前,先分清三件实锤、三个争议和四类人的玩法,再盯两个信号

实锤三:9月21日起向所有人开放,无等待列表,注册入口是console.typesafe.ai,而且所有用户初始拥有5美元的信用额度(约1.2亿个token)——按官方口径折算而来。 这5美元什么概念:一次判断通常只烧几百个token,省着点用够你判断几十万次,对个人尝鲜来说约等于免费。微博

二、它为什么能火:踩中了"判断"这个被忽视的痛点

这轮刷屏不全是营销。AI工作流里大量调用根本不需要生成一段话,只需要做一个判断:这条反馈是投诉还是咨询、这个操作是否可疑、两件商品是不是同款——用GPT-4级大模型跑太贵太慢,用规则引擎又不够灵活,Jev填的就是这个空档。TypeSafe把它定义为"系统一模型"(System One Model),灵感来自诺贝尔奖得主Daniel Kahneman的《思考,快与慢》:传统大模型像负责深度推理的"系统二",Jev像负责直觉快判断的"系统一"。知乎专栏

创始人的叙事则更狠。Almeida在发布前一个月的演讲里直接开炮:RLHF是弯路,AI行业搞错了优化目标,下一个时代一定不是Claude Code时代。 他的核心逻辑是:今天的大模型被训练成"取悦回路里的人",而真正值钱的自动化需要"把人移出回路"——判断这类活,恰恰不需要模型会说话。微博

连名字都埋了梗:Jev来自经济学家杰文斯的「杰文斯悖论」:成本越低,使用越多。 押注的是当一次AI判断便宜到接近免费,软件里会涌现出成千上万个以前用不起AI的微小决策场景。知乎上有个传播学视角的总结很到位:Jev能火,不是因为它证明了"分类模型胜过LLM",而是它巧妙地站在了旧共识上,又打出了新反共识。微博知乎

三、三个争议:跟风之前必须知道的冷静面

争议一:漂亮数字来自自家评测。速度最高提升193.6倍、成本降到对照模型的0.3%以下,这些数字都出自TypeSafe自建的工作流测试。 第三方实测里它赢在速度和价格,但准确率并不顶尖:打DOOM每秒决策十次很惊艳,社区实测半美分干完七美分的活,扑克任务上却63%翻车。 官方宣传的"零幻觉"也要正确理解:它不会跳出你给的预设选项乱编,但在选项范围内照样可能选错。微博微博

「不会聊天」的Jev一周刷屏AI圈:只做判断不写一个字,5美元额度已对所有人开放——注册之前,先分清三件实锤、三个争议和四类人的玩法,再盯两个信号

争议二:“这不就是分类器吗”。这是社区里最常见的质疑:意图识别、rerank模型早就存在,小红书上有"AI老登"直言自己大学期间就用类似模型做过作业,实在不理解这轮狂欢。 更扎心的是复现速度:网上已经出现"两小时复现"的网友项目,开源界也跟进了Laya等复现尝试,提供可以逐行追踪的训练实现。小红书知乎专栏

争议三:大厂已经在路上。谷歌转发了一份DiffusionGemma与Jev的对比并表示已全面超过Jev;对应的知乎分析认为,Jev强调的非自回归、类型化的并行抉择并不难复现,难以复现的是怎么通过大规模的RLCD算法让模型给出的置信度概率更加准确。知乎

四、你到底能用它干什么:先记住一条边界

边界很清晰:Jev只能做封闭式判断,选项、标准得预先给定,不能开放生成、不能发现新选项。 换句话说,它是"判断件",不是"生成件",别指望它替你写方案。微博

社区已经跑通的场景大致三类。第一类是替你过滤信息:有开发者用Jev做了浏览器插件过滤社交平台上不想看的内容,也有人把它接进工作流帮忙判断假新闻、过滤旧新闻。第二类是给工作流当分诊台:小红书一位做客服开发的用户分享,写回复、查电话仍交给其他AI,Jev只负责「判断」这一环,选项概率接近时会明确提示这里有歧义,成本可以忽略:一次问五六个问题大约人民币 1 厘钱。 企业侧更夸张,有实测称用Jev替换GPT 4o执行企业智能体护栏判断,安全护栏成本降低93%。 第三类是纯玩:午饭选择器、坦克大战AI、按玩家行为实时生成关卡的小游戏、即兴音乐生成……蚁工厂感叹:Jev聊天助手昨天还是梗图,今天就成真了。小红书小红书微博

「不会聊天」的Jev一周刷屏AI圈:只做判断不写一个字,5美元额度已对所有人开放——注册之前,先分清三件实锤、三个争议和四类人的玩法,再盯两个信号

知乎上已经有人把这条新流水线概括得很清楚:embedding管找,reranker管排,决策模型管选,大模型管想和写。 对做产品的人这是架构图,对普通用户这是理解"Jev不会取代你手里ChatGPT"的最好注脚——它省的是判断的钱,不省生成的钱,你手里的订阅该买还得买。知乎专栏

五、四类人,四种参与方式

  1. 只用AI聊天、写文案的普通用户:不用跟风注册。你的痛点在"生成"不在"判断",短期Jev对你没有直接用处,等它被集成进你常用的产品里再受益不迟。

  2. 玩vibe coding的尝鲜党:值得花一个晚上。5美元免费额度摆在那里,做个信息过滤器或决策小工具成本约等于零;就算最后没留下,搞懂"判断与生成分离"这个趋势也不亏。

  3. 做Agent开发的程序员:认真评估。路由、过滤、护栏、风控这类高频小判断环节换成Jev型模型,省的是真金白银;但同时盯紧开源复现和谷歌的竞品,别把架构绑死在一家供应商上。

  4. 学生和研究者:这是活教材。系统一/系统二的映射、校准概率、RLCD训练路线,这轮全网讨论就是一份免费公开课。

六、最后盯两个信号,再决定投入多少

信号一:会不会被"内化"。李楠的提醒很直白:趁现在赶紧玩,这个能力很快会被新一代模型内化,那时候你就不用学了。 如果下一代ChatGPT、Claude、豆包把"快判断"做成API默认能力,独立Jev的窗口期就会收窄,你今天花的时间也会贬值。微博

信号二:置信度校准的竞争。Jev真正的护城河不是"不生成文本"这个形式,而是大规模RLCD训出来的校准概率。开源复现能不能逼近官方效果、大厂会不会推出同级免费档,决定了它是品类开创者还是过渡产品。

一句话收尾:当一次判断便宜到不要钱,值钱的就变成了"问对问题"——把选项设计对,比纠结用哪个模型更重要。

内容由AI生成

精选参考来源

1. #Jev为何火爆AI圈# 最近AI圈最火的模型,居然是一个「不会说话」的AI

2. #模型时代# Jev模型创始人、ChatGPT共同发明者:RLHF是弯路,AI行业搞错了优化目标,下一个时代一定不是Claude Code时代

3. 赛博茶馆Jev突然火了,这事儿比你想的重要得多

4. Jev 大气,Jev现已向所有人开放。无等待列表

5. 发布当天 HN 1915 分的 JEV 是什么?一个不会聊天、只会做判断的 AI 决策模型

6. 【西部郑宏达】何为Jev模型?

7. 有了AI之后大家行动力真强,Jev 聊天助手昨天还是梗图,今天就成真了

8. 全网刷屏的 Jev 模型正式开放!一手实战测评 + 保姆级教程

9. 如何评价新模型jev

10. 从 Jev 到开源 Laya,决策模型的概率到底是怎么训出来的?

11. 「不会聊天只做判断」的 Jev 模型爆火,背后原因是什么?

12. 怎么看谷歌转发了 Jev 和 DiffusionGemma 的对比,表示比 Jev 更好?

13. 近期爆火的Jev,确实有点不一样

14. Jev 企业实测:安全护栏成本降低 93%

15. 如何训练一个属于自己的Jev?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章