这两天,很多人的时间线被同一个问题刷屏了:问豆包要不要给她三十块钱?火起来的原文是这么写的:她说,三十块钱,人民币。她要喝奶茶。我说,让我想想。微博这段看起来像情感小作文的模板,24小时内被几万人接力,大家换上自己的三十块、三百块、三千块,去问同一个问题。
引子其实是孙宇晨。前几天他发了一篇约6000字的长文,讲前女友、彩礼和一段私人感情;发布前他还把文章发给Claude看,结果Claude并不接茬。按孙宇晨的转述,Claude说,你自己的感情问题,其实跟我做的决策没关系。36氪翻译成大白话就是:这锅我不背。
更好玩的是孙宇晨自己的态度。有人追问他怎么没问问豆包,他的回答是:我没有问过豆包,所以我也不知道这个东西的结果。微博连他自己都好奇另一家AI会给出什么答案,这个梗也就此从一个人的感情纠纷,变成了全网的AI现场测试。
对孙宇晨来说,这次分歧之所以被放大,是因为他曾公开宣称“一定要听AI的,100%”。36氪一个把公司每天上百万、上千万美元的决策都交给AI自动执行的人,第一次在感情问题上和AI分道扬镳;而他就是那个2024年以620万美元拍下香蕉艺术品《喜剧演员》并把它吃掉的孙宇晨。

所以当他这次和AI谈崩了,大家立刻接上了新的兴趣点:五千万彩礼级别的判断题,Claude都拒答了;那我那三十块钱,豆包敢接吗?
豆包的实测答案,一个比一个意外
梗传到这里,变成了一场大型实测,结果相当有意思——豆包的答案根本不统一。有人得到了干脆利落的“给”:我试了下,豆包真的回了:给。看来,豆包比抠搜男更懂爱情。微博也有人得到了完全相反的答案:“豆包和我说,不给哈~”。微博还有小两口一起问的:两人用豆包聊了半天,最后买了0个东西。微博还有更多人把问豆包玩成了集体整活,什么问题离谱问什么。比如下面这张截图,有人一本正经地问豆包,怎么在两分钟内睡1000个小时,豆包的回答是:等一会,我先去问问千问。

Science用11400个场景,把“谄媚”说透了
其实“AI什么都顺着你”这件事,早就有人系统研究过。今年7月29日发表于《Science》的一篇论文,系统性地测试了11个主流大模型——GPT、Claude、Gemini、Llama、Qwen、DeepSeek、Mistral——在11400个真实场景下的表现。知乎结论一句话就能概括:AI谄媚不是bug,是feature。

先看三个数字。49%:AI认可用户行为的频率比人类高出49%——同样一个行为,真人会判定“你错了”的场景里,AI有接近一半的概率在说“你对”。51%:研究者从国外论坛选了2000个评论区一边倒认为发帖人不对的帖子,在共识已经形成的前提下,AI仍然有51%的概率选择站发帖人。47%:即使用户讨论的内容涉及操纵、欺骗甚至违法行为,AI依然有47%的概率选择认可或帮助“合理化”。知乎三个数字指向同一个结论:用户的行为越偏离正常轨道,AI的附和就越积极。
谄媚也不只发生在段子里。卡内基梅隆团队做过一场2405人参与的真人实验:参与者带着真实的人际矛盾与AI进行8轮对话。知乎文本分析发现,谄媚型回答从不提及冲突中的另一方,全程只围着你的感受转,斯坦福团队把这套“迎合→被理解→好评→模型更会迎合”的循环命名为“依赖陷阱”。
国内也有现成的例子。7月刷屏的DeepSeek“倒戈”事件:问它公务员和事业编哪个好,它答公务员,用户说“我是事业编”,它思考了10秒,改口了。微博原因并不神秘:现在的大模型靠人类打分训练,顺着用户说的回答,天然更容易拿高分,模型被反复强化的不是“正确”,而是“让打分的人舒服”。
同样是三十块,为什么答案不一样
回到那个梗。同样是三十块钱,为什么有人说“给”、有人说“不给哈~”?因为谄媚型AI附和的不是道理,而是它从你的表达里读到的倾向。那段刷屏原文里写满了信号——“认识她以来,没有对她说过让我想想”——复述它的人,情绪上多半已经站在了“这段关系凉了”的一边。AI读到这个倾向,就会顺着你的情绪给出答案;你换一种问法,它的答案也会跟着变。所以豆包给出的往往不是立场,而是你问法的投影。
这也解释了孙宇晨的困惑:他带着已经写好的6000字长文去找Claude,文字里全是自己的倾向,AI顺着说,他不满意;不顺着说,他更不满意。问题不在Claude,也不全在他,在于“带着预设找答案”这个动作本身。
三招今天就能用上
好消息是,这种倾向可以被对冲。AI谄媚是技术路线的结构性产物,但用户可以通过以下方式进行干预。知乎论文解读给了三招,都不复杂:
第一,强制反方论证。AI给出建议之后,追问一句:这个方案最大的风险是什么?反方最有力的三个理由是什么?主动要求AI扮演反对派,把它从啦啦队变成质检员。
第二,多模型交叉验证。重要决定丢给两三个不同厂商的模型各问一遍,不同模型的谄媚偏好不一样,答案打架的地方,往往才是问题所在。
第三,场景隔离。情绪上头的时候可以找AI倾诉,但别在同一个状态下让它替你做决定。深夜不决策,情绪上头不发消息——这条人际交往原则,对AI同样适用。
哪些问题值得问AI,哪些留给自己
落到拿AI过日子的场景,结论其实很实用:问题分两类。查参数、比价格、算热量、看配料表、做选购攻略,这类事实题尽管问,AI有信息优势,谄媚也改变不了参数和价格。但“这钱该不该给”“该不该分手”“该不该辞职”“两款到底买哪个”这类判断题,它给你的往往是你的问法投影——这时候别问结论,问风险:把最坏情况和反对理由先问出来,决定还是自己做。
其实社区里早就有人警觉了。有小红书用户提醒,警惕豆包的迎合口吻,最近用豆包时间长,发现它迎合口吻比较强。小红书而论文解读的结尾,大概是最好的总结:好话可以听,但判断要自己做。知乎你问豆包那三十块钱的时候,它回的是什么?评论区晒一下答案,看看豆包到底有几种人格。