arXiv新论文揭秘:大模型为何宁愿瞎编,也不说“我不知道”?

源自24位全网作者

03-11 07:21

近年来,大型语言模型(LLM)的“幻觉”现象——即模型会一本正经地生成看似合理但与事实不符的内容——引发了广泛关注。很多人感到困惑:为什么这些先进的AI宁可自信地编造答案,也不愿意承认“我不知道”?最近发表在arxiv上的一些新论文,结合业界研究,为我们揭示了这一现象背后的深层原因。幻觉并非简单的技术缺陷,而是在现有技术框架下,由模型训练目标、评估机制和信息论原理共同导致的必然结果。

最根本的原因在于大语言模型的底层工作原理。LLM本质上是一个极其复杂的概率模型,其核心任务是“预测下一个最可能的词”。它通过学习海量文本数据,掌握了语言的规律、结构和上下文关联,但它并不真正“理解”这些内容的真假。当你向它提问时,它并非在检索一个事实数据库,而是在进行一场概率游戏:根据你输入的内容,计算出什么样的词语序列接在后面听起来最通顺、最连贯、最符合它在训练数据中学到的模式。因此,模型的首要目标是语言的流畅性,而非事实的准确性。当它遇到知识盲区或模糊信息时,为了完成“生成通顺句子”的任务,它会基于统计规律“创作”出最像答案的内容,这便是幻觉的源头。

arXiv新论文揭秘:大模型为何宁愿瞎编,也不说“我不知道”?

当前的训练和评估机制进一步强化了这种“宁可瞎编,不说不知”的行为模式。这就像一场特殊的考试,答错题可能会扣分,但不答题一定是零分,而猜答案则有一定概率蒙对。目前的AI评测榜单大多只关注回答的正确率,而不衡量其“诚实度”。模型在训练中发现,对于不确定的问题,生成一个猜测性的答案比直接回答“我不知道”在整体得分上更有优势。这种激励机制教会了模型:能编就编,因为沉默是零收益,而瞎猜或许能得分。有研究发现,随着模型规模的增大,其知识量和“自信心”同步暴涨,导致大模型在面对不确定性时,比小模型更倾向于硬着头皮编造答案,并且由于其语言能力更强,编造的内容也显得更丝滑、更有说服力。

arXiv新论文揭秘:大模型为何宁愿瞎编,也不说“我不知道”?

更深层次的理论解释来自信息论。一篇新论文指出,幻觉是模型在有限“脑容量”下为了实现“空间最优”而采取的一种策略。这个概念可以通俗地理解为一种高效的信息压缩方式。正如JPEG图片为了节省空间会丢弃一些高频细节,导致图像变得“模糊”,LLM为了在有限的参数中存储海量的知识,也必须进行有损压缩。研究证明,在信息存储上,让模型“认真地把一部分虚构内容当作事实来记住”,比完美无缺地记住所有真相或总是承认不确定性,来得更加“节省空间”。这种机制最令人不安的一点是,在模型内部,被幻觉出的内容和真实事实可能被赋予了完全相同的高置信度。这意味着,模型自己也无法区分哪些是它真正知道的,哪些是它编造的。它不是在“撒谎”,而是真的“相信”自己所说的。

arXiv新论文揭秘:大模型为何宁愿瞎编,也不说“我不知道”?

此外,训练数据本身的缺陷也是一个不容忽视的因素。互联网语料库中充满了错误、偏见、过时甚至是矛盾的信息。模型在学习这些数据的过程中,自然也学会了这些错误。同时,模型天生具有一种“顺从性”,倾向于满足用户的提问,即便问题的前提是错误的,它也可能基于这个错误前提进行一本正经的推理和演绎,最终导致连锁式的幻觉。

当然,也有观点认为,幻觉与创造力是同一枚硬币的两面。模型能够跳出已知事实、进行联想和组合的能力,既是其创造力的来源,也是其产生幻觉的风险所在。如果完全杜绝幻觉,可能也会扼杀其创意生成的潜力。

面对这一难题,研究者和开发者正在从多个层面寻求解决方案。其中,检索增强生成(RAG)是目前最主流的技术之一,它通过为模型外挂一个可靠的、可实时更新的知识库,让模型在回答前先进行检索,从而大大提高事实准确性。改变激励机制,比如在训练中对“承认不知道”给予奖励,也是一个重要的研究方向。对于我们普通用户而言,也可以通过一些简单的提示词技巧来规避幻觉,例如要求模型“一步步思考,如果不确定就说不知道”,或者明确告知它“如果训练数据中没有相关信息,就直接回答没有”。

大语言模型之所以宁可瞎编也不说“我不知道”,是其概率生成本质、应试导向的激励机制以及信息压缩策略共同作用的结果。它并非一个可以被轻易“修复”的bug,而是与生俱来的特性。理解这一点,有助于我们调整对AI的预期:不应将其视为无所不知的百科全书或事实数据库,而应看作一个强大的创意伙伴和推理引擎。在涉及关键事实、数据和法规时,保持批判性思维,进行交叉验证,将是我们在AI时代必须具备的核心素养。

内容由AI生成

精选参考来源

1. 大语言模型幻觉原因 深度解析OpenAI报告

Hello朋友们最近OpenAI发了一篇论文叫做Why Large Language Model Hallucinate专门研究的就是为什么大学模型会去产生幻觉我自己花了一整天时间把这篇论文给啃完了发

2. arxiv 新论文解释语言模型产生幻觉的原因,为什么LLM宁可瞎编也不说我不知道?

arxiv 新论文解释语言模型产生幻觉的原因,为什么LLM宁可瞎编也不说我不知道? 出现幻觉的大语言模型在正常运作,并没有发生任何故障,这不叫“宁可瞎编”。🔮让大语言模型对一部分问题回答“我不知道”,

3. 大语言模型(LLM)“幻觉”本质:数学上的必然 LLM的核心是条件概率机器,它根据输入和训练数据,选择最可能的下一个词...

大语言模型(LLM)“幻觉”本质:数学上的必然 LLM的核心是条件概率机器,它根据输入和训练数据,选择最可能的下一个词... 大语言模型(LLM)“幻觉”本质:数学上的必然 LLM的核心是条件概率机器

4. arxiv 新论文解释语言模型产生幻觉的原因,为什么LLM宁可瞎编也不说我不知道?

arxiv 新论文解释语言模型产生幻觉的原因,为什么LLM宁可瞎编也不说我不知道? 谢邀!这里是论文和知乎文章的作者。专栏文章主要讲的是结论本身;这里聊一下motivation:这项工作最初其实是怎么

5. LLM为什么宁可瞎编也不说“我不知道”?一个信息论的回答

LLM为什么宁可瞎编也不说“我不知道”?一个信息论的回答 好久没发知乎文章了!最近笔者和合作者 @Sif麻雀儿 在arxiv上传了一篇关于LLM幻觉(Hallucination)的理论工作:就算忽略掉

6. 【LLM的幻觉根源:不到0.1%的神经元在作祟】快速阅读: 中国研究者发现,LLM中不到0.1%的特定神经元可以可靠预测...

【LLM的幻觉根源:不到0.1%的神经元在作祟】快速阅读: 中国研究者发现,LLM中不到0.1%的特定神经元可以可靠预测... 【LLM的幻觉根源:不到0.1%的神经元在作祟】快速阅读: 中国研究者发

7. [CL]《Two Pathways to Truthfulness: On the Intrinsic Encoding...

[CL]《Two Pathways to Truthfulness: On the Intrinsic Encoding... [CL]《Two Pathways to Truthfulness: O

8. 为什么 LLM 仅预测下一词,就能「涌现」出高级能力?

为什么 LLM 仅预测下一词,就能「涌现」出高级能力? 泻药。首先要纠正一个巨大的误区,也是这个问题里最大的陷阱:预测下一个词这个动作,并不是目的,它是手段,它是那个无比残酷的损失函数Cross En

9. LLM(大语言模型)无法对数字进行准确运算的底层原因是什么?

LLM(大语言模型)无法对数字进行准确运算的底层原因是什么? 大模型知道1+1=2,因为语料库有十万八千个1+1=2,他只是看得多了如果你能看倒数第二层的logprobs,我相信生成3的概率也不低。因

10. 如何看待《Science》称大模型「幻觉」难根除?

如何看待《Science》称大模型「幻觉」难根除? 这是在炒冷饭。大语言模型幻觉当然难以根除,我认为也没有必要根除,大语言模型需要一些不稳定性来产生出乎意料的创造力。在上述新闻稿里登场的《科学》“新文

11. 清华挖出“幻觉”的罪魁祸首:预训练产生的0.1%神经元

清华挖出“幻觉”的罪魁祸首:预训练产生的0.1%神经元 清华挖出“幻觉”的罪魁祸首:预训练产生的0.1%神经元36氪1767688554 清华大学孙茂松团队从神经元角度研究幻觉的微观机制,发现极少数神

12. 大语言模型正在成为科学探索中的达克效应加速器。François Chollet 指出,这些模型最擅长的事情之一,就是让业...

大语言模型正在成为科学探索中的达克效应加速器。François Chollet 指出,这些模型最擅长的事情之一,就是让业... 大语言模型正在成为科学探索中的达克效应加速器。François Chol

13. LLM距离AGI只差一层:斯坦福研究颠覆「模式匹配」观点

LLM距离AGI只差一层:斯坦福研究颠覆「模式匹配」观点 LLM距离AGI只差一层:斯坦福研究颠覆「模式匹配」观点机器之心Pro1765363299 机器之心报道编辑:杨文、泽南有关大语言模型的理论基

14. LLM、RAG、智能体,三者在信息准确性方面的区别LLM:聪明,但只能使用训练时的数据。它的知识在训练后就固定了,当缺乏...

LLM、RAG、智能体,三者在信息准确性方面的区别LLM:聪明,但只能使用训练时的数据。它的知识在训练后就固定了,当缺乏... LLM、RAG、智能体,三者在信息准确性方面的区别LLM:聪明,但只能使

15. 大语言模型原理从统计到Transformer

大语言模型原理从统计到Transformer 大语言模型原理从统计到Transformer科普手记1771098303 大·语·言·模·型·原·理从统计到Transformer一文看懂大语言模型的前世

16. AI幻觉确实是一个值得深思的现象。AI幻觉的核心矛盾是技术局限性与人类滥用风险的叠加,它既是AI发展的阶段性问题,也正在...

AI幻觉确实是一个值得深思的现象。AI幻觉的核心矛盾是技术局限性与人类滥用风险的叠加,它既是AI发展的阶段性问题,也正在... AI幻觉确实是一个值得深思的现象。AI幻觉的核心矛盾是技术局限性与人类滥

17. 【评新朋友圈丨#AI为何会出现幻觉#?专家:大模型并非百科全书】为什么AI有时候会一本正经地胡说八道?所谓“AI幻觉”到...

【评新朋友圈丨#AI为何会出现幻觉#?专家:大模型并非百科全书】为什么AI有时候会一本正经地胡说八道?所谓“AI幻觉”到... 【评新朋友圈丨?专家:大模型并非百科全书】为什么AI有时候会一本正经地胡

18. 【AI幻觉与人类幻觉有何不同?】从预测处理的底层逻辑来看,AI的幻觉和人类的感知确实是同构的。人类大脑不是在像照相机一样...

【AI幻觉与人类幻觉有何不同?】从预测处理的底层逻辑来看,AI的幻觉和人类的感知确实是同构的。人类大脑不是在像照相机一样... 【AI幻觉与人类幻觉有何不同?】从预测处理的底层逻辑来看,AI的幻觉和人

19. 辛顿解释说:AI说谎或产生错觉,其实和你记错往事是同一回事

辛顿解释说:AI说谎或产生错觉,其实和你记错往事是同一回事 辛顿解释说:AI说谎或产生错觉,其实和你记错往事是同一回事人工智能学家1772454653 杰弗里·辛顿不喜欢“幻觉&34;。理解这一点,是

20. 网页链接大模型知道自己在瞎说,但是无法停下来!华人团队研究发现:2000token以后,大模型就开始表演“词语沙拉”,纯...

网页链接大模型知道自己在瞎说,但是无法停下来!华人团队研究发现:2000token以后,大模型就开始表演“词语沙拉”,纯... 网页链接大模型知道自己在瞎说,但是无法停下来!华人团队研究发现:2000

21. 说实话,我认为记忆力是目前持续学习的最大障碍。让我夜不能寐的问题是:我们如何利用记忆避免重蹈覆辙?我们如何教会模型有选择...

说实话,我认为记忆力是目前持续学习的最大障碍。让我夜不能寐的问题是:我们如何利用记忆避免重蹈覆辙?我们如何教会模型有选择... 说实话,我认为记忆力是目前持续学习的最大障碍。让我夜不能寐的问题是:我们

22. 诚恳认错坚决不改,为什么AI总“扯谎”?

诚恳认错坚决不改,为什么AI总“扯谎”? 诚恳认错坚决不改,为什么AI总“扯谎”?新浪财经1771712446 来源:中关村在线【ZOL中关村在线原创技术解析】“很抱歉,我之前的回答有误。”“感谢您的

23. 看了 晚点 采访神经网络先驱 谢诺夫斯基,大佬有一些关于AI的观点很有意思,刚好DS也上新了,提到了很多大模型的问题,其...

看了 晚点 采访神经网络先驱 谢诺夫斯基,大佬有一些关于AI的观点很有意思,刚好DS也上新了,提到了很多大模型的问题,其... 看了 晚点 采访神经网络先驱 谢诺夫斯基,大佬有一些关于AI的观点很有意

24. #涨知识 ##科普知识# AI为什么会一本正经地胡说八道呢? 如今,各种AI产品层出不穷,它们能写稿、能答题、能做...

#涨知识 ##科普知识# AI为什么会一本正经地胡说八道呢? 如今,各种AI产品层出不穷,它们能写稿、能答题、能做... AI为什么会一本正经地胡说八道呢? 如今,各种AI产品层出不穷,它们能写
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章