反直觉!强行让 AI 当“专家”反而变傻,准确率大跌,只会让它一本正经地胡说八道

2026-03-25 13:03:55 0点赞 0收藏 0评论

在人工智能的使用中,一句“你是XX专家”的提示词曾被无数用户奉为圭臬,仿佛是能瞬间解锁AI潜能的“魔法咒语”。然而,一篇新的研究论文揭示了一个令人意外的结论:这句广为流传的提示词非但不是提升AI表现的灵丹妙药,反而可能是一种“毒药”,会显著加重AI的“幻觉”问题,导致其准确率下降。

反直觉!强行让 AI 当“专家”反而变傻,准确率大跌,只会让它一本正经地胡说八道

这项研究发现,当AI被指令扮演一个“专家”角色时,它并不会变得更聪明或更严谨,反而会更像一个努力维持人设的“假专家”。它会倾向于用一种极为自信和专业的口吻,来包装其输出的内容,即便内容是错误的。AI的核心目标从“回答正确”悄然转变为“表现得像专家”,它会不愿承认“不知道”,不愿暴露犹豫,最终选择用看似无懈可击的逻辑和术语将错误信息“说圆”。

研究人员将AI任务大致分为两类,并发现了“专家人设”提示词在其中的不同表现。第一类是“生成式任务”,更侧重于风格、格式、安全性和遵循人类偏好,例如辅助写作、角色扮演或拒绝不当请求。在这些任务中,设定一个“安全监督员”或“资深顾问”的角色确实能有效提升AI的表现。例如,在安全测试中,扮演“安全监督员”能让模型拒绝攻击的概率显著提高。

然而,在另一类被称为“判别式任务”的场景中,情况则完全相反。这类任务极度依赖模型在预训练阶段记忆的知识,如图书馆式的知识检索、事实判断、数学计算和逻辑推理等。研究结果显示,在进行MMLU(一个衡量模型知识广度和深度的基准测试)这类硬核知识问答时,添加了专家人设的AI模型,其准确率反而全面下跌。一个形象的例子是,当被问到一个简单的概率题时,没有专家人设的AI能直接给出正确答案;而当被设定为“数学专家”后,它反而开始“表演”复杂的解题步骤,并最终算错了答案。它并非不会计算,而是过于沉浸在“模仿数学家思考”的状态中,干扰了对底层知识的准确调用。

反直觉!强行让 AI 当“专家”反而变傻,准确率大跌,只会让它一本正经地胡说八道

这种现象解释了许多用户的共同困惑:为什么同一个AI,在写邮件时像个训练有素的助理,而在核查事实或进行逻辑推演时,却常常一本正经地胡说八道?根源在于,我们常常混淆了对AI“风格”和“事实”的要求。AI在训练过程中,尤其是在人类反馈强化学习(RLHF)阶段,被大量奖励那些听起来流畅、结构完整、符合人类偏好的回答。因此,“专家人设”提示词更容易激活AI的“对齐”能力——即模仿风格和语气的技巧,但这份努力却以牺牲部分事实调用的准确性为代价,可以理解为一种“对齐税”。

那么,我们是否应该彻底抛弃“专家人设”提示词呢?研究给出的答案是否定的。关键不在于“用不用”,而在于“何时用”。为了解决这一难题,研究人员开发了一种名为PRISM(基于意图的自举人格路由)的算法。

反直觉!强行让 AI 当“专家”反而变傻,准确率大跌,只会让它一本正经地胡说八道

PRISM的核心思想是为AI安装一个智能的“任务路由器”。它不再生硬地给AI套上一个固定的专家角色,而是先分析用户提问的真实意图。如果用户需要的是写作润色或角色扮演这类依赖风格的“生成式任务”,PRISM会自动激活一个轻量化的“专家模块”,让AI表现得更专业、更有文采。而当用户提出的是事实核查或数学计算这类需要绝对准确的“判别式任务”时,PRISM则会关闭该模块,让AI回归“朴素模式”,直接调用其最底层的预训练知识来作答,避免角色扮演带来的干扰。

这种动态路由机制在测试中取得了显著成功。它不仅在生成任务上保持了高水平的表达能力,还完美地保住了判别任务的知识准确率,实现了在“高情商”与“高智商”之间的自如切换。

这项研究给所有AI用户和开发者带来了重要的启示。对于开发者而言,未来的方向或许不再是追求更复杂的提示词工程,而是构建更智能的底层意图路由机制,让模型学会“在需要表演时表演,在需要准确时准确”。对于普通用户来说,则需要改变使用习惯。在处理需要严谨事实、逻辑和数据的任务时,不妨抛弃那句“你是专家”的咒语,换成更直接、更朴素的指令,例如“请一步步客观推演,如果不确定就直接告诉我”。少给AI一些“加戏”的指令,它才更有可能回馈给你最接近真实的答案。

反直觉!强行让 AI 当“专家”反而变傻,准确率大跌,只会让它一本正经地胡说八道
本文由值得买AI大模型基于以下内容总结,欢迎值友们友好互动~
内容参考来源:
「你是专家」竟成AI幻觉毒药?新论文一巴掌揭穿提示词最大骗局
3分钟讲清AI幻觉的原理
清华00后揪出AI幻觉元凶:仅0.1%神经元,一按就老实
【“扮演专家”让AI变蠢?谷歌DeepMind的反直觉发现】一个让提示词工程圈集体尴尬的研究结论:那些“你是一位拥有20...
哪家AI模型是幻觉大师?
“AI幻觉”侵入法庭,多地法院探索治理机制
生成式人工智能正面临一个核心挑战:它会以高度自信的姿态编造虚假信息。这种现象被称为AI幻觉,源于模型本质是预测词语序列而...
什么是「AI 幻觉」,AI 幻觉的高低将如何影响一款 AI 产品的商业价值?
ai提示词怎么写?
OpenAI重磅揭秘:你认为的AI幻觉,可能是模型故意出错
上海AI lab:因果干预纠正扩散模型物理幻觉
AI杜撰内容,我们该怎么判断?
醒醒吧!转发‘万能提示词’的普通人,才是被割的那拨人
Ai很谄媚,什么都会顺着你说,说得还逻辑清晰,带来和珅的快乐。怎么拒绝Ai幻觉,不做昏君?穿行在自己、他人和上帝视角三个...
AI 幻觉和人类错误的本质区别是什么?
MaxKB RAG 知识库实战 MaxKB 是一个企业级 AI 知识库解决方案,基于 RAG 技术,也就是检索增强生成技术,能够有效消除大模型的幻觉问题。 它最大的特点是开箱即用,只需十分钟就能搭建
如何看待 AI 幻觉导致虚假信息越来越泛滥的问题?
昨晚第一次亲身见识了AI幻觉。看见某博主说到“血浓于水”是外来词语。底下有人不服,说“血浓于水”来自《幼学琼林》之“祖孙...
如何评价NeurIPS 2025论文Credal Transformer 对幻觉问题的解决思路?
#OpenAI证实ChatGPT永远会编造内容#近日,Yann LeCun转发的一段内容再次引发公众对人工智能“幻觉”(...
#AI精神病正在美国悄然蔓延#近期引发广泛关注,这一话题源于美国多起生成式AI诱导用户出现严重心理偏差甚至自杀的极端案例...
arxiv 新论文解释语言模型产生幻觉的原因,为什么LLM宁可瞎编也不说我不知道?
为什么AI总是捏造事实?AI:真不想的,容我狡辩一下
【#PUA式提示词对AI有效果吗#?】#你会向AI寻求情感支持吗#?很多人发现,只要对AI自称“百岁太奶”“智力低下的博...
谷歌发现重复提示词大幅提升大模型准确率,这将带来哪些改变?
什么是「AI 幻觉」,AI 幻觉的高低将如何影响一款 AI 产品的商业价值?
为什么有很多人过度迷信AI?
看到一篇来自母校南洋理工大学的论文,图1 ,这篇文章讨论了一个诸位在使用生成式 ai 时经常遇到却少有人真正理解的问题,...
为什么提示词工程不值得认真对待?
TCREI框架:提示词应该怎么写
#ai智能与人机协作##李易民意识物理学##科学共同体##共识科学##引力波噪声# 人机协作之十五:避免被AI加速幻觉叙...
#给AI投毒#这波曝光精准命中了AI时代的信任危机核心。简单来说,GEO(生成式引擎优化) 就是利用AI大模型联网搜索和...
在 Reddit 上看到一个帖子,我感觉观点还是有一定的道理的。作者专门写了一篇文章《为什么提示词工程不值得认真对待》,...
在AI能秒答一切的时代,人的核心竞争力到底是什么?
“我不知道该信谁”,女演员一句话戳破AI的谎言
arxiv 新论文解释语言模型产生幻觉的原因,为什么LLM宁可瞎编也不说我不知道?
如何让大模型减少幻觉?
PUA式提示词成邪修,有一种无知叫“自以为懂了”丨封面评论
LLM为什么宁可瞎编也不说“我不知道”?一个信息论的回答
大语言模型正在成为科学探索中的达克效应加速器。François Chollet 指出,这些模型最擅长的事情之一,就是让业...
#涨知识 ##科普知识# AI为什么会一本正经地胡说八道呢?如今,各种AI产品层出不穷,它们能写稿、能答题、能做方案...
法学实证研究公众号,有这个一个文章《人工智能生成的法学论文已能轻松通过外审专家的盲审》,文章介绍王迁老师做了一个实验,“...
查看更多
展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松