“深度思考一开,立场就向右?”热搜上的AI站队之争,你真正能拿走的是这套开关规则

源自503位全网作者

00:30

今早的热搜:AI一开“深度思考”,立场就变了?

8月30日早上,#大模型开思考模式立场向右转# 登上微博科技榜,9点刚过就有网友截图记档。微博 传得最广的一张图,把 GPT-5、Claude Opus 5、DeepSeek V4、Kimi、Gemini、Qwen 摆上同一根政治光谱轴,带“思考/reasoning”后缀的版本,几乎全排在同系列非思考版本的右侧。微博

“深度思考一开,立场就向右?”热搜上的AI站队之争,你真正能拿走的是这套开关规则

第一步查证:所谓“研究”,出处找不到

我把这批讨论帖逐条翻完,包括29日深夜起势的那篇长文和今天被转得最多的科普帖:没有任何一条给出论文名称、研究机构、发表渠道或样本细节,全部停在“有研究发现”。这项研究是否存在、结论稳不稳,目前没人能证明。能查证的,是争论本身。

三种机制解释:互相打架,谁也没赢

第一种,对齐修剪论:默认输出的温和,是安全对齐精心修出来的表层,思考一开,就够到了没人修剪的语料层。微博

第二种,长论证链论:互联网语料里右倾话语习惯层层铺因果,左倾更多诉诸价值共识,推理链一长,天然偏向论证链长的一侧。微博 但原帖评论区立刻有人顶回来:也许不是“右翼论证本身更长”,而是“训练数据里恰好它更长”——语料池一换,方向很可能跟着翻转。这个反驳很关键:它说明机制论到底是“推理”的属性、还是“这批数据”的属性,至今没被分离测试。

第三种,标注者政治论:RLHF 教模型的是“这是好回答”,不是“这是中立回答”,长思考只是把标注者的偏好放大了。同一个问题当天也开进了知乎:大模型开思考模式立场向右转。知乎

普通用户真正碰到的:内心戏和账单

27日前后爆火的 DeepSeek“不语只是一味地os”是同一件事的硬币反面:对外回复简短克制,后台思考链路全是内心戏和自我博弈。微博 按技术解释,这只是推理过程被可视化,不是模型有了意识。而“思考”并不便宜:按媒体对 OpenRouter 数据的测算,7月27日至8月2日那一周,全球大模型总调用量 56.8 万亿 Token,每一枚都在计费。微博 评论那句“浪费我的token开小差”,其实是个微型成本模型。

给你的“思考开关”使用规则(不站队版)

  • 立场型问题——政策评价、医疗建议、法律风险、大额消费决策——别让单模型的“深度思考”替你写作业:开、关各生成一版,对比差异,凡是说不出推理过程的立场,先不信。

  • 把“思考=右转”当未证实假设处理:出处没找到、机制互相打架,谁拿它下“AI骨子里保守”的强结论,这条信息就折价一半。

  • 该开:多步推导、代码、规划、需要核对过程的比较;该关:闲聊、简单事实查询、时间紧又敏感的议题。默认输出不是客观,只是把偏见藏进平均数——但至少不会给偏见套上“我想清楚了”的外壳。

  • 继续观察两个信号:有人补出原始论文,或厂商在模型卡里写进“思考模式偏差说明”。出现任何一条,这个话题都值得回来重判一次。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章