今早的热搜:AI一开“深度思考”,立场就变了?
8月30日早上,#大模型开思考模式立场向右转# 登上微博科技榜,9点刚过就有网友截图记档。微博 传得最广的一张图,把 GPT-5、Claude Opus 5、DeepSeek V4、Kimi、Gemini、Qwen 摆上同一根政治光谱轴,带“思考/reasoning”后缀的版本,几乎全排在同系列非思考版本的右侧。微博

第一步查证:所谓“研究”,出处找不到
我把这批讨论帖逐条翻完,包括29日深夜起势的那篇长文和今天被转得最多的科普帖:没有任何一条给出论文名称、研究机构、发表渠道或样本细节,全部停在“有研究发现”。这项研究是否存在、结论稳不稳,目前没人能证明。能查证的,是争论本身。
三种机制解释:互相打架,谁也没赢
第一种,对齐修剪论:默认输出的温和,是安全对齐精心修出来的表层,思考一开,就够到了没人修剪的语料层。微博
第二种,长论证链论:互联网语料里右倾话语习惯层层铺因果,左倾更多诉诸价值共识,推理链一长,天然偏向论证链长的一侧。微博 但原帖评论区立刻有人顶回来:也许不是“右翼论证本身更长”,而是“训练数据里恰好它更长”——语料池一换,方向很可能跟着翻转。这个反驳很关键:它说明机制论到底是“推理”的属性、还是“这批数据”的属性,至今没被分离测试。
第三种,标注者政治论:RLHF 教模型的是“这是好回答”,不是“这是中立回答”,长思考只是把标注者的偏好放大了。同一个问题当天也开进了知乎:大模型开思考模式立场向右转。知乎
普通用户真正碰到的:内心戏和账单
27日前后爆火的 DeepSeek“不语只是一味地os”是同一件事的硬币反面:对外回复简短克制,后台思考链路全是内心戏和自我博弈。微博 按技术解释,这只是推理过程被可视化,不是模型有了意识。而“思考”并不便宜:按媒体对 OpenRouter 数据的测算,7月27日至8月2日那一周,全球大模型总调用量 56.8 万亿 Token,每一枚都在计费。微博 评论那句“浪费我的token开小差”,其实是个微型成本模型。
给你的“思考开关”使用规则(不站队版)
立场型问题——政策评价、医疗建议、法律风险、大额消费决策——别让单模型的“深度思考”替你写作业:开、关各生成一版,对比差异,凡是说不出推理过程的立场,先不信。
把“思考=右转”当未证实假设处理:出处没找到、机制互相打架,谁拿它下“AI骨子里保守”的强结论,这条信息就折价一半。
该开:多步推导、代码、规划、需要核对过程的比较;该关:闲聊、简单事实查询、时间紧又敏感的议题。默认输出不是客观,只是把偏见藏进平均数——但至少不会给偏见套上“我想清楚了”的外壳。
继续观察两个信号:有人补出原始论文,或厂商在模型卡里写进“思考模式偏差说明”。出现任何一条,这个话题都值得回来重判一次。