独家对话GPT-5研究员:AI如何从“大学生”进化成“博士级思考者”

源自39位全网作者

01-26 07:45

与一位亲手训练GPT-5的研究员对谈,我们能窥见怎样的未来?当OpenAI的CEO山姆·奥特曼(Sam Altman)将GPT-5形容为从“大学生思维”迈向“博士级对话”的飞跃时,这不仅仅是一句营销口号。综合多位核心研究员的访谈与公开发布的资料,一个更清晰的图景浮现出来:GPT-5不仅是性能的线性增强,更代表着AI在能力边界、训练范式乃至与人类协作模式上的深刻变革。

从“无所不知”到“善于思考”:GPT-5的核心能力跃迁

GPT-5最直观的变化体现在其解决复杂问题的能力上。它不再仅仅是一个知识的检索和搬运工,而更像一个能够进行深度推理的“思考者”。这种转变的核心在于,模型学会了动态地分配“思考时间”——面对简单问题时快速响应,而处理复杂查询时则会启动深度推理模式,仿佛一个在草稿纸上演算的解题者。

独家对话GPT-5研究员:AI如何从“大学生”进化成“博士级思考者”

这种“思考”能力在多个专业领域得到了验证。在编程方面,GPT-5展现了惊人的“即时编程”能力,可以在几分钟内根据自然语言描述,创建出功能完整的网站、应用乃至交互式游戏。一位研究员分享,他中学时花费数周编写的贪吃蛇游戏,GPT-5在几秒钟内便完成了,并且还能根据新的需求实时更新代码。这背后是模型对代码“美学”的追求,它生成的不再是仅仅“能跑就行”的代码,而是结构优雅、可读性强的专业级代码。

在更严谨的科学研究领域,GPT-5更是扮演起“科研加速器”的角色。一篇广受关注的数学论文中,研究者首次将GPT-5列为“定理贡献者”。在人类教授的引导下,GPT-5成功地为一个长期存在的数学难题“第四矩定理”推导出了定量的收敛速度界限,解决了该领域的空白。研究者将其形容为一位“聪明但毛躁的实习生”,它能快速提出方向、生成证明,但关键步骤仍需人类专家进行纠错和引导。这种“教授+AI”的组合拳,正成为科学发现的新范式。类似的故事也发生在生物学、物理学等领域,GPT-5能够快速梳理海量文献,提出连人类专家都未曾想到的跨学科联系,将数月的研究推理过程压缩至几分钟。

此外,GPT-5在可靠性上也取得了长足进步。据称,其在事实性错误和“幻觉”风险上相比前代产品大幅降低。它引入了“安全完成(safe completions)”机制,在面对敏感或越界请求时,不再一概拒绝,而是尝试在安全准则内给出更有价值的回答。同时,它也增强了“自我意识”,能识别并主动说明自身无法解决的任务和局限性,减少了无依据输出的概率。

揭秘背后:从“喂数据”到“注入灵魂”

GPT-5的强大能力从何而来?核心研究团队的成员们揭示了其训练哲学的演进。如果说预训练(Pre-training)是通过“阅读”整个人类互联网,为模型注入广博的知识,那么后训练(Post-training),特别是基于人类反馈的强化学习(RLHF),则更像是为这头“知识巨兽”注入“灵魂”,教会它如何以对人类有益的方式去思考和行动。

独家对话GPT-5研究员:AI如何从“大学生”进化成“博士级思考者”

一位研究员用一个生动的比喻解释了强化学习:这就像训练一只狗。当模型给出优质、有帮助的回答时,它会得到正向的“奖励”信号;反之,则会收到负向的“惩罚”信号。通过日复一日的精细调校,那个原始、混乱的模型才被雕琢成能够进行高质量对话的智能体。

数据,依然是王道,但核心已从“数量”转向“质量”。研究员们强调,随着学习算法效率的提升,高质量数据变得比以往任何时候都更加重要。团队投入了巨大精力进行数据策划,以确保模型能理解不同用例中的细微差别。当预训练数据不足时(例如计算机使用这类新兴能力),团队甚至会利用早期模型来“自举”生成更多高质量的训练数据,形成一种自我改进的良性循环。

整个训练过程并非一帆风顺。据研究员透露,正是评估体系本身的设计,在无意中“奖励”了模型的幻觉行为。在传统的准确率测试中,模型猜测答案得分的期望值高于承认“不知道”,这迫使AI成为了“应试选手”。意识到这一点后,团队开始调整评估机制,为模型诚实地表达不确定性给予奖励,从根本上抑制了幻觉的产生。

从“工具”到“伙伴”:人机关系的重塑与挑战

独家对话GPT-5研究员:AI如何从“大学生”进化成“博士级思考者”

GPT-5的发布过程也并非一帆风顺。奥特曼坦诚,初期的更新“搞砸了一些事”,许多用户抱怨新模型失去了GPT-4o的“温情”,变得更加“冷漠”。这促使OpenAI迅速做出调整,允许用户切换回旧模型,并深刻反思了一个问题:不存在一个能满足所有人的模型。这也催生了GPT-5的个性化预设功能,用户可以选择让它以“愤世嫉俗者”、“倾听者”等不同风格进行交流。

这场风波揭示了AI发展的一个深层趋势:用户对AI的期待,正在从一个高效的“工具”转变为一个有情感共鸣的“伙伴”。研究员发现,决定模型聪明与否的,已不仅仅是智商(IQ),更是情商(EQ)——即理解用户意图和上下文的能力。一个模型如果无法记住用户此前的谈话背景,哪怕再智能,也会给人带来“冷场感”。

因此,“记忆系统”和“异步工作流”成为了AI Agent时代的关键。未来的AI将不再是即问即答的工具,而是能够记住你的偏好、理解你的长期目标、并能异步为你执行复杂任务(如深度研究、旅行规划)的个人助理。

然而,技术的飞速发展也带来了新的隐忧。当AI能够大规模产出“正确但平庸”的成果时,真正的原创突破是否会被淹没?当博士生可以轻易跳过至关重要的试错与摸索环节时,学术训练的根基是否会动摇?OpenAI的研究员也承认,模型在基准测试中的高分与解决现实世界复杂问题之间,存在着“能力过剩”的断层。这意味着,未来AI发展的瓶颈,可能不再是模型本身,而是人类如何有效地使用这些强大的工具。

最终,与GPT-5研究员的这场“对谈”告诉我们,我们正处在一个激动人心又充满不确定性的转折点。AI正从一个无所不知的“图书馆员”,进化为一个能够与我们共同思考、共同创造的“伙伴”。真正的问题,已不再是AI能为我们做什么,而是当AI已经能写进论文、加速科学发现时,我们作为人类,又该如何定义自己新的角色和价值。

内容由AI生成

精选参考来源

1. #GPT5来了#GPT-5 被 CEO Sam Altman 称为:超越「大学生思维,迈向「博士级」对话。我感觉它最大的...

#GPT5来了#GPT-5 被 CEO Sam Altman 称为:超越「大学生思维,迈向「博士级」对话。我感觉它最大的... GPT-5 被 CEO Sam Altman 称为:超越「大学生思维,迈

2. GPT-5攻入数学圈,证明定理快过博士生?网友热议AI新角色

GPT-5攻入数学圈,证明定理快过博士生?网友热议AI新角色 GPT-5攻入数学圈,证明定理快过博士生?网友热议AI新角色36氪1758170814 9月初,一篇挂在arXiv的论文在学界扔下一颗炸弹

3. 重磅!a16z深度对话GPT-5核心研究团队,曝光更多内幕信息

重磅!a16z深度对话GPT-5核心研究团队,曝光更多内幕信息 重磅!a16z深度对话GPT-5核心研究团队,曝光更多内幕信息人人都是产品经理1754749177 从 WebGPT 到 ChatGPT

4. GPT-5核心开发者:感受到了侮辱,它想都没想丨2025-08-08传说中的GPT-5到底怎么样?本期视频请来了几位Op...

GPT-5核心开发者:感受到了侮辱,它想都没想丨2025-08-08传说中的GPT-5到底怎么样?本期视频请来了几位Op... GPT-5核心开发者:感受到了侮辱,它想都没想丨2025-08-08传说

5. OpenAI首席研究员表示:“从某种意义上讲,GPT-5可以看作是 o3 的升级版 o3.1——它依旧只是同一概念的一种...

OpenAI首席研究员表示:“从某种意义上讲,GPT-5可以看作是 o3 的升级版 o3.1——它依旧只是同一概念的一种... OpenAI首席研究员表示:“从某种意义上讲,GPT-5可以看作是 o3

6. 从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”

从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考” 从Transformer到GPT-5,听听OpenAI科学家 Lukasz 的“大模型第一性思考”C

7. GPT-5首次会推理,OpenAI联创曝AGI秘诀,超临界学习吞噬算力,2045金钱无用?

GPT-5首次会推理,OpenAI联创曝AGI秘诀,超临界学习吞噬算力,2045金钱无用? GPT-5首次会推理,OpenAI联创曝AGI秘诀,超临界学习吞噬算力,2045金钱无用?36氪175547

8. #模型时代# #GPT5# OpenAI CEO:从GPT-5到超级智能,人类很快迎来新科学革命,我们的孩子不会比AI更...

#模型时代# #GPT5# OpenAI CEO:从GPT-5到超级智能,人类很快迎来新科学革命,我们的孩子不会比AI更... OpenAI CEO:从GPT-5到超级智能,人类很快迎来新科学革命,

9. OpenAI:GPT-5模型正开始减轻科学家日常工作量

OpenAI:GPT-5模型正开始减轻科学家日常工作量 OpenAI:GPT-5模型正开始减轻科学家日常工作量IT之家1763740900 IT之家 11 月 21 日消息,OpenAI 官方昨天发布

10. GPT-5真身曝光,首测编程惊艳全网,一句话秒生游戏,OpenAI双雄备战AGI

GPT-5真身曝光,首测编程惊艳全网,一句话秒生游戏,OpenAI双雄备战AGI GPT-5真身曝光,首测编程惊艳全网,一句话秒生游戏,OpenAI双雄备战AGI36氪1754045763 GPT-5

11. OpenAI重组GPT-5「灵魂」团队!亚裔女负责人遭调离,罕见自曝AI幻觉祸首

OpenAI重组GPT-5「灵魂」团队!亚裔女负责人遭调离,罕见自曝AI幻觉祸首 OpenAI重组GPT-5「灵魂」团队!亚裔女负责人遭调离,罕见自曝AI幻觉祸首36氪1757205976 【新智元

12. TheVerge:我和山姆·奥特曼聊了聊 GPT-5 发布引发的风波在晚宴上,OpenAI 的 CEO 回应了关于 GP...

TheVerge:我和山姆·奥特曼聊了聊 GPT-5 发布引发的风波在晚宴上,OpenAI 的 CEO 回应了关于 GP... TheVerge:我和山姆·奥特曼聊了聊 GPT-5 发布引发的风波在晚

13. GPT-5“让人失望”,AI“撞墙”了吗?

GPT-5“让人失望”,AI“撞墙”了吗? GPT-5“让人失望”,AI“撞墙”了吗?华尔街见闻1755399559 OpenAI备受期待的GPT-5未能带来革命性突破。虽然通往通用人工智能(AGI)

14. 【#GPT5可选择4种聊天性格#】#GPT5写作像诗人# 当地时间周四(8月7日),OpenAI官方正式推出了备受外界期...

【#GPT5可选择4种聊天性格#】#GPT5写作像诗人# 当地时间周四(8月7日),OpenAI官方正式推出了备受外界期... 【 当地时间周四(8月7日),OpenAI官方正式推出了备受外界期待的、

15. GPT-5首批重大科研突破官宣,但已救不了奥特曼的焦虑

GPT-5首批重大科研突破官宣,但已救不了奥特曼的焦虑 GPT-5首批重大科研突破官宣,但已救不了奥特曼的焦虑36氪1764042355 OpenAI于2025年11月22号震撼发布GPT-5早期实

16. GPT-5呼之欲出,引发五大技术猜想,阿尔特曼为何“感到恐惧”

GPT-5呼之欲出,引发五大技术猜想,阿尔特曼为何“感到恐惧” GPT-5呼之欲出,引发五大技术猜想,阿尔特曼为何“感到恐惧”每日经济新闻1754114338 每经记者:岳楚鹏 高涵 每经编辑:高涵“

17. OpenAI GPT-5 发布:模型能力全面「屠榜」,构建「超级智能」的第一步

OpenAI GPT-5 发布:模型能力全面「屠榜」,构建「超级智能」的第一步 OpenAI GPT-5 发布:模型能力全面「屠榜」,构建「超级智能」的第一步极客公园1754592831 经历过无数次

18. GPT-5首测编程惊艳全网!一句话秒生游戏,OpenAI双雄备战AGI

GPT-5首测编程惊艳全网!一句话秒生游戏,OpenAI双雄备战AGI GPT-5首测编程惊艳全网!一句话秒生游戏,OpenAI双雄备战AGI新智元1754039503 编辑:桃子【新智元导读】GPT

19. GPT-5王者归来?奥特曼称AI已跨科学门槛,三大学科正迎来实质性突破

GPT-5王者归来?奥特曼称AI已跨科学门槛,三大学科正迎来实质性突破 GPT-5王者归来?奥特曼称AI已跨科学门槛,三大学科正迎来实质性突破36氪1760092544 当ChatGPT学会说话,S

20. GPT-5超越人类医生,推理能力比专家高出24%,理解力强29%

GPT-5超越人类医生,推理能力比专家高出24%,理解力强29% GPT-5超越人类医生,推理能力比专家高出24%,理解力强29%36氪1755251170 GPT-5比人类医生还会看X光片?!最新研

21. 真·博士水平,GPT-5首次给出第四矩定理显式收敛率,数学教授只点拨了一下

真·博士水平,GPT-5首次给出第四矩定理显式收敛率,数学教授只点拨了一下 真·博士水平,GPT-5首次给出第四矩定理显式收敛率,数学教授只点拨了一下36氪1757496434 GPT-5真不愧是博士

22. OpenAI 翁家翌在 WhynotTV 的采访中,关于后训练、infra等观点中,哪些令你受到启发?

OpenAI 翁家翌在 WhynotTV 的采访中,关于后训练、infra等观点中,哪些令你受到启发? 作为一个既做过Infra,也做过算法的研究员来说,我认为Infra和idea都很重要。Infra

23. GPT-5波折超乎想象!奥特曼回应一切:4o重新上阵,团队紧急补救

GPT-5波折超乎想象!奥特曼回应一切:4o重新上阵,团队紧急补救 GPT-5波折超乎想象!奥特曼回应一切:4o重新上阵,团队紧急补救新智元1754789906 编辑:定慧 好困【新智元导读】奥特曼和

24. #模型时代# Cursor官方播客刚采访了Thinking Machines联创、前OpenAI核心研究员John Sc...

#模型时代# Cursor官方播客刚采访了Thinking Machines联创、前OpenAI核心研究员John Sc... Cursor官方播客刚采访了Thinking Machines联创、前

25. GPT-5.2考赢人类,OpenAI警告:大模型能力已过剩,AGI天花板不是AI

GPT-5.2考赢人类,OpenAI警告:大模型能力已过剩,AGI天花板不是AI GPT-5.2考赢人类,OpenAI警告:大模型能力已过剩,AGI天花板不是AI36氪1768179975 刚刚,GP

26. 大模型训练大纲

大模型训练大纲 大模型训练大纲人人都是产品经理1766974805 Transformer架构如何支撑GPT与BERT的差异化能力?MOE模型如何实现稀疏激活与动态分配的巧妙平衡?本文深度拆解大模型训

27. 【开源证券-通信行业周报:GPT~5多领域取得SOTA,Arista上调业绩指引,持续看好全球AI链】研究报告内容摘要 ...

【开源证券-通信行业周报:GPT~5多领域取得SOTA,Arista上调业绩指引,持续看好全球AI链】研究报告内容摘要 ... 【开源证券-通信行业周报:GPT~5多领域取得SOTA,Arista上调

28. #OpenAI新使命自动化科研##OpenAI放话终极目标是自动化研究员#采访时间不到1小时,信息密度却堪称爆炸!Ope...

#OpenAI新使命自动化科研##OpenAI放话终极目标是自动化研究员#采访时间不到1小时,信息密度却堪称爆炸!Ope... 采访时间不到1小时,信息密度却堪称爆炸!OpenAI首席科学家Jakub

29. 本期嘉宾翁家翌。他在 2022 年加入 OpenAI,并且是 OpenAI 一系列核心模型背后的核心贡献者之一——从 G...

本期嘉宾翁家翌。他在 2022 年加入 OpenAI,并且是 OpenAI 一系列核心模型背后的核心贡献者之一——从 G... 本期嘉宾翁家翌。他在 2022 年加入 OpenAI,并且是 OpenA

30. GPT-5.2考赢人类!OpenAI警告:大模型能力已过剩,AGI天花板不是AI

GPT-5.2考赢人类!OpenAI警告:大模型能力已过剩,AGI天花板不是AI GPT-5.2考赢人类!OpenAI警告:大模型能力已过剩,AGI天花板不是AI新浪财经1768055480 来源:市

31. 深度|OpenAI联创:算力不是唯一瓶颈,如果在18年掌握现在的后训练技术,2个人就能手搓出ChatGPT

深度|OpenAI联创:算力不是唯一瓶颈,如果在18年掌握现在的后训练技术,2个人就能手搓出ChatGPT 深度|OpenAI联创:算力不是唯一瓶颈,如果在18年掌握现在的后训练技术,2个人就能手搓出

32. 两位核心人物揭示OpenAI下一个目标:从氛围编程走向氛围研究

两位核心人物揭示OpenAI下一个目标:从氛围编程走向氛围研究 两位核心人物揭示OpenAI下一个目标:从氛围编程走向氛围研究DeepTech深科技1758973064 不久前,《麻省理工科技评论》曾

33. 强烈推荐大家去听OpenAI的官方播客,最新一期请来了这家公司的两位核心人物:Christina Kim,负责后训练的研...

强烈推荐大家去听OpenAI的官方播客,最新一期请来了这家公司的两位核心人物:Christina Kim,负责后训练的研... 强烈推荐大家去听OpenAI的官方播客,最新一期请来了这家公司的两位核心

34. OpenAI 翁家翌在 WhynotTV 的采访中,关于后训练、infra等观点中,哪些令你受到启发?

OpenAI 翁家翌在 WhynotTV 的采访中,关于后训练、infra等观点中,哪些令你受到启发? 他早年的research经历在知乎和一亩三分地上都能找到,你要是了解他的经历就知道为什么他对in

35. 现有路径不通?OpenAI、亚马逊考虑改变大模型训练方式

现有路径不通?OpenAI、亚马逊考虑改变大模型训练方式 现有路径不通?OpenAI、亚马逊考虑改变大模型训练方式华尔街见闻1769150529 随着人工智能领域竞争进入深水区,行业顶尖研究人员正对现

36. 拒绝DeepSeek的清华学霸,如何拿捏OpenAI的最新大模型?

拒绝DeepSeek的清华学霸,如何拿捏OpenAI的最新大模型? 拒绝DeepSeek的清华学霸,如何拿捏OpenAI的最新大模型?智东西1768920952 智东西作者 | 江宇编辑 | 冰倩智东

37. 拒绝DeepSeek的清华学霸,如何拿捏OpenAI的最新大模型?

拒绝DeepSeek的清华学霸,如何拿捏OpenAI的最新大模型? 拒绝DeepSeek的清华学霸,如何拿捏OpenAI的最新大模型?36氪1768954549 ChatGPT背后的男人:在Open

38. 一位曾在 ( 微软方面与 OpenAI 合作过的前 微软员工分享了一些关于 OAI 和 微软之间关系的非常有趣的观点,以...

一位曾在 ( 微软方面与 OpenAI 合作过的前 微软员工分享了一些关于 OAI 和 微软之间关系的非常有趣的观点,以... 一位曾在 ( 微软方面与 OpenAI 合作过的前 微软员工分享了一些关

39. #OpenAI推理第一人离职# 刚开年,OpenAI再出人事动荡:推理模型第一人离职了!Jerry Tworek——构建...

#OpenAI推理第一人离职# 刚开年,OpenAI再出人事动荡:推理模型第一人离职了!Jerry Tworek——构建... 刚开年,OpenAI再出人事动荡:推理模型第一人离职了!Jerry T
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章