OpenAI模型独立证明平面单位距离猜想,AI暂未取代人类数学家

源自61位全网作者

05-21 16:40

内容由AI生成

精选参考来源

1. AI什么题都会算了,我们为什么还要学数学?考试原来是最不重要的原因!

2. 菲尔兹奖得主0贡献!GPT-5.5 Pro两小时跑出博士级证明

3. AI 术语通俗词典:曼哈顿距离

4. 两个200亿美元:OpenAI和英伟达在打一场“推理之战”

5. GPT5.5:更贵不更烧,主角给到Codex,逼Claude慌忙修复降智问题

6. 推翻150年数学直觉:数学家烧坏几台笔记本,解决几何拓扑难题

7. DeepSeek-Math-V2数学模型开源,成绩碾压OpenAI和谷歌同类模型

8. 困扰人类60年的数学猜想,AI花80分钟解出来了! #大有学问 #红衣聊AI #数学 #科研

9. 有人不理解在 AI 时代,我建议的多 “运用 token ” 是什么意思。。。所以我找一个文章,是个转载,说的是一个顶尖数学家,是如何“运用 token ”,解决全球数学难题的。这个故事,充分讲解了人和 AI 的互动关系和双方的价值。而这个价值的量化指标,其实就是你消耗的 token 的多少和 ROI 。以下是转载,来自 x 的 @ doteyxxxxxxxxx世界顶级数学家陶哲轩在解决一个 Erdős(埃尔德什)的经典问题时,全流程都在用 AI 做助手——从证明草案,到简化证明,再到形式化验证。Erdős 是20世纪最高产的数学家之一,一辈子发表了1500多篇论文,提出了无数开放问题。数学圈有个著名的"埃尔德什数"——如果你和他合作过论文,你的埃尔德什数就是1;和他的合作者合作过,就是2,以此类推。爱因斯坦的埃尔德什数是2。后来有人专门做了一个网站,把他的很多未解决/已解决问题系统整理出来,这就是 Erdos Problems 网站。陶哲轩讲的是其中的第 367 号问题,属于数论里的一个具体问题,专业数学研究级别的问题。解决过程大概是这样的:一位数学家 Wouter van Doorn 先给出一个人类手写的反例证明草案,但里面有一个关键恒等式他没完全证明,只是说:“相信有人能帮我确认一下”。陶哲轩把这个恒等式扔给 Google 的 Gemini Deepthink 模式。大概十分钟后,Gemini 给出了一份完整证明,还顺带确认了整套论证是成立的。Gemini 的证明用到了 p-adic 等比较高级的代数数论工具,对这个具体问题来说有点杀鸡用牛刀。于是陶哲轩花了半小时,把 AI 的证明手工转化成更基础、更易懂的版本。两天后,另一位数学家 Boris Alexeev 用一个叫 Aristotle 的工具(基于 AI + Lean)完成了全套形式化证明,还特意手动检查最终结论,以防 AI 在形式化过程中存在编造。陶哲轩觉得还没完,又用 Deep Research (同时用了 ChatGPT 和 Gemini)做了一轮文献搜索,看这个问题有没有前人类似工作。结果找到了若干关于连续幂数的相关论文,但没有直接解决第 367 号问题。整个流程:人类提出猜想 → AI暴力证明 → 人类简化优化 → AI辅助形式化验证。都在说 Gemini 3 已经到了博士生水平,看来所言非虚,这些事情真的需要数学博士级别才能做的出来,但另一方面,真正的数学家也并没有被 AI 代替:是人类决定哪个问题值得解决,是人类判断AI的p-adic方法太重了需要简化,是人类手工完成最终的形式化表述以验证 AI 的结果是否准确。AI 做的是那些需要大量计算、符号推演、但方向已经明确的体力活。在 AI 时代,问对问题、甄别结果,比以前更重要了。

10. 如何评价 OpenAI 最新发布的 GPT-5.5 模型?

11. AI又要颠覆数学?陶哲轩紧急发声:停止造神!

12. 谷歌Gemini 3杀疯了!陶哲轩亲测:10分钟干翻百年数学难题

13. 半夜被AI「吓醒」!57岁导师投奔24岁华人女学霸,打造「AI数学家」

14. 如何评价陶哲轩《AI 时代的数学方法与人类思想》这篇文章?你有哪些思考?

15. 陶哲轩震撼!数学家1975年埋下的「坑」,被AI和全球网友用48小时填平了

16. #DeepSeek推出新模型#DeepSeekMath-V2的发布,为AI数学推理开辟了“严谨性优先”的新赛道。摒弃单纯追求答案正确率的传统思路,其创新的自我验证框架,通过LLM验证器审查推理链条、生成高难度样本迭代优化,精准破解了数学推导“重结果轻过程”的行业痛点。在IMO、CMO等顶级赛事中斩获金牌,普特南竞赛近乎满分的成绩,印证了这一路径的可行性。对定理证明等需严密推导的任务而言,这种“自我纠错”能力让AI不再是“黑箱解题”,而是具备了可追溯、可验证的理性思维。AI数学智能的核心价值,不仅在于攻克难题,更在于建立可靠的推理逻辑。DeepSeekMath-V2的突破,为构建更强大的数学智能系统提供了关键支撑,也为AI在科研、工程等精密领域的应用打开了更广阔的空间。#秒懂热点就用智搜# deepseek推出新模型

17. 爱因斯坦、费曼在智能体世界「复活」:30分钟刷新Erdos经典数学问题记录

18. 陶哲轩:千年数学规则被AI按下重启键

19. #华人顶级数学家称被AI吹捧到脸红##专家称未来十几年有望找到外星人#AI让数学家都脸红?原来宇宙终极答案,根本不靠算力! 一边是AI捧上神坛,一边是专家喊话:十几年内找到外星人!😂 别光盯着代码了——外星人可能更想跟数学家握手!🔥转发这个宇宙预告,见证人类最炸裂的倒计时!

20. #华人顶级数学家称被AI吹捧到脸红#华人数学家张益唐谈及使用AI趣事,直言AI钻研高深数学不在行,花式吹捧却十分擅长。各种夸张夸赞接连不断,听得他都倍感羞涩,大佬低调谦逊的模样格外接地气。#专家称未来十几年有望找到外星人#

21. OpenAI加速研发全新模型“Garlic”,直面谷歌AI进展压力

22. 幻觉减少52.5%,废话少30%,ChatGPT默认模型正式升级为GPT-5.5 Instant

23. 顶级数学家陶哲轩刚刚用AI,给我们所有家长上了一堂价值千万的育儿课!看懂这个视频,孩子起跑至少提前十年。#家长必看# #小学规划# #小学数学# 乔爸在海淀的微博视频

24. 当AI开始泡在数学项目里:DeepMind的48%突破意味着什么?

25. 菲尔兹奖得主用AI解出博士级数学题,然后他开始为博士生们发愁了

26. #AI会最先替代哪些岗位#智能客服秒接咨询,工业机械臂精准拧螺丝,AI的替代浪潮已率先拍向规则明确、重复度高的岗位。这些岗位的核心任务可被算法拆解,效率与精度远超人工,成为AI渗透的“首站”。#人工智能##AI创造营# 凯文思考的微博视频

27. 【陶哲轩谈AI:廉价胜利还是真正的研究伙伴?】快速阅读: 陶哲轩在最新访谈中给AI数学能力泼了盆冷水,称那些被吹上天的“AI攻克Erdős猜想”多是专家半天能搞定的活。但他也承认,到2026年AI有望成为可信赖的初级合著者。问题是:AI能执行已知技术,却留不下人类数学家那种深刻的思维痕迹。---陶哲轩对AI的态度可以用三个字概括:有用,但。那些让人激动的“AI解决Erdős问题”的新闻,在他看来大多是cheap wins。一千多个Erdős问题里挑出来的长尾题目,用的是标准技术,给个专家半天时间也能搞定。这话听起来像是在泼冷水,但你换个角度想:三年前ChatGPT还在数strawberry有几个r这种问题上翻车,现在已经能做到“专家半天能搞定”的水平了。目标确实在移动。陶哲轩预测AI到2026年能达到“可信赖的初级合著者”水平。这个判断来自2023年,当时推理模型还没开发出来,结果进度基本符合预期。有网友指出一个有趣的对比:有人的博士论文题目,陶哲轩几小时就给解了。所以他眼中的“廉价胜利”,可能已经超过很多职业数学家一生中最难的研究。真正让陶哲轩在意的不是AI能不能算得对,而是它算完之后留下了什么。人类数学家证明一个定理,过程中会产生概念性的洞见,那些弯路、直觉、失败的尝试本身就是知识。AI的证明缺乏这种“思维痕迹”。它可以用暴力计算扫荡一大片问题空间,但不会告诉你为什么走这条路而不是那条。有观点认为这就像字典比你认识的单词多,但字典不会写诗。也有人反驳:这分明是在移动门柱,几年前AI连完整句子都说不利索,现在开始嫌人家证明不够优雅了。陶哲轩最近几次访谈里反复提到一件事:他担心的不仅是AI能不能做到,而是如果AI真的能越来越多地把人从循环中移除,对人类的智识生活意味着什么。这是一个更大的问题,他没有给出答案。他呼吁AI系统需要更好的不确定性信号——也就是说,让AI知道自己不知道什么,而不是一本正经地胡说八道。他更倾向于人机交互式协作,而非那种按一个按钮就自动出结果的流程。数学会不会在今年年底被“解决”?有人赌会。但至少在陶哲轩看来,AI改变的是数学的实践方式,不是一夜之间取代数学家。它把数学从手工作坊式的精雕细琢,推向大规模的问题探索。至于这算进步还是损失,可能取决于你觉得数学到底是什么。---简评:陶哲轩的真正恐惧藏在一个词里:“把人从循环中移除”。这不是在讨论AI能不能证明定理,而是在追问:如果证明定理不再需要人类的挣扎、顿悟和失败,那“做数学”这件事对人还意味着什么?字典认识所有单词却不会写诗,但如果有一天字典开始写诗,我们会说那不叫诗——因为诗的定义就是“人类写的”。 他要求AI保留“不确定性信号”,本质上是在请求:请给人类留一个参与的借口。这听起来很傲慢,但也很悲壮——我们正在发明一种东西,它最大的成功标志就是让发明者变得多余。---www.reddit.com/r/singularity/comments/1rf41gl/math_legend_terence_tao_on_the_promise_and_limits

28. 从某种程度认同计算机和数学最容易被AI替代,我每天都花3-5小时与AI(gpt deekseek)一起工作和思考数学问题,已经明显感觉到它们的数学,从一个高中水平,变成大学水平,变成了一个phd学生,然后变成低配版的我。毫无怀疑未来ai可以自己证明出来,人类的数学难题

29. 30年数学难题,AI仅6小时告破!陶哲轩:ChatGPT们都失败了

30. AI独立解决三十年数学问题的变体,陶哲轩分享自动化研究经验

31. 陶哲轩亲自曝光:AI破解数学难题,竟全是「抄」的?

32. 李雅普诺夫函数构造问题,和费马大定理、庞加莱猜想、黎曼假设一样,属于“数学中最优美、也最折磨人的那类问题”。它们有一个共同特征:陈述极其简单,证明极其困难。 AI 在这类问题上的突破,正在重塑“数学研究”这件事本身的定义。传统的数学研究范式是:人类数学家依靠直觉和洞察力,提出猜想,然后给出严格证明。AI 正在插入一个新的中间层:用算力探索人类直觉无法触及的解空间,然后把找到的模式呈现给人类。 然而这仅仅是2024年的 AI4Science 进展。 到了2026年,AI 还在进一步侵蚀人类科学家的领域。人类,何去何从。 http://t.cn/AXJWJNBf

33. 谷歌AI连发6篇数学论文!Gemini攻入博士级科研,91.9%刷爆SOTA

34. #大厂员工们正在帮AI取代自己#蒸汽机没淘汰工匠,计算机没淘汰数学家,AI 也不会淘汰程序员 但它确实在筛选人 —— 只会重复编码的会被取代,懂业务、能设计复杂系统、会和 AI 协作的反而更吃香。以后程序员的核心价值不是写代码,而是用 AI 创造更大价值。 ​​​

35. 计算机算力这么强,但没有淘汰数学家,那么AI会吗?

36. “AI是否会取代人类工作” 诺奖得主这样说

37. Nature:AI 引导人类直觉,帮助发现数学定理

38. GPT-5破解数学猜想,AI超越人类还有多远?

39. 2万字全文|陶哲轩和OpenAI对谈数学及科学研究中的AI应用、人脑更善于基于少量数据作出判断...

40. 数学家如何看待AI证明数学猜想

41. 人工智能为数学家找到“巨人的肩膀”

42. AI败给数学家

43. 别把思考彻底外包给AI

44. 专访菲尔兹奖得主杰曼诺夫:AI不会取代数学家,技术无法复刻人类灵感|封面头条

45. AI 有可能代替人类从事数学研究吗?

46. AI新工具或可帮助解决数学难题

47. 研究发现:AI与人类“思考”方式存在重大差异

48. 11位顶尖数学家发了篇没结果的论文,陶哲轩推荐都关注一下

49. GPT-5.5 Pro独立完成数学证明:学界重新审视“原创智能”的边界

50. 炸了!ChatGPT-5.2 凭“氛围”破解数学猜想,AI 要抢数学家饭碗了?

51. 多位数学家谈AI在数学领域的影响:数学的AI拐点已出现

52. 陶哲轩为何跨界创立 SAIR?AI 时代数学研究的范式转变与避坑指南

53. 数学研究,AI一小时,人类一百年?

54. AI 能解博士级数学难题,真正该慌的,从来不是 “被取代”

55. 专访菲尔兹奖得主杰曼诺夫:AI不会取代数学家,技术无法复刻人类灵感|封面头条

56. 当AI独立攻克世界级数学难题:是基础数学的春天,还是顶尖数学家的寒冬?

57. 数学正在经历其历史上最大的变革,AI重新定义数学家这份职业

58. 数学家也要被AI取代了吗?

59. 656行代码5小时搞定,Axiom AI自主完成两项Erdős猜想形式化证明

60. Lean创始人Leo de Moura专访:当AI会\"幻觉\",数学证明如何保证100%正确?|

61. HarmonicMath 宣称 Aristotle AI 成功证明 Paul Erdős 第 124 号数学问题的 “简化版本”

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章