AI攻破60多年悬而未决的著名猜想,一个博士的课题被"截胡":这个夏天AI数学大战的6件事,哪些能信

源自13位全网作者

13:18

8月14日晚,知乎上冒出一个问题:怎么看森多夫猜想已被AI、Lech Mazur、陶哲轩攻破。知乎一天时间,浏览量冲破11万。而赞数最高的回答,不是祝贺。

回答者是Tang-Zhang猜想里的"Zhang",森多夫猜想正是他博士期间的课题。他写下的第一句话是:Sendov猜想被Lech Mazur用AI解决了,我的青春结束了。知乎

这次攻破的,到底是什么

先说清楚发生了什么。森多夫猜想是1960年代提出的经典难题,通俗说:如果一个多项式的所有零点都落在单位圆盘里,那么以任意一个零点为圆心画单位圆,圆内至少能罩住一个临界点。听着简单,悬置了60多年没人能证。2022年陶哲轩证明了多项式次数"充分大"时猜想成立,但完整版本一直没人啃下来。知乎这正是上面那位Zhang同学常年打磨的方向。

AI攻破60多年悬而未决的著名猜想,一个博士的课题被

这一次,青年数学家Lech Mazur借助AI给出了全次数范围的完整证明。有意思的是,据首发报道的博主说,他还是一家科技初创公司的CEO。微博而且结果比原猜想更强:另一个悬置多年的著名猜想Phelps–Rodriguez猜想,直接成了它的推论。项目方公布的核验信息显示,整份证明已经完成Lean形式化验证——也就是每一步都被机器形式系统检查过。

AI攻破60多年悬而未决的著名猜想,一个博士的课题被

陶哲轩不仅亲自写博客消化、讲解这份AI证明,随后还用AI解决了Tang-Zhang猜想"n充分大"的情形——对,就是那位Zhang参与提出的猜想。

更让人感慨的是时间线。Zhang那篇关于Sendov方向的论文,本来打算作为博士毕业论文的一部分。前一阵他收到拒稿消息,编辑转达审稿人的态度是"不感兴趣"。他后来才反应过来:那个时候,陶哲轩正在消化Mazur的AI证明。

这个回答的评论区,成了数学圈的集体焦虑现场。最高赞评论84个赞:AI时代这种课题被爆的情况会越来越多,最近已经听说好几起类似的事件。知乎Zhang回复:是的,太多了。另一条高赞回答更直接:以前证明一个有名有姓的猜想可以上四大、拿985教职、上国家级人才帽子,现在证明出来了,别人会问,是AI做的吧?知乎

先别急着震撼:这个夏天的时间线

如果你一直关注AI新闻,应该能保持冷静——这波"AI证猜想"的新闻,真真假假,远不止这一条。我把整个夏天的时间线整理了一遍:

  • 5月21日:OpenAI宣布其推理模型推翻了埃尔德什1946年提出的"平面单位距离猜想"。微博这个猜想问的是:平面上n个点,距离恰好为1的点对最多能有多少?悬置约80年,OpenAI给出了突破已知上界的构造。

  • 7月11日:据微博博主整理,OpenAI证明了1973年提出、悬置50年的图论"循环双覆盖猜想"。微博

  • 7月21日:Anthropic的一位数学家用其模型Fable 5给出"雅可比猜想"的反例——这个猜想悬置87年,曾入选"21世纪18大数学难题"。知乎OpenAI内部Codex随后独立得到类似结果。

  • 8月2日—4日:OpenAI宣布下一代模型Astra一口气解决10个至少悬置10年的数学难题,横跨群论、量子复杂性、格密码等8个领域,单项推理成本约2000美元,结果通过Lean形式化验证。同一天,新晋菲尔兹奖得主Tsimerman宣布加入OpenAI。微博

  • 8月4日:翻车也来了。据科技博主复盘,另一条"AI攻破80年悬而未决猜想"的宣称,24小时内被数学家打回——证明的每一句话形式上都对,但整体绕开了原猜想的核心命题。微博

  • 8月上旬:Anthropic宣布Claude把黎曼猜想的已知下界从41.6%提升到67.2%,相关讨论在知乎冲上270万浏览。知乎

  • 8月13日深夜:森多夫猜想告破,随后陶哲轩亲自消化、讲解并跟进证明。

AI攻破60多年悬而未决的著名猜想,一个博士的课题被

补两个背景:第一,5月那次其实是OpenAI的"翻身仗",再往前半年,他们曾把文献里已有的结果当成新发现,闹过乌龙。第二,Astra那10项成果里,单项被评价为"菲尔兹奖级别"——这也是为什么数学家圈子里既有兴奋,也有恐慌。

真突破还是营销?三级鉴别法

看完这条时间线你会发现,这些"攻破"的可信度根本不是一个量级。我整理了一套鉴别方法,建议存一下:

第一级,看机器校验。 证明有没有过Lean这类形式化验证工具。机器验证意味着推理的每一步都被形式系统接受,含金量最高。Astra那10项属于这一档,这次的森多夫猜想同样完成了Lean验证。

第二级,看同行消化。 有没有本领域的顶尖专家亲自跟进、讲解、延展。森多夫猜想属于第一级加第二级的"双保险",而且消化它的人就是陶哲轩本人——当然,证明刚公布,完整的同行检验还在路上。

第三级,只有官宣。 没有校验、没有同行跟进,只有官方通稿和博主转发。8月4日翻车的那条就在这一档:AI证对了每句话,但答错了题。

还要补一句:机器能验证"每一步对不对",但验证不了"答的是不是那道题"。今年3月底,菲尔兹奖得主陶哲轩与合作者在个人博客发布长文,并在arXiv上传了论文《AI时代的数学方法与人类思维》。知乎文中直言AI是被过分夸大的预测机器。知乎7月底的国际数学家大会上,他进一步说,大模型的数学原理没有想象中神秘,但现有数学也解释不了模型为什么有些任务灵、有些任务翻车。微博8月4日的翻车,恰好印证了他的担心。

AI攻破60多年悬而未决的著名猜想,一个博士的课题被

和我们有什么关系

你可能觉得这是数学圈的八卦。但"每句话都对、整体跑题"这件事,每个常用AI的人都熟:

它写的代码跑通了测试,却不是你要的功能;它写的报告格式正确、语句通顺,却绕开了核心问题;它给的方案每条看起来都合理,合在一起解决不了你的事。

所以,AI产出交出去之前,问自己三个问题:

  1. 这件事有没有"校验环节"?代码能不能跑测试,数据能不能溯源,结论能不能交叉核对?

  2. 它回答的是不是我原来的问题,还是一个相似的问题?

  3. 如果错了,代价多大?代价越大,越不能省掉人工复核。

另外有三个信号值得持续观察:Astra正式发布后,那10项成果能不能通过外部检验;森多夫猜想证明的同行检验进展,盯陶哲轩的博客更新就好;以及Tsimerman会不会是最后一个加盟AI实验室的顶级数学家——大概率不是。

写在最后

这个夏天的数学圈有点热闹。有人看到AI的狂飙,有人看到一个博士的青春提前散场。我看到的是一件更清楚的事:AI已经从"帮你找资料"跨进了"独立出成果",但检验成果的尺子,暂时还握在人类手里。

这波AI证猜想,你觉得哪一次最可信?评论区聊聊。

内容由AI生成

精选参考来源

1. 怎么看森多夫猜想(Sendov's Conjecture)已被AI、Lech Mazur、陶哲轩攻破?

2. 怎么看森多夫猜想(Sendov's Conjecture)已被AI、Lech Mazur、陶哲轩攻破?

3. 午夜#学术新闻# 不知道有没有正在做森多夫猜想(Sendov's Conjecture)的朋友,这里有个说不上好是不好的消息

4. 怎么看森多夫猜想(Sendov's Conjecture)已被AI、Lech Mazur、陶哲轩攻破?

5. #AI攻破80年数学难题#OpenAI官方宣布,其一个全新的通用推理模型,成功推翻了一个困扰数学界近80年的著名几何难题

6. OpenAI证明了图论中著名的“循环双覆盖猜想”,这个数学进展还是挺大的

7. 如何评价代数几何著名猜想「雅可比猜想」被AI证伪?如此简洁、可独立验证的数学发现意味着什么?

8. 炸裂!OpenAI宣称其新大模型解决了10个菲尔兹奖级别的数学问题

9. #OpenAI数学翻车##陶哲轩早有预警##AI证对了一切却答错了题#今天科技圈最戏剧的一幕

10. 如何评价 Anthropic 宣布将黎曼猜想的已知下界从 41.6% 提高到了 67.2%?

11. 如何评价数学家陶哲轩说:AI是被过分夸大的预测机器!AI的数学原理不是最先进的,而是19世纪数学?

12. 如何评价数学家陶哲轩说:AI是被过分夸大的预测机器!AI的数学原理不是最先进的,而是19世纪数学?

13. 陶哲轩在2026年国际数学家大会上的公众演讲《人工智能时代的数学》

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章