猜想一个个被推翻,菲尔兹奖得主还吵起来了:今年AI做数学的清单,我们逐个对了一遍

源自96位全网作者

14:24

7月23日,费城国际数学家大会上,中国籍数学家王虹和邓煜双双拿下菲尔兹奖,这是中国数学家首获菲尔兹奖,也是中国数学界迄今为止获得的最高奖项。新华网可领奖还不到一个月,数学圈的时间线已经被另一种消息刷屏:AI推翻雅可比猜想、AI解决埃尔德什问题、AI推进黎曼猜想……2026年的菲尔兹奖也被人们戏称为“人类的最后一届菲尔兹奖”。中国新闻周刊有意思的是,新科得主们的态度几乎是分裂的。齐默尔曼(Jacob Tsimerman)获奖当天就加入了OpenAI,宣布不再招收博士生,还预测AI会在两年内超越人类数学研究;邓煜则在采访里反复说,AI到目前为止还没给他带来太大帮助。听谁的好?先别急着站队,我们把这份成绩单逐条对一遍。

猜想一个个被推翻,菲尔兹奖得主还吵起来了:今年AI做数学的清单,我们逐个对了一遍

先看成绩单:今年AI到底"解"了什么

从3月到8月中旬,公开可查的节点大致是这些:

  • 3月,菲尔兹奖级别的成果首次被AI完整形式化,Lean生态开始承接"验证"环节(已确认);

  • 5月,OpenAI称AI独立推翻悬置近80年的埃尔德什单位距离猜想(未过同行评审,可信度有争议);

  • 7月20日,悬置87年的雅可比猜想被一个极短的反例推翻,人机协作完成(预印本);

  • 7月下旬,DGG猜想、Batyrev猜想相继出现反例(预印本);

  • 8月10日,Claude挑战黎曼猜想,没证出来,却意外刷新一个37年没动的纪录(结果真实,性质有争议);

  • 8月14日,一位神经外科医生宣称与AI协作,16小时"证明"悬置22年的Crouzeix猜想(归属与验证均有争议);

  • 8月16日,一位民间数学爱好者宣称用AI解决Sendov猜想,陶哲轩帮着AI消化证明(待同行评审)。

分量最重的还是Astra。8月1日,OpenAI公布其内部版Astra在10个悬置十年以上的数学难题上给出新结果,寻找这些解法消耗的算力按Sol API价格计算约为2000美元。机器之心十个问题横跨高维几何、群论、编码理论、量子复杂性、格密码和极值组合,Connes刚性猜想被直接证伪,三个埃尔德什问题被完整解决;249页论文全部过Lean形式化验证,sorry_count为零——没有一步是"请相信我"。

Anthropic的画风不同。Claude试了650个思路,全部失败,但它把黎曼ζ函数临界线零点比例的下界从41.6%推到了67.2%——过去37年,人类数学家把这一比例推进了0.8个百分点。阿行黎曼猜想没被证出来,但这个数字是实打实的推进。

不过这份最漂亮的成绩单,后续有点出人意料:8月7日,OpenAI宣布放慢Astra的研发,公司暂时无法排除它已经达到「临界」网络安全能力。机器之心目前Astra没有公开发布时间。一个能解数学题的模型,因为安全问题被自家按住——这件事本身比它解出的任何一道题都更值得琢磨。

逐条对完,结论其实不复杂:真正走完"同行评审+形式验证"闭环的屈指可数,清单上大部分条目停在预印本或争议区。而且有个明显规律——AI的战果几乎集中在"找反例、推翻猜想",长的结构性证明几乎缺席。这不是巧合。

为什么AI擅长"推翻",不擅长"证明"

反例天生好验证:给出一个例子,代入猜想看它成不成立就行。证明正相反。2012年,望月新一宣称证明abc猜想,600多页,满是自创的定义和符号;审稿花了近9年才刊登,后来两位数学家把他的语言翻译成数学界能看懂的形式,指出存在不可修复的错误,望月新一拒绝承认。直到今天,abc猜想依然不被认为是已解决的问题。格兰维尔说得好:数学证明是一种社会契约,它能不能成立,不完全取决于对错,还取决于数学界能不能读懂你的语言。

高尔斯(1998年菲尔兹奖得主)对这种变化的感受最直接:他已经两次眼睁睁看着GPT-5.6 Pro一次性解出他非常喜欢、认真想过的问题。他说感觉像地毯被从脚下猛地抽走。阿行他给AI的擅长点下过一个更准的定义:知道得足够多,又能很低成本地试错。

邓煜的获奖工作,恰好是AI目前做不了的那一类。授奖理由是他用严格的数学推导,从稀薄气体的硬球碰撞出发推出宏观的玻尔兹曼方程——这是希尔伯特第六问题留下的一条百年路径;邓煜与Zaher Hani、马骁将推导推进到任意长时间。Supreium适创科技每一步都是长链条的结构性推理,这正是当下AI的短板:它能生成几百次尝试,却搭不起一栋百层高楼。

猜想一个个被推翻,菲尔兹奖得主还吵起来了:今年AI做数学的清单,我们逐个对了一遍

陶哲轩给这个困境起过名字。他在费城ICM的公众演讲里提出"证明消化不良":证明的生命周期分五层——生成、验证、阐释、发表接受、经典化,AI能大幅加速前端的生成和验证,后端的阐释、整合、传承还得靠人;数学正在从证明稀缺进入证明过剩。他还有个更早的比方:AI像直升机,直接把人送到目的地,可沿途留下的路标和地图,本身也是解题价值的一部分。

得主们的分裂,其实在说不同的事

表面上是立场之争,细看是领域之别。齐默尔曼最激进:获奖当天加入OpenAI、停招博士生,公开预测两年内AI超越人类数学家。注意他的获奖方向偏数论与代数几何,而最近这波AI成果,恰恰集中在容易用反例和检索验证的领域。

邓煜在另一端。他在ICBS"数学之夜"上说,自己一直在尝试让AI处理正在思考的开放性问题,但到目前为止它们还没带来太大帮助;对中国新闻周刊,他给了更完整的判断:菲尔兹奖应该还是会颁给人类,但未来的获奖工作很可能是人机结合的产物。中国新闻周刊马丁·海尔(2014年得主)在央视采访里说,AI做"从1到N",从0到1的探索仍属于人类;丘成桐的判断更直白:AI是高效工具,无法替代原创思考,且AI目前的成果大多是组合数学——那正是反例容易验证的地方。陶哲轩居中:他全心全意支持设定人机边界的《莱顿宣言》(截至7月底已有3164人签名、国际数学联盟背书),但也反复强调,AI生成证明,人类负责赋予意义。签了名的朔尔策还特意注明:思考数学问题时不用AI,也尽量不读AI生成的文本。

分歧背后是一句常被忽略的话:在反例易验证、搜索空间有限的领域,AI推进很快;在依赖长结构推理的偏微分方程、几何等领域,人类仍握着闸门。得主们不是在立场互喊,是在描述各自脚下的战线。

这对你意味着什么

如果你是看热闹但真在意的爱好者,有三个信号值得盯住。第一,Crouzeix和Sendov这两个争议案例,能不能在半年内走过同行评审或Lean形式化——这是"AI结果"与"数学定论"之间的分水岭。第二,下一代模型能不能碰偏微分方程、算术几何这类结构性硬骨头;如果能,齐默尔曼的两年预言可能提前。第三,Lean形式化生态的铺开速度——形式化是AI成果从"热搜"变成"定论"的唯一通道。

如果你是准备把数学当职业的学生,这波新闻是一次明确的提醒:能被AI复现的标准化证明训练在快速贬值,而提出好问题的能力、消化长证明的能力、判断一个结果可信不可信的能力在快速升值。陶哲轩那句"证明消化不良"翻译过来就是:未来稀缺的不是证明,是消化证明的人。

想补课的话,两个入口:邓煜接受中国新闻周刊专访的全文,讲透了他和AI协作的方式与边界;B站UP主"彭导分享"的挂谷猜想科普,播放量已经386万,把王虹的获奖工作讲得很清楚。

最后引邓煜对"如何衡量研究意义"的回应:一项研究工作的意义由它本身和它解决的问题决定,与解决过程中AI的参与度无关。中国新闻周刊

猜想一个个被推翻,菲尔兹奖得主还吵起来了:今年AI做数学的清单,我们逐个对了一遍

这会不会是人类的最后一届菲尔兹奖,也许没那么重要。更值得盯的是:2030年下一届获奖者登台时,他们的获奖工作里会不会有AI的署名。这个问题的答案,正在被这份成绩单上的每一条慢慢写出来。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章