165页论文"攻克"NS千禧难题、25位菲奖得主联名反击、同届得主却入职OpenAI:数学界这半个月吵翻了——焦虑AI会不会取代人脑之前,先把"退休写小说""NS已被解决"这三个说法拆开看

源自205位全网作者

10:39

如果你这半个月刷过科技区,大概每隔两三天就能看到一条"AI又解出数学难题":9月8日OpenAI甩出165页论文宣布解决纳维-斯托克斯方程千禧难题,9月23日李永乐老师讲GPT-6 Astra证明弱化哥德巴赫猜想的视频冲到22万播放,9月24日又冒出"AI证明zeta(5)是无理数"。而另一边,25位在世菲尔兹奖得主联名发了一份声明,标题就叫《AI在数学领域的严重错位》,菲奖得主反对菲奖得主,B站相关视频播放二十多万,知乎单个问题播放量数百万。热闹是看到了,但大多数人也仅限于看热闹——AI到底"解决"了什么、数学家到底在反对什么、这跟你每天用AI写代码写报告有什么关系,这三个问题才是真问题,这篇挨个拆开讲。

先把时间线摆正:半个月里发生了什么

事情要从9月8日说起。OpenAI公布了一份165页的数学论文,宣布找到纳维-斯托克斯方程(Navier–Stokes,简称NS)存在性与光滑性问题的解答。 NS方程是克雷研究所悬赏百万美元的七大千禧难题之一,描述流体运动,堪称数学界最难啃的骨头之一,所以消息一出直接炸锅。微博

三天后的9月11日,是整个争议的关键节点:邓煜发布玩笑言论的同一天,25位在世菲尔兹奖得主(占全球三分之一)联合发布声明,直指AI在数学领域的严重错位,陶哲轩等顶尖学者悉数署名。 注意,不是一两位老先生发牢骚,是在世菲奖得主的三分之一集体署名,这个规模在数学史上没有先例。知乎

之后就是连环新闻。9月22日,B站上有视频梳理OpenAI的100多个数学成果与数学顾问组的成立,24.7万播放、七千多赞。 9月23日,李永乐老师发布了那期爆款视频:AI大模型Astra在哥德巴赫猜想证明方面取得突破,证明了刘维尔函数下弱化的哥德巴赫猜想。 同一天,知乎上"25位菲奖得主联合声明"的问题开始发酵,单回答播放量破百万。9月24日凌晨,又有Up主发快报"AI数学新核弹:zeta5是无理数"。 也就是说,菲奖得主声明发出去之后,AI这边的"战报"不但没停,反而一天一个。哔哩哔哩哔哩哔哩哔哩哔哩

数学圈并不是铁板一块,而是裂成了三块

很多人以为这是"数学家 VS AI"的对决,真去翻一圈讨论会发现,数学共同体内部先吵起来了,而且裂得比想象中厉害。

第一块是签名的25位菲奖得主。他们反对的不是AI本身,而是反对把数学难题当商业跑分工具——论文还没走完验证就官宣、算力堆出来一个"攻克"就开发布会。今年新科菲奖得主邓煜就是署名者之一,这位89年深圳籍数学家履历顶尖:IMO金牌出身,北大转学MIT,普林斯顿博士,现任芝加哥大学教授。 他今年刚与王虹一同拿下菲尔兹奖,是中国籍数学家首次获奖、一届双冠,成名作是攻克悬置125年的希尔伯特第六问题——按理说,他是最不需要怕AI的人。知乎

但撕裂就撕裂在同一届领奖台上。同届得主Tsimerman则入职OpenAI,坚信AI将替代大部分人类数学工作。 一个签名警告AI乱象,一个直接去了AI公司,这个画面的冲击力比任何评论文章都直观。知乎专栏

第二块是官方组织,态度和签名者微妙地错位。25位菲奖的声明是他们的私人行为,而美国数学会、欧洲数学会则以官方通告的形式祝贺OpenAI解决NS方程问题。 也就是说,"数学界集体抵制AI"这个流传很广的叙事并不成立——官方在祝贺,个人在抗议,两边都有顶级数学家。知乎

第三块是中间派,代表人物是陶哲轩。他既签了名,又在另一头做事:菲尔兹奖得主陶哲轩宣布SAIR基金会启动开放数学模型计划。 他今年在国际数学家大会的公众演讲里展示了自己年轻时读Bourgain论文的批注页,想说的是,理解的形成恰恰在这些停顿、卡壳、重写的痕迹里。 这个派别的态度可以概括成:AI可以用,但"过程"不能丢,验证不能省。知乎微博

三个流传最广的说法,都得打个折

说法一:“菲奖得主邓煜宣布退休写言情小说”。 这是全网传得最凶的一条,也是错得最离谱的一条。事实是9月11日邓煜朋友圈的一句玩笑,原文为"百合小说",经英文媒体笼统译作"浪漫小说",再转回中文变成"言情小说",两次翻译偏差彻底扭曲了原本的玩笑语境。知乎专栏

注意时间点:这句玩笑发在9月11日,和25位菲奖得主的声明是同一天。他次日已正式澄清:从未打算写小说,且绝不相信AI能解决高端核心数学问题。 一句吐槽圈内焦虑的玩笑,出海转一圈回来,变成了"菲奖得主绝望退休",这是这轮热点里最典型的一次传歪。知乎

说法二:“NS千禧难题已被AI解决”。 这条要拆成两层看。第一层,165页论文宣称的是NS方程存在性与光滑性问题的解答,属于克雷悬赏要求的内容之一,但克雷研究所给出的百万美元的条件是回答四个不同版本的问题其中之一,但是这四个问题实际上相互独立,每个都有价值,而且即使全都回答了,也没法说是完全理解了NS方程。 说人话就是:哪怕论文验证通过、百万美元真发下来,也只是把一个百年大问题的研究推进了一步,离"流体力学之谜被解开"还差得远。第二层,目前学界对论文的独立验证还在进行中,AMS和EMS的祝贺针对的是这项工作本身,并不等于认证完成。知乎

说法三:“AI数学能力已经超过顶尖数学家”。 这个判断下得太早。一位签署了公开信的知乎数学答主看得比较透:ai公司花算力解决这些问题,是因为这些问题最受关注,因此他们就可以以此证明他们模型的能力。 这些问题的关注度本来就是数学共同体几百年攒出来的,AI挑的恰好是性价比最高的"考试题"。真正的数学研究是提出新概念、建立新理论、找到新问题,这一步目前还没有任何模型证明自己能做到。知乎

撕裂现场:比声明本身更值得看的细节

声明只是台面,台面下的裂痕才是这场大战的真实部分。知乎答主Yuhang Liu的判断比多数媒体冷静:25位菲奖联名的同一天,数学界内部的"身份政治"已经开始——自己反对使用AI,所以所有使用AI做数学的人都被他否定。 具体到操作层面,真的会有人直接拒稿AI辅助的论文的,完全不看论文本身的数学价值,这已经不是学术争论,是圈内站队了。知乎

更微妙的是"隐瞒"的风险。一旦被发现使用AI的痕迹(比如TeX文件里有没删干净的AI生成的特征),同样是直接拒,并且会给人留下"不诚实"的把柄。 也就是说,在验证标准成型之前,用AI的人和反AI的人都在承担代价——这恰恰是声明里"严重错位"四个字的现实注脚。知乎

而围墙外面,围观群众的态度又是另一回事。有人真心觉得棋盘已经翻:AI证明了一件事,这些问题的解,在人类知识库里是存在的。只是人类的注意力不够惊人。 这条评论一千一百多赞,是视频的热评之一。哔哩哔哩

也有人在评论区玩梗解构一切:我有一个绝妙的解法,可惜token不够了。哔哩哔哩

还有答主提醒大家别忘了另一股力量:中国的年轻人可以不睡觉通宵达旦地刷AI,一轮又一轮地冲击公开问题, 你们可以吗? 专业数学家在吵该不该用,普通爱好者已经拿AI往公开问题上撞了——这大概才是菲奖得主们真正焦虑的画面。知乎

跟你有什么关系:三个判断和三个观察点

看到这你可能会说,我不搞数学,这事跟我有什么关系。关系恰恰很大,因为数学界这半个月踩的坑,和普通人用AI踩的是同一个。

第一,生成不等于验证,这是所有AI场景的共同软肋。数学界的解法是上Lean形式化验证系统,让机器反过来审机器;你让AI生成的代码、合同、报告,同样需要一条独立的验证路径,"AI产出无人能懂、无人能审"的坑,数学界和写代码的你踩的是同一个。AI极大提升了内容生成效率,却无法同步提速验证与审核——这句话从数学圈传出来,适用范围其实覆盖每一个重度AI用户。

第二,以后再看到"AI攻克XX难题"的标题,先过三道筛子:是原始问题还是弱化版本(这次的哥德巴赫是"刘维尔函数下弱化的哥德巴赫猜想");有没有独立验证(NS论文目前还在验证中);官宣方是AI公司还是学术共同体(前者有天然的发布会动力,后者才有认证资格)。这三道筛子过完,一条新闻的信息量才真正属于你。

第三,别急着焦虑也别急着站队。数学界内部的分歧说明这件事连最顶尖的当事人都没有共识,一个"AI已碾压人类智慧"或"AI只会死记硬背"的斩钉截铁结论,大概率都错了。相比之下,几个可观察的信号更实在:NS论文会不会通过克雷研究所的正式认证;陶哲轩SAIR开放数学模型计划能不能落地成公开可用的工具;OpenAI数学顾问组的下一步是继续刷千禧难题,还是转向新理论构建。哪个先发生,哪个方向就赢了一步。

数学家们吵的是数学的未来,但"AI能解决什么、不能解决什么、谁说了算"这道题,此刻正在被每一个用AI写代码、写方案、写论文的人用行动作答。看懂这半个月的吵闹,至少能让你在下一次"AI又双叒叕攻克人类难题"的热搜里,多稳三秒钟。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章