这一周,AI圈和数学圈正面撞车了。
三条头条级消息接踵而至:9月8日,OpenAI官宣内部模型"攻破"了七大千禧年大奖难题之一的纳维-斯托克斯(NS)问题;9月11日,第二道千禧年难题霍奇猜想被曝"接近解决";还是同一天,陶哲轩、邓煜等25位菲尔兹奖得主联合发布声明《AI在数学中的严重错位》(A Severe Misalignment of AI in Mathematics),直指AI公司把数学难题当成能力跑分广告,正在伤害这门学科。微博澎湃新闻
微博、知乎、B站上,相关话题刷了整整十天。B站一条《千禧年七大难题已经沦为了AI的benchmark》播放量超31万。衍生标题一个比一个吓人——“数学界崩塌”"韦东奕天塌了"都出来了。但信息越炸裂,噪音越大:数字有矛盾、传闻混着事实、双方各执一词。今天把这笔账一次拆清:哪些是实锤、哪些是罗生门、哪些还只是传闻,以及数学家们到底在怕什么。哔哩哔哩
先把十天时间线拉一遍
这轮风波不是从官宣开始的,而是从一条流言开始的:
9月3日:圈内流传"Anthropic解决了重大开放数学问题"。实际上那是纽约大学教授Tristan Buckmaster和Anthropic数学家Levent Alpöge的私人合作,与公司无关。科普中国
9月6-7日:Buckmaster得知研究进展的信息已传到OpenAI,主动联系澄清,却被告知OpenAI内部已经生成了NS问题的爆破证明。追问"第一条prompt什么时候发出的",对方闪烁其词——最终确认,时间在流言传出之后。9月7日,Buckmaster发布公开声明,指控OpenAI可能窃取了他和Alpöge的研究思路。机器之心
9月8日上午:Buckmaster和Alpöge公布了自己的三项证明(欧拉方程等系统在光滑外力下的有限时间爆破),大量使用Codex和Claude辅助。几小时后,OpenAI正式发布NS存在性与光滑性问题的完整证明。
9月10日:在加州理工学院研究者的批评后,OpenAI撤回了对该校一场数学活动的赞助。
9月11日:X上爆料OpenAI接近完成霍奇猜想验证(无官方说明);据称OpenAI和Anthropic两家正在BSD猜想上疯狂竞速。同日(当地时间),25位菲尔兹奖得主联合声明发布,陶哲轩把全文贴在了个人博客,专门页面mathandai.org开放继续联署。微博
9月12日:又有消息称OpenAI已在用内部模型尝试黎曼猜想和P vs NP问题。国内媒体全面铺开报道,知乎多个相关问题冲上热门。微博
十天里,"AI攻破千禧年难题"从一条变成了一串。先别急着信或者不信,看下面两层拆解。

第一层拆解:“攻破千禧年难题”,到底攻破了什么
这是本轮传播中失真最严重的地方。OpenAI确实发布了一份166页的证明文稿,并完成了Lean形式化验证——这部分是实锤。但细节里有四个关键限定词:
第一,证的是"爆破"方向,不是"解出了NS方程"。 克雷数学研究所把NS问题分成四种情形:A和B要求证明无外力情况下光滑解一定存在,C和D要求证明存在某种初始条件和光滑外力、使解在有限时间内爆破(出现奇点)。OpenAI证明的是C和D——通俗说,是证明了"水流着流着,数学描述会在某个时刻崩掉",而且构造里带了一个施加于流体的光滑外力项,克雷的标准表述针对的是无外力情形。所以"解出了NS方程"是彻头彻尾的误传——NS方程作为流体力学工程基石的地位没有任何变化,你家的飞机、汽车设计软件不受任何影响。科普中国
第二,算力数字很震撼,但口径要小心。 OpenAI的说法是:一个未发布的下一代内部模型,约1万个智能体并行工作88小时,消耗上千亿token,刚发布的GPT-6 Astra在这个流程里只负责核对答案、用17小时完成Lean形式化验证。不同媒体转述的消息数和token数有出入,但量级一致:这是用整个团队的算力压制一道题,不是某个模型灵光一现。机器之心
第三,OpenAI自己明确表示不申领那100万美元奖金。 千禧年难题七题各悬赏100万美元,此前只被解决过一个(庞加莱猜想)。OpenAI宣称其结果"确立了官方表述中的陈述C(以及D)",但克雷研究所至今没有认证动作。数学难题的"解决"以学界共识和官方认定为准,不以公司公告为准——这个常识在流量狂欢里被忘得一干二净。微博
第四,霍奇猜想、BSD猜想、黎曼猜想、P vs NP,目前全部是传闻层。 “接近解决”“正在竞速”“已在尝试”,信源都是X上的爆料和媒体转述,没有一份论文、没有一次官宣。把这些和NS消息打包成"AI连下四城"的,都是在带货。
第二层拆解:署名罗生门,两边各有一个版本
比技术争议更点燃数学圈的,是Buckmaster事件里的人性戏码。
Buckmaster版本:他和Alpöge沿着西班牙数学家Córdoba和Martínez-Zoroa 2021年提出的方案研究了一年,“通过光滑外力通往克雷问题"这条路是他们悄悄选定的,据他所知几乎没有别人在做;OpenAI的第一条prompt发在他们的进展信息传过去之后,技术路线却高度相似。更过分的是署名——他声称OpenAI数学家Sébastien Bubeck提出折中方案:可以让他独自署名NS论文,但要移除Alpöge,理由是Alpöge受雇于Anthropic"太烦人了”;当Buckmaster坚持要公开争议时,Bubeck留下了那句刺眼的"你为什么要毁掉自己的职业生涯?"这句话成了整场风波里最重的注脚。科普中国

OpenAI版本:行动始于9月1日,起因是听到了两个千禧年难题被解决的传闻;9月6日完成Lean验证后,以为对方也拿到了解,主动联系希望联合发布并承认对方优先权,沟通中开放了全部prompt和证明;没有为解决此问题调取任何特定用户数据,两份证明差异显著。机器之心

真相可能永远没有定论。但有两句话是OpenAI自己说的,值得所有AI工具用户划重点:一是承认"虽然可能性不大,无法排除源自其产品使用的去标识化数据曾帮助改进模型"——翻译一下:你喂给AI的未公开思路,理论上可能进入训练管线;二是陶哲轩在评论中提到的连锁反应:如果一则谣言就能触发AI公司上万智能体的算力碾压,数学家唯一理性的选择就是不再公开研究方向,几百年开放科学传统会被系统性推向保密。TechCrunch报道称,已经有数学家开始怀疑自己用Codex的记录被喂给了模型。科普中国机器之心
25位菲尔兹奖得主到底在反对什么
先看这份声明的分量:签名名单从1978年的皮埃尔·德利涅一直排到2026年刚获奖的邓煜,横跨48年,包括彼得·舒尔茨、玛丽娜·维亚佐夫斯卡、许埈珥、詹姆斯·梅纳德、孔采维奇、吴宝珠、森重文——基本是在世菲尔兹奖得主的半座名人堂。量子位
然后是流传最广的三个误读,声明原文里都能直接戳破:
误读一:“数学家反对AI做数学”。 声明第一段就承认:过去几个月大语言模型的数学能力急剧提升,已能解决多个数学领域重大的未决问题;后文明确写了AI有加速真正数学研究的潜力。陶哲轩本人就是AI辅助数学最认真的实践者——上台做节目前一分钟还在让Agent生成证明,7月Alpöge用Claude推翻87年历史的雅可比猜想后,他还专门写博客消化解读。今年5月OpenAI内部模型给出悬置约80年的Erdős单位距离猜想反例时,配套论文九位署名数学家里就有一位后来的菲尔兹奖得主。机器之心
误读二:“这是学术权贵保饭碗”。 声明反对的是三件具体的事:匆忙公布结果,来不及写像样的论文、来不及提炼新方法、来不及引用他人在先工作;归属与剽窃问题(最近AI论文署名直接写OpenAI或Claude);以及没有人类数学家愿意接手消化,“传承链"断掉。对应的诉求也是三条程序性要求:给写作和思想提炼留出时间、明确标注所依赖的先前工作、承认需要有人类数学家接手。没有一条是"禁止AI”。知乎
误读三:“AI都能证定理了,数学家慌了”。 知乎上一个1100多赞的回答说得透彻:AI现在的状态是"有可能做出前沿成果,但也有很大概率是错的",需要人工检查推导;即使逻辑上对了,还有一层"没人读得懂"的问题——之前有个案例,AI跑出证明、Lean验证通过,但稿子没人读得懂,陶哲轩花好几天"做翻译",把九万行Lean代码压到一万五,还顺带翻出能覆盖更强猜想的意外收获。那时候"AI出结果、大师出意义"的分工挺体面,问题是最近AI公司开始"吃独食":绕过共同体直接官宣,把百年难题变成发布会素材。知乎
陶哲轩有个"低本底钢"的比喻特别值得记住:核试验前生产的钢材放射性污染极低、近乎不可再生,AI时代之前的数学开放问题也一样——绝大多数问题缺乏研究价值,值得攻的难题被碾过一个就少一个,而军备竞赛本身并没有生产出新的问题。他给AI公司指了另一条赛道:“与其比谁先宣布解决了一个未解问题,不如比谁先宣布发现了一个新的数学洞察”。科普中国
值得注意的是,这已经是数学界今年第二次集体发声:6月2日,16位来自15所大学的数学家发布《莱顿宣言》,首日130人签名、24小时破千人、国际数学联盟正式背书,反对的同样是三件事——未经同意拿论文当训练数据、绕过同行评审直接向媒体发布、不归属先前工作。从16人到1000+人再到25位菲尔兹奖得主,签名在升级,诉求没变过。机器之心

变的是另一边:今年菲尔兹奖得主之一Tsimerman领奖后宣布加入OpenAI,他的判断是"我们所知的那种数学家职业生涯,不会以现在的形式继续存在"——他没在25人名单上。
两边的声音,其实都值得听
反方不只有数学家。Keras作者、ARC Prize联合创始人François Chollet提供了另一个难以量化的证据:他在数学学生中听到一种非常普遍的情绪——“我不想再当数学家了”。AI或许不会在功能上取代数学家,但可能通过压垮年轻一代的心气,造成事实上的断层。机器之心
正方也不是水军。Redis作者在X上公开反驳陶哲轩:一项猜想被证明或反驳后,人们知道的东西就比此前更多,把这称为"知识上的净负面影响"在事实上是错的。微博上600多赞的热帖更直接:“人类进入AGI,OpenAI赢麻”。知乎上也有分析认为AI公司只是"小试身手"——一道猜想花几千美元token费,和万亿级投资相比不值一提,真正用AI证明猜想的将来还是数学家。知乎微博知乎
我的判断是:两边的分歧根本不在"AI能不能做数学"(都能,且越来越强),而在按什么规则做。声明全文里最重的一句话其实指向所有人:"当AI改变工作的方式时,我们如何确保自己不会忘记这项工作最初是为了什么。"数学是第一个被逼到台前、必须把价值观明确写下来的学科——按声明的说法,它不会是最后一个。机器之心
对你有什么用:三个提醒和五个问题
如果你是每天用AI工具干活的人,这场风波里有一条和你直接相关:OpenAI亲口承认无法排除用户去标识化数据帮助改进了模型。未公开的商业思路、创意方向、研究草稿,喂给任何AI之前,先想清楚"提示词即披露"这件事。科普中国
如果你在关注AI概念股:小红书上都有人在问"AI都解决千禧年难题了,(股票)也该涨涨了吧"。把"攻破难题"直接映射到能力和营收,中间隔着认证、商业化、成本三座山——88小时烧掉上千亿token,这笔账目前只在PR里划算。
如果你是单纯的AI动态围观者,下次再刷到"AI攻破XX"的标题,先问这五个问题,30秒完成降噪:
谁认证的? 公司公告≠学界共识≠官方认定(克雷研究所对NS的沉默就是态度)
证的是哪个变体? 带外力的C/D情形和无外力的标准表述,差之毫厘
署名是谁? 写"OpenAI"还是写具体的人,前者本身就是声明抗议的点
引用先前工作了吗? Buckmaster、Córdoba师徒的方案在传播中几乎被遗忘
有验证吗? Lean形式化是硬通货,但"166页文稿没人读得懂"和"验证通过"是两回事
接下来值得盯的信号:克雷研究所是否对NS证明启动评审、霍奇猜想和BSD猜想有没有从传闻变成官宣、mathandai.org的联署人数走势、以及期刊和资助机构会不会像声明期待的那样,把这25个签名当成处理AI生成成果主张的参照点。
一句话总结这十天:AI的数学能力是真涨,OpenAI的流程是真糙,数学家的担忧也是真的——但担忧的从来不是机器会解题,而是解题之后,那些本来会因此被生产出来的东西:方法、教科书、传承,和下一代。
你怎么看这场"AI对决数学界"?是AGI前夜的必然阵痛,还是学术圈的应激反应?评论区聊聊。