88小时、1万个智能体、约2250万美元烧出一道千禧难题:陶哲轩带25位菲尔兹奖得主集体抗议、克雷官网至今不认——OpenAI又逼近第二道难题,跟风喊"AGI来了"之前先看清这三层

源自240位全网作者

01:24

先说今天(9月17日)刚发生的事

如果你这几天刷到过"AI解决了千禧年难题"的热搜,但一直没搞清楚数学家们为什么集体炸锅——今天这个事件又翻开了新的一页。

9月17日,OpenAI联合创始人兼总裁Greg Brockman公开证实:“我们在另一个千禧年大奖难题上也取得了重大进展”。 当天,多家媒体报道称,这道题极可能是七大千禧难题之一的霍奇猜想,OpenAI员工预计这一问题"可能在不久后得到解决"。 而一周多前,OpenAI刚刚官宣用约1万个AI智能体、88个小时"解出"了另一道千禧难题——纳维-斯托克斯方程(下称N-S方程)的存在性与光滑性问题,也就是那个传说中"韦神的长期研究方向"。知乎知乎

88小时、1万个智能体、约2250万美元烧出一道千禧难题:陶哲轩带25位菲尔兹奖得主集体抗议、克雷官网至今不认——OpenAI又逼近第二道难题,跟风喊

一边是AI圈高呼"AGI时刻降临",一边是陶哲轩带头的抗议声浪一浪高过一浪:25位菲尔兹奖得主的联署声明,到9月16日已经扩大成42位会士牵头、127名数学家联名致信英国皇家学会主席保罗·纳斯爵士,对AI发展速度表示担忧。 千人联署叫停了加州理工的首届数学马拉松,OpenAI被迫全面撤回赞助。知乎知乎

而最有意思的是,真正负责千禧难题认定的克雷数学研究所,官网上N-S方程那一栏至今仍标着"未解决"。 同一个事件,两边看到的东西完全不一样。这篇文章不打算重复"AI好厉害"或者"数学已死",而是把这二十天的完整时间线、账单和各方口径摊开,帮你分清哪些是真实进展、哪些是营销叙事、哪些跟你口袋里的订阅费有关。知乎

一、88小时的"围猎"是怎么发生的

先把这件事的完整时间线捋一遍,很多关键细节在热搜里被压缩掉了:

  • 8月28日,OpenAI刚开工训练一个新的内部模型。知乎

  • 几天后,项目负责人Sébastien Bubeck听到传闻:老对手Anthropic可能已经解出了两个千禧难题。

  • 9月1日,团队把刚出炉的模型直接丢进未解决的千禧问题池。最初并没有专攻N-S——他们把不同命题拆给不同智能体组,有的证解存在,有的找反例,大约100个智能体花了50小时先啃下三维欧拉方程的爆破问题,整个项目才调转枪口。

  • 9月5日,压到N-S上的约一万个智能体,在首批任务启动约88小时后吐出证明:166页论文,N-S单项消耗270万条智能体消息、约1300亿个输出token,GPT-6 Astra又花17小时把证明翻译成Lean代码全部验证通过。 AI证明的核心结论是:一团从完全光滑状态开始运动的流体,速度会在有限时间内冲到无穷大。

  • 9月8日—9日,OpenAI官宣这一结果。

  • 9月11日,陶哲轩在其博客What’s New发布联署声明《A Severe Misalignment of AI in Mathematics》(数学中人工智能的严重错位),邓煜、Peter Scholze、Pierre Deligne、吴宝珠、Maxim Kontsevich等25位菲尔兹奖得主首批署名,名单从1978年的得主一直排到2026年刚获奖的邓煜。 同日,OpenAI撤回了对加州理工"数学黑客马拉松"的赞助。

  • 9月15日,OpenAI前后训练VP Liam Fedus公开回应陶哲轩;Greg Brockman在访谈中给出那个著名对比:当年怀尔斯为证费马大定理在阁楼里秘密独行十年,而今天,“如果一个学者使用公开发布的弱版AI敲开了真理的一条缝隙,拥有千倍算力、下一代私有模型的超级科技巨头,就能在几天内暴力推平剩下的整个长夜”。知乎

  • 9月16日,127名数学家联名致信英国皇家学会主席。

  • 9月17日,Brockman证实"第二个难题取得重大进展",霍奇猜想的传闻满天飞,所有人都在等OpenAI开发者大会(DevDay)上可能掏出的"终极底牌"。

88小时、1万个智能体、约2250万美元烧出一道千禧难题:陶哲轩带25位菲尔兹奖得主集体抗议、克雷官网至今不认——OpenAI又逼近第二道难题,跟风喊

再算一笔账。N-S单项1300亿个输出token,加上此前欧拉方程等整个数学攻坚周,总消耗约3000亿个输出token——按Astra费率折算约2250万美元。 另有报道称总投入接近4000万美元。 而克雷研究所为这道题开的悬赏是100万美元——也就是说,OpenAI花了二十多个悬赏奖金的钱,去抢一个悬赏。为什么要抢?注意时间线里的那个细节:围猎开始的直接原因,是怕Anthropic抢先知乎知乎知乎

88小时、1万个智能体、约2250万美元烧出一道千禧难题:陶哲轩带25位菲尔兹奖得主集体抗议、克雷官网至今不认——OpenAI又逼近第二道难题,跟风喊

二、数学家愤怒的点,跟你想的不一样

很多人以为25位菲尔兹奖得主是怕AI比人聪明——这封公开信最容易误读的地方,就是把它读成"数学家抵制AI",但公开信明确承认:AI在加速真正数学研究方面潜力巨大。 他们反对的是另一件事:AI公司把"解决数学难题"当成模型基准测试来推进,仓促发布、跳过梳理方法、不引用前人工作。知乎微博

真正让事件出圈的,是纽约大学柯朗所教授Tristan Buckmaster的遭遇,这段值得细看。过去一年,他和Anthropic的数学家Levent Alpöge一直在沿西班牙数学家Córdoba和Martínez-Zoroa的思路,推进"用外力让流体在有限时间内失去光滑性"这条路线。8月中旬,两人刚在二维Boussinesq方程和三维欧拉方程上做出爆破结果,陶哲轩评价说,这"尚未完全实现目标,但已经取得了突破性进展"。知乎

9月3日,Buckmaster听说自己的研究可能已经传到OpenAI,主动打招呼:这是私人合作,跟两家公司没关系。三天后他才知道,OpenAI的内部模型已经做完了外力驱动下的N-S爆破证明——用的正是他那条"当时几乎没有其他研究者在坚持"的路线。知乎

88小时、1万个智能体、约2250万美元烧出一道千禧难题:陶哲轩带25位菲尔兹奖得主集体抗议、克雷官网至今不认——OpenAI又逼近第二道难题,跟风喊

更刺眼的是署名条件。按Buckmaster 9月7日凌晨两点半挂上网的公开陈述,Bubeck给了他两个安排:要么他和Alpöge先发成果、OpenAI第二天跟着公布;要么由他单独写N-S论文、证明归OpenAI内部模型,但在Anthropic上班的Alpöge不能署名。知乎

交换条件是他当第一作者、拿充足算力,OpenAI还"建议"他们分那100万美元奖金。Buckmaster拒绝了,把整个经过挂上了网,随后有了那句对话:Bubeck问他"你为什么要毁掉自己的职业生涯",撂下了那句"如果你不想让我友善,那我就不必友善"。知乎

至于大家最关心的问题——Buckmaster和合作者平时写推导草稿用的就是OpenAI的Codex,这些对话有没有被模型看到——OpenAI的声明说,解题模型的训练数据切断在今年7月初、在外部学者成果公开之前,但也承认"尽管可能性很低",无法完全排除去标识化的用户数据曾参与模型改进。 没有证据,时间线和方法却高度可疑。你没法证明自己被偷了,但也没法假装什么都没发生——这是整件事里最让人难受的部分。知乎

加州理工的数学家们造了一个词,叫"粗糙的数学"(rough mathematics):AI公司宣布模型"解决"了难题,但接下来的验证、修正、有时甚至彻底推翻,全靠人类数学家免费做,“这项工作没有得到报酬、没有署名,也没有得到承认”。知乎

陶哲轩这几年反复警告的也是同一件事:不加区分地用强大的"解决方案提取工具",眼前问题确实解决得快,但代价是"损害支撑下一轮突破的研究生态"。 解决一个具体问题只是手段,真正的目标是构建数学理解。知乎

Buckmaster则把这件事叫做数学界的"深蓝对卡斯帕罗夫时刻"。 1997年深蓝赢了卡斯帕罗夫,国际象棋没有死,但棋还是人在下、每一步为什么这么走人讲得清楚;现在的问题是,当AI连"这一步为什么这么走"都说不清、却已经把头条和奖杯抱走的时候,剩下那些验证、修补、传承的人,图什么。知乎

三、这次突破的成色,三个机构给出了三个答案

有意思的是,处理这件事的几家权威机构,口径完全分层:

  • 美国数学学会(AMS)给了台阶:N-S问题的进展是"人类知识的一项里程碑式进步",数学的目的在于增进人类理解。 但它同时强调,这次进展并不是AI凭空完成的突破,而是建立在Navier、Stokes、Leray以及近年Córdoba、Martínez-Zoroa、Buckmaster、Alpöge几代数学家积累之上。知乎知乎

  • 伦敦数学会(LMS)把AI定位成一种强大的新工具:它可以加速探索和发现,但提出问题、创造新概念和形成真正的数学理解,仍然是人的工作。

  • 克雷数学研究所(CMI),真正负责千禧难题认定的那家,态度最谨慎:结果仍然需要公开、经过同行检验,并接受长期验证——官网至今没把N-S标为已解决。

克雷的谨慎不是没有理由的,OpenAI在"宣布解决数学难题"这件事上有前科账本。2025年10月,OpenAI副总裁Kevin Weil曾宣布GPT-5解决了10个此前未解决的Erdős问题,相关说法随后被删除——其中一些问题其实早有解答。知乎

今年8月1日,OpenAI一口气公布10项带Lean证明的数学成果,没几天数学家就发现其中一项量子博弈证明的关键条件方向写反了;另一项高维球堆积的核心论证,被指出早已出现在2016年的工作中,最初版本没注明出处,后来才补上。知乎

这次N-S证明虽然Lean验证通过,但科学记者Kenneth Chang问了句最要命的话:OpenAI有人能对自己的智能体"到底是怎么构造出这个证明的",给出一个让人信服的说明吗?这个问题,目前没有答案。知乎

当然,账本的另一面也有真金白银:今年5月,OpenAI内部模型反驳了已有近80年历史的Erdős单位距离猜想,构造出无穷多反例并引入代数数论工具,经外部数学家检查后,被菲尔兹奖得主Tim Gowers等人称为"AI数学的里程碑"。 所以准确的说法是:AI的数学能力是真的在跨门槛,但"官宣解决"和"被数学共同体承认"之间,隔着一条Lean代码填不平的沟。知乎

四、对立面的声音,也值得听完

这件事在AI圈内部并不是一边倒的谴责。OpenAI前后训练VP Liam Fedus回应陶哲轩:他赞同对概念理解的重视,但"不能用今天AI的能力边界,框定未来的可能性"——如果训练目标从"把题做对"扩展到解释为什么、提炼方法,AI最终可能既给答案也创造新思路。 他还引用了Noam Brown的AlphaGo类比:AlphaGo不会解释自己的走法,但人类棋手研究它的落子后水平明显提高,数学或许也会经历同样的阵痛。知乎

而Brockman在访谈里说的一段话,可能比整个证明更值得普通用户留意。面对"顶尖算力该不该花在象牙塔猜想上、而不是攻克癌症"的拷问——AI证明流体力学奇点确实很酷,但患者在等待新的靶向抗癌药在哪儿?36氪

他吐露了OpenAI内部的算力现实:在GPT-5.5发布前夕,“我们甚至为了算力配额精打细算到每一行代码,痛苦地削减每一个接口的速率限制”。 同时他坚信数学推演是检验"超长链条严密逻辑与反幻觉能力"的试金石——这套推理框架迁移到分子动力学、基因工程,才是通往攻克绝症的路。36氪

顺带一提,OpenAI研究科学家Noam Brown本周刚说,“递归自我改进是我们的第一优先级,遥遥领先”。 数学,就是那个自我改进的训练场。NYU兼科朗研究所的数学教授Scott Armstrong则直言"奇点已经开始了;只不过它的分布极度不均"。知乎知乎

另外泼一盆冷水给"韦神被AI截胡"的焦虑叙事:N-S方程确实是北大韦东奕深耕多年的方向,但这次OpenAI证明的是"外力驱动下"的爆破结果,只是通往克雷原始命题的一步;克雷不认,韦神的研究也远没有被"截胡"。 那些用这件事推导"孩子不用学数学了"的内容,看看就好。微博

五、普通AI用户该带走的三样东西

第一,一套识别"数学营销"的三道门禁。 以后你还会不断刷到"AI解决XX难题",过三关再决定信几成:①有没有形式化验证——Lean通过只能证明逻辑自洽,不能证明价值;②有没有第三方承认——克雷、AMS、期刊同行评议,谁认了;③有没有人能解释"怎么想出来的"——解释不了的就是屠龙术,等验证者免费打工。三关全过之前,一律当成"进展"而非"解决"。

第二,一道算力账。 2250万美元烧一道题,同一时期GPT-5.5发布前OpenAI在"痛苦地削减每一个接口的速率限制"——这两件事是同一枚硬币的两面。你订阅的Plus会员、你的token配额、你的限速,和这些数学马拉松共享同一个算力池。当Brockman说千禧难题是"最严苛试金石"时,意思是:你交的订阅费,有一部分正在被拿去刷数学榜。这不一定是坏事——如果真能炼出反幻觉的长链条推理,你的日常使用也会受益——但下次模型宣传"解决世纪难题"时,你应该知道这既是在炼能力,也是在造势能,尤其DevDay就在眼前,第二个千禧难题的官宣随时可能变成最贵的一场发布会。

第三,一张观察清单。 接下来盯这四件事,比盯"AI会不会取代人类"有用得多。①DevDay上第二个难题到底揭晓不揭晓、是霍奇猜想还是P与NP——后者若被解决,将直接动摇现代全球密码学体系、算法极限以及所有可验证问题的计算边界,你的网银和聊天记录都在内。 ②克雷官网N-S那一栏什么时候变色。③25位菲奖牵头的1400+联署会不会转化为具体的署名和验证规则——数学家们要的恐怕不是"更多交流",是署名、报酬和被记得。 这套规则将来会外溢到代码、设计、写作所有创意行业。④"数学之后下一个学科是谁"——知乎上已经有人押注天文巡天数据和理论物理,这才是这场军备竞赛的下一站。36氪知乎

数学没有死,AlphaGo之后围棋反而更热闹了。真正在死掉的,是"AI进展只能靠AI公司发布会来定义"这个惯性。25位菲尔兹奖得主这次集体站出来,本质上是在争夺定义权:进展算不算、算谁的、谁说了算。这场争夺的结果,会决定你以后看到的每一场"AI奇迹"的成色。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章