陶哲轩们吵了20天,争的根本不是AI该不该做数学:给你一把量新闻的尺子
9月上旬,两条新闻几乎是前后脚砸进中文互联网。
一条是:OpenAI宣布调动约1万个AI智能体、跑了88小时,拿出165页论文,声称攻克了悬赏100万美元的千禧年难题之一——纳维-斯托克斯方程的存在性与光滑性问题,论文和Lean形式化证明一并公开。微博

另一条是三天后:陶哲轩、彼得·舒尔茨、皮埃尔·德利涅、邓煜等25位菲尔兹奖得主联名发表声明《人工智能在数学中的严重错位》。到9月下旬,全球已有近8000名数学家在这份声明下署名。两条新闻撞在一起,最流行的解读是"数学家急眼了,饭碗要被AI砸了"。第一财经陶哲轩博客
如果你当时也是这么理解的,那这20天的进展基本都错过了。9月29日出来的一份正式文件把落点摆得很清楚:争的东西和"抢饭碗"没关系,而是一套马上就能用上的判断标准——看完下面这把尺子,你以后刷到"AI又解了数学难题"的新闻,自己就能量出它值不值得信。
先把误会拆了:联名信到底在反对什么
那份声明开头就承认:过去几个月大模型的数学能力进步显著,已经开始解决多个领域长期悬而未决的问题;声明里甚至明确写着,AI有潜力增强和加速真正的数学研究。他们反对的是很具体的一件事:AI公司把"解决数学难题"当成模型能力的基准测试和营销指标。陶哲轩博客
声明里有句话值得抄下来:解决问题只是实现概念理解和洞察这一首要目标的工具和代理指标。批量生产越来越快的对错结论,可能不是在孕育新思想,反而是在摧毁孕育思想的沃土。第一财经
担心落到实处是三件事。成果宣布得太急,没留下时间做规范写作、提炼新方法、引用前人工作,直接带来成果归属和抄袭问题。没人看得懂的结论堆起来,会挤掉那种读论文读到卡壳、重写、补全中间步骤的理解过程——陶哲轩在国际数学家大会的演讲里展示过自己年轻时读Bourgain论文的批注页,理解就是在那页纸的停顿和问号里长出来的。再就是传承链条会断:就算AI产生了正确又新颖的想法,没有数学家愿意接手发展、整合进知识体系,这些想法永远活不过来。第一财经微博
所以他们的结论不是禁用AI,而是把这些议题交给数学共同体、开发技术的公司和更广泛的社会共同处理。要的是规则和对话,不是抵制。
这把尺子,就是9月29日那份建议
这份叫《负责任地发布AI生成的数学成果》的文件,由一个叫AGMAI的独立小组发布,基于600多份全球数学家的问卷反馈写成。开头第一句就很冲:我们不认可在专有模型上测试高难度数学问题的做法,请求各家停止这么做。文件把AI实验室的责任拆成两层。如果某个成果有数学家完全看懂并愿意负责,那就按传统规矩走:预印本、期刊评审、去报告。如果没人看得懂——现在基本都是这类——就要走一套新的发布规范,里面有五条特别硬:AGMAI官网
第一,先扫文献再发稿。 用模型把证明里涉及的想法和已有文献对一遍,哪怕模型是独立想出来的,也要按学术惯例引用首次提出的论文;证明要重写成传统数学论文的样子,有友好的导言、精确的定理和证明,而不是一堆冗长的自造术语。
第二,放到不受任何AI公司控制的学术仓库里。 永久可引用的编号,版本修改有记录,最好还能评论。
第三,把生产过程亮出来。 用了哪个模型、什么提示词、摘要后的思考链、花了多长时间、估算的算力成本,全部公开。鼓励连清理之前的原始输出一起放出来。
第四,尽量形式化。 形式化产物要符合社区标准;如果来不及,也要写清楚形式化到了什么程度。
第五,说清AI到底是怎么用的。 一次放出很多成果时,还要单独写一份文件,交代模型在同等难度的问题上试过多少、失败了多少、问题是怎么挑的。

拿这五条回头量一下9月初那场官宣,会发现不少事早就露了马脚。88小时、1万个智能体、165页论文,数字倒是给得痛快;但算力成本这一项,不同渠道传出的口径根本对不上,有的说数百万美元,有的说上千万。同一时期OpenAI还预告其内部模型在多个数学领域拿下了上百个长期未解的公开问题,但只是宣布了结果的存在,没有给出细节。AGMAI问卷针对的正是这种情况:一口气宣布一大堆成果,却不交代来龙去脉。AGMAI官网
五条之外还有两条更实在的。谁发的稿,谁出钱让人类看懂:AI实验室要掏真金白银支持研讨会、暑期学校、长期工作组、博士后和学生、专著和长篇综述,钱怎么分由已有的非营利机构决定,不能由AI公司说了算——而且数学界接受这笔资助,不等于认可这些公司的做法。另一条是关于入场券的:用内部专有模型做数学研究,会让实验室跑在整个学科前面,“实际上把数学共同体从自己的学科里排除出去”,所以建议各家向全球数学界提供广泛、公平的模型访问权限。AGMAI官网
以后看到AI数学新闻,就量五个地方:有没有具体的人说自己完全理解这个证明并为其负责;发在公司博客还是可引用的学术仓库;模型、提示词、时间、算力成本公布了几个;前人的工作引没引;失败的账算没算。一条都不占的,基本可以当营销稿看。
这不是反AI。恰恰相反,真正想用AI做数学的人会欢迎这几条,因为它们让结果变得可核验、可积累、可信任——这和写代码的人要求模型给出可复现的构建、可追溯的依赖,是同一种洁癖。
这套规矩不是拍脑袋想的,是吵出来的
有意思的是这套规矩的来路。
OpenAI在这波争议后,找到几位数学家,想建一个自家的外部顾问委员会。谈下来的结果是:不建OpenAI的顾问会,改成建一个独立小组。这就是AGMAI——数学与人工智能咨询组,挂靠在普林斯顿高等研究院,九名成员包括菲尔兹奖得主高尔斯(Timothy Gowers)、海瑞尔(Martin Hairer)、物理学家威腾(Edward Witten)等人。成员不拿报酬,不替任何AI公司代言,只提建议、不做决定,出了事责任还在公司头上。AGMAI官网
海瑞尔在陶哲轩博客上专门写了篇东西解释这件事,里面有句很实在的算计:如果数学界拒绝和AI公司说话,对方最省事的公关话术就是"这帮老古董跟不上时代"。陶哲轩博客
高尔斯的立场更说明"数学家集体反AI"是个误读。9月17日他在陶哲轩博客发了篇《为什么我没签菲尔兹奖得主的信》:他同意声明的大部分内容,也同意确实面临一场危机,但没签。在他看来数学本来就有两种文化,一端以解题为驱动、把概念理解当手段,另一端反过来,声明只强调了一端。陶哲轩博客
他还主动交代自己和OpenAI的数学团队有接触、提前几天拿到过模型、免费用过Pro版本,但从没收过钱。没签抗议信的人,成了给AI公司立规矩的九个人之一——这才是这场讨论的真实生态。陶哲轩博客
另一边,有人已经把规矩用在了自己身上。加州理工有个叫Mathathon的活动,是首个面向研究级数学的黑客松。活动办起来后争议不小,甚至有人写了公开信反对。一周之内,活动组织者、公开信作者和师生坐下来把赛制重做了:主题从"用AI解开放问题"改成"旧问题,新证明"——挑一个解法公认别扭的已解难题,花40小时搞懂,再用两个月做出另一种证明或讲解,交讲解和GitHub仓库,连用过的LLM对话记录都要留档。微博
钱的来路也变了:不再接受任何专有AI模型开发商的赞助,改成给每位参与者发一笔现金补贴,自己决定买算力还是买笔纸。活动定在11月13日至15日,由陶哲轩参与创办的SAIR基金会协办,声明发布前陶哲轩本人看过稿并留了意见。陶哲轩博客

接下来盯两件事,顺便想一件事
一件事是OpenAI手里那批成果怎么放。AGMAI现在的首要任务,就是在帮OpenAI协调"一大批重要数学成果"的发布方式。建议是9月29日发的,接下来几周的发布动作,就是它管不管用的第一场考试。AGMAI官网
另一件是11月中旬的Mathathon。“旧问题,新证明"加"LLM使用全披露”,是目前把AI放回工具位置的最完整一次公开实验。办砸了是谈资,办成了就是范本。陶哲轩博客
顺便想的那件事是:这不只是数学圈的私事。声明里写了,这是所有知识行业都要面对的问题——当AI能直接产出过去靠多年训练才能产出的东西,怎么保证我们没丢掉这些工作本来的目的。写代码、做研究、搞创作,逻辑是同一套。你要求模型给出可复现的构建和可追溯的依赖,数学家要求AI公司给出可引用的论文和算过的失败账,本质上是同一件事:不接受一个无法核验的权威。陶哲轩博客
陶哲轩9月份在博客上发了39篇东西,大部分是各方客座发言——支持AI的、反对AI的、天文系主任的、博士生的。他自己的态度藏在动作里:不站队喊口号,把吵架的人拉到同一张桌子上,然后盯着规矩变成文字。
这一轮吵下来,数学界还没输掉什么,先赢到的是一份可以拿去质问发布者的清单。
(本文信息来自陶哲轩个人博客、AGMAI官网建议全文、加州理工Mathathon联合声明,以及公开报道和社区讨论;OpenAI宣称的具体数字以公开报道口径为准,不同渠道的算力成本说法不一。)