10月7日,一个名为"人类数学协会"(AHM)的组织发表声明,强烈敦促数学家停止与OpenAI合作,菲尔兹奖得主陶哲轩在自己的个人博客上全文转载了这份声明。 直接的导火索是前一天——美国时间10月6日,OpenAI在GitHub上线仓库openai/math,首批722篇手稿、372个结果族,全部出自一个未发布的内部模型。 按仓库说明,模型累计被给予约4000个研究问题,公告还把每项结果的平均算力折算成相当于ChatGPT Pro思考"大约三小时"。 但"恐破学术合作"说的不是一天的决裂:撤回赞助在发布前近一个月就已发生,目录在上线次日就减了员,连"机器验证过"的成果数量两份报道都对不上。双方真正撕裂的是三件事:谁来验证、谁署名字、谁来付账。第一财经知乎盒饭财经
验证到什么程度:连"机器查过"的数量都对不上
首版722份手稿,到10月7日目录已变为719篇:3篇撤回、14篇修订——722与719只是同一仓库不同时点的篇数,都不等于被解决的问题数。 一篇Weil类手稿因为一个符号错误使核心论证失效,连带两篇依赖它的K3曲面手稿一起被撤下。 不过撤回说明并没有宣布原命题为假:论证有缺口,不代表命题被推翻,也不排除存在另一条有效证明。 命题没有被宣判死刑,只是暂时没人能替它作保。知乎爱范儿盒饭财经
"机器验证"的覆盖面,两份报道给出的数字差距很大:有报道称722篇里只有162篇的主要结果经过了计算机验证。 另一份逐项核对目录的结论则是约42%(300/719)已形式化、其余依赖人工审阅。 两种口径无法直接换算,但共同指向一个事实:并非全部手稿都带着机器核验的标签。爱范儿知乎
更根本的是可复现性:OpenAI承认并非所有论文都采用了Lean形式化,并在README里写明一些未形式化的结果可能存在问题。 而模型未发布、提示词也未公开,MIT的Andrew Sutherland对《科学美国人》表示,在他人能够复现之前,"单个提示词、单个智能体完成"的说法应视为未经验证。 正面信号也存在:开发者社区里有人重跑了准黎曼结果的Lean检查并报告通过,还有人把一项矩阵乘法结果推广到更一般的域后同样过了检查。爱范儿知乎
但形式化只保证写进Lean的那段代码逻辑自洽,替代不了对命题含义、研究贡献与学术背景的人工审查——“机器查过"并不等于"查的是同一件事”。
最抢眼的两项成果,传播里都被念错了
流传版本里的"OpenAI证明黎曼猜想"不成立:仓库第003组证明的是更弱的准黎曼猜想,对ζ函数及所有Dirichlet L函数给出Re s>7/8的无零点区域,从7/8到黎曼猜想要求的1/2之间仍有距离。 准黎曼是沿这条老路的一次实质推进,不是终点。知乎
挂谷猜想方向同样被简化了:一篇175页手稿直指四维挂谷猜想,另一篇97页瞄准比王虹与Zahl集合定理更强的三维极大函数版本。 三维"集合版"今年才刚被王虹与Zahl攻下、王虹并因此捧起今夏的菲尔兹奖;按报道口径,这两篇新论证仍需独立检验,即便成立也只覆盖四维集合版,五维及以上仍只推进到"维数至少为4"。新智元
值得注意的是,OpenAI的路线里仍然用到Guth、王虹与Zahl建立的估计——AI往前走,用的仍是人类解锁的工具。 两篇稿子的分量,最终取决于社区的检验进度,而不是页数。新智元
被押注最重的可能是唯一博弈猜想(UGC):一篇手稿宣称证明了理论计算机科学里挂了二十多年的这块硬骨头。长期深耕该猜想的学者Dana Moshkovitz第一时间研读了论文,称其充斥着难以理解的构造、语焉不详的推理步骤、让人摸不着头脑的文献引用。 OpenAI发言人自己承认:这堆新结果里,有很多连他们自己的数学家都还没搞懂。 猜想被解开,留下一篇没人读得懂的证明——这正是所有争端的起点。第一财经知乎
决裂不是从10月7日开始的
纽约大学数学家Tristan Buckmaster公开指责OpenAI向他施压,要求他将一位在Anthropic工作的合作者从论文中剔除。 OpenAI项目负责人给出的条件包括让他率先发表成果、成为OpenAI论文第一作者、获得充足计算资源,以及与合作者分享那100万美元奖金;Bubeck事后对《纽约时报》否认威胁,称提议是为了帮助他。界面新闻
加州理工的数学家把这类局面概括为"粗糙的数学":AI宣称解决了难题,之后需要人来验证、修正甚至彻底驳斥,而这项工作没有得到报酬、没有署名,也没有得到承认。 OpenAI随后撤回了对该校一项数学活动的赞助。界面新闻
9月11日,陶哲轩等25位菲尔兹奖得主作为初始署名者发表联合声明,承认AI数学能力的进步,也强调解题应服务于"概念理解与洞见";联名信警告,若没有人愿意把这些方案整合进数学体系,数学家之间的传承链条将断裂。 换句话说,学界对"该怎么发布"早有具体建议。盒饭财经
制度通道其实也已经搭过:9月21日OpenAI宣布成立数学与人工智能顾问组(AGMAI),设在普林斯顿高等研究院、独立于OpenAI运作、成员不从OpenAI领薪。 9月29日AGMAI进一步建议,前沿实验室不要用外界无法访问的内部模型测试高难度数学问题,发布时应披露模型名称、提示词、算力成本与失败记录,且不得把成果发布当作营销工具。 这两条建议直指的就是一个月后的发布方式。界面新闻第一财经
发布之后,OpenAI称此次发布参考了AGMAI的建议,AHM则认为公司忽视了建议的核心前提。 同日OpenAI还承诺出资支持研讨班、会议和专项活动帮助人类消化这些成果,但公告没有列出预算、受资助名单或实施日期。 承诺在先、细则缺位,正是互信流失的具体形状。第一财经盒饭财经
陶哲轩的"领衔"是讹传,他要的不是决裂
中文传播大多写成"陶哲轩领衔发布抵制声明",核对下来事实更曲折:声明出自AHM,陶哲轩本人并不在该协会会员名单里,他的动作是转载。 所谓"领衔",与事实不符。爱范儿
这个协会成立于2026年8月,目前仅有809名会员,且大多数只是研究生。 入会要承诺不向商业AI公司提供技术劳动力、数学知识、咨询或宣传服务,并承诺不发表AI生成的数学文本——概括起来是"加入就得放弃AI"。爱范儿
抵制也远不是数学界的统一行动:组合数学家吉尔·卡莱称这次发布为"数学的一个惊人里程碑",紧接着提醒:证明仍需人类数学家核验、消化。 OpenAI自设的九人独立顾问组(含三位菲尔兹奖得主)在手稿上线时也声明,不代表认可这批结果。 西北大学数学家Bryna Kra代表了多数温和派的立场:AI有望帮助研究者探索过去难以解决的问题,但企业应以更符合学术规范的方式发表成果,让同行能够检查、理解和继续研究。盒饭财经知乎第一财经
破的不是定理,是"生产—验证—传承"的分工
伦敦数学学会10月7日的声明把界线画得很清楚:AI得到的解答,只有被其他数学家理解、核验,并作为恒久知识体系的一部分继续拓展,才能兑现全部价值。 该学会主席同时提醒,处在职业起步阶段的博士生与青年研究者,很可能受到这一轮变化的最大冲击。知乎
矛盾的本质是成本错配:AI让数学成果的生产成本急剧下降,但理解、验证和判断这些成果价值的成本,并没有同步下降。 后一张账单,正在转移给学术共同体,尤其是年轻人。爱范儿
面对批评,OpenAI研究负责人Dan Roberts回应说,希望与数学界进行更多交流。 接下来值得盯住三个信号:撤回与修订的节奏是否放缓、形式化比例是否上升;模型、提示词、算力成本与失败记录能否按AGMAI的要求公开;OpenAI的资助承诺何时兑现预算、名单和日期。界面新闻
数学界面对的已经不只是机器能否证明定理,而是由谁决定研究方向、谁承担验证成本,以及如何确保技术进步仍服务于知识积累。第一财经