10月11日,丘成桐数学与人工智能实验室联盟在清华大学成立。这位清华大学讲席教授、求真书院院长谈起OpenAI此前公开的722篇AI生成数学手稿,给出了自己的判断:这是学者们最兴奋的时代,也是最危险的时代。微博
面对AI对数学研究的冲击,他的态度是迎上去:在大潮上冲浪,而不是躲起来、避开它。他真正担心的是年轻人——机器的强大算力正在让一批年轻学者灰心,不想再做研究。他说,这是很严重的问题。中国青年报
722篇手稿:答案比验证先到
这场争论的起点在GitHub。10月6日,OpenAI一次性公开了722篇由内部AI模型生成的数学手稿,涉及372个成果组,覆盖数论、几何、代数、理论计算机科学等多个领域,其中不乏长期困扰数学家的著名开放难题。微博
按OpenAI自己的披露,模型一共尝试了约4000个悬而未决的数学问题,最终在372组问题上拿出结果,平均每个结果耗费的算力约相当于ChatGPT付费高级版思考3个小时。果壳
分量最重的一项与黎曼猜想有关。素数在数轴上看似杂乱,其分布却由黎曼ζ函数的无穷多个“零点”控制,黎曼猜想断言这些零点全部排在实部等于1/2的直线上。本次手稿声称,实部大于7/8的区域里已经一个零点也没有——离终点仍远,却是人类几十年没能做到的大幅推进;罗格斯大学数学家孔托罗维奇评价,如果是人做出来的,“立刻拿菲尔兹奖,没有任何疑问”。果壳
但“攻克”目前还只是手稿上的声称。发布次日,OpenAI就撤回了3篇——毛病出在一个符号上:该写负号的地方写成了正号,一步关键的抵消因此不成立,另外两篇建立在同一构造上的论文跟着一起撤回,同一天还有14篇做了修补。果壳
722篇手稿没有一篇经过同行评审,也没有人类作者署名;截至10月10日,约42%的结果通过了Lean定理证明器这类机器检查,数学家普遍估计,要把这批稿子真正弄明白,得花好几年。果壳
抵制、叫好与真正的裂缝
数学界的反弹来势汹汹。发布第二天,一个由800多名数学家组成的团体“人类数学协会”发表声明,呼吁同行停止与OpenAI合作,称一次放出700多个文件是在秀肌肉,算不上学术。 菲尔兹奖得主陶哲轩公开反对这波“论文轰炸”,并转发了抵制声明。 在此之前的9月,20多位菲尔兹奖得主已联名发表宣言,批评AI公司把数学难题当成测试模型的考题。果壳36氪
更在意规则本身的还有中国数学界。10月11日的联盟成立仪式上,中国科学院院士、中国数学会会长席南华指出,企业不受学术规则约束,发布成果不需要经过同行严谨核验,甚至允许错误内容流出,给数学界带来了巨大的冲击;但他同时认为不必因此焦虑——新的共识还在形成,数学界完全可以和AI产业界一起,逐步建立起一套各方都能接受的规则体系。中国青年报
数学界内部也并非只有一种声音。多伦多大学的丹尼尔·利特转述一位合作者的感受:“我觉得自己爬了一辈子,现在能飞了。”也有人看到自己研究过的问题被解决,感到的是轻松。
把这些争议放在一起看,真正被摇动的不是数学的难度,而是研究生态的三个环节:验证、激励和传承。等着通读和核查的722篇稿子,落到了整个数学界的头上;有数学家说,身边一批朋友和同事押着开放难题的经费申请一夜之间作废,也开始有人把有前途的方向藏起来防截胡;而“证明—报告—研讨班—教科书”这条传统链条,在解题者自己也讲不清楚的时候几乎停摆。答案变得廉价,提出好问题、校验真伪的能力因此变得更贵。
冲浪不是口号
丘成桐的兴奋与危险并存,但他没有只示警。在同一场合他说,AI可以生成海量证明,却无法像人类数学家一样提出真正有洞察力的新问题,更无法拥有人类在长期研究中沉淀的数学直觉——这种融合了经验、审美和创造力的独特能力,始终是人类研究者不可替代的核心优势。北京日报
他发起的联盟,就是“冲浪”的落点。这个由丘成桐联合国内多家数学科研机构发起的组织,将向数学科学专用大模型研发、AI辅助数学形式化证明与猜想发现、可解释人工智能及交叉领域智能计算等领域发起攻关,推动AI与数学深度融合。 按北京日报方面的说法,联盟已集结超1000位数学家和科研工作者。微博
回到标题里的问题:AI会颠覆数学研究吗?一周多的证据给出的答案是——被颠覆的是答案的生产速度,还没被颠覆的是必须由人来消化的一切。机器写出的证明哪篇是金子、哪篇是废稿,仍要靠数学家一篇一篇读,业内估计要花好几年;而真正危险的,是丘成桐点破的那个问题:年轻人还愿不愿意走这条路。“在大潮上冲浪”,把验证的工具、攻关的方向和属于自己的数学大模型握在手里,是中国数学界此刻给出的回应。