陶哲轩公开支持抵制OpenAI:他不是起草人,却投出了最重的一票

源自63位全网作者

12:42

10月7日,菲尔兹奖得主陶哲轩在个人博客上全文转载了一份"人类数学协会"(AHM)的声明,公开呼吁数学家停止与OpenAI合作。 但先要厘清一个传播中的失真:陶哲轩不是这份声明的起草人,甚至没有出现在该协会的会员名单里,所谓"牵头抵制"是误传——他的公开支持,是用数学界最有分量的个人博客,把一份原本只在专业圈发酵的声明顶上了公共舆论。 声明里火药味最足的一句话随后在学术圈传开。 而把这句话推成公共事件的,正是陶哲轩的这次转载。Techsoho36氪微博

他声援的并不是"反AI"。陶哲轩真正支持的是一项程序性主张:谁能出题、谁先发布、谁来验证、什么才算"进步"的定义权,不能由一家垄断算力的商业公司单方面决定。 这个判断值得所有关注AI的人认真对待,因为它背后压着三件事:一次算力批发式的发布、一套被无视的咨询机制、一个远未被验证的成果库。

导火索在转发的前一天。10月6日,OpenAI在GitHub上一次性公开了722篇由内部未公开模型生成的数学手稿,涉及372个成果组,覆盖数论、几何、代数、理论计算机科学等领域,其中包含准黎曼猜想、四维挂谷问题、唯一博弈猜想等多道著名开放难题。 评估中模型总共尝试了约4000道数学题,平均每项成果消耗的算力,大致相当于ChatGPT Pro约三个小时的"思考计算量"。DeepTech深科技Techsoho

生成端三小时一项,验证端却当场出了问题。发布第二天,OpenAI撤下3篇手稿:一处符号错误使一个核心论证失效,并连带影响两篇依赖它的论文;另外14篇被修订,13篇更新了引用关系。 截至10月7日,仓库保留719篇手稿,约42%的主要结论完成了Lean形式化验证,而OpenAI在README中承认一些未形式化的结果可能存在问题。 更深一层的麻烦在于:计算机能确认形式化推导逻辑自洽,但被验证的命题是否真的对应原问题的数学内涵,仍需数学家逐行人工判断。36氪DeepTech深科技

两位学者的现场感受把"消化不良"摆上了台面。理论计算机科学家斯科特·阿伦森把10月6日称为"Mathocalypse"(数学末日)。 深耕唯一博弈猜想多年的达娜·莫什科维茨则发现,OpenAI那篇"证明"充斥着难以理解的构造和语焉不详的引用,最后不得不借助另一个AI工具才勉强读下去。量子位Techsoho

这场决裂也不是临时起意。9月8日,OpenAI宣布其内部模型给出了纳维—斯托克斯方程存在性与光滑性问题的一种解答——这是七大千禧年难题之一;纽约大学数学家特里斯坦·巴克马斯特随即质疑OpenAI抢先推进了他与Anthropic研究员正在开展的工作,OpenAI否认不当使用数据,双方至今各执一词。DeepTech深科技

共同体随即发出正式警告。9月11日,陶哲轩、邓煜等25位菲尔兹奖得主发表联合公开信,承认AI有加速研究的潜力,但批评AI公司把解题当作能力标尺急功近利地推进。澎湃新闻

OpenAI并非没有搭过咨询机制。千禧难题风波后,它与普林斯顿高等研究院设立了数学与人工智能咨询小组(AGMAI),而该小组第一份咨询报告就划出红线:前沿AI公司不应该在内部模型上擅自测试高深数学难题。 10月6日发布当天,AGMAI专门发表声明划清界限,强调其咨询工作不代表认可OpenAI的研究方式。量子位DeepTech深科技

也要说清陶哲轩本人的技术立场,否则很容易把他读成"反技术派"。他真正在意的,是数学家能否继续自主决定研究什么,以及如何评价什么样的成果才真正有价值;他的博客在同一天还刊登着看好AI数学前景的学者文章,讨论的门始终开着。Techsoho

他警示的是一种不可逆:一个问题一旦被宣称解决,就再也回不到未解决的状态。据媒体报道,已有年轻学者因为害怕被大模型截胡,不敢公开自己正在探索的方向。量子位

但如果把整件事理解成"数学界铁板一块地封锁OpenAI",那就读厚了。这个喊出抵制的AHM成立于2026年8月,只有约809名会员,且大多数是研究生,并非做出过重要成果的数学家群体,入会须承诺不向商业AI公司提供技术劳动与咨询服务、不发表AI生成的数学文本。 主张接触的阵营同样有分量:菲尔兹奖得主马丁·海雷尔的态度很明确——如果数学家拒绝与AI公司接触,也就很难影响这些公司的行为。 而批评优先权最尖锐的巴克马斯特,自己仍在使用OpenAI的编程智能体Codex辅助研究。36氪TechsohoDeepTech深科技

这就是抵制难以彻底执行的现实基础:当前最强的数学推理模型和算力,恰恰掌握在少数商业实验室手里,批评它的人和依赖它的人是同一批。 一个更添讽刺的细节是,有人把这份"回归人类理解"的声明喂给AI检测工具Pangram,检测结果显示100%由AI生成。 图灵奖得主杨立昆则站在另一端:数学正迎来新时代,形式证明将大幅自动化,重点将转向发展新概念、新抽象、新定义和新猜想。36氪量子位

争论蔓延到课堂之外也有回声。国内数学教育界的落点更日常:深圳大学数学学院创院院长张文俊认为,数学家真正焦虑的是把数学教育带偏——教育的价值不在解出某道具体题目,而在培养人的思维能力。 社交平台上的评论同样分裂:有人讥讽这是"纺织女工砸珍妮机",而被高赞的类比则把问题看得很准——AI让生成候选证明变便宜,却让"判断对不对、有没有新意"的评审变贵,和写代码时coding与code review的成本结构一模一样。 这条高赞评论点破了整场风波的经济学本质:生成与验证之间的成本剪刀差。深圳卫视科创最前沿知乎

接下来值得盯的不是口水战,而是719篇手稿的验货进度:OpenAI开发者社区里已有人重新运行准黎曼结果的Lean检查并报告通过,OpenAI也承诺出资赞助研讨会,帮助数学界消化这批成果。36氪

挂谷问题的两篇手稿还标出了AI此刻的真实位置:OpenAI要继续往前,用的仍是王虹与合作者建立的估计和方法——最新一轮的人类突破建立在上一轮人类工作之上,AI也一样。 所以陶哲轩这次"公开支持抵制",不是宣判AI做不了数学,而是坚持一件规则尚未写死的事:验证、定义与议程的权力,不能由算力持有者单方面改写。只要生成成果的成本持续下降、理解成果的成本居高不下,这场争论就不会止步于数学——正如一位微博博主的判断,这个争议一定会蔓延到物理和化学上的。新智元微博

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章