10月7日,菲尔兹奖得主、加州大学洛杉矶分校数学教授陶哲轩在个人博客转载了一份公开呼吁数学家停止与OpenAI合作的措辞严厉的声明。这份声明出自"人类数学协会"(AHM),陶哲轩本人不是起草人,他的声援方式是全文转载,却让一场原本只在专业圈发酵的争议迅速获得极高关注度。声明里被引用最多的一句话是:一次性发布700多个文件并非学术能力的体现,而是权力的展示。TechsohoDeepTech深科技李建秋的世界
宣战背后的24小时:OpenAI到底发布了什么
导火索在前一天。10月6日,OpenAI在GitHub上一次性公开了722篇数学手稿,全部出自一个尚未公开的内部模型,涉及372个成果组,覆盖数论、几何、代数、理论计算机科学等多个领域。平均每项成果消耗的算力,大致相当于ChatGPT Pro约三个小时的"思考计算量"。但"生成"和"坐实"之间差距很大:仓库最终保留的719篇手稿里,58%的顶层结果压根没有可供机器逐行检查的Lean形式化证明代码。TechsohoDeepTech深科技知乎·小爷毛毛
发布之后的验收环节随即暴露了问题。截至10月7日的最新版本,代码仓库中保留了719篇手稿,其中约42%的主要结论完成了形式化验证。发布第二天就出了状况:10月7日,OpenAI撤回了3篇手稿——一个符号错误让核心论证失效,连带两篇依赖它的论文下架,另有14篇修订、13篇更新引用。换句话说,这不是719个"已解决的问题",而是719份待整个数学界消化多年的草稿。DeepTech深科技知乎·小爷毛毛
这不是第一次摩擦,三个月内冲突三连升级
今年8月,OpenAI曾公布10项数学与理论计算机科学进展,但很快有研究者指出,其中部分成果存在论证缺陷和引用问题。9月8日,OpenAI又宣布内部模型给出了纳维—斯托克斯方程存在性与光滑性问题的一种解答,随即引爆优先权争议:纽约大学数学家特里斯坦·巴克马斯特公开质疑,OpenAI抢先推进了他与Anthropic研究员莱文特·阿尔珀格正在开展的工作。9月11日,陶哲轩、邓煜等25位菲尔兹奖得主发表联合声明,警告AI企业把解题作为能力评测标尺、大力推进的做法正在伤害数学研究。DeepTech深科技Techsoho澎湃新闻
需要澄清的是,这一连串动作不等于"数学界反AI"。陶哲轩作为积极探索AI数学应用的研究者,长期支持利用大模型和形式化工具推进研究,但同时反对将数学难题变成单纯衡量模型能力的竞赛。他10月6日发在Mastodon上的帖文里,真正公开的是对"污染"的担忧:一个被解决的问题,没办法变回未解决;哪怕只知道解是存在的,寻找其他路径的努力就已经被污染了。他声援的不是"AI不行",而是一家公司不该单方面决定整个学科消化成果的节奏——这个说法放在任何依赖AI产出的领域都成立。DeepTech深科技知乎·小爷毛毛
数学界自己还没有共识
OpenAI邀请数学家组成的咨询小组AGMAI,在发布当天专门发表声明,强调其咨询工作不代表认可OpenAI的研究方式;相较AHM的抵制主张,它更倾向于通过沟通建立规范。菲尔兹奖得主马丁·海雷尔认为,如果数学家拒绝与AI公司接触,也就很难影响这些公司的行为。图灵奖得主杨立昆则持不同看法,认为AI让数学进入了新时代——这场交锋,两边都还没说服对方。圈内人都没有结论,站队式的"全面抵制""带头宣战"反而是传播中最先跑偏的部分。TechsohoDeepTech深科技智东西
对普通人来说,这是一场现成的挑工具质检清单
第一个标准:它给出的东西能不能被验证。这次争议里最硬的教训是,最强大的实验室以小时级批量"生产"证明,仍有超过半数的顶层结果连机器可检查的形式化都没有;即便编译通过,计算机确认的也只是形式化推导逻辑自洽,被验证的命题和论文原意是否同一件事,仍要人工核实——机器验证都有"翻译错位",何况只给结论不给过程的聊天工具。落到日常:写作、查资料、写代码、做决定,优先选能标注来源、展示推理过程、区分AI生成与人工核验内容的工具;医疗、法律、财务、作业这类高风险场景,自己复核不了的输出,先交叉验证再采信。DeepTech深科技
第二个标准:看透明度,也看它敢不敢记录错误。这批结果出自公众无法访问的未公开内部模型,外人无法复现生成过程,何时发、发什么、发多少全由一家单方面决定。反过来看,OpenAI次日公开撤回3篇、修订14篇,"承认错误并留痕"本身反而是这份清单里难得的正面信号。挑AI工具时,说明底层模型、公布能力边界和错误记录的,比只喊"全球最强"的更值得信任。知乎·小爷毛毛
第三个标准:按场景选,别为"最强"光环付溢价。用户端的真实痛点从来不是工具不够多:小红书上那些收获大量收藏的AI工具攻略,反复强调的就是一句话——工具不是越多越好,关键是按任务选。下载渠道同样要留心,热度越高的工具,应用商店里同名仿冒越多,认准官方名称和开发商再付款。还有一条教训就来自这个热搜本身:中文传播里,“陶哲轩转载声明"被层层加工成"陶哲轩牵头人类数学协会、数学界集体行动全面抵制OpenAI”,连未经认证的账号也敢把"集体"当成既成事实。选工具和选信息是一个逻辑:重要结论,找原文、找原链接,别让转述替你下判断。小红书微博·九野天目
争议的边界也要说清:截至10月10日,这批手稿仍在逐篇撤回、修订和核验之中,所谓"准黎曼猜想"等突破是否坐实,要等数学界按年去裁决——OpenAI声称证明了准黎曼猜想,这与完整的黎曼猜想仍有差距,只有"如果结论属实"才谈得上解析数论的重大突破。此外,“OpenAI正面临非法剽窃与侵犯版权等诉讼"是AHM声明给出的背景表述,不是本次事件独立核实的事实。所以"怎么选靠谱AI"不用等这场争论分出胜负:在标准未定的几年里,把任何AI的产出当"待验证的草稿"而不是"已定论的权威”——AI给出答案的速度越快,答案的责任越要由使用它的人来承担。DeepTech深科技李建秋的世界