张大妈

OpenAI数学成果不共享?一文看懂AI科研模式如何颠覆传统

源自83位全网作者

14:45

OpenAI数学成果"不共享"的前提,其实说反了。美国时间10月6日,OpenAI把一个尚未发布的内部模型产出的722篇数学手稿整体挂上GitHub,按结果相关性归成372组,谁都能看。真正没共享的是另一半:模型没有发布,据报道提示词也没有公开。所以这场争议要回答的不是"共享不共享",而是:当一家商业实验室用小时级的速度批量生产证明、把验证和理解整个留给学术共同体时,传统科研那套"共享"规则会发生什么。微博知乎

共享了什么:722篇手稿全量公开,一天后就开始缩水

按仓库README的口径,模型在内部评测中被给予约4000个开放研究问题,经聚合和重要性门槛筛选后形成目录,平均每项结果约使用3小时ChatGPT Pro思考算力。这批成果覆盖理论计算机科学、数论、几何、数学物理等17个领域。里面不乏真正的大名字:准黎曼猜想、四维挂谷问题、唯一博弈猜想,任何一个坐实都足以成为相应领域的里程碑。知乎微博知乎

这份全量公开目前还站不稳:发布第二天目录就开始缩水,撤回3篇手稿,一个符号错误让一篇论文的核心论证失效,连带两篇依赖它的论文一起下架,另有14篇修订、13篇更新引用,目录降至719篇。所谓"准黎曼"结果也要先泼冷水:它只是证明了ζ函数在θ=7/8右侧无零点,与真正的黎曼猜想(θ=1/2)仍有距离,"证明了黎曼猜想"的说法不成立。知乎知乎

没共享什么:模型、提示词和大半的推导过程

验证覆盖并不完整:截至10月7日,只有约42%的主要结论完成了Lean形式化验证——即用计算机程序逐步检查逻辑链条,OpenAI自己也承认,尚未完成形式化的证明可能存在漏洞。过程共享更稀疏:剩下的719份文件里,只有10份附了模型的推理链。换句话说,OpenAI共享了结论,没有共享生产结论的手段:共同体拿到的是海量答案文档,不是可复现的检查工具。知乎知乎

数学家为什么愤怒:生产成果和验证成果变成了不对等的分工

最先感到切肤之痛的,是被"解决"了毕生课题的人。研究了二十多年唯一博弈猜想的达娜·莫什科维茨发现,这份"证明"充斥着难以理解的构造、语焉不详的推理步骤和莫名其妙的文献引用,最后不得不借助另一个AI工具才勉强读下去。人类数学协会(AHM)的声明把火药味挑明:数学家们并没有要求OpenAI做这些工作,一次性发布超过700个文件,不是学术的展示,而是权力的展示。伦敦数学会的措辞温和许多,但落点一致:数学不只是拿到答案,更要实现人类对结论本身、以及得到该结论整套推导过程的充分理解,共同体依靠阐释说明、同行评审与集体核验来确认新结果、形成更深刻的洞见,为后续新发现打下基础。知乎知乎知乎

这不是三个月里的第一次摩擦。8月,OpenAI公布10项数学与理论计算机科学进展,很快就有研究者指出部分成果存在论证缺陷和引用问题。9月8日,其内部模型又宣布给出了纳维—斯托克斯方程存在性与光滑性问题的一种解答,这是七大千禧年大奖难题之一。知乎微博

而9月底,陶哲轩已联合另外24位菲尔兹奖得主发表公开信,警告AI公司正在让数学研究偏离原本的目标。这批手稿上线的次日,陶哲轩把AHM声明以客座文章形式转到自己博客——他并非该协会会员,但"全文转载"这个动作本身被普遍视为公开站队。知乎知乎

被颠覆的到底是什么:"人签字"的机制被绕开了

一个数学成果从论文到知识,传统链条是:投稿、同行评审、发表、讲座研讨、简化并写进教材、再长出新的问题。慢,但每一步都有人签字。现在生成被压到小时级,验证和吸收仍然留在人这边,成本结构就此倒挂——生产的成本崩塌了,理解的成本原地不动。陶哲轩把这叫数学界的"证明消化不良":AI生成命题、证明、反例的速度很快,人类验证、理解、写作、教学、吸收的速度跟不上。他给出的出路是重新定义进步:讲解、建立社区、开辟新方向,应当取代"解出著名难题"成为评价标准。知乎知乎

连机器验证也出现了新的裂缝。有研究者把OpenAI纳维—斯托克斯手稿的自然语言陈述与配套Lean代码逐条对比后发现,Lean实际证明的定理陈述和手稿想证明的命题并不等价。编译通过只证明"写进代码的命题为真",不保证它和原问题是同一件事。同行评审、复现、归因这套过去让论文"成立"的机制,各自出现了新的失效方式。知乎

数学界没有统一:抵制、接触、继续用

抵制不是共识。菲尔兹奖得主马丁·海雷尔态度明确:如果数学家拒绝与AI公司接触,也就很难影响这些公司的行为。更微妙的是,OpenAI自己的独立顾问组——九位学者、含三位菲尔兹奖得主——在手稿上线当天就声明:不代表认可这些结果。各方立场的底色是一个现实:当前最强大的数学推理模型和算力,主要掌握在少数商业实验室手里。知乎知乎

OpenAI方面的回应是继续给台阶:承诺出资办研讨班,资助社区消化这些结果。冲击波也已经溢出数学界:这批成果公开后,不仅全球数学界被震动,加密货币行业也一时紧张起来。知乎微博

接下来该盯什么

可观察的信号有三个:撤回与修订的节奏,形式化比例相对300/719的变化,以及提示词与模型最终是否公开——这三项都来自仓库方公布的口径本身。对多数人来说,最简单的结论是:以后再看到"AI攻克某著名难题",别急着当成教科书新增定理,它现在的准确含义是——多了一份需要整个数学界花几年去读懂、挑错、消化的文件。知乎

这场"不共享"之争,真正颠覆传统的地方在这里:传统科研的共享单位是"论文",共享的前提是可复现、可同行评议、可署名归因;AI科研的共享单位变成了"结果包",生产端小时级、验证端年计,而问题、模型、算力都留在黑箱里。陶哲轩那句"一次性发布700多份文件,展示的不是学术研究,而是权力"之所以传得快,是因为它点破了规则冲突的本质——共享从来不只是公开,它需要一套人来签字的机制。这套机制怎么重建,比这719篇手稿本身更值得等一个答案。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章