OpenAI一次性公开722篇数学手稿,涉及黎曼猜想等顶级难题但仍待验证
源自284位全网作者
10-08 19:33
精选参考来源
1
宽窄观察#OpenAI 一夜攻克722个数学难题#这篇别跟着“数学大爆炸、古典数学已死”起哄。OpenAI 把 openai/math 一锅端出来:722 篇手稿、372 个结果族、约 4000 个问题、平均每个结果约相当于 ChatGPT Pro 思考 3 小时、部分附 Lean、模型不具名——这是“研究辅助工业化”的里程碑,不是“AI 取代数学家”的丧钟。先泼三盆冷水。第一,准黎曼不是黎曼。仓库 003 给的是 ζ 与所有狄利克雷 L 函数在 Re(s)>7/8 无零点,另有 11/12 版本并一致排除朗道-西格尔零点;离 Re(s)=1/2 的完整黎曼猜想还差整条临界带,离“拿菲尔兹”也还差同行逐行审。数论意义确实大——固定宽度无零点带、统一消西格尔零点,比过去贴着 Re=1 越收越窄的老区域猛得多,但“准”字不能省。第二,霍奇、BSD、挂谷都只是特例或待核。CM 阿贝尔簇/ K3 乘积的霍奇、按密度覆盖部分椭圆曲线族的 BSD、三维极大+四维豪斯多夫挂谷,仓库里是“声称证明”;其中霍奇、四维挂谷、有理数域希尔伯特第十、部分 BSD 未附 Lean 或仅部分形式化。OpenAI 自己 README 都写“未形式化结果可能有问题”,自媒体直接写“攻克千禧难题”属于标题党。第三,形式化覆盖率别被平均数骗。按族算 372 里有 235 族有 Lean 说明页、约 63%,按篇算约 330/722、46%;而且 Lean 页常只覆盖主定理,不覆盖应用推演。准黎曼形式化注明“后续应用不在范围内”,唯一游戏、自由群因子、π 无理性指数等主结论形式化了才算硬,其余先当预印本假设。再批发布姿势。IAS 下属数学与 AI 独立咨询组 9 月建议很清楚:放非实验室控制的学术库、公开模型名、提示词、思维摘要、耗时、算力、失败率;OpenAI 这次只做到一半——给 10 份推理摘要、给平均 3 小时算力、给 BibTeX 和版本留痕,但模型不具名、提示词不公开、仓库在自己 GitHub、4000 题里多少尝试多少失败不拆开。顾问组声明也专门说“给建议≠认可结果、≠认可发布流程”。结合 8 月十题、9 月纳维-斯托克斯抢发、40 位数学家闭门会、Buckmaster/Alpöge 署名争议的大背景,这次仍是“先扔仓库、再让人类阅卷”,营销味大过学术礼数。但也不能写成“全是忽悠”。平均 3 小时出一个可形式化候选、两周批量扫 372 族,说明前沿模型已经不是定理证明玩具,而是能提候选、补技术细节、做大量穷举与归约的研究流水线;Lean 把“人读不读得动”和“逻辑对不对”拆开,未来数学审稿会变成“机器先验、专家再解释”。真正值钱的不只是 7/8 无零点,而是它把数论、几何、TCS、数学物理放进同一个自动研究-形式化闭环。人类数学家的角色会从“从头推证明”转向“出题、判题、翻译、归因、挑反例”——谁会写规格、会验 Lean、会把 AI 输出接回学科脉络,谁才不会被淘汰。OpenAI 这波不是“数学已死”,是“不做形式化、不公开提示、不交失败率的数学发布该死”;722 篇里哪怕最终只有 50 篇经住同行审,也够改写多个分支,但现在就开香槟的,喝的只是 GPU 热量。 网页链接
2
华尔街日报:OpenAI发布数百项数学成果,突破与学术争议同时扩大据这篇报道,OpenAI在宣布解决一道“千禧年大奖难题”约一个月后,于10月6日晚集中公开大量AI生成的数学证明。数学界既震惊于成果规模,也担忧企业竞争正在改变数学研究的方式与价值。- 一次发布722篇论文,涵盖372组数学成果。 OpenAI称,模型共接受了约4,000道问题,研究涉及数论、代数几何等领域,并报告了与剩余五道千禧年难题中三道有关的进展,其中包括黎曼猜想。这里的“相关进展”并不代表三道难题都已解决。- 顶尖数学家给予高度评价。 罗格斯大学教授Alex Kontorovich认为,如果相关黎曼研究成果由人类完成,足以获得菲尔兹奖。报道同时呈现了学者仍在消化、审视这些证明的过程。- 企业竞赛引发信任与成果归属争议。 OpenAI称,它是在听说Anthropic已解决至少一道千禧年难题后,才投入数百万美元算力开展攻关。一名学者质疑此前的纳维–斯托克斯证明可能利用了其未发表研究,OpenAI予以否认。- 数学界担心研究被变成模型营销。 二十多位菲尔兹奖得主联名发表公开信,警告AI企业争相攻克难题的做法可能损害数学研究的核心目的。一些学者也担心自己的工作被抢先发表,开始赶着公布AI辅助研究成果。- OpenAI调整发布方式,但保留内部测试。 公司参考独立数学顾问委员会的建议,整理成果,并为10项结果提供推理过程摘要;对于委员会要求停止使用专有模型测试高等数学问题的建议,公司没有接受。文章呈现的核心问题是:当AI能够批量生成高水平证明,数学界需要重新安排验证、理解、成果归属和研究方向,而这些规则正在受到科技公司竞争速度的冲击。感觉人类真的是没啥事可干了。你干得再好也打不过AI模型。这是一个教授的评论,burton rothberg|10小时前这次集中发布的成果,所解决问题的广度和难度令人惊叹。其中一项是希尔伯特第十问题。这道题由大卫·希尔伯特在20世纪初提出,是数学界的一座标志性丰碑。据称,他们已经证明:不存在一种通用算法,能够求解有理数域上的整系数多项式方程。仅凭这一项成果,就足以让一位人类数学家成为传奇。此外,他们在黎曼猜想上也取得了重大进展,缩小了ζ函数零点在“临界带”内实部的可能取值范围。还有许许多多其他成果。这是我有生以来见过的最大数学进展——而我已经快80岁了!
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹