张大妈

OpenAI 175页证明稿刷屏:学生党上手AI数学工具,先学会“核”,再谈效率

源自141位全网作者

10-11 22:11

OpenAI 那份 175 页证明稿刷屏了,但学生最先要知道的不是"AI 证出了四维挂谷猜想",而是这份手稿还没被数学界确认。10月6日,OpenAI在GitHub上公开首批722篇数学手稿。其中一篇长175页,目标直指四维挂谷猜想。 这场热点给出的真正信号是:数学里稀缺的东西已经从做出证明换成了理解、质疑和验证证明——学生党上手 AI 数学工具,也得倒过来学:先学会核,再谈效率。新智元

先别信标题:数字和"版本"要回到原始仓库里对

网上流传的说法多是"解决了 722 个难题",而对照原始仓库会发现口径细得多:722 是首发时的手稿篇数,归入 372 个结果族,由模型对约 4000 个问题的产出筛选而来;10 月 7 日撤回 3 篇后,当前目录剩 719 篇。 篇数不等于问题数,更不等于结论全部成立。今日头条

“攻克黎曼猜想"这类标题也需要降温:第 003 组证明的是更弱的"准黎曼猜想”,即 ζ 函数与所有 Dirichlet L 函数在 Re s>7/8 的半平面内无零点,离黎曼猜想要求的 Re s=1/2 直线仍有距离;被并称为"千禧年难题突破"的霍奇猜想、BSD 猜想,同样只是限定条件下的结果。今日头条

发布方式同样反常——没有预警,没有经过同行评审,OpenAI 直接把成果扔进了公开仓库。 MIT 数学家 Andrew Sutherland 对《科学美国人》的态度是:在他人能够复现之前,"单个提示词、单个智能体完成"的说法应当视为未经验证。 OpenAI 官方博客则回应,正在负责任地推进产出这些成果的模型发布,并将根据社区反馈更新重大科学成果的披露标准。新智元今日头条OpenAI官方博客

这份 175 页的难度,要放回挂谷"一根针掉头"的百年史里才看得懂。王虹与 Zahl 在 2025 年 2 月交出 127 页论文,把三维挂谷猜想的"集合版"推进到一般情形并正式解决。新智元

四维则是另一道坎:此前的维数下界停在 3.059,今年 9 月的满维突破也只覆盖特殊的"粘性"情形,OpenAI 这份手稿要做的,正是从 3.059 直冲满维 4。新智元

验证方式比结果本身更值得学生注意:仓库里约 42%(300/719,为仓库自述)的顶层结果配了 Lean 形式化证明,撤回与修订记录全部公开。 把证明写成计算机能机械检查的语言,"验证"第一次从学术礼节变成了可执行流程。今日头条

10 月 11 日,陶哲轩公开了他在加州理工的《Math 2.0》演讲,恰好给这场热点提供了注解:数学界的许多制度、传统和激励机制,原本都建立在"证明稀缺"的假设上。机器之心

工具地图按"短板"挑,而不是按名气挑

陶哲轩的演讲里还有一句更重的判断:继续盲目地只优化问题求解能力,如今已经在积极损害数学的长期健康发展。 当答案开始廉价,"会算"不再稀缺,"会核"才稀缺。这套判断落到学生手里,就是一张按"理解—计算—画图—形式化"排开的工具地图:通用大模型(ChatGPT、Claude、国产模型这一类)覆盖最广,代数题和应用题基本能接手,但短板是几何题尤其弱——画不出准确图形,辅助线讲解全是文字描述。 所以让 AI 复述定义、生成第二三种讲法、尝试构造反例,比直接要答案值钱。机器之心知乎

计算验证要交给"引擎"而不是模型本身:Wolfram MCP 的做法是让 AI Agent 可以直接调用 Wolfram Language / Wolfram|Alpha,做符号计算、数值计算、绘图和验证,AI 负责推理,引擎负责真算。知乎

几何和函数题先"看见"再推理:Desmos、GeoGebra 画函数图依旧可靠,较新的文本生成几何工具只要一句"作三角形的外接圆并标出外心",就能生成可拖动、可导出、可嵌入的动态几何图——AI 的辅助线思路对不对,拖一拖图形就知道。 至于拍照识别、一步出完整解答的搜题类工具,用在作业和考试前务必先查学校的学术诚信规定:识别和查步骤是反馈,代写作业是红线。知乎

三步日常流程:复述、交叉验证、讲出来

把整场热点压缩成一套三步日常流程。第一步,精确复述:让 AI 先说出定理的条件、版本和失效情形再往下推——连挂谷猜想都分"集合版"和"极大函数版",这份 175 页只是前者,五维及以上也只有"维数至少为 4"。 定理说不精确,多半说明模型自己也没懂。第二步,交叉验证:计算丢给 CAS 重跑,图形拖进动态几何,结论让 AI 构造反例自己打自己;这套动作就是 OpenAI 仓库"Lean 形式化加公开撤回记录"的学习版。第三步,复述输出:合上对话框用自己的话把证明讲一遍,讲不出破绽才算学会。成本上也不必焦虑:仓库说明显示,绝大多数结果出自同一套固定流程,平均每项约使用 3 小时的 ChatGPT Pro 思考算力。 这是研究级问题的量级,学生用它理解概念、核对推导,免费额度完全够用。新智元今日头条

截至发稿,这份 175 页和它的姊妹篇仍在排队接受人类数学家的检验,陶哲轩也提醒,目前处于数学研究前沿的大多数问题仍然没有得到解决,即便投入巨额计算资源也是如此。 学生党不必恐慌"AI 会做题你不会"——公开仓库、演讲幻灯片和这些证明稿本身就是免费教材。AI 大规模生产答案的时代,最先吃到红利的,是把"能看懂、能验证、能讲清"练成肌肉记忆的那批人。机器之心

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章