今天一早,数学圈和AI圈的朋友大概率被同一个消息刷屏:没有预警、没有同行评审、没有期刊,OpenAI 把722篇数学手稿一次性扔上了 GitHub(仓库名 openai/math),覆盖372个此前悬而未决的难题族。 奥特曼的配文只有一句:“我们正进入一个全新的发现时代。”36氪
声量有多大:B站一条解读视频一晚上冲到6万播放、1073条评论;微博上质疑"学术劫持"的帖子拿下1.1万赞,今天还在靠新话题续热度;36氪转载的新智元长文半小时333赞98藏。兴奋派喊"数学已死",愤怒派骂"黑帮行径"。对每天刷 OpenAI 动态、有人还掏着200刀 Pro 的围观党来说,这篇帮你做三件事:把722项成果的含金量拆档、把数学家的愤怒理成时间线、找出跟你钱包和工作习惯真正有关的部分。

先把事实说清:722篇、每题平均3小时算力
按 OpenAI 自己的披露(官方博客 + GitHub 仓库),这批成果全部出自一个未发布的内部前沿模型,绝大多数证明平均只花了约3小时 ChatGPT Pro 级别的"思考算力";多数结果是模型全自动跑出来的。 发布方式是直接上 GitHub,README 里同时写明:结果可能仍有问题,需要人类核对。哔哩哔哩
这个"先扔再验"的发布方式,就是后面所有争议的引线。

含金量拆三档,再谈"数学已死"
第一档:若通过验证,会直接改写教科书的。
拟黎曼方向(Result003,各平台也称"准黎曼猜想"):据新智元解读,模型证明了所有狄利克雷 L 函数在实部 Re(s)>7/8 的整个半平面内无零点,并排除了挡在黎曼猜想路上几十年的朗道-西格尔零点。注意分寸——这不是黎曼猜想本身(目标是 Re(s)=1/2 那条线),但无零点区域一口气推到常数界,是解析数论几十年来罕见的跃进;这项还同步发布了 Lean 形式化验证,也是 OpenAI 承认的少数经过严密人工审查的条目之一。36氪

Basic-SDP 阈值的普通 NP-困难(Result102):理论计算机 2008 年的经典定理(Raghavendra)建立在 2002 年唯一游戏猜想(UGC)之上,“如果 UGC 是假的,大厦就塌"拧了快二十年。这项成果据称在只依赖 P≠NP 的前提下证明了半定规划近似极限本身就是 NP-困难——若成立,等于数学上锁死"人类多项式算法不可能超越这条线”。
第二档:撕开大口子,但不等于攻克。 霍奇猜想只在"复乘阿贝尔簇+K3曲面有限乘积"这类高度对称的特例上被证明(含泰特猜想等赠品);马勒猜想在凸几何这个子领域全维数解决;还有两点 Chowla 型相关性。都是真实推进,但离"千禧年难题被通杀"的自媒体标题差着十万八千里。
第三档:还在验证流程里。 9月以来的纳维-斯托克斯方程、近期被反复转的"多维挂谷"等声明,属于"模型找到了证明+Lean在查"状态。机器可检验、证明正确、学界接受,是三道完全不同的闸门——OpenAI 现在站在第一道门前。
数学家为什么愤怒:不是面子问题
把散在各平台的信息拼成时间线:
今年8月:据《连线》披露,OpenAI 曾秘密召集40位顶级数学家闭门会,议题是"AI 全面超越人类数学家怎么办"。 在场学者回忆气氛是"极致兴奋与极致恐惧并存",并苦苦劝告:别学网红只发推文,按学术规范发表、给人类留消化和验证时间。36氪
9月1日-5日:OpenAI 听说千禧年难题可能有突破,调集约1万个 Agent 猛攻纳维-斯托克斯方程,几天内宣布找到证明。 而 NYU 数学家 Buckmaster 和 Alpöge 沿一条冷门路线做了近一年、刚要发表就被截胡——更要命的是,两人过去一年把大量草稿和推导放进了 Codex 辅助研究。当面质问后,OpenAI 的回应是:没查过特定用户私人数据,但"不能完全排除用户产生的去标识化数据曾帮助改进模型"。这句"不能排除",就是那条1.1万赞质问帖的核心。微博

9月中旬:据微博热议的公开信报道,包括陶哲轩、邓煜在内的25位菲尔兹奖级学者联名发声,陶哲轩撰文直指"AI 在数学领域存在严重错位":承认加速价值,反对只要结果、绕过理解与传承的劫持式发布。
10月7日:OpenAI 无视劝告,722篇直接上 GitHub。一边是 OpenAI 研究员苏炜杰说的"哥白尼式范式转变",一边是纽约大学客座教授 Guillen 骂的"黑帮行径"。36氪
争议的本质不是"AI 能不能做题",而是:公共知识的发现,该不该被一家公司用算力私有化收割,并且剥掉过程、不给验证和传承留时间。
三件跟你自己有关的事
在付200刀 Pro 的:「每题3小时算力」改写的是长链路深度推理任务的上限,不是你日常写表格不出错的保证。它真正对工作党有用的地方在于:数学、代码审计、方案可行性验证这类"值得慢慢想"的硬任务,单次成本被重新定价了——这正是你判断 Pro 值不值的新参照。
拿 AI 干未发表成果的(论文、代码、商业方案同理):这件事把知识产权问题从哲学讨论变成了实例。"去标识化数据不能排除曾帮助改进模型"这句话,就是平台给你的全部承诺。 在把没发表的原创想法喂给 Codex/ChatGPT 之前,先读一遍数据条款。微博
在观望订阅的:同一天,谷歌深夜发低价 Gemini Flash 正打 OpenAI Pro。 马斯克则把 Claude 接进了 Grok。 722篇数学论文同时也是订阅战里的秀肌肉,别把它当纯学术公告读——它改变的是竞争压力,未必改变你的账单。36氪小红书
接下来盯三个信号
两周内看有没有独立数论/理论计算机团队复验 Result003 和 Result102,Lean 形式化的部分验证门槛最低,第一批人类核对结论会先出现在 X 和知乎;
9月纳维-斯托克斯声明的学界正式结论,以及 Buckmaster/Alpöge 路线重合争议有没有第三方审查结果;
OpenAI 对25人公开信的正式回应——它会不会给下一批722篇开同行评审通道,比这一批722篇更能说明意图。
一夜之间真正改变的,可能不是"数学死了",而是"发表"死了:成果开始被算力截胡,人类的过程、验证和传承反而成了稀缺品。判断 AI 做数学的成色,现在下结论为时过早——等第一道闸门被第三方人类通过,再站队不迟。