OpenAI被曝雪藏数百个数学证明、逼近霍奇猜想:对完这条传闻链,三类搞研究的人得先改打法

源自119位全网作者

06:28

过去三天,凡是盯着 OpenAI 的群聊都在被两条链接刷屏:一条说 OpenAI 压着「数百个」AI 证明不发,另一条说它快要解决霍奇猜想了。先把丑话说在前面:这两条目前都不是官方事实,是传闻。但有一条是官方实锤的——OpenAI 联合创始人兼总裁 Greg Brockman 在最新访谈里公开承认,他们在「另一道千禧年大奖难题」上取得了重大进展,只是不肯点名是哪道。36氪

真正值得每个啃过题的人停下来算一算的,不是 OpenAI 下一步发什么,而是这场风波第一次把一种新风险摆上了桌面:你死磕的题,可能早就被机器解出来了,而你是最后知道的那批人。

一条传闻链,先分成三档再谈观点

把 9 月上旬到今天的公开信息按时间捋一遍,谁说的、说多满,一目了然:

  • 9 月 8 日:OpenAI 官宣,一个未公开的内部模型(官方描述为显著超过 GPT-6 Astra)组织约一万个并发智能体,在 88 小时后给出纳维-斯托克斯方程存在性与光滑性问题的解答,并公开 166 页论文与 Lean 形式化证明代码。 官宣同时明确:不申领那 100 万美元千禧奖金。知乎

  • 9 月 11 日:陶哲轩等 25 位菲尔兹奖得主联名发信,批评把数学难题当跑分工具——这一波前阵子已经拆过原文,本文不重复。

  • 9 月 15 日:理论计算机科学家 Scott Aaronson 发长博文,开头是 13 岁女儿的玩笑话「如果我想当数学家,看来大概只剩两周了」,附「过去一个月被 AI 证明或协助证明的开放问题」清单,末尾提到一则传闻:AI 公司在纳维-斯托克斯证明遭遇敌意舆论之后,正把一些「非常重大的问题」的解法压在手里,打算等想出更好的处理办法再说。 沃顿的 Ethan Mollick 转发时特意声明自己平时不传谣,但判断这条消息来源可信度不低。36氪

  • 9 月 16—17 日:Brockman 说出那句「significant progress on another one of these money problems」;同日报道援引 The Information 的消息,OpenAI 内部员工预计公司很快可能在另一道千禧年难题上取得突破,目标据称是霍奇猜想。微博

  • 9 月 16—18 日:数学家 Scott Armstrong 接棒爆料:他「被告知」,OpenAI 至少从 7 月的国际数学家大会(ICM)起,就压着「数百个」数学证明没有发布。知乎

按证据分档,官方说过的只有三件:发布纳维-斯托克斯成果、承认「另一道难题有重大进展」、以及顶不住学界抵制,全面撤回对加州理工首届数学黑客松(Mathathon)的赞助。 点名但属于转述的有:「雪藏数百个」是 Armstrong「被告知」的,「压着非常重大的问题」是 Aaronson 博文里的传闻,霍奇猜想的靶心是「据知情人士」。纯流传、零实锤的是「已经解掉两道」「内部模型代号」这类说法。OpenAI 至今没确认「数百个」这个数字,也没确认霍奇——不确认本身,就是目前最值得记录的信号。36氪

「雪藏」两个字背后,先算三笔成本

为什么一家公司解了题不发?把账摆出来,答案比阴谋论朴素得多。

第一笔:生成与消化的时差。 单看纳维-斯托克斯这一道题:攻克它的那一组约一万个智能体并发工作,距首批智能体启动约 88 小时解法出炉,随后的 Lean 形式化验证又花了 17 小时,仅这一道题就消耗了约 1300 亿个输出 token。 Aaronson 估算,这份 166 页的证明至少烧掉了约 1500 万美元算力。 另一个流传口径是约 3000 亿 token、按 Astra 费率值 2250 万美元——两个数对不上,恰恰说明没人拿得出官方账单。36氪知乎36氪

而对照组是:奖金 100 万美元,且克雷研究所至今仍把这道题列为「未解决」,奖金规则要求论文发表后经过两年社区检验。 也就是说,这道题的「终审」大约要到 2028 年。Armstrong 还说,实验室现在几天之内就能拿出一篇 160 页的论文,外加一份数十万行规模的 Lean 形式化证明。机器出结果按天算,人类读懂结果按年算——在这种产量下,「压着不发」与其说是密谋,不如说是消化不动:发快了没人读得懂,发慢了被指责雪藏。公开一个答案的成本,第一次高过了找到答案的成本。知乎

第二笔:抢跑的代价。 纽约大学的 Tristan Buckmaster 与 Anthropic 的 Levent Alpöge 此前已在相近方向做出带光滑外力的欧拉方程证明,同样做了 Lean 验证,只是没来得及发表。OpenAI 正是听到了风声,才在不到一周内用庞大资源碾压出证明,事后才联系两人提出同时发布。 Aaronson 博文里更值得琢磨的是工程细节:这次攻关不是一上来就一万个智能体——先派约 100 个智能体探路,做出无外力版欧拉方程的解答当跳板,再把主力资源全部压到纳维-斯托克斯上。 探路、跳板、饱和攻击——这是一套工程调度,不是灵感闪现。36氪知乎

第三笔:定价权变了。 当一份证明的算力账单(1500 万美元级)比奖金(100 万美元)贵出一个数量级,OpenAI 图什么?Brockman 给过答案:千禧年数学难题是检验 AI 超长链条严密推理与反幻觉能力的「最严苛试金石」,这套能力最终要迁移到分子动力学、基因工程这类现实问题上。 你在围观的是 benchmark,人家在做的是产品线验收。36氪

不搞科研的人,这周末该盯什么

  • 别混淆两个概念:「Lean 形式化验证通过」不等于「千禧年难题官方解决」——克雷研究所至今不认纳维-斯托克斯;「重大进展」也不等于「解决霍奇猜想」。所有「AI 已破两道千禧难题」的说法,目前都只到传闻档。

  • 接下来的观察点有三个:DevDay 前后,Brockman 口中的「另一道难题」会不会被点名;霍奇或 BSD 猜想会不会公开 Lean 工件;以及 OpenAI 官方会怎么回应「数百个证明」——承认、辟谣,还是继续沉默。

  • 修正一个直觉:这事和「AI 会不会取代数学家」关系不大,和「知识生产的节奏由谁控制」关系很大。数学三百年靠公开交流起家,如今最凶悍的进步方式,是把结果先锁进服务器、等处理方案。陶哲轩的警告就是冲着这个来的:如今只要传出「有人在研究某个问题」,就可能引来大规模 AI 算力的降维打击,在人类项目长成之前将其碾平。知乎

给还在啃题的人:三条今天就能执行的改法

  1. 优先权改法:未成形的思路,从「会上聊、群里发、推文预告」改成「成型前最小范围公开」。Buckmaster 的遭遇说明,现在泄露的不只是 idea 本身,而是在给算力标定靶心。

  2. 数据改法:OpenAI 的回应其实是两句话拼起来的——用于最终解题的模型,训练数据停留在今年 7 月初、完全在外部学者成果公开之前;但官方同时承认,不能完全排除脱敏后的产品使用数据以某种方式参与过模型训练。 这两句放在一起读,结论只有一条:把未发表的工作输入任何 AI 工具之前,按「寄给陌生编辑」的标准处理。36氪知乎

  3. 选题改法:死磕超过一年的题,先做一次「已解排查」——arXiv、Lean 社区、mathoverflow 各轮一遍;知乎那个三万多浏览量的「雪藏证明」问题下,已经有研究者开始把「非常大胆的猜想」发在评论区而不是写进论文里。当一道悬了几十年的题能被 88 小时解掉,读博最大的风险就不只是「解不出」,而是「解出来了,但不知道对面早就解出来了」。

最后留一句这轮风波里最该抄进笔记的判断:Aaronson 说,奇点已经开始了,只是分布得极不均匀。 需要补一句的是:分布不均的不只是解题能力,还有知情权。接下来两年,一个研究者最值钱的第一篇论文,搞不好不是「我解了这道题」,而是「我确认了这道题还没人解」——包括那些没有公开服务器的地方。36氪

内容由AI生成
1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章