OpenAI烧数百万算力、88小时“攻克”90年千禧年难题,转头被数学家手撕“截胡”:转发“AI数学封神”前,先分清这三层真相

源自298位全网作者

02:44

美东时间9月8日、北京时间今天上午,OpenAI干了一件会被写进教科书的事:一个还没发布的内部模型,带着约1万个AI Agent并行跑了88小时,拿下了七大"千禧年大奖难题"之一——纳维-斯托克斯方程的存在性与光滑性问题。微博这道悬赏100万美元的题,悬了90年,此前七大难题里只有庞加莱猜想被摘牌。量子位

更戏剧的是,掌声还没落地,纽约大学数学家Buckmaster就甩出一份4页声明,指控OpenAI"截胡"。微博上#OpenAI遭数学家质疑#、#OpenAI被质疑截胡数学家成果#先后挂上热搜,知乎一条回答攒了近2000赞、150多条评论;《科学美国人》给的定性是"这可能是数学界至少20年来最重要的一天",而评论区另一边在吵"AI是不是偷了别人的成果"。微博量子位

我把机器之心、量子位、InfoQ、爱范儿四家的完整报道,连同双方的公开声明都翻了一遍。这篇把"确凿的事实"“双方的说法”"还不知道的事"分开摆给你——转发"AI数学封神"之前,值得先花5分钟看完全貌。

OpenAI烧数百万算力、88小时“攻克”90年千禧年难题,转头被数学家手撕“截胡”:转发“AI数学封神”前,先分清这三层真相

先看数字:这道题是怎么被"攻克"的

OpenAI官方披露的信息,密度有点高:

  • 约1万个Agent并行工作,9月1日启动任务,9月5日找到解法,前后约88小时;

  • 全程交换490万条消息、消耗约3000亿输出token,其中纳维-斯托克斯这一题就吃掉270万条消息、1300亿token;

  • 刚发布没几天的GPT-6 Astra退居二线,又花了17小时把整份证明形式化成Lean代码、逐步查漏;

  • 最终放出166页论文,Lean形式化代码同步开源;

  • 研究负责人Mark Chen透露:仅这道题的算力成本就达"数百万美元";

  • OpenAI明确表态:不领那100万美元奖金。

OpenAI烧数百万算力、88小时“攻克”90年千禧年难题,转头被数学家手撕“截胡”:转发“AI数学封神”前,先分清这三层真相

百万美元的题、数百万美元的算力、奖金不要了——历史押韵得很:2006年佩雷尔曼解决庞加莱猜想,同样拒领了那100万美元。机器之心量子位

真正解题的模型更有意思:不是GPT-6 Astra,而是一个8月28日才开始训练、至今没发布的内部模型,官方描述是"能力显著超过Astra、且还在增长"。机器之心爱范儿OpenAI研究员陈立杰——清华姚班出身、IOI全球第一、现在的伯克利助理教授——说他自己年初还预测AI要到2028年前后才能解决千禧年难题,结果进度条直接被拽飞。量子位他的原话是:“这是一个非常不可思议的时代。”

第一层真相:它解的题,可能不是你脑子里那道

纳维-斯托克斯方程描述的是水和空气怎么流动——浴缸排水的旋涡、机翼表面的气流、血管里的血液、天上的天气系统,背后都是它。困扰数学界90年的问题是:一团三维流体,一开始流得很平滑,它会永远平滑下去吗?还是可能在有限时间内突然"爆破"——局部流速冲向无穷大,方程当场失效。

顺带提一个中文互联网特别在意的细节:爱范儿在报道里注明,纳维-斯托克斯方程据传也是韦东奕长期研究的方向,知乎评论区已经刷满了联想。爱范儿

克雷数学研究所的官方题面其实留了四扇门:A、B两扇要求在无外力的情况下证明解"永远不爆";C、D两扇允许你构造一个光滑外力,证明解"会爆"。36氪OpenAI走的是C、D门:构造一个最初静止的平滑流体,施加一个处处光滑的外力,让涡旋不断向中心收缩、被轴向拉长——OpenAI自己的形容是"一根越拧越细的意大利面"——旋转速度持续增大,最终在有限时间内冲向无穷大,而全程总能量保持有限。机器之心最难的地方在于不能靠无限大的外力作弊:加速度、压力梯度、动量传递、黏性这些项必须极其精确地相互抵消,最后留下一个处处光滑的外力。

但划重点:数学家们默认最关心的核心版本——没有外力,流体自己会不会爆——依然没有解决。量子位的总结很到位:按照官方题面,OpenAI可能已经通关;但按照大家脑海里默认的终极版本,它打的又不完全是同一个Boss。量子位而且按克雷研究所的规则,千禧年难题的确认需要论文公开发表后经历至少两年的同行验证。所以此刻的"攻克",只能先打上引号——这是谁都绕不过的流程,佩雷尔曼当年也一样。

第二层真相:"截胡"罗生门,两个版本完全不同

这是过去48小时最炸的部分。综合四家信源,时间线大致是这样的:

8月15日,纽约大学数学家Buckmaster和Anthropic研究员Alpöge(注意:以个人身份参与、自费研究,不是Anthropic的项目)取得突破——证明了三维不可压缩欧拉方程、布辛涅斯克方程、多孔介质方程三类流体方程,在光滑外力下都能发生有限时间爆破;8月22日,欧拉方程的结果通过Lean验证。机器之心菲尔兹奖得主陶哲轩给出"了不起的成就"的评价,还判断:把这套方法推进到带黏性的纳维-斯托克斯方程,看不出根本性障碍。量子位也就是说,路已经快铺到大门口了。两人只差一步:AI生成的初稿证明"质量极差"——Buckmaster形容是他见过最粗糙混乱的数学证明之一——他们原计划再花几周把它改写成人类能读的论文再发布。

然后事情开始加速:

  • 9月初,"Anthropic攻克重大数学难题"的传闻在全网扩散;

  • 9月1日,OpenAI听到风声,把所有未解决的千禧年难题全部扔给正在训练的内部模型,万级Agent开工;

  • 9月3日,Buckmaster主动发邮件给OpenAI澄清:那是两人的私人研究,纳维-斯托克斯还没解决,成果即将发布;

  • 9月5日,OpenAI的Agent完成纳维-斯托克斯证明——在此之前,约100个Agent先花50小时攻下了无外力欧拉方程的爆破,确认这条路线可行;

  • 9月6日,OpenAI研究员Bubeck加入沟通,双方当天下午通了两轮电话。Buckmaster在电话里得知:OpenAI内部模型已经拿到一份约100页的"外力驱动爆破"证明;

  • 9月8日,OpenAI官宣,166页论文上线;同一天,Buckmaster和Alpöge也把自己三项成果的论文和Lean代码提前公开;

  • 9月8日-9日,Buckmaster的4页声明让全网炸锅。

OpenAI烧数百万算力、88小时“攻克”90年千禧年难题,转头被数学家手撕“截胡”:转发“AI数学封神”前,先分清这三层真相

为什么Buckmaster会警觉?因为"光滑外力"这条路线,是数学家Córdoba和Martínez-Zoroa开辟的小众方向,全世界几乎没别人在走,而他和Alpöge一整年的未公开草稿、推导、提示词,全都放在Codex里。机器之心当OpenAI告诉他"我们也是从这个方向解出来的",他当场就问了那个最关键的问题。

三个焦点,双方的说法完全对不上:

焦点一:用没用他们的Codex数据?Buckmaster说,他当面追问内部模型是否访问过、或是否用他们的Codex会话训练过,得到的回答是"模型不会查阅用户数据",但继续追问训练数据时,没有得到明确回应。OpenAI官方博客则说:在两人公开成果之前,OpenAI的研究员和Agent都没有看到过他们的成果,也没有为解题访问特定用户数据——但留了一句非常微妙的话:无法完全排除两人使用OpenAI产品产生的"去标识化数据"曾以某种方式帮助模型训练。量子位

焦点二:要不要把"Anthropic的人"从署名里拿掉?Buckmaster说,OpenAI提过两套方案——要么两人先发欧拉成果、OpenAI次日发纳维-斯托克斯;要么由他单独发表纳维-斯托克斯论文,而Bubeck两次提出把Alpöge排除在作者名单外,理由是他供职于竞争对手Anthropic。Bubeck的回应是:从未要求把Alpöge从"他自己的论文"里除名,当时讨论的语境是"请Buckmaster执笔重写OpenAI内部模型的证明",他说的是"如果Levent不是Anthropic员工,事情会简单得多",联系两人本来就是为了协调发布时间、避免抢发。机器之心

焦点三:有没有威胁?Buckmaster说,当他拒绝方案、表示会公开全部沟通过程后,对方反问"你何必毁掉自己的学术生涯"。InfoQ还留下一句"如果你不希望我保持友善,那我也不必友善"。量子位Bubeck说,"毁掉职业生涯"这句话说过,但没有威胁意味,并且已经道歉。

第三层真相:最重要的事,其实还不知道

吵了两天,有两个点特别容易被情绪盖过去:

一是Buckmaster自己划清了界限:他没看过OpenAI那份166页的证明,没有实锤证据,所以并没有直接指控OpenAI窃取数据——他公开的只是自己听到的话、时间线和收到的方案。量子位有意思的是,连Anthropic的员工Sholto Douglas都公开表示:从技术流程看,OpenAI拿到并利用用户研究数据去影响结果的可能性非常低。

二是"训练数据"这个问题,大概率永远无法自证清白。OpenAI那句"无法完全排除去标识化数据帮助了训练",对每一个付费用户都适用——这就不只是数学家和OpenAI的纠纷了,它是所有把草稿、代码、方案喂进AI工具的人共同的数据边界问题。

知乎评论区已经吵成两派:一派说数学界成了《三体》里的黑暗森林——有人用AI广播了问题的坐标,歌者就会携二向箔而来;另一派说真正妨碍数学发展的是人类还在用古法争credit,AI至少把活干出来了。知乎知乎你站哪派都行,但这场罗生门还没到结局。

跟你有什么关系?三条实际建议

最后落回到我们这些普通AI用户身上,这件事有三条直接相关:

第一,AI订阅的"换代"只会更快,别按买家电的思路买服务。那个碾压Astra的内部模型8月28日才开始训练,OpenAI自己说能力"仍在增长"——意味着你今天掏钱上车的旗舰,可能几周内就被自家新模型掀桌子。机器之心前几天GPT-6 Astra推送时"额度1.5次烧完"的教训还在眼前:续费前想清楚,你的场景是真需要顶配模型,还是中档模型+高额度更划算。

OpenAI烧数百万算力、88小时“攻克”90年千禧年难题,转头被数学家手撕“截胡”:转发“AI数学封神”前,先分清这三层真相

第二,去读一遍你所用AI工具数据条款里"是否用于训练"那行字。Buckmaster的未公开草稿全在Codex里,而OpenAI的官方口径是"无法完全排除"去标识化数据回流训练。你不需要是数学家也会被波及:ChatGPT可以在设置里关闭"模型训练"开关,Claude、Codex也有对应的隐私模式——真正值钱的东西(论文草稿、核心代码、商业方案),放进去之前多想一秒。

第三,接下来有四个信号值得蹲:①166页证明的同行评审和克雷研究所验证进展(按规则要两年);②Buckmaster和Alpöge的后续——他们被抢发的那三篇论文已经公开,但纳维-斯托克斯相关的完整工作还没放出来;③那个"内部模型"何时正式发布,传闻代号Bel;④Anthropic会不会用成果回应——按微博上流传的科普内容,上个月Claude已经在黎曼猜想上把"非平凡零点落在临界线上的比例"推进到了67.25%,两家的AI for Science军备竞赛其实早就开打了。36氪微博

88小时,AI攻克的可能不只是一道数学题,还有人类交出"发现"定义权的速度。如果是你,会把手里没做完的稿子放进AI里吗?评论区聊聊。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章