“Grok 8分钟推翻30年猜想”,推翻的到底是哪个?把7月图论热搜逐条核对后,我做成了一份台账

源自9位全网作者

10:47

这个7月,图论连着上了好几次热搜。先是「AI 8分钟证伪30年猜想」,马斯克转发引来四百多万人围观;然后是王虹、邓煜拿下菲尔兹奖;再然后是「OpenAI证明50年图论猜想」。但如果你全程刷下来,会发现同一条新闻至少有三个版本在流传:有人说Grok 8分钟推翻的是Dinitz-Garg-Goemans猜想,有人说是Graffiti猜想284,连日期都互相打架。我把源头帖子、技术报告和几篇复盘文逐条核对了一遍,把整个「图论收割7月」整理成这一份台账:哪些已经坐实,哪些还是待复核的候选结果,哪些纯属吆喝。

7月,图论的哪些「老大难」真的倒了

分量最重的是圈双重覆盖猜想。7月11日前后,OpenAI研究员Ethan Knight宣布,GPT-5.6 Sol Ultra用64个子代理,在不到一小时内给出了这个悬置约50年、图论领域最著名的开放问题之一的三页证明。截至7月24日,Jim Geelen与Sang-il Oum已分别发表解释性证明,OpenAI也开源了Lean形式化(cdc-lean)。知乎它还没走完传统期刊同行评议,但已经有图论研究者亲自下场「翻译」证明,证据链的扎实程度是这波里最高的。

最有戏剧性的是Graffiti猜想284。7月23日,Capy.ai联合创始人justin发帖:跑在Grok 4.5 Medium上的智能体Capy,看到有人往Slack群里随手丢了一条图论猜想帖,自己决定「试一把」,8分钟后给出反例——Hoffman–Singleton图。这张图50个顶点、7-正则、围长5,是教科书级的经典对象,数学家盯着它研究了几十年;它的最小对偶度是7,距离矩阵最小特征值是−4,而猜想要求7 ≤ 4,一眼证伪。团队又把引用过该猜想的349篇论文扫了一遍,确认此前从无人发表过这个反例。知乎

“Grok 8分钟推翻30年猜想”,推翻的到底是哪个?把7月图论热搜逐条核对后,我做成了一份台账

最容易被报错误的是DGG猜想。7月22日,研究者Dmitry Rybin在和GPT-5.6 Pro的四轮对话中,找到了这个约30年网络流猜想的反例:一张7个顶点、9条边的小有向图,分数解代价58,而任何满足容量约束的不可分流代价至少60。之后有媒体的报道直接写成:8分钟故事的主角是Dinitz-Garg-Goemans猜想。微博但对照源头帖,Grok 8分钟推翻的是284;它对DGG的角色,是之后独立复现了Rybin的反例构造。这是本轮传播里最容易绕错的结,记住它,营销号就带不偏你。

为什么总是图论先中枪

把这一波排开看,规律很明显:反例构造占了绝大多数,五个代表性案例里只有AlphaProof Nexus是正面证明。原因不玄:找反例本质上是一个搜索问题,在巨大的数学对象空间里寻找满足特定约束的实例。知乎而图论恰好是「可搜索对象」最多的领域:Hoffman–Singleton图、Petersen图、各类强正则图,早就躺在教科书和图录里,参数标得清清楚楚;前面那张7点9边的DGG反例图,就是机器在搜索空间里捞出来的战利品。人类30年没想起来代进去试一把,机器8分钟扫完整本经典图录。

“Grok 8分钟推翻30年猜想”,推翻的到底是哪个?把7月图论热搜逐条核对后,我做成了一份台账

而且这不是7月才开始的。3月,Claude补上了高德纳《计算机程序设计艺术》习题中关于有向哈密顿环的奇数情形构造,让高德纳连发「震惊」;5月,OpenAI证伪了悬置约80年的Erdős单位距离猜想,DeepMind的AlphaProof Nexus则一次性解决353道形式化Erdős开放问题中的9道,全部附Lean证明。图论与组合数学「经典对象多、验证一行搞定」,天然成了AI的第一靶场。用一篇复盘文章的话说:数学开放问题的候选解的边际生产成本,被AI打穿了。知乎

信息流里该信什么:先看验证状态

同一类「AI破解猜想」的新闻摆到面前,先问的不是「AI有多强」,而是「这个结果走到验证的哪一步了」。按这把尺子把这一波排开:

结果

验证状态(截至7月底)

AlphaProof Nexus解决9道Erdős问题

附Lean形式化证明,在陶哲轩维护的AI贡献wiki上持续接受审计

圈双重覆盖猜想证明

人类专家解释性证明+cdc-lean形式化双推进,未过期刊同行评议

Graffiti 284反例

反例本身一锤定音,通过对抗性复核,xAI agent短时复现

DGG猜想反例

作者自陈「仍待独立验证」,Grok后续复现了构造

OpenAI 8月3日「10项菲尔兹奖级难题」

反例、进展、宣称混杂,对外表述明显夸大

最后一行尤其值得警惕。「菲尔兹奖级难题」本身就是个幼稚的提法:菲尔兹奖奖励的是人和有影响力的新理论,难题的解决往往只是副产品。这十项里,有些只是取得实质性进展,但离最终解决还有很长的路。知乎「推翻老猜想」的热潮也一样:候选结果正在通货膨胀,可信知识没有。下次再有人转给你一条「AI证伪百年猜想」,先问它处在上面五档里的哪一档,转发冲动大概能少一半。

也正因为这个对照,2026年的菲尔兹奖更值得品味。当地时间7月23日,国际数学家大会在费城开幕,王虹、邓煜成为首批中国籍菲尔兹奖得主。微博王虹用多项式代数方法和解耦理论做纯分析,邓煜用图论、费曼图和概率论去解偏微分方程。知乎他们靠的不是暴力搜索,而是搭建全新的框架——这恰恰是AI目前不会的部分。AI正在证明自己是最好的「反例猎手」,但定义问题、构建框架的活,暂时还留在人类这边。

接下来一个月看什么,这波热度改变了什么

几个值得盯的信号:圈双重覆盖证明能否走完正式同行评议;DGG反例的独立复核有没有落槌;陶哲轩维护的AI贡献wiki上的持续归类审计——那是目前最接近「权威台账」的一页。8月11日,Anthropic又披露Claude在黎曼猜想上取得「重大突破」,这波浪潮正在从离散数学走向更硬的阵地,噱头只会更大,验证只会更慢。

更实在的变化发生在学习者一侧。小红书上已经出现「看多了王虹的报道诞生了想继续学数学的想法,目前想联系导师研究图论方向」的帖子。小红书这波关注确实把图论的学习资源热度推高了:B站上南大程龚的《图论与算法》在逐节更新,AI整理的图论知识图谱也被不少人收藏。

“Grok 8分钟推翻30年猜想”,推翻的到底是哪个?把7月图论热搜逐条核对后,我做成了一份台账

如果你也想在今年秋天入坑图论,门槛没想象中高,但第一步仍然是分清「新闻里说的」和「已经被证明的」。猜想可以让AI去证伪,把噱头从已确认里筛出来,暂时还得靠人自己。这份台账更新到8月12日,收藏一下,下个月拿它对着新闻看。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章