今年8月,如果你关注arXiv,大概率已经注意到不对劲:“xx猜想被解决"出现在时间线上的频率,越来越像一份营销日历。OpenAI一周,Anthropic一周,中间还夹着陶哲轩亲自下场。8月20日,arXiv上一篇论文给一个在微分几何里悬了近百年的难题画上了句号——而几乎同一时间,另一个人用AI独立找到了同一个问题的另一条路。这篇文章以这一天为锚点,回头盘一盘这个"猎杀猜想月”:哪些成果是真金,哪些还得再飞一会儿,哪些已经被证实是乌龙。
8月20日最重要的一幕:两条路登上同一座山
先说被解决的是什么。Hopf积猜想问的是一个很直观的问题:能不能给S²×S²(两个球面的乘积)配上严格正的截面曲率度量?
正曲率可以粗略理解成"圆滚滚"——球面就是典型代表,上面的三角形内角和会超过180度。这种几何在高维极其稀缺:此前在4维,已知能带正截面曲率度量的只有S⁴和CP²。Hopf在1930年代提出的这个老问题就是:两个正曲率流形的乘积,还能不能保持正曲率?
几十年里,悲观派一度占上风:在乘积度量附近扰动一下,并不能得到正截面曲率,所以一度很多数学家对这个问题是持悲观态度的。知乎与之相关的还有丘成桐的猜想(非负截面曲率能否提升为正)。

8月20日,Brendle与Hung挂出arXiv:2608.19068《A metric on S²×S² with positive sectional curvature》,给出了肯定回答。他们没有用AI,反倒用了科学工具mathematica。微博

更有意思的是平行线:Alpoge差不多同时,独立用AI也找到了Hopf猜想的另一条路,并且他给的那个例子,明显更explicit一些。知乎这个Alpoge,就是此前用Fable 5找到悬了80多年的雅可比猜想反例的人——同一座山,一条路靠人脑加计算机代数,一条路靠AI,前后脚登顶。
"猎杀清单"全景:分档看
Hopf只是8月的一个切面。把整个月的战报放在一起,分三档看会清楚很多。
较坐实档。一是Hopf积猜想:8月20日,有人解决了Hopf(积)猜想,Brendle与Hung给出了S²×S²的正曲率度量。微博二是森多夫猜想:证明在GPT-5.6 Pro辅助下完成,配有约9万行Lean 4形式化代码。知乎8月12日,陶哲轩发博客消化,把证明简化到约1.5万行,还发现这条路径连带解决了1972年的Phelps-Rodriguez猜想。三是668阶哈达玛矩阵(8月13日):Alpoge和两个人类伙伴带着Claude,打破了2005年以来的僵局,顺带扫清2000阶以下全部悬而未决的阶数;Epoch AI已把这道题暂时标为"由AI解决",如果确定解决,这将是FrontierMath基准测试中50个开放问题被AI解决的第四个。知乎

森多夫猜想被AI解决后,一位博士期间课题正是该方向的答主写下:“Sendov猜想是我博士期间的课题,Sendov猜想被Lech Mazur用AI解决了,我的青春结束了”。知乎
待验证档。S⁶复结构(8月24日):Alpoge挂出一篇100多页、大概率由Claude生成的论文,如果这篇论文正确,那么它和Campana-Demailly-Peternell的已发表结论是正面矛盾的,而论文也完全知道这一点,专门用整整一章解释冲突来自哪里。知乎连发布者自己都说:"我个人希望这个构造是对的(因为可以看乐子),但感觉他错的可能性还是不小的。"这是本月最大悬念。
Crouzeix猜想:协和住院医金山木挂出AI生成的预印本,仔细读过这份预印本的学者说得直接:“解决一词是不妥的,是别人判断的正确性,改成发现一词比较合适”。知乎另有一份独立证明arXiv:2608.03841。此外,YTD猜想也声称被AI构造的五维反例证否。哔哩哔哩还有疑似出自Alpoge之手的光滑Caratheodory猜想。
乌龙与争议档。Connes刚性猜想的"反驳"闹剧:Nielsen的反驳论文并不成立,带有基本的数学错误,先后被OpenAI的AcerFur和Alpoge驳斥。知乎Shuoxing Zhou同期也独立发现了同一反例(arXiv:2608.0232x)。
黎曼zeta(8月11日):Anthropic宣布把零点可计算验证的已知下界从41.6%推到67.2%,争议点被评论区一语道破——“当个人尝试黎曼猜想时被叫民科,当Anthropic做同样的事就百万浏览”。知乎Yang兄弟8月23日的57页zeta论文,评论区也已经指出问题。知乎
Astra十题发布仅五天,数学界就对其进行了质疑:两名数学家分别独立审查后发现,10项结果中至少2项核心成果未正确引用已有文献中的前期工作,比如球填充问题的核心论证,首次出现在Miller 2016年与合作者发表的论文中。知乎
三条鉴定法则
看了一整月战报,其实可以提炼出三条可复用的鉴定法则。
第一,作者本人能否判断正确性?协和的案例是反例:AI生成的证明,数学正确性作者是不清楚的,就算检查,也只是让AI检查,AI说正确,作者就认为正确。知乎Alpoge习惯随手给出"short certificates"(短小可验证的证书),则是正面示范。第二,与已发表结论冲突时,是否正面处理?S⁶那篇论文专章回应Campana-Demailly-Peternell的矛盾,这个姿态值得等一个结果。第三,第三方能否独立复核?Lean形式化、不同路线的独立构造,都算硬通货。
陶哲轩在2026数学大会(IML2026)的演讲里给这个时代定了调:发布者只发布,消化则由社区兜底。知乎而仔细复盘过Connes闹剧的答主说得更直白:真正要判断,还是需要靠谱人脑来判断。知乎
与此同时,arXiv本身也在悄悄变化
论文洪水在加速。有博主统计,单日arXiv更新的AI领域相关论文已达626篇,覆盖计算机视觉、机器人、人工智能、机器学习、计算语言学5大核心方向。小红书《为什么我停止了每日追更arxiv》被收藏2500多次——不是不关心,是人肉追更已经不可能。小红书
工具侧,有人做了把arXiv论文直接转成大模型可读格式的小项目,距离第一次发布差不多一年,下载量刚刚突破一万。小红书

平台侧则在收紧。5月以来,arXiv对AI生成论文严查,论文出现明显滥用AI的痕迹,很可能会喜提arXiv1年封禁套餐。小红书有答主在知乎甚至预言:传统的期刊体系,学术荣誉体系,必然崩溃。知乎一边是立规矩把关口收严,一边是旧体系被预言崩溃——arXiv自己,也在被这波AI重塑。
观察清单:值得继续盯的四件事
S⁶复结构的验证结论:本月最大悬念,几周内看社区是推翻还是坐实。
Crouzeix猜想两份证明的关系:AI预印本与arXiv:2608.03841,哪条路是对的,还是都对。
Astra引用问题的后续:未引用前人工作的质疑,OpenAI是否回应。
“另一半Hopf猜想”:正截面曲率蕴含正欧拉示性数,这个方向还开放,作为更加困难的问题,仍然有诸位读者、同好大展身手的机会。知乎
8月的arXiv,最有价值的不是"哪些猜想倒了",而是我们看到了一条新的知识生产流水线正在成型:人类出想法,AI做计算,社区做消化,平台立规则。猎杀清单的含金量,最终不看谁杀得多,而看谁的结果经得起检验。