这个周末,OpenAI 兴趣圈里刷屏的不是新模型,而是一封信。9月11日,陶哲轩、邓煜等菲尔兹奖得主在 mathandai.org 联署发表公开信《A Severe Misalignment》(人工智能在数学中的严重错位),矛头直指 OpenAI 和 Anthropic:把千禧年难题当模型基准和公关素材,正在损害数学这门科学。 B站相关视频最高播放 18 万+,知乎下 231 个回答的话题名干脆就是:陶哲轩发文称「AI正杀死数学百年开放传统」,你如何看待这一观点?微博知乎
但有意思的是,B站高赞区第一条就是:评论区 99% 的人都没看声明,甚至没看这个视频,就开始高谈阔论,属实可悲。吵"数学家破防了"和吵"AI 要毁掉基础科学"的人,大多没读过信本身。这篇就替没读过信的人,把三笔账算清。哔哩哔哩

第一笔账:这封信到底写了什么、签名几个人、骂的是什么
先算一个最基础的账:到底几个人签。《经济学人》报道写的是 24 位菲尔兹奖得主联名发表反对信。国内通稿基本写 25 位,签署者名单可确认的包括 Artur Avila、Maxim Kontsevich、Peter Scholze、陶哲轩、邓煜等。连人数都没对得上,恰好证明"看标题就吵"有多普遍。经济学人新智元
第二算骂的是什么。信骂的不是"AI 太强"。开篇就承认大模型数学能力提升很快、AI 有潜力加速数学研究;反对的是"把解决著名难题当作模型能力基准"这件事——企业目标和数学共同体目标严重错位。信里的原话是:解决问题只是实现概念理解和洞见这一首要目标的一种工具和代理指标。经济学人
信里两个金句值得截图存着:陶哲轩说"我们在优化方面已经做得太好了";另一位联署者 Duminil-Copin 打比方——把一个人空投到珠穆朗玛峰峰顶,与让他自己一步步攀登上去,是完全不同的事情。经济学人
信的具体诉求其实就三条:给论文写作与思想提炼留时间;标注在先工作;承认需要人类数学家接手消化。翻译成人话:不是"AI 滚出数学",而是"你发成果,按我们这行的规矩发"。微博
导火索链也顺手理一遍:9月8日,OpenAI 宣布其内部 AI 利用 1 万个智能体、耗时 88 小时攻破纳维-斯托克斯方程,证明流体在特定条件下会产生奇点,并公布了 Lean 形式化验证。而《经济学人》对那篇 166 页论文的批评非常具体:尽管论文篇幅很长,其中几乎没有数学家公布新发现时通常会提供的那些解释。新智元经济学人
第二笔账:OpenAI 到底证明了什么、没证明什么
联名信吵成这样,很大程度是因为大家把"一个真结果 + 三个传闻"揉成了一颗瓜。拆开算:
NS 方程:真,但要抠字眼。OpenAI 拿下的不是"解决千禧年大奖难题"的完整口径——按克雷数学研究所的规矩,要顶刊发表且被数学界普遍接受满两年才有资格领奖。OpenAI 据新智元报道甚至公开表示拒领那 100 万美元。奖项认证这条路本来就没走到,这个"拒领"姿态本身就很"基准测试":流程我不要,话题我要。新智元
霍奇猜想:官方口径只有一句——OpenAI 向《纽约时报》承认在另一个千禧年问题上取得了实质性进展。把它认作霍奇、传出"已验证",都是社区自己填的空。截至 9月13日,陶哲轩的个人博客已连续两天更新霍奇相关文章。风向正处在从传闻变实锤的边缘。新智元知乎

BSD(据传在 Anthropic 侧)、黎曼猜想、P 与 NP:"正在尝试"级别的报道和传闻,全部未证实。新智元
社区疯传的那张"千禧年难题基准图"——Meta、DeepMind、xAI 等公开模型全员 0 分,"全人类顶级数学家基线"1 分,Anthropic 内部模型 1 分,OpenAI 内部系统 2 分——是社区梗图,不是官方榜单。连一张梗图的分数都是各家转述各家的版本,这就是"社区消化不了黑箱成果"的现场版。新智元
OpenAI 这边,针对 Buckmaster 团队的"学术掠夺"质疑,已通过《纽约时报》追访更新了关于用户数据的说法:Buckmaster 过去两个月的 Codex 提示词,绝不可能以任何方式影响内部模型。但截至目前,对联名信本身,OpenAI 还没有公开回应。微博

第三笔账:数学圈的裂缝不在"学界 vs 业界",在两派数学家自己
如果只看到"数学家集体反 AI",那就把戏看少了。真实的阵营要乱得多。
一边,7 月刚领完菲尔兹奖的 Jacob Tsimerman,下台就宣布入职 OpenAI。同一届得主里的邓煜,此刻却在反 AI 联名信上签名。微博
另一边,陶哲轩。知乎吵得最凶的点就在这,有个高赞回答干脆说:人类玩不起,急了,之前最支持 AI4Math 的也就是陶哲轩,现在也跳反了。但对照全文看,这是读反了:三年前就是他在喊"AI 要来了,数学界准备好"。正是一路把 AI 当工具用的人,最清楚黑箱证明意味着什么——这不是背叛,是布道者开始喊刹车。知乎
然后是全网都在用的 AlphaGo 类比,两派各说各的。支持信的那派算得很细:AlphaGo 是按行规来的——面对人下棋、网棋测试、发表自对弈棋谱、邀请选手测试、发表定式研究成果,公开可复现的论文,围棋圈因此普遍进步;OpenAI 发表证明缺少数学圈的参与,只是为了说明"AI 很牛"。反对那派的版本则是:柯洁只是第一批被打倒的,各行各业都会受冲击。更刻薄一点的评论说,这封声明就是在喊快来招安我呀。微博微博哔哩哔哩
《经济学人》还给了一段历史坐标:自从苏格拉底抱怨文字可能让人变得懒于记忆以来,学术界似乎从未对一项新技术产生过如此强烈的焦虑——但圆珠笔、计算器那些恐慌,后来大多被证伪了。可信里的担忧有一个新变量:以前的工具替代的是体力活,这次被替代的可能是"解题过程顺手生产出来的副产品"——新问题、新方法、新一代受训练的数学家。经济学人
所以这封信值不值得当回事?我的判断:它不是反 AI 宣言,也不是护饭碗的哀鸣,而是一份"发布规范谈判书"——24 位还是 25 位联名,本质上是在争"AI 时代的重大成果该按什么流程进入人类知识库"。把它读成任何一方的输赢,都白读了。
你该带走什么:按人群各拿一条
日常用 AI 写代码、做分析、算数的:模型能力是真的(Lean 形式化是数学界二十年的实质进展,AI 验证证明这条路已经走通),但"AI 解出难题"的可信度,现在取决于厂商肯不肯公开过程。以后判断一个"AI 攻克 XX"的新闻,先看有没有可复现的形式化产物和同行评审时间表,再看通稿。
看 OpenAI 产品和资本动向的:9月11日,奥特曼在公司全员会上表示,公司可能放缓前沿人工智能开发,并考虑与其他 AI 实验室协调行动。——这和联名信是同一周发生的事。模型发布节奏、以及会不会用"响应数学界诉求"包装下一波发布,都值得盯。微博
只刷到过"菲尔兹奖得主炮轰 AI 毁掉数学"标题的:先读那三条诉求再决定站不站队。信在 mathandai.org 全文可查,比刷十条微博截图便宜不了几秒时间。
准备追下去的,盯五个信号:1)OpenAI 对联名信的正式回应;2)那 166 页论文有没有补齐人类可读的解释、有没有投期刊;3)霍奇"实质性进展"是实锤还是哑火;4)陶哲轩博客对新一批结果的跟评;5)有没有第二波联署或反联署。BSD 和黎曼的传闻,大概率会在第五个信号里被裁决。
最后留一句陶哲轩的话收尾,也是这整件事的真正焦点:好问题远比好答案稀缺。AI 拿下一个又一个答案是厂商的记分牌,这些答案能不能变成教材、变成工具、变成下一代人脑子里的想法,才是数学的记分牌。这封信争的就是这一件事。