陶哲轩和25位菲尔兹奖得主联名开火,气的是什么?天天用AI拍题的人,这三笔账跟你直接有关

源自222位全网作者

03:46

这两天,凡是用AI拍题对答案的人,大概率都刷到了同一条热搜:OpenAI宣称88小时解出千禧年难题NS方程;庆贺还没刷屏,陶哲轩领衔的25位菲尔兹奖得主联名发声,标题直译过来就是"AI在数学里的严重错位"。站内一张782赞、520评的热帖标题更狠:「25位菲尔兹奖得主,联名让AI别刷题了」。另一边,家长们的评论区还在吵"孩子写作业到底能不能直接问AI"。小红书

乍一看是两个世界的事。但把声明拆开读你会发现:全球最顶级那批数学大脑在意的三个问题,几乎就是我们在手机屏幕上天天踩的三个坑。

先把时间线拉直:谁宣布了啥,谁签了啥

信息密度大、变体多,先把事实链理一遍:

  • 9月8日,OpenAI宣布:一个未公开的内部模型,带着约1万个智能体跑了88小时,证明了流体在特定条件下会产生奇点——也就是拿下千禧年大奖难题纳维-斯托克斯方程的一侧。随后公布了Lean形式化验证,并公开表示不要那100万美元奖金(据媒体报道,这波算力的花费以千万美元计)。知乎

  • 紧接着两天,OpenAI又向媒体证实"在霍奇猜想上有实质性进展"。一张疯传的"千禧难题基准榜"写着:Meta、DeepMind等公开模型0题,人类顶级数学家基线1题,Anthropic未发布内部模型1题,OpenAI 2题。

  • 9月11日(当地时间),陶哲轩在个人博客发布《A Severe Misalignment of AI in Mathematics》(AI在数学中的严重错位),首批签署人25位菲尔兹奖得主,包括陶哲轩、Artur Avila、Maxim Kontsevich、Peter Scholze、新晋得奖的中国数学家邓煜,矛头直指OpenAI、Anthropic等公司把解题当营销的行为。微博

  • 次日,#25位菲奖得主联名炮轰AI毁掉数学#登上中文热搜。光明网9月11日刊文把争议核心点得很准:问题不是AI能不能解题,而是AI解的题"算不算数"。光明网

陶哲轩和25位菲尔兹奖得主联名开火,气的是什么?天天用AI拍题的人,这三笔账跟你直接有关

一个关键背景:陶哲轩不是反AI人士。他长期是"AI帮数学"最卖力的布道者,公开演示过用ChatGPT配合Lean做形式化证明,把AI比作"把我空投到答案附近的直升机";今年8月还在呼吁数学家主动引领AI。这样的人牵头联名,反对的不是AI,而是现在这套玩法——这才是整场风波里最大的信号。知乎

声明到底说了啥:不是"禁止AI做数学",是三笔具体的账

meme版叙事是"数学家急了、要砸纺织机"。但声明原文承认AI有加速数学研究的潜力。他们真正点名的是三件事:

第一笔:把数学打成了通关副本。 把"解出名题"做成模型基准和公关素材,让行业最稀缺的资源全部涌向"出答案",而"理解结构"没人管。声明的逻辑是:一个难题的突破,要经过漫长的演讲、讨论、简化、写进教材,才能变成全人类共享的工具;只甩一个算力轰出来的结果,人类的思想链就断在这一环。

第二笔:发表与归属。 仓促公布、没有完整论文、不交代推导过程、不引用前人工作。纽约大学数学家Tristan Buckmaster质疑:自己几个月来把未公开的NS方向草稿当作提示词喂给某AI系统,几天后对方就拿出了证明——他怀疑未发表研究被模型"学"走了。数学家Andreas Thom也爆料,某公司解决soficity猜想时用的,恰好是他花过二十年、且近期与AI讨论过的冷门路径。公司方否认,但回复里留了一句很玩味的"不能排除来自用户数据的去标识化信息帮助改进了模型"。这些指控目前都还没有第三方核验,双方立场并存——但"连质疑都很难被澄清"这件事本身,就是声明里说的"错位"。知乎

第三笔:判分权全在自己手里。 AI公司自己出题、自己判分、自己开发布会。当一份证明要压成上万行机器验证代码时,人类评审无法逐行核账——数学界焦虑的本质,是"答案没人能审"。

陶哲轩和25位菲尔兹奖得主联名开火,气的是什么?天天用AI拍题的人,这三笔账跟你直接有关

拍题查答案的人为什么要关心:三个争议,对应你三个日常

把声明的尺度缩小到一部手机,它几乎是逐条翻译给你的:

争议一 → 答案对了≠懂了。 "思想链断裂"转译过来,就是无数家长看着眼熟的一幕:孩子拍题拿到解析,抄得全对,期中原样再考还是不会。小红书上周那篇「别再让ai直接给孩子答案了」说的就是这个:病根不在AI给不给答案,在于只拿答案、跳过了为什么。数学界向AI公司提的要求——把推导摊开——你完全可以对自家娃的搜题App提同一要求:让AI分步讲思路、说错因,再让孩子把题反讲一遍,答案才算变成理解。小红书

争议二 → 判卷没人审。 数学圈担心"自判分",用户是天天撞见"错答案":有家长吐槽搜题软件第一个结果就是AI解题入口,照片没拍清楚就解错,“人很难抄得顺”。普通人版的"第三方审校"是个很老派但有效的动作:关键题(选对错的、写大步骤的)换第二个模型交叉核对一次,或者直接反问它"这一步的依据是什么条件";两个答案打架时,先回教材例题对照,别急着信任何一个。你没法要求一家公司既当运动员又当裁判,但至少可以不让他们替你家孩子判卷子。小红书

陶哲轩和25位菲尔兹奖得主联名开火,气的是什么?天天用AI拍题的人,这三笔账跟你直接有关

争议三 → 你的信息流也被"抢发"过了。 这条新闻传到你的屏幕前,已经变成"AI无敌、数学已死"的meme——这就是一个没有思想链的答案。数学界为AI证明争取的三查:有没有形式化、有没有论文、有没有人审——恰好是你刷到一切"AI解决XX"内容前该过的清单。能带着这份警惕看完这篇文章,你的信息筛选已经赢过大多数转发了。

先别急着站队,盯住四个信号

  1. NS证明的同行评审进程。 机器验证过了,人类期刊的评审这一百年传统还没走完——这一步才决定"算不算数"之争有没有标准答案。

  2. 公司是否收敛"千禧难题基准"。 联名信之后各家跟进多快,直接暴露"解题KPI"这套商业逻辑会不会刹车。

  3. 归属疑云有没有独立调查。 如果Buckmaster和Thom的质疑只停留在一问一否认,"错位"只会越来越大。

  4. 联署会不会扩容。 25位只是首批,克雷数学研究所、Lean形式化社区等机构是否接话,决定它是公开信还是规则的前奏。

至于天天用AI拍题对答案的你:工具不会因为这场风波消失,争议反而可能让"讲步骤、说原因"的答法成为标配。这场大戏真正留给普通人的启示就一句——

AI让做题越来越便宜,但"谁来核对答案、谁真正看懂了",从来没有外包出去。数学界在替整个知识共同体争这件事,而你可以从今晚改一下问AI的方式开始。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章