三万支队伍全在用AI做题,出题人开始"防AI":今年华为杯最大的坑不是题,是AI

源自51位全网作者

13:46

这个九月,研究生数学建模"华为杯"刚结束,备赛群里最热的复盘不是"怎么建模",而是"谁家AI又踩坑了":D题数据表里悄悄换了单位,AI怎么算都到不了理想结果;F题题面里埋着小字陷阱;还有一个叫"AI使用说明"的东西,写的位置不对,评委可以直接不评分。当AI越来越会做题,出题的人、判卷的人,已经开始研究怎么对付AI。这届华为杯的坑,每个用AI答题的人都躲不开。

一、题目开始专门为"防AI"设计

9月23日,数模UP主"BZD数模社"发了一条两分钟的复盘视频《2026年华为杯研赛史诗级大坑-AI解题必错》,讲的是D题(山区洪涝灾害下无人机运输与通信协同优化):数据表里埋着针对AI的单位陷阱,有选手跟着复现踩坑过程——表里的数字从0.几变成0.0几,AI算第二问怎么都到不了理想结果。这条视频播放刚过1万,转发却有437次,转发率接近观看的4%——典型的"备赛群里疯传型"内容,坑不是个例,是批量翻车。哔哩哔哩

评论区更有意思。最高赞评论自嘲:“别逗你codex大人笑了”,底下有人接:“现在很害怕数据集也藏毒”。哔哩哔哩

三万支队伍全在用AI做题,出题人开始

同一作者另做的《2026年华为杯研赛D题题目反AI设计一》播放1.07万;F题的复盘则专门提醒"不要因为识别了题目中的小字就大意"。换句话说:出题方已经在按"你们都会用AI"的假设设计题干和数据。最讽刺的是F题本身:题面是《算力约束下提升大语言模型能力的资源配置建模》,考"有限算力怎么训练大模型",而做题的人正用大模型做题,还被题目埋的反AI陷阱咬了一口。哔哩哔哩

三万支队伍全在用AI做题,出题人开始

二、更玄的报错:只有高级模型才犯的错

同一批复盘挖出反常识现象:不光低级模型会出问题,越高级的模型反而越容易犯低级模型根本碰不到的错,典型三类:参考文献第一条悄悄放进了赛题官网,把"要解决的问题"当成"引用的文献";自作主张给数模论文加上"文献综述""方法论"等科研论文板块,和问题一、问题二拼成四不像;只会做加法——人做题靠合理假设简化问题,AI反过来堆鲁棒优化、多目标、蒙特卡洛、七种模型对比,简单问题被搞复杂后连求解都出问题。知乎

这不只在竞赛圈。今年5月,淘宝免单答题把AI集体问懵上了热搜:同一道题丢给四个AI,四个AI给了四个答案,全员认真但全员不一样。知乎上有人试AI出初中数学题:三秒成型,题干选项解析"读起来无可挑剔",但它有概率算错,而错题的代价和对题的价值不在一个量级上。这正是"用AI答题的人"要面对的真实水位。微博知乎

三万支队伍全在用AI做题,出题人开始

三、评审端静默地震:做对题只是摸到获奖门槛

基于上一周约400篇论文的评阅,备赛社区得出的结论是:今年因为AI性能足够优异,做对一个问题、做好一个问题的求解变得很简单,大家结果都不错、分数分布很紧密,往年算对两问就能拿的成绩今年不够用了;正因为格式问题扣一两分,就会导致不获奖或者降档。知乎

于是最致命的细节全在题外:论文中不能出现任何含答题人身份的标志,正文汉字一律小四号宋体、单倍行距;摘要页就是第一页,不能按本科竞赛习惯从正文开始标页码;页眉里的承办单位标识必须是今年的西安交通大学,放成过去三年的学校直接取消评奖资格。知乎

而今年新出的"AI使用说明",是问得最多、踩得最狠的细节。9月16日官网发布联赛四个附件后,答疑口径是:说明要放在参考文献的里面,要素是人工智能的名称、版本、开发公司和发行日期。知乎

更硬的一条是:根据评审规定,没有AI使用说明的不评分;至于单独写一篇"AI声明报告"塞进正文,答疑UP主的原话相当直接——你敢写我就敢不给你评分,这属于给评委"做标记",性质类似高考用红笔答题。备赛群里选手的追问也全是这个方向:这个AI使用说明说白了就是参考文献中写入,然后再在原文中引用就行?查重是怎么查的?附录写了使用说明,但是没引用参考文献会影响吗?需要说明:这些口径来自备赛社区对官方附件的转述解读(发布者自己也标注"个人观点,仅供参考"),最终以主办方附件原文为准;但一轮接一轮的追问,已足以说明AI声明就是今年最大的不确定项。知乎哔哩哔哩

提交机制同样收紧:三万支队伍先提交PDF的MD5码锁定截止时间,之后上传的正文必须与该哈希完全一致,改一个字都不行。知乎

三万支队伍全在用AI做题,出题人开始

四、如果你也用AI答题:一份带得走的核验清单

  1. 题面和数据表先人肉读一遍再交给AI:单位、量级、小字,是出题方给"不读题的AI"准备的陷阱,AI不会提醒你,只会顺着错误前提算到底。

  2. AI输出先看结构再看结论:高级模型的典型错法是自作主张改结构、堆花活,结构对了数字才有意义。

  3. 参考来源查两头:第一条是不是被塞了不该塞的东西,最后几条是不是AI编的。

  4. 涉"AI声明/AIGC检测"逐字对照官方规则:AI使用规范正从竞赛扩展到论文、作业、面试各场景,写错位置比不写的代价更大。

  5. 同质化预警:所有人都用AI做到"结果不错"时,差距转移到摘要完整度、篇幅分配、格式干净度这些AI不会主动帮你优化的地方。

人群也分得开。刚比完赛、正在等结果的,按上面逐条复盘;明年备赛的,现在就开始练"AI出初稿+人做核验"的分工;考公、考教资的刷题党——教资面试社区已经在流传"AI答题模板",遇到AI相关题目直接套用成了备考动作,AI生成的答案必须自己核对事实锚点。家长群体更直接:之前用通用AI帮忙看题,偶尔讲解出现偏差,每一题我都再核对一遍,很累——要不要为专业批改工具花钱,取决于你想不想把复核时间买回来。微博小红书

三万支队伍全在用AI做题,出题人开始

五、接下来值得盯的信号

11月前后华为杯公布结果,重点盯一件事:会不会出现因AI声明缺失或AIGC检测导致的取消获奖通报——那将决定明年数模竞赛的规则走向。更长的背景线是这个9月:媒体报道1万个AI攻破了困扰数学界百年的难题。邓煜、陶哲轩等数学家和菲尔兹奖得主联合发布了关于"AI在数学中的严重错位"的公开声明。771位数学家联名之后,OpenAI宣布退出那场AI解题大赛。从数学界顶层到研究生赛场是同一条剧情:AI答题进入"人人能拿到正确答案"的阶段,人的价值从"会做"上移到"会判"。哔哩哔哩哔哩哔哩哔哩哔哩

三万支队伍全用AI做完题的这届华为杯是个分水岭——它第一次让"做对题"几乎不再重要,让"知道AI错在哪"变得重要。以后用AI答题,比的不是敢不敢用,而是接得住接不住AI的错。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章