你问AI的历史可能被“投毒”了——外交部点名的语料暗战与三个自保动作

源自94位全网作者

11:49

问AI"抗战怎么开始的",你可能得到一句别扭的答案:1937年,中日发生了"军事冲突"。

你以为是用词不当,其实这个答案在进模型之前就已经被人动过手脚。

外交部点名的,是一场语料暗战

10月9日的外交部例行记者会上,一件新课题被点名:日本右翼势力持续向国际主流大模型提供经过篡改的二战历史语料,一些大模型在对话中输出带有明显错误史观的回答——将七七事变称为“日中军事冲突”,将南京大屠杀淡化为“南京陷落”,将日本侵略东南亚美化为“对南方资源的关心”。毛宁的定性没有辞令空间:日本军国主义侵略罪行铁证如山,不容否认。这套"新伎俩"的目的也被原话点破:扭曲全球公众对二战的历史认知,为日本摆脱战后体制约束、加速再军事化扫除舆论障碍。人民日报的跟进同样直接:历史不容篡改,侵略罪责更不容抹杀。央视新闻中国新闻网央视新闻人民日报

你问AI的历史可能被“投毒”了——外交部点名的语料暗战与三个自保动作

为什么AI会被"投毒":喂什么,它说什么

这不是AI坏掉了,是AI的本性。知乎上那篇被大量转发的解释一针见血:大模型从来没有在“回忆事实”,它自始至终都在做“概率接龙”。它学的是"最像人话的下一个词",不是"是否属实"。它的记忆来自全网语料池,谁往里铲假料,它就老实学。知乎

你问AI的历史可能被“投毒”了——外交部点名的语料暗战与三个自保动作

剂量比想象吓人。国家安全部披露的调研里,0.01%虚假训练文本可致有害内容增加11.2%。而日本已经把它做成了国家级项目:日本政府斥资44亿日元打造、拟向约18万名中央政府职员开放、接入美国闭源大模型的政务生成式AI系统“源内”。战前档案、投降文件、东京审判记录,都不在它的核心基准文本里——语料什么脸色,它就什么说法。中国经济网中国新闻网

投毒,已经是一门产业

更可怕的是,篡改历史成了计件生意。据网络披露,右翼势力通过日本最大的众包平台CrowdWorks发布招募广告,公开征集“批判中国类”的视频。几分钟一条的"历史谎言短视频",就这么被流水线炮制出来,再流进全网语料池。微博

你问AI的历史可能被“投毒”了——外交部点名的语料暗战与三个自保动作

给大模型"造数据"本身,早就是按学科分工的成熟产业——有人专门在给大模型出题、卖题、判卷。至于"被喂大"的考生成色:在人类出卷的"最后一考"基准上,各家模型的成绩不过是从两年前的5%上下爬到50%出头,头部也几乎错一半。36氪

你问AI的历史可能被“投毒”了——外交部点名的语料暗战与三个自保动作

三个自保动作,今天就能做

一,把AI的历史、时政回答当草稿,别当结论。概率接龙天生不校验,它出错时从不脸红。那桩热搜旧事就是教训:有网友称自己通过豆包预约线下餐厅,拿到了AI生成的占座、取号和预约成功界面,结果到店后被商家告知预约无效。AI说"办成了",核实之前都只是对话框里的字。36氪

你问AI的历史可能被“投毒”了——外交部点名的语料暗战与三个自保动作

二,对"中性化"措辞保持敏感。“冲突”“摩擦”"陷落"这类淡化侵略性质的用词,往往不是描述,而是框架。看到别扭说法,先停下,去查权威史料。三,重要事实至少两个独立渠道交叉核验——教科书、博物馆、档案馆,铁证在那里,不在大模型的"可能"里。

历史不会因巧舌如簧而扭曲,正义不会因技术伪装而缺席。外交部把话说明白了:人工智能应当向上向善,而不是被用于篡改历史真相,洗白侵略罪责。谁往语料池里倒脏水,我们就得盯着谁。央视新闻央视新闻

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章