四大会计所集体被AI坑了:假引用假脚注,最会挑错的人翻了车
四大会计所集体被AI坑了:假引用假脚注,最会挑错的人翻了车
普华永道(PwC)中东分部,被查出至少4份研究报告是「AI幻觉批发市场」。(数据来源:TechSpot/CityAM 8月初报道,GPTZero检测结果)
假引用、假脚注、编造的案例研究——最离谱的一份,把「ChatGPT」直接列进了参考文献。你敢信?一份研究机构的报告,把聊天机器人当成了学术来源。
我盯着这条新闻看了半天,脑子里只有一个念头:
这个世界上最会挑错的一群人,居然被AI骗了。
先看案发现场:不是一家,是快凑齐了
过去两年,四大会计师事务所里至少三家被迫撤过报告——因为AI幻觉。(数据来源:Going Concern/Accounting Today行业报道)
案发时间线拉一下:
5月,EY撤回了一份关于忠诚度奖励计划的研究——被查出来里面有明显的AI幻觉。(数据来源:CityAM报道)
7月,KPMG一份关于Agentic AI的研究报告,被GPTZero查出满篇幻觉和假引用。(数据来源:CityAM报道)
8月初,PwC中东,至少4份「思想领导力」报告被查出是AI生成的,假脚注、假案例,连参考文献都是编的。(数据来源:TechSpot/ThePrint 8月3日报道)
Delhitte呢?也中过招,只是没被点名撤稿。
四大里边,三大已经躺下,剩下一个在ICU门口排队。

为什么是它们?这才是真问题
会计事务所的看家本领是什么?
审计。挑错。给企业的账目挑毛病,挑了几十年。它们内部有完整的三级复核流程:项目组自查、经理复核、合伙人终审。全世界的企业报表都过它们的眼。
这样一家机构,发出去的报告里引用了一个根本不存在的文献,脚注编得头头是道,居然没人发现?
说明什么?说明它们自己内部,也把AI当成了「同事」。
咨询公司这几年都在抢AI概念,内部疯狂用AI写报告、做PPT、出白皮书。用起来太顺手了——AI三分钟出一版初稿,人类同事要写三天。
顺手到,复核的人默认「AI写的,肯定没问题」。
这就像我在便利店装了自动补货系统之后,店长再也不看库存报表了——系统说补就补。直到某天系统抽风,一次订了三个月的货,冷库里堆满了过期的盒饭。机器替代了人眼,人就真把眼睛闭上了。
我干IT25年,最怕的就是「信任自动化」
四大的翻车,表面看是AI幻觉,根子上是一个我特别熟悉的词:信任自动化。
早年上ERP的时候,我把所有库存数据迁移进系统,跟管理层打包票「以后不用手工对账了」。结果第二年盘点,账实差异巨大——因为系统的初始数据有几万条是错的,大家却都默认「系统里的肯定是对的」。
从那以后我立了一条规矩:凡是系统生成的报表,至少要抽查10%。不是不信任系统,是信任必须留一道人工的缝。
四大把这个环节跳过了。
GPTZero(一个AI检测工具)能一眼看出报告是AI写的——因为它够不到AI内部,但它能抓「假引用」。而四大的三级复核,理论上也该抓到。没抓到,说明复核的人已经默认「AI同事不会骗我」。

这事对普通人的影响,比你想的近
你可能觉得:四大翻车关我屁事?我又不请它们审计。
但它们每年输出成千上万份行业报告、经济预测、政策建议——企业看它们,媒体转它们,政府参考它们。这些报告的署名是「权威机构」,读者默认它们自带可信度。
现在这些报告里,混进了AI编的引用和幻觉数据。谁在用?你的老板、你的客户、你的投资决策依据。
我最近在文章里反复强调一句话:AI时代,来源不等于真相,权威不等于正确。四大这件事就是活教材。
以后看任何报告,先问三个问题:这份数据的原始出处是什么?引用的文献能不能查到原文?作者有没有动机造假?
我在零售行业干了25年,看过太多「看起来权威、实际经不起推敲」的报告。AI让这事放大了一百倍。
别急着嘲笑四大
最后说句公道话。
嘲笑四大,其实是在嘲笑所有正在用AI干活的职场人——包括你和我。
谁没让AI写过周报?谁没让AI整理过会议纪要?谁没把AI生成的方案直接发过群?
四大只是规模更大、翻车更显眼。
真正值得记住的,是这条分界线:AI可以替你干活,但替不了你负责。复核的环节,永远要留一道人的缝。
四大替我们所有人,花了几十亿美金学费,买到了这个教训。
你最近的AI输出,抽查过吗?评论区聊聊。
来源:TechSpot/CityAM(PwC中东报告AI幻觉检测)、CityAM(KPMG/EY撤稿)、ThePrint/Going Concern(四大两年三撤稿)、Accounting Today(行业背景)
如果这篇让你重新想了一件事,点个「在看」让朋友也看到。
每周一篇算账硬货 + 两篇AI快评,关注虾哥,不掉队。
#AI幻觉 #AI安全 #四大会计所 #AI避坑
