专业报告被曝100%AI生成:虚构概念、编造文献成风,“四大”会计师事务所深陷“AI幻觉”信任危机
2026-08-05 18:17:18未知 作者:徽声在线
近期,AI检测权威机构GPTZero团队针对全球知名会计师事务所普华永道(PwC)发布的一系列研究报告,展开了一场深入的“AI真实性审查”。
审查结果令人震惊:在2024年至2026年间,普华永道中东分支机构(PwC Middle East)发布的四份研究报告中,普遍存在“AI幻觉”现象,包括虚构专业概念、错误引用资料以及编造参考文献等严重问题。其中,一份报告更是被检测工具明确判定为完全由AI生成,无任何人工干预痕迹。
值得注意的是,普华永道并非唯一陷入此类危机的“四大”会计师事务所。此前,德勤、安永及毕马威也相继被曝出其研究报告中存在类似的“AI幻觉”问题,引发了业界对咨询行业专业性与严谨性的广泛质疑。
随着生成式AI技术在知识生产领域的迅速渗透,咨询行业这一历来以专业判断与严谨性为基石的领域,正面临着前所未有的信誉挑战。
普华永道报告被曝100%AI生成,信誉危机升级
在GPTZero团队检测的普华永道中东四份研究报告中,《治理变革》(Transforming Governance)一书的问题尤为突出。
检测数据显示,这份发布于2025年2月的报告,正文部分若剔除参考文献等非核心内容,其AI生成的概率竟高达100%,令人咋舌。
整份报告围绕一个名为“Citizen Pulse”(公民脉搏)的治理框架展开论述,然而,GPTZero团队发现,“公民脉搏”这一概念在除该报告外的任何公开资料、报道或文献中均无迹可寻。尽管如此,普华永道的报告却声称丹麦、沙特阿拉伯、美国和澳大利亚政府正在利用这一理念改善公共服务。
例如,报告提及丹麦公共机构利用“公民脉搏”数据提升公共服务,并引用丹麦政府公共服务门户网站Borger.dk作为来源。但经核实,该网站并未提及“公民脉搏”相关内容。
同样,报告还称沙特公共机构利用“公民脉搏”推动公共服务改革,并引用了沙特“2030愿景”官方网站作为依据。然而,在该网站页面上,并未发现任何支持这一说法的证据。
徽声在线记者随后通过搜索引擎及多款AI大模型进行搜索,同样未能找到关于“公民脉搏”的任何公开信息。
此外,普华永道报告中的“AI幻觉”问题还体现在虚构参考文献、引用错误等多个方面。
GPTZero团队检测发现,《治理变革》中的17条参考文献中,仅有10条与正文脚注相对应,其余引用存在编号缺失、对应关系混乱等问题,甚至有两条参考文献被直接判定为虚构。
报告声称引用了《麻省理工科技评论》的《政府服务中的人工智能》(Artificial Intelligence in Government Services)以及世界经济论坛的《第四次工业革命:智慧城市与人工智能应用》(The Fourth Industrial Revolution: Smart Cities and AI Applications)两篇文章,但GPTZero团队检测后发现,这两篇文章根本不存在。徽声在线记者通过多方搜索,同样未能找到相关文章。
此外,该报告还存在正文论述与引用来源之间缺乏对应关系的问题,不少参考文献仅链接至相关网站首页,无法直接支撑正文中的具体内容。
普华永道多份报告错误频出,人工核查环节形同虚设
《治理变革》并非普华永道中东唯一存在严重“AI幻觉”问题的报告。
GPTZero团队检测发现,普华永道中东的其他三份研究报告中,同样存在正文论述与引用来源不符、统计数据误读以及案例无法由参考文献支撑等问题。
例如,《塑造海合会国家交通出行格局》(Shaping the GCC Mobility Landscape)一文混淆了国际能源署报告中的两项不同指标,将中国电动汽车累计销量误写为公共充电桩数量。GPTZero团队表示,这类对网页图表或可视化数据的误读,是AI生成内容中较为典型的错误。该报告正文部分完全由AI生成的概率高达82%。
""
另外,《构建具有网络韧性的电动出行生态系统》(Building a Cyber-Resilient eMobility Ecosystem)报告声称引用学术论文和媒体报道,但却呈现了参考文献中并不存在的统计数据。
""
GPTZero团队还指出,该报告一处参考文献链接中包含“utm_source=chatgpt.com”参数,并据此认为该链接由ChatGPT生成。
GPTZero团队认为,该报告正文完全由AI生成的概率达60%。
《代理式AI:生成式AI的新前沿》(Agentic AI – The New Frontier in GenAI)报告则出现了正文结论与引用内容不符、引用时间晚于报告发布时间等严重问题。该报告正文部分完全由AI生成的概率达50%。
""
GPTZero团队总结称,普华永道中东报告中错误的密集程度充分表明,这些报告在发布前并未经过充分的人工核查,质量控制流程形同虚设。
针对GPTZero团队的检测结果,徽声在线记者向普华永道发去采访请求,但截至发稿时仍未得到回应。
普华永道中东于7月29日向英国媒体回应称,公司“高度重视已发布研究内容的准确性”,目前正对相关报告中的“少量支持性引用”进行更新。公司设有适用于研究和内容开发的质量控制流程,并强调相关流程符合其“负责任AI”原则。然而,对于相关错误如何产生,以及涉事报告是否使用生成式AI参与撰写,公司并未作出进一步说明。
从德勤退款到毕马威撤稿:“四大”专业报告均陷“AI幻觉”风波
普华永道并非首家因研究报告中的AI“幻觉”问题而受到质疑的“四大”会计师事务所。
此前,GPTZero团队已陆续对德勤(Deloitte)、安永(Ernst & Young,EY)、毕马威(KPMG)发布的多份研究报告进行检测,并指出这些报告普遍存在虚构参考文献、正文论述与引用来源不符、统计数据错误引用等问题。
最早引发广泛关注的是德勤澳大利亚(Deloitte Australia)于2025年7月发布的一份政府咨询报告。
该报告源于一项价值44万澳元的政府合同。有学者发现,该报告引用了一本并不存在的著作。澳大利亚媒体进一步核查发现,报告中还存在大量虚构案例、错误引用和不存在的参考文献。随后,澳大利亚政府内部审查发现这份报告有超过50处可疑引用。最终,德勤更新了报告,并向澳大利亚政府退还了9.8万澳元。
随后,GPTZero团队又从中识别出30余处引用问题,其中19处被判定为“幻觉引用”。
2026年5月,安永加拿大(EY Canada)发布的网络安全报告《攻击点:揭示忠诚度体系中的网络威胁与欺诈》(Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems)也因类似问题被撤回。
今年6月,GPTZero团队又针对毕马威的报告《全面体验:代理式AI时代重新定义卓越》(Total Experience: Redefining Excellence in the Age of Agentic AI)进行检测。结果显示,这份报告共包含45条参考文献,其中仅5条能够准确对应真实来源。
事件曝光后,多家被毕马威报告列为案例的机构公开否认相关内容。
瑞银集团(UBS)、英国国家医疗服务体系(National Health Service,NHS)、瑞士联邦铁路公司(Swiss Federal Railways,SBB)以及伦敦交通局(Transport for London,TfL)均表示,相关报告中关于其使用代理式AI的描述并不准确或具有误导性。随后,毕马威撤下了相关报告,并启动了内部调查。



