近日,AI 检测机构 GPTZero 团队对普华永道(PwC)发布的研究报告开展了一次 "AI 体检 "。
检测结果显示,2024 年至 2026 年间,普华永道中东分支机构(PwC Middle East)陆续发布的 4 份研究报告中充斥着大量 "AI 幻觉 ",包括虚构概念、错误引用及编造参考文献等,其中一份报告被检测工具判定为 100% 由 AI 生成。
普华永道并非孤例。在此之前," 四大 " 会计事务所中的另外三家——德勤、安永及毕马威——在其发布的研究报告中亦被检出过类似的 "AI 幻觉 " 问题。
随着生成式 AI 加速渗透知识生产领域,向来依凭专业判断与严谨性立足的咨询行业,正面临一场前所未有的信誉考验。
普华永道一份研究报告
被测出 100% 由 AI 生成
在 GPTZero 检测的 4 份普华永道中东的研究报告中,《治理变革》(Transforming Governance)问题最为突出。
检测显示,这份发表于 2025 年 2 月的报告存在明显 AI 生成特征,若剔除参考文献等末尾内容,正文部分由 AI 生成的概率竟达到 100%。
整份报告围绕一个名为 "Citizen Pulse"(公民脉搏)的治理框架展开论述。但是,GPTZero 检测发现," 公民脉搏 " 这一概念从未出现在这份报告之外的公开资料、报道以及文献中。然而,普华永道的报告却宣称,丹麦、沙特阿拉伯、美国和澳大利亚政府正在利用 " 公民脉搏 " 这一理念改善公共服务。
普华永道报告称,丹麦公共机构利用 " 公民脉搏 " 数据提升公共服务,并将丹麦政府公共服务门户网站 Borger.dk 作为引用来源。但实际上,该网站并未提及 " 公民脉搏 "。
报告还称,沙特公共机构利用 " 公民脉搏 " 推动公共服务改革,并引用了沙特 "2030 愿景 " 官方网站作为依据。但在该网站页面上未发现能够支持这一说法的证据。
《每日经济新闻》记者(以下简称 " 每经记者 ")随后通过搜索引擎以及多款 AI 大模型的搜索功能,未检索到关于 " 公民脉搏 " 这一概念的公开信息。
此外,普华永道报告 "AI 幻觉 " 问题还体现在虚构参考文献、引用错误等方面。
GPTZero 检测发现,《治理变革》中的 17 条参考文献中,仅有 10 条与正文脚注相对应,其余引用存在编号缺失、对应关系混乱等情况,甚至有两条参考文献直接被判定为虚构。
在参考文献列表中,《治理变革》报告表示引用了《麻省理工科技评论》题为《政府服务中的人工智能》(Artificial Intelligence in Government Services),以及世界经济论坛题为《第四次工业革命:智慧城市与人工智能应用》(The Fourth Industrial Revolution: Smart Cities and AI Applications)两篇文章,但 GPTZero 检测发现,这两篇文章并不存在。每经记者通过搜索引擎以及多款 AI 大模型检索后,同样没有查找到相关文章。
此外,普华永道中东的这份研究报告还存在正文论述与引用来源之间缺乏对应关系,不少参考文献仅链接至相关网站首页,无法直接支撑正文中的具体内容。
普华永道多份报告出现明显错误
检测称发布前未经人工充分核查
《治理变革》并非唯一存在严重 "AI 幻觉 " 问题的报告。
GPTZero 检测发现,普华永道中东的另外三份研究报告中,同样出现了正文论述与引用来源不符、统计数据误读以及案例无法由参考文献支撑等问题。
例如,《塑造海合会国家交通出行格局》(Shaping the GCC Mobility Landscape)一文混淆了国际能源署报告中的两项不同指标,把中国电动汽车累计销量误写为公共充电桩数量。GPTZero 表示,这类对网页图表或可视化数据的误读,是 AI 生成内容中较为典型的错误。该报告正文部分完全由 AI 生成的概率高达 82%。
另外,《构建具有网络韧性的电动出行生态系统》(Building a Cyber-Resilient eMobility Ecosystem)报告声称引用学术论文和媒体报道,但却呈现参考文献中并不存在的统计数据。
GPTZero 还指出,该报告一处参考文献链接中包含 "utm_source=chatgpt.com" 参数,并据此认为该链接由 ChatGPT 生成。
GPTZero 认为,该报告正文完全由 AI 生成的概率达 60%。
《代理式 AI:生成式 AI 的新前沿》(Agentic AI – The New Frontier in GenAI)报告则出现了正文结论与引用内容不符、引用时间晚于报告发布时间等情况。该报告正文部分完全由 AI 生成的概率达 50%。
GPTZero 总结称,普华永道中东报告中错误的密集程度充分表明,这些报告在发布前并未经过充分人工核查。
针对 GPTZero 对报告的检测结果,每经记者向普华永道发去采访请求,截至发稿未得到回应。
普华永道中东 7 月 29 日向英国媒体回应称,公司 " 高度重视已发布研究内容的准确性 ",目前正对相关报告中的 " 少量支持性引用 " 进行更新。公司设有适用于研究和内容开发的质量控制流程,并强调相关流程符合其 " 负责任 AI" 原则。不过,对于相关错误如何产生,以及涉事报告是否使用生成式 AI 参与撰写,公司未作进一步说明。
从德勤退款到毕马威撤稿:
" 四大 " 专业报告均出现 "AI 幻觉 "
普华永道并非首家因研究报告中的 AI" 幻觉 " 受到质疑的四大会计师事务所。
此前,GPTZero 已陆续对德勤(Deloitte)、安永(Ernst & Young,EY)、毕马威(KPMG)发布的多份研究进行检测,并指出这些报告普遍存在虚构参考文献、正文论述与引用来源不符、统计数据错误引用等问题。
最早引发广泛关注的是德勤澳大利亚(Deloitte Australia)2025 年 7 月的一份政府咨询报告。
该报告源于一项价值 44 万澳元的政府合同。有学者发现,该报告引用了一本并不存在的著作。澳大利亚媒体进一步核查发现,报告中还存在大量虚构案例、错误引用和不存在的参考文献。随后,澳大利亚政府内部审查发现这份报告有超过 50 处可疑引用。最终,德勤更新了报告,并向澳大利亚政府退还 9.8 万澳元。
随后,GPTZero 又从中识别出 30 余处引用问题,其中 19 处被判定为 " 幻觉引用 "。
2026 年 5 月,安永加拿大(EY Canada)发布的网络安全报告《攻击点:揭示忠诚度体系中的网络威胁与欺诈》(Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems)也因类似问题被撤回。
今年 6 月,GPTZero 又针对毕马威的报告《全面体验:代理式 AI 时代重新定义卓越》(Total Experience: Redefining Excellence in the Age of Agentic AI)进行检测。结果显示,这份报告共包含 45 条参考文献,其中仅 5 条能够准确对应真实来源。
事件曝光后,多家被毕马威报告列为案例的机构公开否认相关内容。
瑞银集团(UBS)、英国国家医疗服务体系(National Health Service,NHS)、瑞士联邦铁路公司(Swiss Federal Railways,SBB)以及伦敦交通局(Transport for London,TfL)均表示,相关报告中关于其使用代理式 AI 的描述并不准确或具有误导性。随后,毕马威撤下了相关报告,并启动内部调查。
(免责声明:文章内容和数据仅供参考,不构成投资建议。投资者据此操作,风险自担。)
记者 | 罗雪琳
编辑 | 段炼 高涵 杜恒峰
校对 | 梁露月
封面图片:视觉中国(图文无关)
|每日经济新闻 nbdnews 原创文章|
未经许可禁止转载、摘编、复制及镜像等使用


登录后才可以发布评论哦
打开小程序可以发布评论哦