四大會計師事務所中三家,栽在假註釋上
27條註釋中有16條是假的。

前言
各位訂閱者,上個月 EY 刪除了自家的報告。27條註釋中有16條是假的。但本週 KPMG 也遭遇了同樣的事情,而且這次更嚴重了。45條註釋中只有5條是真的。加上德勤,四大1中有三家栽在了 AI 捏造的假註釋上。
AI 偵測新創公司 GPTZero 將這種現象命名為 “氛圍引用(vibe citing)“2。指的是 AI 捏造的假來源,未經驗證就直接照搬使用的行為。
先說結論,這不是個別企業的失誤。問題的本質不在技術,而在 “讓驗證被跳過的組織結構”。
GPTZero 研究團隊逐行追蹤了 EY 加拿大和 KPMG 的報告 “Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems”、“Total Experience: Redefining Excellence in the Age of Agentic AI”,結果相當震撼。
🔍 EY 報告中實際發現的問題
首先,EY 的報告內容是關於忠誠度計畫(積分、里程)的資安漏洞。EY 的兩位合夥人和一位資深經理署名為作者,該報告被用作加拿大分公司的資安顧問業務行銷素材。

先按時間順序看第一件事。2025年底 EY 加拿大發布的忠誠度計畫資安報告,被 GPTZero 逐行追蹤。
- 27篇參考文獻中有16篇(約60%)是幻覺:URL 回傳 404,或該文件根本不存在
- 偽造麥肯錫報告:引用了一篇名為 “Loyalty Economics Report (2022)” 的麥肯錫報告,但麥肯錫根本沒有這份報告。經分析,這是低品質部落格中已被幻覺污染的資訊被 AI 再次吸收後產生的 “間接幻覺(secondhand hallucination)”
- 自相矛盾的數據:忠誠度市場規模和未使用積分規模同時被標為 2,000 億美元
- AI 生成機率 72%:報告文字中 72% 被判定為 AI 生成
EY 加拿大立即刪除了該報告,並表示”正在審查發布經過”。同時劃清界線表示”此報告與任何客戶專案無關”。換句話說,他們自己撰寫、自己發布的報告,卻說不知道怎麼發布上去的,跟客戶也無關,數據來源也不知道。😂
KPMG:AI 報告被 AI 幻覺填滿
EY 事件爆發不到一個月,本週 KPMG 爆出了更大的事件。
問題出在 KPMG 國際 2025年10月發布的 “Total Experience: Redefining Excellence in the Age of Agentic AI” 報告。這份報告探討代理式 AI3 的企業應用案例,但 GPTZero 的分析結果顯示,45條註釋中 精確與來源吻合的只有5條。其餘40條要麼標題被篡改,要麼無法確認來源,要麼完全是捏造的。
不只是註釋有問題。報告中出現的 事實陳述約有一半是虛假的或來源被調換了。 UBS、英國 NHS、瑞士聯邦鐵路、倫敦交通局的 AI 導入案例被具體描述,但這些機構向 FT 確認”沒有這回事”。阿聯酋航空的 AI 聊天機器人 ‘Sara’ 能變更航班的描述也是假的。Sara 不是聊天機器人而是機器人導覽員,而且沒有變更航班的功能。
更諷刺的是自相矛盾。報告寫著”55% 的 CEO 將 AI 列為首要投資目標”,但同一個月 KPMG 發布的自家 CEO Outlook 報告中,這個數字是 71%。連自己公司的報告都正確引用不了。
KPMG 將報告從網站下架,表示”正在調查發布經過”。(怎麼套路都一樣?)
📋 不只是顧問業的問題
在 EY、KPMG 之前,德勤已經被抓住兩次了。2025年澳洲政府福利報告(部分退還費用)和加拿大醫療人力報告(160萬加元)中發現了假學術引用,真實存在的研究者被列為從未合作過的論文的共同作者。
法律業界也不例外。2026年4月,華爾街頂尖律所 Sullivan & Cromwell 向紐約聯邦破產法院提交了道歉信。在緊急申請書中錯誤引用美國破產法、引用不存在的判例的事實被發現了。合夥人 Andrew Dittrich 承認”內部 AI 政策未被遵守”。
學術界也是如此。GPTZero 分析了全球頂尖 AI 學術會議 NeurIPS 2025 的 4,000 篇已接受論文,在至少 53 篇中發現了 100 件以上的幻覺引用。巴黎 HEC 的 Damien Charlotin 運作的 AI 幻覺判例資料庫中,截至 2026年初已記錄 1,450件以上,其中 2025年一年就佔了整體的約 90%。
🧩 結構性問題:為什麼這種事反覆發生
到這裡很容易得出”AI 是問題所在”的結論,但我看到的焦點略有不同。
第一,“觀點領導報告”的生產結構變了。
EY 的忠誠度報告也好,KPMG 的代理式 AI 報告也好,都不是客戶交付物。它們是 行銷資產,用來推廣顧問服務。四大每年發布數百份這樣的報告,向市場傳遞”我們是這個領域的專家”的信號。生產壓力增大,驗證流程就不像客戶交付物那樣嚴格了。KPMG 的情況是,一份探討 AI 應用案例的報告被 AI 幻覺填滿,這已經超越了諷刺,是信任結構本身的缺陷。
第二,“有沒有用 AI”不在驗證對象中。
德勤澳洲的案例很具代表性。最初報告中根本沒有提及 AI 使用的事實。問題爆發後才承認”使用了 Azure OpenAI”。Sullivan & Cromwell 也說”有全面的 AI 使用政策和教育要求”,但實際上是”該政策未被遵守”。有政策和政策在運作是完全不同的問題。
第三,出現了”間接幻覺”這個新的污染路徑。
GPTZero 這次特別關注的是 間接幻覺(secondhand hallucination)4。EY 報告中的假麥肯錫來源,很可能是 AI 從低品質部落格中學習了已被幻覺污染的資訊,將其當作”真的”再行產出的結果。用 GPTZero 研究團隊的話來說,將這樣的報告發布到線上,本身就 “等於往互聯網這口知識之井裡下毒”。特別是像 EY 這樣權威機構網站上的資訊,很可能被其他 AI 模型作為訓練數據吸收,從而形成幻覺生幻覺的惡性循環。尤其,AI 引用時傾向優先選擇權威媒體,所以問題更嚴重。
奧茲的視角
我不認為這件事的核心是”AI 幻覺”這個技術缺陷。
在制定 GTM 策略時,我無數次見過一個模式:新工具出現時,企業一邊向客戶 賣 這個工具,同時在內部 用 它。這個雙重定位要運作,就需要證明”我們能管理這個工具的風險”,而現在四大中有三家同時在證明上失敗了。EY 吹噓 AI 營收成長 30%,卻無法驗證註釋;KPMG 強調 AI 治理,卻原封不動地刊載了 AI 捏造的案例。
在我看來,真正危險的不是幻覺本身。用 AI 生成一條註釋只要 3 秒,驗證它需要 3 分鐘。27條註釋就是 81 分鐘。發現幻覺的成本可能大於用 AI 節省的時間,這個事實,大多數組織還沒有意識到。
結語
這件事有三點值得記住。
-
四大中有三家被抓住,意味著這不是特定公司的文化問題,而是產業結構的問題。剩下那家(PwC)也無法保證安全。
-
問題反覆發生的原因不在技術,而在 組織內的驗證流程。光有”AI 使用政策”是不夠的。需要確認政策是否真正在運作的結構。
-
在賣信任的產業中,來源的準確性就是產品本身。一旦一條假註釋被揭穿,受質疑的不是報告的結論,而是 機構整體的判斷力。
下次讀顧問報告或研究資料時,試著直接點擊一下註釋的 URL。這個小小的動作,就是”這個來源是真的嗎?“這個問題的起點。
參考資料 & 延伸閱讀
核心來源
- GPTZero, “Investigation: Hallucinations in Ernst & Young Report on Loyalty Fraud”, 2026.5.14.:可以看到 EY 報告註釋逐條追蹤的過程。
- GPTZero, “Chasing the Hallucinations: KPMG’s AI-Powered Attempt at Redefining Excellence”, 2026.6.12.:KPMG 報告 45條註釋全數追蹤的調查報告。
- Stephen Foley, “EY retracts study after researchers discover AI hallucinations”, Financial Times, 2026.5.15.:FT 的一手報導。包含 EY 的官方立場。
- TechCrunch, “KPMG pulls report on AI usage due to apparent hallucinations”, 2026.6.13.:包含 UBS、NHS、倫敦交通局直接否認”事實並非如此”的內容。
- Sherwood News, “AI hallucinations appear to be creeping into consulting reports”, 2026.5.15.:首次詳細探討”間接幻覺(secondhand hallucination)“概念的報導。
背景知識
- Fortune, “Deloitte allegedly cited AI-generated research in a million-dollar report for a Canadian provincial government”, 2025.11.25.:德勤加拿大 160萬美元報告事件的始末。
- Canadian Lawyer, “Sullivan & Cromwell apologizes to US bankruptcy judge for AI-generated errors in Prince Group case”, 2026.4.
- Fortune, “NeurIPS research papers contained 100+ AI-hallucinated citations”, 2026.1.21.:顯示 AI 學術社群本身也未能倖免於幻覺的報導。
- Damien Charlotin, “AI Hallucination Cases Database”:追蹤全球法院 AI 幻覺判決的資料庫。截至 2026年初已記錄 1,450件以上。

각주
-
四大(Big Four):指全球四大會計師與顧問公司——德勤(Deloitte)、PwC、EY(Ernst & Young)、KPMG。負責全球大型企業和政府機構的會計審計、策略顧問、稅務諮詢等業務,是業界最大的企業。 ↩
-
氛圍引用(vibe citing):指 AI 生成的假來源或引用未經驗證就直接使用的行為。意為”憑氛圍引用”,是 GPTZero 在 2025年初創立的用語。 ↩
-
代理式 AI(Agentic AI):超越僅等待使用者指示的既有生成式 AI,能自主設定目標、規劃、利用所需數據和工具,自主執行複雜多階段任務的人工智慧系統。 ↩
-
間接幻覺(secondhand hallucination):AI 從其他來源學習了已被幻覺(捏造)的資訊,將其當作真實資訊再行產出的現象。類似假資訊在互聯網上流傳後被”來源洗白”的結構。 ↩


