29. Juli 2026·4 Min. Lesezeit·AIgentic.media

Die eigene Medizin: PwC erwischte KI-Halluzinationen

ai-newssafety-incidentbig-fourconsultinghalluzination
Die eigene Medizin: PwC erwischte KI-Halluzinationen

Die Waffe richtet sich gegen den Schützen

PricewaterhouseCoopers, eines der vier größten Wirtschaftsprüfungsunternehmen der Welt, hat jahrelang eine Praxis aufgebaut, die Kunden zu KI-Governance, Risikomanagement und verantwortungsvoller Bereitstellung berät. Die Website ist voll von Whitepapers über vertrauenswürdige KI, ethische Rahmenwerke und die Bedeutung menschlicher Überwachung.

Letzte Woche fand GPTZero heraus, dass PwCs eigene Berichte zu genau diesen Themen möglicherweise von derselben Art von KI geschrieben wurden, deren Kontrolle die Kunden bezahlen.

Die KI-Erkennungsfirma analysierte vier PwC-Middle-East-Reporte, die zwischen 2024 und 2026 veröffentlicht wurden. Jeder einzelne enthielt erfundene Quellen und falsche Behauptungen. Das schlechteste Beispiel, ein Bericht mit dem Titel "Transforming Governance", erreichte 84 Prozent auf GPTZeros KI-Generierungswahrscheinlichkeitsskala.

Ein Produkt auf Basis von Phantomkunden

Der Bericht "Transforming Governance" tut etwas besonders Problematisches: Er bewirbt ein PwC-Produkt namens Citizen Pulse, das als Plattform zur Messung des öffentlichen Vertrauens in Regierungsinstitutionen beschrieben wird. Der Bericht behauptet, Regierungen in Dänemark, Saudi-Arabien, den USA und Australien würden auf Citizen Pulse setzen.

GPTZero fand keine Belege dafür, dass eine dieser Regierungen das Produkt nutzt. Die Zitate, die diesen Behauptungen zugeordnet waren, verwiesen auf Quellen mit falschen Titeln, defekten URLs und nicht existierenden Autoren. GPTZero nennt dieses Muster "Vibe Citing": Referenzen werden lose angefügt, um den Anschein von Autorität zu erwecken, ohne die zugrunde liegende Aussage tatsächlich zu stützen.

Ein Consulting-Bericht auf einem Schreibtisch mit roten Fragezeichen neben erfundenen Quellenangaben, ein Laptop zeigt die GPTZero-Analyse

Das Set ist komplett

Der PwC-Fund macht den Durchmarsch perfekt. GPTZero hatte zuvor dasselbe Muster von KI-generierten Inhalten und erfundenen Quellen bei KPMG, Deloitte und Ernst & Young identifiziert. Alle vier großen Wirtschaftsprüfungsgesellschaften wurden nun mit KI-Halluzinationen in ihren veröffentlichten Arbeiten erwischt.

Das Muster ist bemerkenswert konsistent: Am stärksten betroffen sind Thought-Leadership-Beiträge über KI-Governance und digitale Transformation. Genau jene Berichte, die von Kunden am ehesten ungeprüft übernommen werden, weil sie bei einer Big-Four-Firma strenge redaktionelle Standards vermuten.

Die Wissenschaft hat dasselbe Problem

GPTZeros Ergebnisse spiegeln einen breiteren Trend wider. Eine früher in diesem Jahr veröffentlichte Studie fand über 100 gefälschte Zitate, die bei einer großen KI-Konferenz durch das Peer-Review schlüpften. Forscher dokumentieren einen Anstieg von KI-generierten Einreichungen bei wissenschaftlichen Zeitschriften, von denen viele Referenzen auf nicht existierende Papiere und Autoren enthalten.

Die Beratungsbranche funktioniert wie die Wissenschaft auf Vertrauen in institutionelle Kontrollinstanzen. Wenn diese Kontrolle an dieselben KI-Modelle ausgelagert wird, über die geschrieben wird, wird die Fehleranfälligkeit des Systems sich selbst verstärkend.

Was PwC dazu sagt

PwC Middle East teilte der Financial Times mit, man nehme Genauigkeit ernst und aktualisiere "eine begrenzte Anzahl unterstützender Zitate" in den markierten Berichten. Die Firma erklärte nicht, wie die Fehler entstanden, ob KI-Tools bei der Erstellung verwendet wurden oder welche Qualitätskontrollen versagt haben.

Dieses Schweigen ist aufschlussreich. Ein Unternehmen, das Kunden im KI-Risikomanagement berät, sollte in der Lage sein, genau zu erklären, wie seine eigenen KI-Governance-Prozesse funktionieren. Es nicht zu können oder nicht zu wollen, wirft die Frage auf, ob diese Prozesse überhaupt existieren.

Die Ironie wirkt in beide Richtungen

Es gibt eine oberflächliche Ironie: KI-Berater, die beim schlechten Einsatz von KI erwischt werden. Aber die tiefere Geschichte handelt von Verantwortungsstrukturen. GPTZero, selbst ein KI-Tool, deckt die Fehler auf, die PwCs menschlicher Überprüfungsprozess übersehen hat. KI ist sowohl die Quelle des Problems als auch das Instrument, das es offenlegte.

Für Kunden, die Big-Four-Preise für KI-Governance-Beratung zahlen, bleibt die unbequeme Frage: Wenn die Berater ihre eigene Arbeit nicht prüfen, was prüfen sie dann für Ihre?

Quellen

Mehr erfahren?

Lass uns besprechen, wie KI dein Business transformieren kann.

Kontakt aufnehmen