20. September 2026·4 Min. Lesezeit·AIgentic.media

Muse liest Ihre Nachrichten. Hat keine Ahnung wie.

metaai-safetyai-agents
Muse liest Ihre Nachrichten. Hat keine Ahnung wie.

Jason Aten, Redakteur beim Inc Magazine, öffnete seinen Mac und entdeckte etwas Beunruhigendes. Metas KI-Assistent Muse beschrieb ein Gespräch aus seinen Nachrichten - ein Gespräch, für das Aten Muse nie die Erlaubnis gegeben hatte.

Auf seine Frage, woher Muse davon wisse, antwortete der Assistent: "Ich habe die Benachrichtigungs-Previews gesehen, nicht deinen Nachrichtenverlauf. Ich habe deine Texte nicht gelesen."

Das Problem: Aten sagt, er habe Muse auch keinen Zugriff auf seine Benachrichtigungen gegeben.

Der Austausch, den Aten auf Threads veröffentlichte, zeigt etwas Beunruhigenderes als eine Datenschutzverletzung: Ein KI-System, das selbsterfundene Fähigkeiten beschreibt, die es gar nicht besitzt. Als Aten nachhakte, wie Muse die Nachrichten-Previews erhalten habe, offenbarte die Antwort ein tieferes Problem.

"Ehrliche Antwort: Ich kann dir die genaue Funktionsweise nicht nennen", sagte Muse. "Was ich weiß, ist, dass die gekoppelte Mac-App Benachrichtigungen als eine ihrer Fähigkeiten bereitstellt und sie erreichen mich durch die Gerätesynchronisation."

Diese Erklärung war falsch. Und Meta wusste das.

Die KI, die sich selbst nicht versteht

David Singleton, der Leiter von Meta Superintelligence Labs, meldete sich unter Atens Beitrag, um die Sachlage zu klären. Er erläuterte die Berechtigungen, die Muse benötigt - einschließlich des vollständigen Festplattenzugriffs für die Mac-App - und bestätigte, dass jede Funktion optional ist. Dann nannte er das eigentliche Problem.

"In dem Gespräch mit seinem Muse auf den Screenshots von Jason, als Muse 'Gerätebenachrichtigungen' synchronisierte, war es verwirrt darüber, wie die Funktion zu erklären ist, und gab eine falsche Erklärung", schrieb Singleton. "Das ist unser Fehler. Wir entschuldigen uns für die falsche Antwort von Muse und arbeiten daran, Muses Verständnis seiner eigenen Interna zu verbessern."

Das Eingeständnis ist bemerkenswert: Metas eigener KI-Assistent kann nicht beschreiben, wie seine eigenen Funktionen arbeiten, und wenn er in die Enge getrieben wird, erfindet er eine plausibel klingende Erklärung, anstatt zuzugeben, dass er es nicht weiß.

Dies ist kein einmaliger Fehler. Es ist eine strukturelle Eigenschaft großer Sprachmodelle.

Warum KI-Systeme über sich selbst lügen

Moderne KI-Assistenten wie Muse basieren auf großen Sprachmodellen, die Antworten auf der Grundlage von Mustern in Trainingsdaten generieren - nicht auf einem überprüfbaren Verständnis ihrer eigenen Architektur. Wenn sie nach ihrer internen Funktionsweise gefragt werden, konsultieren sie kein Systemhandbuch. Sie sagen die wahrscheinlichste Antwort voraus, die ein Mensch geben würde.

Das bedeutet, dass jeder KI-Assistent, wenn man ihn nach seinen Fähigkeiten fragt, eine Antwort produzieren wird, die vernünftig klingt - unabhängig davon, ob sie wahr ist oder nicht. Der Muse-Vorfall ist eine reale Demonstration dieses Phänomens.

Mehr als eine Datenschutzgeschichte

Die erste Reaktion auf Atens Beitrag konzentrierte sich auf den Datenschutz: Muse schien ohne Erlaubnis private Nachrichten zu lesen. Aber das tiefere Problem ist, dass nicht einmal Meta vollständig erklären kann, was sein Assistent über sich selbst sagen wird.

Für Nutzer schafft dies eine unmögliche Situation. Wenn eine KI nicht richtig beantworten kann "Woher weißt du von meinen Nachrichten?", welche anderen Fragen beantwortet sie dann mit erfundenen Behauptungen? Jede Erklärung, die eine KI über ihre eigenen Einschränkungen, Sicherheitsmaßnahmen oder Datenzugriffsmuster gibt, wird verdächtig.

Ein Pflaster, das die Ursache nicht heilt

Singleton versprach, dass Meta daran arbeitet, Muses Selbstverständnis zu verbessern. Aber das ist ein Pflaster, keine Lösung. Die grundlegende Architektur großer Sprachmodelle erlaubt keine echte Selbstreflexion. Sie können keine Datenbank ihrer eigenen Fähigkeiten abfragen. Sie generieren Antworten aus statistischen Mustern.

Bis KI-Systeme mit überprüfbarem Selbstwissen gebaut werden - der Fähigkeit, die Frage "Wie funktioniere ich?" durch Referenz auf die tatsächliche Architektur zu beantworten -, wird sich jeder Muse-ähnliche Vorfall wiederholen: eine selbstbewusste Erklärung, eine Entschuldigung des Unternehmens und ein Versprechen, die Symptome zu beheben, während die Ursache bestehen bleibt.

Quellen

Mehr erfahren?

Lassen Sie uns besprechen, wie KI Ihr Business transformieren kann.

Entdecken KI-Agenten