Falsche KI-Zusammenfassungen halbieren korrekte Erinnerung
29. September 2026

In einer Studie mit 331 Personen sank die korrekte Erinnerung nach einer irreführenden KI-Zusammenfassung von 83,6 auf 44,8 Prozent. Ein Warnhinweis auf KI half nicht.
Worum es geht
Eine am 28. September 2026 veröffentlichte Studie von Georgetown University und University of Washington zeigt, dass fehlerhafte KI-Zusammenfassungen nicht nur falsch informieren. Sie können auch verändern, woran sich Menschen später zu erinnern glauben.
331 Versuchspersonen sahen ein animiertes Video eines Verkehrsunfalls. 24 bis 48 Stunden später lasen sie eine korrekte oder gezielt irreführende Zusammenfassung. Bei einer richtigen Zusammenfassung erinnerten sich 83,6 Prozent korrekt an das Verkehrszeichen im Video. Nach der irreführenden Version waren es nur noch 44,8 Prozent.
Was die Untersuchung tatsächlich macht
Die Forschenden kombinierten zwei Untersuchungen. Zunächst ließen sie ChatGPT und Gemini das Unfallvideo mit verschiedenen Vorgaben zusammenfassen. Im Mittel fehlten 51,6 Prozent der zentralen Details. 95 Prozent der Zusammenfassungen ließen sogar das wichtigste Ereignis aus: die Kollision zwischen Auto und Fußgänger.
Für das Gedächtnisexperiment wurden die Teilnehmenden zufällig Gruppen zugewiesen. Sie sahen entweder ein Stopp- oder ein Vorfahrt-gewähren-Schild. Später erhielten sie eine Zusammenfassung, in der dieses Detail korrekt oder falsch dargestellt war. Manche Personen wurden darüber informiert, dass der Text von einer KI stammte, andere glaubten an einen menschlichen Verfasser. Die Kennzeichnung veränderte den Effekt nicht messbar.
Warum das wichtig ist
KI-Zusammenfassungen erscheinen heute in Suchergebnissen, Besprechungsprotokollen, Nachrichten-Apps und Dokumentensystemen. In Bereichen wie Medizin, Polizei oder Recht können sie zur Grundlage späterer Aussagen und Entscheidungen werden. Der übliche Ansatz „Ein Mensch prüft das Ergebnis“ greift möglicherweise zu kurz, wenn der fehlerhafte Text bereits die Erinnerung der prüfenden Person beeinflusst.
Die Studie liefert eine konkrete Größenordnung für dieses Risiko. Der Anteil korrekter Antworten sank um 38,8 Prozentpunkte. Zudem half weder allgemeines Vertrauen in KI noch der ausdrückliche Hinweis auf die maschinelle Herkunft. Das spricht dafür, Zusammenfassungen in wichtigen Verfahren direkt mit dem Originalmaterial zu verknüpfen und strittige Details sichtbar zu markieren.
Die Arbeit soll im Oktober 2026 auf der Fachkonferenz AIES vorgestellt werden. Sie verbindet Forschung zu generativer KI mit dem seit Jahrzehnten bekannten Effekt, dass nachträgliche Informationen menschliche Erinnerungen verändern können.
Einfach erklärt
Stellen Sie sich vor, Sie packen einen Koffer und fotografieren den Inhalt. Am nächsten Tag gibt Ihnen jemand eine Liste, auf der fälschlich ein roter Schal steht. Wenn Sie später nur aus dem Gedächtnis aufzählen, was im Koffer war, kann die Liste das Foto in Ihrer Erinnerung überlagern. Eine KI-Zusammenfassung kann genauso zwischen das ursprüngliche Erlebnis und die spätere Erinnerung treten.
Praktisches Beispiel
Eine Versicherung bearbeitet 1.000 Schadensvideos im Monat und lässt jedes Video automatisch zusammenfassen. Bei 100 Fällen ist die Farbe einer Ampel entscheidend. Wenn Mitarbeitende zuerst eine falsche Zusammenfassung lesen und die in der Studie gemessene Quote übertragbar wäre, würden statt rund 84 nur etwa 45 Personen das Detail korrekt erinnern. Deshalb sollte das System die relevante Videostelle direkt anzeigen, Aussagen aus der Zusammenfassung mit Zeitmarken belegen und Entscheidungen nicht allein auf den Kurztext stützen.
Einordnung und Grenzen
- Die Studie nutzte animierte Videos und ein einzelnes Verkehrsszenario. Reale Polizeiaufnahmen, Arztgespräche oder Arbeitsbesprechungen können andere Ergebnisse liefern.
- Die Forschenden untersuchten 331 Personen. Das ist aussagekräftig für das Experiment, aber keine universelle Fehlerquote für alle Bevölkerungsgruppen und Situationen.
- Die Zusammenfassungen wurden für kontrollierte Bedingungen teilweise zusammengesetzt und gezielt verändert. Die Studie misst daher keinen typischen Fehleranteil kommerzieller Zusammenfassungsdienste im Alltag.
SEO- und GEO-Schlüsselbegriffe
KI-Zusammenfassungen, menschliches Gedächtnis, Fehlinformation, ChatGPT, Gemini, Georgetown University, University of Washington, AIES 2026, generative KI, Erinnerungsverzerrung
💡 Im Klartext
Eine falsche KI-Zusammenfassung kann beeinflussen, was Menschen später für ihre eigene Erinnerung halten. Im Experiment fiel die korrekte Erinnerung von 83,6 auf 44,8 Prozent; selbst ein KI-Warnhinweis schützte nicht.
Wichtigste Erkenntnisse
- →331 Personen nahmen an dem zweistufigen Gedächtnisexperiment teil.
- →Irreführende Zusammenfassungen senkten die korrekte Erinnerung von 83,6 auf 44,8 Prozent.
- →Im Mittel fehlten 51,6 Prozent der zentralen Details in den geprüften KI-Zusammenfassungen.
- →Ein Hinweis auf die maschinelle Herkunft verhinderte die Erinnerungsverzerrung nicht.
- →In wichtigen Verfahren sollten Zusammenfassungen immer auf überprüfbare Originalstellen verweisen.
Häufige Fragen
Welche Modelle wurden untersucht?
Die Forschenden analysierten Zusammenfassungen von ChatGPT und Gemini. Für das kontrollierte Gedächtnisexperiment stammte der Text aus ChatGPT und wurde teilweise zusammengesetzt.
Half ein Hinweis, dass die Zusammenfassung von KI stammt?
Nein. Die Kennzeichnung als KI-Text verringerte den gemessenen Einfluss auf die Erinnerung nicht.
Gilt das Ergebnis auch für reale Polizeivideos?
Das ist noch offen. Die Studie verwendete animierte Unfallszenen; reale Aufnahmen sollen Gegenstand weiterer Forschung sein.