KI-ZUSAMMENFASSUNGEN KÖNNEN IHRE ERINNERUNG UMSCHREIBEN
Generative KI breitet sich in Arbeitsfeldern aus, in denen viel auf dem Spiel steht: Polizeibehörden können Berichte inzwischen automatisch aus Bodycam-Aufnahmen oder Tonmitschnitten erzeugen; KI taucht auch bei Einstellungsverfahren und im Gesundheitswesen auf. Sie macht Fehler. In einem berichteten Fall behauptete ein KI-generierter Polizeibericht, ein Beamter habe sich in einen Frosch verwandelt — die KI hatte den Soundtrack von Küss den Frosch aufgeschnappt, der im Hintergrund lief.
Die übliche Absicherung ist ein Mensch, der das Ergebnis prüft. Doch auch das menschliche Gedächtnis ist fehlbar.
Ein 50 Jahre alter Effekt
1978 zeigte die Psychologin Elizabeth Loftus, dass Informationen, die man nach einem Ereignis erhält, verändern können, wie man sich daran erinnert: der Fehlinformationseffekt. In ihrem klassischen Experiment sahen Personen einen Autounfall an einer Kreuzung mit einem Stoppschild oder einem Vorfahrt-gewähren-Schild und lasen dann einen Text, der das falsche Schild nannte — und viele erinnerten sich falsch. Schon ein einziges Verb („krachten“ statt „stießen“) kann verändern, wie schnell die Autos in der Erinnerung fuhren.
Mattea Sim, Yael Eiger und Tadayoshi Kohno von der Georgetown University und der University of Washington fragten sich, ob KI-Zusammenfassungen dasselbe bewirken könnten.
Schritt 1: Wie genau sind KI-Zusammenfassungen?
Sie nahmen zwei 25-sekündige Animationsvideos aus einer modernen Wiederholung von Loftus’ Studie: Ein rotes Auto erreicht eine Kreuzung mit einem Stopp- oder Vorfahrt-gewähren-Schild, biegt rechts ab, fährt einen Fußgänger an, der stürzt und wieder aufsteht, und der Fahrer steigt aus. Sie baten ChatGPT-5.5 und Gemini 2.5 Flash-Lite um sachliche, neutrale Zusammenfassungen von mindestens 300 Wörtern, die „alles Wichtige“ enthalten sollten — insgesamt 20 Zusammenfassungen.
- Jede Zusammenfassung enthielt Fehler: 7 bis 21 pro Text, bei rund 305 Wörtern.
- Im Schnitt fehlten 51,6 % der zentralen Details.
- 19 der 20 Zusammenfassungen ließen den Zusammenstoß selbst weg — das mit Abstand wichtigste Ereignis.
- 60 % fügten Details hinzu, die es nicht gab, etwa erfundene Fußgänger oder Fahrzeuge. Eine Zusammenfassung stellte sogar fest, dass „keine anderen Personen oder Fahrzeuge direkt mit der Szene interagierten“.
- Die Fehler wechselten von Versuch zu Versuch: In einer Zusammenfassung bog das Auto rechts ab, in einer anderen links.
Schritt 2: Verändert das, woran sich Menschen erinnern?
328 Teilnehmende in den USA sahen eines der Videos. Ein bis zwei Tage später lasen sie eine von ChatGPT verfasste Zusammenfassung aus 21 Sätzen. Sie nannte entweder das richtige oder das falsche Verkehrszeichen. Einigen wurde gesagt, eine KI habe sie geschrieben, anderen, ein professioneller menschlicher Transkribent — der Text war identisch. Dann folgte ein Gedächtnistest.
- Mit einer korrekten Zusammenfassung erinnerten sich 83,6 % an das richtige Schild.
- Mit einer irreführenden nur 44,8 %.
- Es machte keinen Unterschied, ob die Leute glaubten, die Zusammenfassung stamme von einer KI (46,3 % richtig) oder von einem Menschen (43,4 %).
- Weder das Vertrauen in KI noch die Häufigkeit ihrer Nutzung machten einen signifikanten Unterschied.

Anteil der Teilnehmenden, die sich an das richtige Verkehrszeichen erinnerten: etwa 80 % nach einer korrekten Zusammenfassung, unter 50 % nach einer irreführenden — egal ob als KI oder Mensch gekennzeichnet. — Abbildung 1, Sim, Eiger & Kohno (2026), arXiv:2609.28820.
An das Video selbst erinnerten sich die Teilnehmenden durchaus: 96,6 % wussten noch, dass der Unfall bei Tag geschah, ein Detail, das in der Zusammenfassung fehlte. Kurioserweise wurde die „menschliche“ Zusammenfassung als klarer bewertet, obwohl sie Wort für Wort identisch war.
Ein Mensch in der Schleife reicht nicht
Die Autoren folgern, dass die Person, die die KI korrigieren soll, stattdessen durch deren Fehler eine veränderte Erinnerung bekommen kann — ohne böse Absicht von irgendwem. In Bereichen wie der Polizeiarbeit, wo das Gedächtnis von Augenzeugen seit Langem Sorgen bereitet, stellen sie infrage, ob KI überhaupt eingesetzt werden sollte. Eine gekürzte Fassung dieser Arbeit erscheint im Tagungsband der AAAI/ACM Conference on AI, Ethics, and Society (Oktober 2026).
Grenzen
Zwei einfache Animationsvideos, ein einziger Prompt und 20 Zusammenfassungen; nur eine Art irreführendes Detail, online getestet. Die den Teilnehmenden gezeigte Zusammenfassung wurde aus mehreren Versuchen ausgewählt und für mehr Genauigkeit leicht überarbeitet.
