Informatique & IAPreprintExpérience3 min de lecture

LES RÉSUMÉS D'IA PEUVENT RÉÉCRIRE VOTRE MÉMOIRE

L’IA générative gagne des métiers à enjeux : des services de police peuvent désormais générer automatiquement des rapports à partir des images ou du son des caméras-piétons ; l’IA s’invite aussi dans le recrutement et la santé. Elle se trompe. Dans un cas rapporté, un rapport de police généré par IA affirmait qu’un policier s’était transformé en grenouille : il avait capté la bande-son de La Princesse et la Grenouille en arrière-plan.

Le garde-fou habituel : un humain vérifie. Mais la mémoire humaine est faillible, elle aussi.

Un effet vieux de cinquante ans

En 1978, la psychologue Elizabeth Loftus a montré qu’une information reçue après un événement peut modifier notre souvenir : c’est l’effet de désinformation. Dans son expérience classique, des gens voyaient un accident à un carrefour avec un panneau stop ou un cédez-le-passage, puis lisaient un texte citant le mauvais panneau — et beaucoup se trompaient ensuite. Un simple verbe (« percuté » plutôt que « heurté ») change même la vitesse dont on se souvient.

Mattea Sim, Yael Eiger et Tadayoshi Kohno, des universités de Georgetown et de Washington, se sont demandé si les résumés d’IA pouvaient faire de même.

Étape 1 : les résumés d’IA sont-ils fiables ?

Ils ont repris deux vidéos animées de 25 secondes, issues d’une réplication moderne de l’étude de Loftus : une voiture rouge arrive à un carrefour avec un stop ou un cédez-le-passage, tourne à droite, percute un piéton qui tombe puis se relève, et le conducteur sort. Ils ont demandé à ChatGPT-5.5 et Gemini 2.5 Flash-Lite des résumés factuels et neutres, d’au moins 300 mots, incluant « tout ce qui est important » — 20 résumés au total.

  • Tous les résumés contenaient des erreurs : de 7 à 21 chacun, pour environ 305 mots.
  • En moyenne, 51,6 % des détails centraux manquaient.
  • 19 résumés sur 20 omettaient la collision elle-même, l’événement le plus important.
  • 60 % ajoutaient des éléments absents, comme des piétons ou des véhicules inventés. Un résumé affirmait même qu’« aucun autre personnage ou véhicule n’a interagi directement avec la scène ».
  • Les erreurs changeaient d’un essai à l’autre : la voiture tournait à droite dans un résumé, à gauche dans le suivant.

Étape 2 : cela change-t-il nos souvenirs ?

328 participants américains ont regardé l’une des vidéos. Un à deux jours plus tard, ils ont lu un résumé de 21 phrases rédigé par ChatGPT, citant le bon panneau ou le mauvais. On disait aux uns qu’une IA l’avait écrit, aux autres un transcripteur humain professionnel — le texte était identique. Puis venait un test de mémoire.

  • Avec un résumé exact, 83,6 % se souvenaient du bon panneau.
  • Avec un résumé trompeur, seulement 44,8 %.
  • Peu importait qu’ils croient le résumé écrit par une IA (46,3 % de bonnes réponses) ou par un humain (43,4 %).
  • Ni la confiance envers l’IA, ni la fréquence d’usage n’ont fait de différence significative.

Graphique de l’exactitude du souvenir pour les résumés exacts et trompeurs, étiquetés IA ou humain.

Part des participants qui se souviennent du bon panneau : environ 80 % après un résumé exact, moins de 50 % après un résumé trompeur — qu’il soit présenté comme écrit par une IA ou par un humain. — Figure 1, Sim, Eiger & Kohno (2026), arXiv:2609.28820.

Les participants se souvenaient bien de la vidéo : 96,6 % savaient que l’accident avait lieu de jour, un détail absent du résumé. Curiosité : le résumé « humain » a été jugé plus clair, alors qu’il était identique mot pour mot.

Un humain dans la boucle ne suffit pas

Les auteurs concluent que la personne censée corriger l’IA peut au contraire voir sa mémoire modifiée par ses erreurs — sans aucune intention malveillante de quiconque. Pour la police, où la mémoire des témoins inquiète depuis longtemps, ils posent la question de savoir si l’IA doit être utilisée du tout. Une version courte de ce travail est publiée dans les actes de la conférence AAAI/ACM sur l’IA, l’éthique et la société (octobre 2026).

Limites

Deux vidéos animées simples, une seule consigne et 20 résumés ; un seul type de détail trompeur, testé en ligne. Le résumé montré aux participants a été choisi parmi plusieurs essais et légèrement retouché pour être exact.

Mentions légales