Bilişim ve yapay zekâÖn baskıDeney3 dk okuma

YAPAY ZEKÂ ÖZETLERİ HAFIZANIZI YENİDEN YAZABİLİR

Üretken yapay zekâ, riskin yüksek olduğu işlere yayılıyor: polis teşkilatları artık yaka kamerası görüntülerinden ya da ses kayıtlarından otomatik olarak rapor üretebiliyor; yapay zekâ işe alımda ve sağlıkta da karşımıza çıkıyor. Ve hata yapıyor. Bildirilen bir vakada, yapay zekânın ürettiği bir polis raporu bir memurun kurbağaya dönüştüğünü iddia etti — arka planda oynayan The Princess and the Frog (Prenses ve Kurbağa) filminin sesini almıştı.

Olağan güvence, çıktıyı denetleyen bir insandır. Ama insan hafızası da yanılabilir.

50 yıllık bir etki

1978’de psikolog Elizabeth Loftus, bir olaydan sonra edinilen bilginin o olayı nasıl hatırladığımızı değiştirebileceğini gösterdi: yanlış bilgi etkisi (misinformation effect). Klasik deneyinde insanlar, bir kavşakta “dur” ya da “yol ver” işaretinin bulunduğu bir araba kazasını izledi, ardından yanlış işareti belirten bir metin okudu — ve pek çoğu onu yanlış hatırladı. Tek bir fiil bile (“hit” yerine “smashed”, yani “çarptı” yerine “ezip geçti”) insanların arabaları ne kadar hızlı hatırladığını değiştirebiliyor.

Georgetown Üniversitesi ve Washington Üniversitesi’nden Mattea Sim, Yael Eiger ve Tadayoshi Kohno, yapay zekâ özetlerinin de aynısını yapıp yapamayacağını sordu.

1. adım: yapay zekâ özetleri ne kadar doğru?

Loftus’un çalışmasının modern bir tekrarından iki adet 25 saniyelik animasyon video aldılar: kırmızı bir araba “dur” ya da “yol ver” işaretli bir kavşağa gelir, sağa döner, düşüp kalkan bir yayaya çarpar ve sürücü arabadan iner. ChatGPT-5.5 ve Gemini 2.5 Flash-Lite’tan, “önemli olan her şeyi” içeren, en az 300 kelimelik, olgusal ve tarafsız özetler istediler — toplam 20 özet.

  • Her özette hata vardı: yaklaşık 305 kelimede, her birinde 7 ile 21 arası.
  • Ortalama olarak merkezi ayrıntıların %51,6’sı eksikti.
  • 20 özetin 19’u çarpışmanın kendisini atladı — en önemli tek olayı.
  • %60’ı, uydurma yayalar ya da araçlar gibi olmayan ayrıntılar ekledi. Bir özet, “başka hiçbir karakterin ya da aracın sahneyle doğrudan etkileşime girmediğini” bile belirtti.
  • Hatalar bir denemeden ötekine değişti: araba bir özette sağa, bir başkasında sola döndü.

2. adım: insanların hatırladıklarını değiştiriyor mu?

Amerika Birleşik Devletleri’nde 328 katılımcı videolardan birini izledi. Bir ila iki gün sonra, ChatGPT tarafından yazılmış 21 cümlelik bir özet okudular. Özet ya doğru trafik işaretini ya da yanlış olanı belirtiyordu. Bazılarına özeti bir yapay zekânın, bazılarına da profesyonel bir insan deşifre uzmanının yazdığı söylendi — metin aynıydı. Ardından bir hafıza testi geldi.

  • Doğru bir özetle, katılımcıların %83,6’sı doğru işareti hatırladı.
  • Yanıltıcı bir özetle bu oran yalnızca %44,8 oldu.
  • İnsanların özetin bir yapay zekâdan (%46,3 doğru) ya da bir insandan (%43,4) geldiğini düşünmesi fark yaratmadı.
  • Ne yapay zekâya duyulan güven ne de onu ne sıklıkla kullandıkları anlamlı bir fark yarattı.

Tutarlı ve yanıltıcı özetler için, yapay zekâ ve insan etiketleriyle hatırlama doğruluğu grafiği.

Doğru trafik işaretini hatırlayan katılımcıların oranı: doğru bir özetten sonra yaklaşık %80, yanıltıcı bir özetten sonra %50’nin altında — özet ister yapay zekâ ister insan olarak etiketlenmiş olsun. — Şekil 1, Sim, Eiger ve Kohno (2026), arXiv:2609.28820.

Katılımcılar videonun kendisini hatırlıyordu: %96,6’sı, özette geçmeyen bir ayrıntı olan kazanın gündüz olduğunu doğru hatırladı. İlginç biçimde, “insan” özeti kelimesi kelimesine aynı olmasına rağmen daha açık bulundu.

Döngüde bir insan yeterli değil

Yazarlar, yapay zekâyı düzeltmesi beklenen kişinin bunun yerine onun hatalarıyla hafızasının değişebileceği sonucuna varıyor — kimsenin kötü niyeti olmadan. Görgü tanığı hafızasının uzun zamandır bir endişe kaynağı olduğu polislik gibi alanlarda, yapay zekânın hiç kullanılıp kullanılmaması gerektiğini sorguluyorlar. Bu çalışmanın kısaltılmış bir sürümü, AAAI/ACM Yapay Zekâ, Etik ve Toplum Konferansı’nın (Ekim 2026) bildiri kitabında yayımlandı.

Sınırlar

İki basit animasyon video, tek bir istem (prompt) ve 20 özet; çevrimiçi olarak test edilmiş tek bir tür yanıltıcı ayrıntı. Katılımcılara gösterilen özet birkaç deneme arasından seçildi ve doğruluk için hafifçe düzenlendi.

Legal notice