কম্পিউটিং ও এআইপ্রিপ্রিন্টপরীক্ষাপড়তে ৩ মিনিট

এআই-এর সারাংশ আপনার স্মৃতি নতুন করে লিখে দিতে পারে

জেনারেটিভ এআই এমন সব কাজে ছড়িয়ে পড়ছে যেখানে ঝুঁকি অনেক বেশি: পুলিশ বিভাগ এখন বডি-ক্যামেরার ফুটেজ বা অডিও থেকে স্বয়ংক্রিয়ভাবে রিপোর্ট তৈরি করতে পারে; এআই নিয়োগ ও স্বাস্থ্যসেবাতেও দেখা দিচ্ছে। এটি ভুল করে। একটি প্রতিবেদিত ঘটনায়, এআই-এর তৈরি একটি পুলিশ রিপোর্টে দাবি করা হয়েছিল যে একজন অফিসার ব্যাঙে পরিণত হয়েছেন — পেছনে চলতে থাকা দ্য প্রিন্সেস অ্যান্ড দ্য ফ্রগ ছবির শব্দ সেটি ধরে ফেলেছিল।

সাধারণ সুরক্ষাব্যবস্থা হলো একজন মানুষ, যিনি ফলাফল যাচাই করেন। কিন্তু মানুষের স্মৃতিও ভুল করতে পারে।

৫০ বছরের পুরোনো একটি প্রভাব

১৯৭৮ সালে মনোবিজ্ঞানী এলিজাবেথ লফটাস দেখান যে কোনো ঘটনার পরে পাওয়া তথ্য আমরা ঘটনাটি কীভাবে মনে রাখি তা বদলে দিতে পারে: একে বলে ভুল তথ্যের প্রভাব (misinformation effect)। তাঁর বিখ্যাত পরীক্ষায় অংশগ্রহণকারীরা একটি মোড়ে গাড়ি দুর্ঘটনা দেখেন, যেখানে হয় “থামুন” (স্টপ) চিহ্ন ছিল, নয়তো “পথ ছাড়ুন” (ইল্ড) চিহ্ন; তারপর তাঁরা একটি লেখা পড়েন যাতে ভুল চিহ্নের নাম ছিল — এবং অনেকেই সেটি ভুলভাবে মনে রাখেন। এমনকি একটিমাত্র ক্রিয়াপদও (“ধাক্কা লাগল”-র বদলে “চুরমার হয়ে গেল”) বদলে দিতে পারে, মানুষ গাড়িগুলোর গতি কত দ্রুত বলে মনে রাখে।

জর্জটাউন ইউনিভার্সিটি ও ইউনিভার্সিটি অফ ওয়াশিংটনের ম্যাটিয়া সিম, ইয়েল আইগার ও তাদায়োশি কোহনো প্রশ্ন তোলেন: এআই-এর সারাংশও কি একই কাজ করতে পারে?

ধাপ ১: এআই-এর সারাংশ কতটা নির্ভুল?

তাঁরা লফটাসের গবেষণার একটি আধুনিক পুনরাবৃত্তি থেকে ২৫ সেকেন্ডের দুটি অ্যানিমেটেড ভিডিও নেন: একটি লাল গাড়ি স্টপ বা ইল্ড চিহ্নওয়ালা একটি মোড়ে পৌঁছায়, ডানে ঘোরে, এক পথচারীকে ধাক্কা দেয় — তিনি পড়ে গিয়ে আবার উঠে দাঁড়ান — এবং চালক গাড়ি থেকে নেমে আসেন। তাঁরা ChatGPT-5.5 ও Gemini 2.5 Flash-Lite-এর কাছে অন্তত ৩০০ শব্দের তথ্যনিষ্ঠ, নিরপেক্ষ সারাংশ চান, যাতে “সব গুরুত্বপূর্ণ বিষয়” থাকে — মোট ২০টি সারাংশ।

  • প্রতিটি সারাংশেই ভুল ছিল: প্রায় ৩০৫ শব্দে ৭ থেকে ২১টি করে।
  • গড়ে মূল তথ্যের ৫১.৬% অনুপস্থিত ছিল।
  • ২০টির মধ্যে ১৯টি সারাংশে ধাক্কার ঘটনাটিই নেই — অথচ সেটিই সবচেয়ে গুরুত্বপূর্ণ ঘটনা।
  • ৬০% সারাংশে এমন তথ্য যোগ হয়েছে যা ছিলই না, যেমন বানানো পথচারী বা যানবাহন। একটি সারাংশে তো এমনও বলা হয়েছে যে “অন্য কোনো চরিত্র বা যানবাহন দৃশ্যটির সঙ্গে সরাসরি যুক্ত হয়নি।”
  • ভুলগুলো এক প্রচেষ্টা থেকে আরেকটিতে বদলে গেছে: এক সারাংশে গাড়িটি ডানে ঘুরেছে, আরেকটিতে বাঁয়ে।

ধাপ ২: এতে কি মানুষের স্মৃতি বদলায়?

যুক্তরাষ্ট্রের ৩২৮ জন অংশগ্রহণকারী ভিডিও দুটির একটি দেখেন। এক থেকে দুই দিন পরে তাঁরা ChatGPT-এর লেখা ২১ বাক্যের একটি সারাংশ পড়েন। তাতে হয় সঠিক ট্রাফিক চিহ্নের নাম ছিল, নয়তো ভুলটির। কাউকে বলা হয় এটি এআই-এর লেখা, অন্যদের বলা হয় একজন পেশাদার মানব প্রতিলিপিকারের — লেখাটি হুবহু এক ছিল। তারপর স্মৃতির পরীক্ষা।

  • সঠিক সারাংশ পড়ে ৮৩.৬% সঠিক চিহ্নটি মনে রেখেছেন।
  • বিভ্রান্তিকর সারাংশ পড়ে মাত্র ৪৪.৮%।
  • মানুষ সারাংশটিকে এআই-এর (৪৬.৩% সঠিক) নাকি মানুষের (৪৩.৪%) লেখা ভেবেছেন, তাতে কোনো পার্থক্য হয়নি।
  • এআই-এর প্রতি আস্থা বা এটি কত ঘন ঘন ব্যবহার করেন — কোনোটিই উল্লেখযোগ্য পার্থক্য তৈরি করেনি।

সামঞ্জস্যপূর্ণ ও বিভ্রান্তিকর সারাংশ, এআই ও মানুষের লেবেল অনুযায়ী স্মৃতির নির্ভুলতার চার্ট।

সঠিক ট্রাফিক চিহ্ন মনে রাখা অংশগ্রহণকারীদের অনুপাত: সঠিক সারাংশের পরে প্রায় ৮০%, বিভ্রান্তিকর সারাংশের পরে ৫০%-এর কম — লেবেল এআই হোক বা মানুষ। — চিত্র ১, সিম, আইগার ও কোহনো (২০২৬), arXiv:2609.28820।

অংশগ্রহণকারীরা অবশ্য ভিডিওটি মনে রেখেছিলেন: ৯৬.৬% সঠিকভাবে মনে করতে পেরেছেন যে দুর্ঘটনাটি দিনের বেলায় ঘটেছিল, যে তথ্য সারাংশে ছিল না। মজার ব্যাপার, “মানুষের” সারাংশটিকে বেশি স্পষ্ট বলে মূল্যায়ন করা হয়েছে, যদিও সেটি শব্দে শব্দে একই ছিল।

লুপে একজন মানুষ থাকাই যথেষ্ট নয়

লেখকদের উপসংহার, যে মানুষটির এআই-কে শোধরানোর কথা, এআই-এর ভুলে উল্টে তাঁরই স্মৃতি বদলে যেতে পারে — কারও কোনো অসৎ উদ্দেশ্য ছাড়াই। পুলিশি কাজের মতো ক্ষেত্রে, যেখানে প্রত্যক্ষদর্শীর স্মৃতি বহুদিন ধরেই উদ্বেগের বিষয়, তাঁরা প্রশ্ন তোলেন আদৌ এআই ব্যবহার করা উচিত কি না। এই কাজের একটি সংক্ষিপ্ত সংস্করণ AAAI/ACM কনফারেন্স অন এআই, এথিক্স অ্যান্ড সোসাইটির (অক্টোবর ২০২৬) কার্যবিবরণীতে প্রকাশিত হয়েছে।

সীমাবদ্ধতা

দুটি সরল অ্যানিমেটেড ভিডিও, একটি প্রম্পট ও ২০টি সারাংশ; অনলাইনে কেবল এক ধরনের বিভ্রান্তিকর তথ্য পরীক্ষা করা হয়েছে। অংশগ্রহণকারীদের দেখানো সারাংশটি কয়েকটি প্রচেষ্টার মধ্য থেকে বাছাই করা এবং নির্ভুলতার জন্য সামান্য সম্পাদিত।

Legal notice