கணினியியல் & செயற்கை நுண்ணறிவுமுன்பதிப்புசோதனைபடிக்க 4 நிமிடங்கள்

ஒரே ஒரு வாக்கியம் AI ஓட்டுநர்களை நெரிசலில் சிக்க வைக்கிறது

சில பொதுவான மாதிரிகளின் மீது கட்டப்பட்ட AI முகவர்கள் பெருகிவரும் எண்ணிக்கையிலான மக்களின் சார்பாகச் செயல்படுகின்றன. டோக்கியோ பல்கலைக்கழகத்தைச் சேர்ந்த தகாஹிரோ எசாகி, நாவோட்டோ இமுரா, கட்சுஹிரோ நிஷினாரி ஆகியோர், இந்த முகவர்களில் பல ஒரே செய்தியைப் பெறும்போது என்ன நடக்கும் என்று அறிய விரும்பினர் — குறிப்பாக, மற்ற எல்லோரும் என்ன செய்வார்கள் என்பது பற்றிய ஒரு முன்கணிப்பை. ஒருமுறை ஒலிபரப்பப்பட்டால், அத்தகைய முன்கணிப்பு தான் விவரிக்கும் சூழ்நிலையையே மாற்றிவிடுகிறது; தன் சொந்தக் கணிப்பையே தோற்கடிக்கவும் கூடும்.

இதைச் சோதிக்க, மக்கள் ஒரு வரையறுக்கப்பட்ட வளத்துக்காகப் போட்டியிடும் மிக எளிய அமைப்புகளில் ஒன்றை அவர்கள் தேர்ந்தெடுத்தனர்: அன்றாட அலுவலகப் பயணம்.

இரண்டு சாலைகள், ஒரு விதி

ஒரே மாதிரியான இரண்டு சாலைகள் ஒரு புறநகரை ஒரு வணிக மாவட்டத்துடன் இணைக்கின்றன. ஒவ்வொரு காலையும் எல்லாப் பயணிகளும் ஒரே நேரத்தில் தேர்வு செய்கிறார்கள். அவர்களில் n/N பங்கினர் பயன்படுத்தும் ஒரு சாலை 20 + 80 n/N நிமிடங்கள் எடுக்கும்: போக்குவரத்து சமமாகப் பிரிந்தால் ஒரு மணி நேரம்; கிட்டத்தட்ட எல்லோரும் ஒரே சாலையில் குவிந்தால் கிட்டத்தட்ட 100 நிமிடங்கள். சமப் பிரிவில், யாரும் தனியாக மாறுவதால் லாபம் பெற முடியாது.

முக்கியச் சோதனையில், 50 முகவர்களில் ஒவ்வொன்றும், நீட்டிக்கப்பட்ட பகுத்தறிவு (extended reasoning) இல்லாமல் இயக்கப்பட்ட அதே மாதிரியான GPT-5.4-mini-க்கான தனித்தனி அழைப்பு. ஒவ்வொரு முகவரும் விதிகள், கடந்த ஐந்து நாட்களின் தன் சாலை மற்றும் பயண நேரங்கள், ஒரு தினசரி ஒலிபரப்பு ஆகியவற்றைக் காண்கிறது. மற்ற ஓட்டுநர்கள் அதே தகவலுக்கு எப்படி எதிர்வினையாற்றக்கூடும் என்று சிந்திக்கவும் ஒவ்வொரு உள்ளீட்டுக் கட்டளையும் (prompt) முகவரிடம் கேட்கிறது. ஒலிபரப்பு நான்கு வடிவங்களில் வருகிறது:

  • எந்த அறிக்கையும் இல்லை;
  • எண்கள்: ஒவ்வொரு சாலையிலும் நேற்றைய பயண நேரம்;
  • ஒரு குறிப்பு: “வழி B தற்போது குறைவான நெரிசலுடன் உள்ளது”;
  • குறிப்பும் எச்சரிக்கையும்: அதே குறிப்பு, அதைத் தொடர்ந்து “ஆனால், பல ஓட்டுநர்கள் இதே தகவலைப் பார்த்து வழி B-க்கு மாறுவார்கள் என எதிர்பார்க்கப்படுகிறது, எனவே வழி B நெரிசலாகலாம்.”

இரு-சாலை விளையாட்டு, நான்கு ஒலிபரப்புகள், ஒவ்வொரு ஒலிபரப்புக்கும் 60 சுற்றுகளில் குறைவான நெரிசல் சாலையைத் தேர்ந்தெடுத்த முகவர்களின் பங்கு.

விளையாட்டும் நான்கு ஒலிபரப்புகளும் (மேலே); கீழே, ஒவ்வொரு ஒலிபரப்புக்கும், 60 சுற்றுகளில் நேற்றைய குறைவான நெரிசல் சாலையைத் தேர்ந்தெடுத்த முகவர்களின் பங்கு, இடைநிலைப் (median) பயண நேரத்துடன். எச்சரிக்கையின் கீழ், விளையாட்டு 100-ஆவது சுற்று வரை தொடர்ந்தாலும், இந்தப் பங்கு பூஜ்ஜியத்துக்கு அருகிலேயே இருக்கிறது. — படம் 1, Ezaki, Imura & Nishinari (2026), arXiv:2609.30883.

தன்னைத்தானே தோற்கடிக்கும் ஓர் எச்சரிக்கை

எந்த அறிக்கையும் இல்லாதபோது, முகவர்கள் மந்தையாக நகர்ந்தன: கிட்டத்தட்ட எல்லாமே ஒவ்வொரு காலையும் சாலையை மாற்றின; கூட்டம் வெறுமனே ஒரு சாலையிலிருந்து மற்றதற்கு ஊசலாடியது; சராசரி 96 நிமிடங்கள். எண்கள் அதை 71 நிமிடங்களாகக் குறைத்தன; வெறும் குறிப்பே சிறப்பாகச் செயல்பட்டது: 64 நிமிடங்கள், சிறந்த 60 நிமிடங்களுக்கு அருகில்.

எச்சரிக்கை வாக்கியத்தைச் சேர்த்தது எல்லாவற்றையும் மாற்றியது. சுமார் 96% முகவர்கள் ஒரே சாலையில் — சற்று முன் நெரிசலாக இருந்த சாலையில் — நிலைகொண்டு அங்கேயே தங்கின. ஜோடியாக்கப்பட்ட பத்து ஓட்டங்களிலும், சராசரிப் பயண நேரம் 95 நிமிடங்களாக உயர்ந்தது — வெறும் குறிப்பைவிட 30 நிமிடங்கள் அதிகம். 47-க்கு 3 பிரிவில், நெரிசல் சாலையிலுள்ள ஒரு முகவருக்கு 95.2 நிமிடங்கள் தேவை; தனியாக மாறியிருந்தால் அது 26.4 நிமிடங்களாகக் குறைந்திருக்கும். முகவர்கள் அரிதாகவே அப்படிச் செய்தன. பத்து ஓட்டங்களும் 100 சுற்றுகள் வரை நீட்டிக்கப்பட்டபோது, ஒன்றுகூடத் தப்பவில்லை.

முகவர்களின் சொந்த ஒருவரி விளக்கங்கள் இந்தப் போக்கைக் காட்டுகின்றன. ஓர் ஓட்டத்தில், அவற்றில் 89% மற்ற ஓட்டுநர்கள் மாறுவதையோ நெரிசலையோ குறிப்பிட்டன. ஒரு வழக்கமான எடுத்துக்காட்டு: “A எனக்குத் தொடர்ந்து மிகவும் மெதுவாக இருந்திருக்கிறது, ஆனால் B பல மாறுபவர்களை ஈர்க்கும் என்று ஒலிபரப்பு எச்சரிக்கிறது, எனவே A பாதுகாப்பான தேர்வு.” இந்த வாக்கியங்கள் உருவாக்கப்பட்ட உரையை விவரிக்கின்றனவே தவிர மாதிரியின் உள் கணக்கீட்டை அல்ல என்று ஆசிரியர்கள் வலியுறுத்துகின்றனர்.

நெரிசல் நிரந்தரமானதல்ல. 31-ஆவது சுற்றில் எச்சரிக்கைக்குப் பதிலாக வெறும் எண்களைக் கொடுத்தது, 96–100% முகவர்களைக் கிட்டத்தட்ட காலியான சாலைக்கு விரைய வைத்தது — சிறிது நேரம் அதையே நெரிசலாக்கின — பின்னர் செலவுகள் சுமார் 67–74 நிமிடங்களுக்குத் திரும்பின. சில முகவர்களை மட்டும் எச்சரித்ததும் உதவியது: 20 முகவர்களில் 5 பேர் எச்சரிக்கப்பட்டு மற்றவர்களுக்கு எண்கள் கொடுக்கப்பட்டபோது, பயணங்களின் சராசரி 65 நிமிடங்கள் — எண்கள் மட்டும் இருந்ததைவிடச் சிறந்தது.

வேறு மாதிரிகள், வேறு வரம்புகள்

விளைவின் திசை மற்ற மாதிரிகளுக்கும் கடத்தப்பட்டது, ஆனால் அதன் முழு வலிமை அல்ல. Claude Haiku 4.5, Gemini 3.5 Flash ஆகியவையும் எச்சரிக்கையின் கீழ் குறிப்பிடப்பட்ட சாலையைத் தவிர்க்கும் பக்கம் சாய்ந்தன, சுமார் 3 மற்றும் 5 நிமிடங்களைக் கூட்டின; ஆனால் அவற்றின் எந்த ஓட்டமும் முழுமையாக உறைந்துவிடவில்லை. பகுத்தறிவு இயக்கப்பட்ட GPT-5.4-mini-யும் உறையாமல் தவிர்ப்பை நோக்கிச் சாய்ந்தது. புதிய மாதிரியான GPT-6 Luna, அதன் இயல்புநிலைப் பகுத்தறிவு அமைப்பில், வெறும் குறிப்பின் கீழேயே உறைந்தது. ஒரு கூட்டம் முடங்குமா என்பது மாதிரியையும் அது இயக்கப்படும் விதத்தையும் பொறுத்தது.

மனிதர்கள் பரவுகிறார்கள் — காலியான சாலையை எடுக்கிறார்கள்

குழு இந்த விளையாட்டை இணையம் வழியாகச் சேர்க்கப்பட்ட 240 பேருடனும், 20 பேர் கொண்ட அறைகளில், எண்கள் அல்லது எச்சரிக்கையின் கீழ் நடத்தியது. பன்னிரண்டு அறைகளும் சமநிலைக்கு அருகில், சுமார் 62 நிமிடங்களில் இருந்தன — சீரற்ற நாணயச் சுண்டல்கள் தரும் விளைவுக்கு அருகில். தனிநபர்கள் வேறுபட்டனர்: சிலர் தொடர்ந்து குறிப்பைப் பின்பற்றினர், சிலர் தொடர்ந்து அதைத் தவிர்த்தனர். இந்த ஒப்பீடு சூழல் சார்ந்தது மட்டுமே என்று ஆசிரியர்கள் எச்சரிக்கின்றனர்: மனித ஆய்வும் AI ஆய்வும் வெவ்வேறு நேரங்களில், வெவ்வேறு ஊக்கத்தொகைகளுடன் நடத்தப்பட்டன; மற்றவர்களை எதிர்பார்க்குமாறு மனிதர்களிடம் கேட்கப்படவில்லை.

பின்னர் கலப்பு அறைகள் வந்தன: 5, 10 அல்லது 15 AI முகவர்களுடன், எல்லாம் எச்சரிக்கையின் கீழ், மேலும் 240 பேரால் நிரப்பப்பட்ட 20 இருக்கைகள் கொண்ட 24 அறைகள். முகவர்கள் குறிப்பிடப்பட்ட சாலையைத் தொடர்ந்து தவிர்த்தன. மனிதர்கள் அதை எடுத்தனர்: சராசரியாக 65%, 83%, 91% நேரம் — 10 அல்லது 15 முகவர்கள் கொண்ட அறைகளில், அமர்வு செல்லச் செல்ல மேலும் மேலும். இறுதியில், எட்டு ஒப்பீட்டுத் தொகுதிகள் ஒவ்வொன்றிலும், அதிக முகவர்கள் கொண்ட குழுக்கள் அதிகச் சமநிலையற்றவையாக இருந்தன.

இரண்டு வரைபடங்கள்: குறிப்பிடப்பட்ட சாலையில் மனித மற்றும் AI இருக்கைகளின் பங்கு, ஒவ்வொன்றின் சராசரிப் பயண நேரம், 20 வீரர்களில் உள்ள AI முகவர்களின் எண்ணிக்கையின்படி.

இடது: முகவர்கள் தவிர்க்கும் சாலையை மனிதர்கள் மேலும் மேலும் எடுக்கிறார்கள். வலது: 15 முகவர்களுடன், மனித இருக்கைகளின் சராசரி 44 நிமிடங்கள், AI இருக்கைகளின் சராசரி 80; சமப் பகிர்வில் 60. — படம் 5 (B, C), Ezaki, Imura & Nishinari (2026), arXiv:2609.30883.

நெரிசலுக்கு விலை கொடுப்பது யார்

மொத்தத்தில், முகவர்கள் மட்டும் கொண்ட அறைகளைவிடக் கலப்பு அறைகள் சிறப்பாகச் செயல்பட்டன — 15 முகவர்களுடன் 71 நிமிடங்கள், சுமார் 96-க்கு எதிராக. ஆனால் சராசரி ஒரு சமமின்மையை மறைத்தது. 15 முகவர்களுடன், மனித இருக்கைகளின் சராசரி 43.5 நிமிடங்கள் — நியாயமான பிரிவின் ஒரு மணி நேரத்தைவிட மிகக் குறைவு; முகவர் இருக்கைகளின் சராசரியோ 80.2. 240 பங்கேற்பாளர்களில் 129 பேர் 60 நிமிடங்களைவிடச் சிறப்பாகச் செய்தனர்; எந்த முகவரும் செய்யவில்லை. பின்னர் கேட்டபோது, உண்மையான பங்கு 25%, 50% அல்லது 75% எதுவாக இருந்தாலும், தங்கள் அறையில் 63–69% AI என்று பங்கேற்பாளர்கள் ஊகித்தனர்.

ஒரு பொது வளத்தைப் பகிரும் முகவர்களை மதிப்பிடும் எவருக்கும் ஆசிரியர்கள் மூன்று பாடங்களை முன்வைக்கின்றனர்: ஒரு நேரத்தில் ஒரு முகவரை அல்ல, முழுக் கூட்டங்களைச் சோதியுங்கள்; ஒவ்வொரு செய்தியையும் ஒரு தலையீடாகக் கருதுங்கள்; செலவுகளைக் குழுவின் சராசரியாக மட்டுமல்லாமல் பங்கேற்பாளர் வகையின்படி அறிக்கையிடுங்கள். அவர்களின் வரம்புகளும் வெளிப்படையானவை: ஒரு இரு-சாலை விளையாட்டு, எதிர்பார்ப்பைத் தூண்டும் கட்டளைகள், பங்கேற்பாளர் சேர்க்கை வரிசையுடன் பிணைக்கப்பட்ட அமைப்பு கொண்ட கலப்பு அறைகள். மக்களின் முகவர்களே செலவுகளைச் சுமக்க நேர்ந்தால், அவற்றிடம் பணிகளை ஒப்படைப்பது மெதுவான சாலையாக மாறக்கூடும்.

Legal notice