الحوسبة والذكاء الاصطناعينسخة أوليةتجربةمدة القراءة: 5 د

جملة واحدة تحبس سائقي الذكاء الاصطناعي في الزحام

صار وكلاء الذكاء الاصطناعي المبنيون على عدد قليل من النماذج المشتركة يتصرفون أكثر فأكثر نيابةً عن كثير من الناس. وأراد تاكاهيرو إيزاكي وناوتو إيمورا وكاتسوهيرو نيشيناري، من جامعة طوكيو، أن يعرفوا ما يحدث حين يتلقى كثير من هؤلاء الوكلاء الرسالةَ نفسها، ولا سيما توقعًا لما سيفعله الجميع. فهذا التوقع، ما إن يُذاع، حتى يغيّر الوضع الذي يصفه، وقد يُبطل نبوءته بنفسه.

ولاختبار ذلك، اختاروا أحد أبسط المواقف التي يتنافس فيها الناس على مورد محدود: التنقل اليومي إلى العمل.

طريقان وقاعدة واحدة

يربط طريقان متطابقان ضاحيةً بحيٍّ للأعمال. وكل صباح، يختار جميع المتنقلين في اللحظة نفسها. والطريق الذي يستخدمه جزء n/N منهم تستغرق الرحلة فيه 20 + 80 n/N دقيقة: ساعة إذا توزّعت حركة المرور بالتساوي، ونحو 100 دقيقة إذا تكدّس الجميع تقريبًا في طريق واحد. وعند التوزيع المتساوي، لا يستطيع أحد أن يكسب شيئًا بتغيير طريقه منفردًا.

في التجربة الأساسية، كل واحد من الوكلاء الخمسين استدعاءٌ مستقل للنموذج نفسه، GPT-5.4-mini، يعمل من دون استدلال موسَّع. ويرى كل وكيل القواعد، وطريقه وأزمنة رحلاته في الأيام الخمسة الأخيرة، ونشرة يومية. ويطلب كل موجِّه (prompt) أيضًا من الوكيل أن يفكر في كيفية تفاعل السائقين الآخرين مع المعلومات نفسها. وللنشرة أربع صيغ:

  • لا تقرير على الإطلاق؛
  • أرقام: زمن الرحلة أمس على كل طريق؛
  • نصيحة: «الطريق B أقل ازدحامًا حاليًا»؛
  • نصيحة مع تحذير: النصيحة نفسها، تليها عبارة «لكن يُتوقع أن يرى كثير من السائقين هذه المعلومات نفسها وينتقلوا إلى الطريق B، لذا قد يزدحم الطريق B».

لعبة الطريقين، والنشرات الأربع، ونسبة الوكلاء الذين يختارون الطريق الأقل ازدحامًا على مدى 60 جولة لكل نشرة.

اللعبة والنشرات الأربع (في الأعلى)؛ وفي الأسفل، لكل نشرة، نسبة الوكلاء الذين يختارون طريق الأمس الأقل ازدحامًا على مدى 60 جولة، مع الوسيط لزمن الرحلة. ومع التحذير، تبقى النسبة قريبة من الصفر، حتى حين تمتد اللعبة إلى الجولة 100. — الشكل 1، إيزاكي وإيمورا ونيشيناري (2026)، arXiv:2609.30883.

تحذير يهزم نفسه

من دون أي تقرير، تحرك الوكلاء كالقطيع: كان جميعهم تقريبًا يغيّرون طريقهم كل صباح، فتتأرجح الحشود ببساطة من طريق إلى آخر، بمتوسط 96 دقيقة. وخفّضت الأرقامُ ذلك إلى 71 دقيقة؛ وكانت النصيحة المجردة الأفضل، بـ64 دقيقة، قريبًا من الستين دقيقة المثالية.

غيّرت إضافةُ جملة التحذير كل شيء. استقر نحو 96% من الوكلاء على الطريق نفسه، وهو الطريق الذي كان مزدحمًا للتوّ، وبقوا عليه. وارتفع متوسط زمن الرحلة إلى 95 دقيقة، أي بزيادة 30 دقيقة عمّا كان مع النصيحة وحدها، في جميع التجارب العشر المتقابلة. وعند توزيع 47 مقابل 3، يحتاج الوكيل على الطريق المزدحم إلى 95.2 دقيقة، وكان تغيير طريقه منفردًا سيخفّض ذلك إلى 26.4 دقيقة. ونادرًا ما فعل الوكلاء ذلك. وحين مُدّدت التجارب العشر إلى 100 جولة، لم تفلت أي منها.

وتكشف تفسيرات الوكلاء أنفسهم، المكتوبة في سطر واحد، هذا النمط. ففي إحدى التجارب، ذكر 89% منهم أن سائقين آخرين سيغيّرون طريقهم أو أن الطريق سيزدحم. ومن التفسيرات النموذجية: «كان A بطيئًا جدًا معي باستمرار، لكن النشرة تحذّر من أن B سيجذب كثيرًا ممن يغيّرون طريقهم، لذا فإن A هو الرهان الأكثر أمانًا». ويشدد المؤلفون على أن هذه الجمل تصف نصًا مولَّدًا، لا الحسابات الداخلية للنموذج.

ولم يكن الازدحام دائمًا. فاستبدال التحذير بأرقام بسيطة في الجولة 31 جعل 96 إلى 100% من الوكلاء يندفعون إلى الطريق شبه الفارغ، فيزدحم هو بدوره لبعض الوقت، قبل أن تعود التكلفة إلى نحو 67 إلى 74 دقيقة. كما أن تحذير بعض الوكلاء فقط كان مفيدًا: فحين حُذِّر 5 من أصل 20 وكيلًا وأُعطي الباقون أرقامًا، بلغ متوسط الرحلات 65 دقيقة، وهو أفضل من الأرقام وحدها.

نماذج أخرى وحدود أخرى

انتقل اتجاه التأثير إلى النماذج الأخرى، لكن ليس بكامل قوته. فقد مال Claude Haiku 4.5 وGemini 3.5 Flash أيضًا إلى تجنب الطريق الموصى به تحت التحذير، مضيفَين نحو 3 و5 دقائق، لكن لم تتجمد أي من تجاربهما تمامًا. وظل GPT-5.4-mini مع تفعيل الاستدلال يميل إلى التجنب من دون أن يتجمد. أما نموذج أحدث، GPT-6 Luna، فبإعداد الاستدلال الافتراضي، تجمّد حتى مع النصيحة المجردة. فانغلاق مجموعة ما من عدمه يتوقف على النموذج وعلى طريقة تشغيله.

البشر يتوزعون ويسلكون الطريق الحر

أجرى الفريق اللعبة أيضًا مع 240 شخصًا جُنِّدوا عبر الإنترنت، في غرف من 20 شخصًا، مع الأرقام أو مع التحذير. وبقيت الغرف الاثنتا عشرة كلها قريبة من التوازن، عند نحو 62 دقيقة، قريبًا مما تعطيه رميات عملة عشوائية. واختلف الأفراد فيما بينهم: فبعضهم اتبع النصيحة باستمرار، وتجنّبها آخرون باستمرار. ويحذّر المؤلفون من أن هذه المقارنة سياقية فقط: فدراستا البشر والذكاء الاصطناعي أُجريتا في أوقات مختلفة وبحوافز مختلفة، ولم يُطلب من الناس توقّع تصرفات الآخرين.

ثم جاءت الغرف المختلطة: 24 غرفة من 20 مقعدًا، فيها 5 أو 10 أو 15 وكيلًا من الذكاء الاصطناعي، كلها تحت التحذير، وشغل بقية المقاعد 240 شخصًا آخرون. واستمر الوكلاء في تجنب الطريق الموصى به. أما البشر فسلكوه: في المتوسط 65% و83% و91% من المرات، بل إنهم في الغرف التي تضم 10 أو 15 وكيلًا سلكوه أكثر فأكثر مع تقدم الجلسة. وفي النهاية، كانت المجموعات التي تضم وكلاء أكثر أقل توازنًا، في كل واحدة من كتل المقارنة الثماني.

رسمان بيانيان: نسبة مقاعد البشر ومقاعد الذكاء الاصطناعي على الطريق الموصى به، ومتوسط زمن الرحلة لكل منها، حسب عدد وكلاء الذكاء الاصطناعي بين 20 لاعبًا.

يسارًا: يسلك البشر أكثر فأكثر الطريق الذي يتجنبه الوكلاء. يمينًا: مع 15 وكيلًا، يبلغ متوسط مقاعد البشر 44 دقيقة ومقاعد الذكاء الاصطناعي 80، مقابل 60 عند التقاسم المتساوي. — الشكل 5 (B، C)، إيزاكي وإيمورا ونيشيناري (2026)، arXiv:2609.30883.

من يدفع ثمن الزحام

كان أداء الغرف المختلطة إجمالًا أفضل من الغرف التي تضم وكلاء فقط: 71 دقيقة مع 15 وكيلًا، مقابل نحو 96. لكن المتوسط أخفى خللًا. فمع 15 وكيلًا، بلغ متوسط مقاعد البشر 43.5 دقيقة، أي أقل بكثير من ساعة التقاسم العادل، في حين بلغ متوسط مقاعد الوكلاء 80.2. ومن بين المشاركين الـ240، حقق 129 زمنًا أقل من 60 دقيقة؛ ولم يحقق ذلك أي وكيل. وحين سُئل المشاركون بعد ذلك، قدّروا أن 63 إلى 69% من غرفتهم كانوا من الذكاء الاصطناعي، سواء كانت النسبة الحقيقية 25% أو 50% أو 75%.

ويستخلص المؤلفون ثلاثة دروس لكل من يقيّم وكلاء يتقاسمون موردًا: اختبار مجموعات كاملة لا وكيلًا واحدًا في كل مرة؛ ومعاملة كل رسالة على أنها تدخّل؛ وعرض التكاليف حسب نوع المشارك، لا متوسط المجموعة فقط. وهم صريحون أيضًا بشأن حدود دراستهم: لعبة بطريقين، وموجِّهات تدعو إلى التوقع، وغرف مختلطة ارتبط تكوينها بترتيب التجنيد. وإذا انتهى الأمر بوكلاء الناس إلى تحمّل التكاليف، فقد يتبيّن أن تفويض الأمور إليهم هو الطريق البطيء.

Legal notice