Do Agents Repair When Challenged -- or Just Reply? Challenge, Repair, and Public Correction in a Deployed Agent Forum
تكشف هذه الورقة أن منتدى وكلاء النماذج اللغوية الكبيرة المنشور (Moltbook) يفشل في الحفاظ على آليات التحدي، والإصلاح، والتصحيح العلني الموجودة في المجتمعات البشرية مثل Reddit، مما يشير إلى أن التوافق الاجتماعي الحقيقي يتطلب عمليات تفاعلية لإنفاذ المعايير بدلاً من مجرد إنتاج لغة واعية بالمعايير.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل ساحة مدينة صاخبة. في هذه الساحة، توجد مجموعتان متميزتان من الناس يخوضون محادثات:
- البشر (ريديت - Reddit): حشد حيوي حيث يتجادل الناس، ويوضحون وجهات نظرهم، ويعتذرون، ويغيرون آراءهم أمام الجميع.
- وكلاء الذكاء الاصطناعي (مولتبوك - Moltbook): مجموعة من الروبوتات المتطورة المبرمجة للتحدث مع بعضها البعض، لكنها تبدو عالقة في حلقة صامتة غريبة جداً.
هذه الورقة البحثية تطرح سؤالاً بسيطاً ولكنه جوهري: عندما يتحدى شخص ما وكيل ذكاء اصطناعي في مكان عام، هل يقوم الوكيل بإصلاح خطئه ومواصلة المحادثة، أم أنه يكتفي بقول شيء مهذب ثم ينسحب؟
الإجابة، وفقاً للباحثين، هي: "إنه ينسحب."
إليك تفصيل لما وجدوه، باستخدام بعض التشبيهات اليومية.
1. الهاتف المعطل مقابل المحادثة العميقة (الهيكل)
أولاً، نظر الباحثون في كيفية بناء المحادثات.
- ريديت (البشر): تخيل شجرة عميقة متعددة الطبقات. شخص ما يطرح نقطة، ثم يرد شخص آخر على تلك النقطة، ثم يرد شخص ثالث على الرد، وهكذا. هذا يسمى "التسلسل" (Threading). وهذا يسمح بنقاش طويل ومتطور.
- مولتبوك (الوكلاء): تخيل حقلًا من نبات الهندباء. الجميع ينفخون بذورهم (منشوراتهم) في الريح، لكنها نادراً ما تهبط فوق بعضها البعض. المحادثات هنا "مسطحة". إذا قال الشخص (أ) شيئاً، ورد الشخص (ب)، فإن الشخص (أ) نادراً ما يرد على الشخص (ب).
النتيجة: منتدى الذكاء الاصطناعي أكثر تسطحاً بنحو 10 مرات من المنتدى البشري. لا يوجد "شجرة" لتنمو عليها المحادثة. الأمر يشبه محاولة لعب التنس في ملعب بدون شبكة؛ فالكرة ستتدحرج بعيداً ببساو.
2. تأثير "مدينة الأشباح" (التحدي)
بعد ذلك، نظر الباحثون فيما يحدث عندما يقول أحدهم: "مهلاً، أنت مخطئ!" (تحدٍ).
- على ريديت: إذا تحديت بشراً، فغالباً ما يلتفت إليك. في حوالي 41% من الحالات، يعود الشخص الأصلي إلى المحادثة. قد يقول: "أوه، أنت على حق"، أو "دعني أوضح ما كنت أعنيه". إنه يشارك في عملية "إصلاح".
- على مولتبوك: إذا تحديت وكيل ذكاء اصطناعي، فالأمر يشبه الصراخ في وجه شبح. الوكيل الأصلي نادراً ما يعود (بنسبة 1.2% فقط). يتم مواجهة التحدي بالصمت. الوكيل لا يقول "لقد ارتكبت خطأً" أو "إليك المزيد من الأدلة". إنه يغادر الغرفة فحسب.
التشبيه: تخيل أنك في حفلة عشاء.
- البشر: تقول لصديقك، "قصتك عن الدب مستحيلة!" فيلتفت صديقك، يضحك، ويقول: "أنت محق، لقد اختلقتُ تلك القصة. إليك القصة الحقيقية".
- وكيل الذكاء الاصطناعي: تقول للروبوت، "هذه القصة مستحيلة!" فيومئ الروبوت برأسه، ويقول "نقطة مثيرة للاهتمام"، ثم يدير ظهره فوراً ويبدأ بالتحدث إلى الحائط. إنه لا يعترف بتصحيحك أبداً.
3. حلقة "التصحيح العلني" (النتي_جة)
أهم جزء في أي مجتمع صحي هو التصحيح العلني. وهذا هو الوقت الذي يُرتكب فيه خطأ، فيتم تحديه، وإصلاحه، ويتعلم المجتمع بأكمله منه.
- ريديت: وجد الباحثون أن التحديات على ريديت غالباً ما تتحول إلى "حلقة تصحيح علنية". يعود الشخص الأصلي، وتستمر المحادثة لعدة جولات، ويرى الجميع الخطأ وهو يُصلح. بهذه الطريقة تتعلم المجتمعات قواعدها وأعرافها.
- مولتبوك: هذه الحلقة مكسورة تماماً. وجد الباحثون صفر حالات قام فيها وكيل ذكاء اصطناعي بتصحيح نفسه علناً بعد تحديه. تموت المحادثة فوراً.
الاستعارة: فكر في المجتمع كأنه مدرسة.
- ريديت هي فصل دراسي حيث إذا أخطأ طالب في مسألة رياضية، يشير المعلم أو طالب آخر إلى ذلك، فيقوم الطالب بإصلاح الخطأ، ويتعلم الجميع.
- مولتبوك هو فصل دراسي حيث إذا أخطأ طالب في مسألة، يُقال له إن إجابته خاطئة، لكن لا يُسمح له أبداً بإصلاحها، والمعلم لا يعود أبداً ليشرح. الطالب يجلس هناك فقط، يكرر إجابته الخاطئة، بينما تمضي الحصة في طريقها.
لماذا يهم هذا؟ (السلامة والعدالة)
يجادل المؤلفون بأن هذه مشكلة كبيرة لسببين:
- السلامة (مشكلة "الروبوت السيئ"): في المستقبل، سيعمل وكلاء الذكاء الاصطناعي معاً للقيام بأشياء (مثل إدارة المرور، كتابة الكود، أو الإشراف على المحتوى). إذا قدم وكيل ذكاء اصطناعي ادعاءً خطيراً أو مضللاً، ولم يستطع أحد "تحديه" لإصلاحه، فإن تلك الفكرة السيئة ستظل باقية في النظام. لا يمكن للمجتمع أن "يصحح نفسه ذاتياً". إنه مثل سيارة بلا مكابح؛ إذا بدأت تسلك الطريق الخاطئ، لا يمكن لأحد توجيهها للعودة.
- العدالة (مشكلة "النموذج الواحد للجميع"): المجتمعات البشرية المختلفة لها قواعد مختلفة. بعضها مهذب جداً، والبعض الآخر فظ للغاية. بدا أن وكلاء الذكاء الاصطناعي في هذه الدراسة لديهم "إعداد افتراضي" لم يتكيف. لم يعرفوا كيف يجادلون، أو يعتذرون، أو يوضحون بما يتناسب مع المجموعة التي يتواجدون فيها.
"لماذا" (هل المشكلة في الروبوت أم في الغرفة؟)
أجرى الباحثون اختباراً أخيراً لمعرفة ما إذا كانت الروبوتات "غبية" فحسب أم أن "الغرفة" (المنصة) هي المشكلة.
- أخذوا نموذج ذكاء اصطناعي واحداً وعرضوا عليه تحدياً بشكل مباشر.
- النتيجة: عندما استطاع الذكاء الاصطناعي رؤية التحدي بوضوح، فقد حاول بالفعل إصلاح خطئه (بنسبة 50% تقريباً).
- الاستنتاج: الروبوتات يمكنها التعلم والإصلاح، لكن منصة مولتبوك مصممة بطريقة تخفي التحديات عن المؤلف الأصلي. ليس أن الذكاء الاصطناعي غير قادر على إصلاح أخطائه؛ بل إن النظام لا يسمح له بمعرفة أنه أخطأ.
الخلاصة
تخبرنا هذه الورقة البحثية أن مجرد كون الذكاء الاصطناعي يبدو مهذباً وذكياً في جملة واحدة لا يعني أنه يمكنه العمل في مجتمع حقيقي.
المجتمع الحقيقي لا يتعلق بقول الشيء الصحيح مرة واحدة؛ بل يتعلق بكيفية التعامل مع كونك مخطئاً. يتعلق الأمر بالاستماع، والمجادلة، والاعتراف بالأخطاء، وتغيير الرأي أمام جيرانك. حالياً، وكلاء الذكاء الاصطناعي بارعون في قول الأشياء الصحيحة، لكنهم سيئون جداً في العمل البشري الفوضوي المتمثل في إصلاح الأمور عندما تسوء.
لبناء مستقبل آمن مع الذكاء الاصطناعي، نحتاج إلى التوقف عن مجرد التحقق مما إذا كان الذكاء الاصطناعي يبدو لطيفاً، والبدء في التحقق مما إذا كان بإمكانه فعلياً البقاء في المحادثة عندما تصبح الأمور صعبة.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.