← أحدث الأبحاث
🤖 machine learning

MaMa: A Game-Theoretic Approach for Designing Safe Agentic Systems

تقدم هذه الورقة MaMa، وهو خوارزمية قائمة على نظرية الألعاب تستفيد من البحث التنافسي القائم على النماذج اللغوية الكبيرة لتصميم أنظمة متعددة الوكلاء تلقائياً تحافظ على سلامة قوية ضد أسوأ حالات اختراق الوكلاء مع الحفاظ على أداء المهام.

المؤلفون الأصليون: Jonathan Nöther, Adish Singla, Goran Radanovic

نُشر 2026-05-25
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Jonathan Nöther, Adish Singla, Goran Radanovic

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك تقوم بتوظيف فريق من الروبوتات الخبيرة لمساعدتك في إدارة عمل تجاري معقد، مثل التخطيط لرحلة، أو كتابة أخبار مالية، أو برمجة لعبة فيديو جديدة. هذه الروبوتات (التي تُسمى "الوكلاء" أو Agents) تتحدث مع بعضها البعض، وتستخدم أدوات مثل متصفحات الويب وأنظمة الملفات، وتعمل معاً لإنجاز المهمة.

المشكلة هي: ماذا لو تعرض أحد هذه الروبوتات للاختراق، أو أصبح مارقاً، أو ارتكب ببساطة خطأً فادحاً؟ في الماضي، إذا جُن جنون أحد الروبوتات، كان بإمكانه سحب الفريق بأكمله معه إلى الأسفل، مما يتسبب في خسائر مالية أو تصرفات خطيرة.

يقدم هذا البحث طريقة جديدة لبناء فرق الروبوتات هذه لتكون غير قابلة للكسر، حتى لو انقلب بعض أعضائها ضد الفريق. يطلق المؤلفون على طريقتهم اسم MaMa (الخصم الميتا - الوكيل الميتا / Meta-Adversary–Meta-Agent).

إليك كيف تعمل، باستخدام تشبيه بسيط:

اللعبة: المهندس المعماري مقابل المخرب

يعامل المؤلفون تصميم فريق روبوتات آمن كأنه لعبة عالية المخاطر بين لاعبين:

  1. المهندس المعماري (الوكيل الميتا - Meta-Agent): هو المصمم. مهمته هي بناء فريق الروبوتات. هو من يقرر من هم الروبوتات، وما هي الأدوات التي يمتلكونها، وكيف يتحدثون مع بعضهم البعض. هدفه هو جعل الفريق سريعاً، وذكياً، وجيداً في أداء المهمة.
  2. المخرب (الخصم الميتا - Meta-Adversary): هذا هو الذكاء الاصطناعي "الشرير". مهمته هي محاولة كسر فريق المهندس المعماري. يُسمح له بـ "اختراق" عدد قليل من الروبوتات (في البحث، يقومون عادةً باختراق روبوت واحد فقط) وإجبارهم على القيام بأفعال خطيرة، مثل حذف الملفات، أو إرسال رسائل مزعجة (Spam)، أو حجز رحلات طيران إلى مناطق حروب.

معسكر التدريب: "الفريق الأحمر" (Red Teaming)

بدلاً من مجرد بناء فريق وتمني أن يعمل، تقوم MaMa بدورة تدريب مستمرة:

  1. المهندس المعماري يبني فريقاً.
  2. المخرب يهاجمه. يحاول المخرب استخدام كل حيلة ممكنة لجعل الفريق يفشل. إذا نجح المخرب، فإنه يسجل بالضبط كيف فعل ذلك.
  3. المهندس المعماري يتعلم. ينظر المهندس المعماري إلى هجمات المخرب الناجحة ويقول: "أوه، لقد فهمت! إذا أضفت 'روبوت سلامة' ليتحقق من رسائل 'روبوت التخطيط'، فلن يستطيع المخرب خداعهم بعد الآن".
  4. المهندس المعماري يعيد البناء. ينشئ فريقاً جديداً وأكثر قوة مع هذه الدفاعات الجديدة.
  5. التكرار. يحاول المخرب كسر الفريق الجديد. إذا وجد طريقة جديدة لكسره، يقوم المهندس المعماري بإصلاحها مرة أخرى.

يستمر هذا الذهاب والإياب حتى يصبح الفريق محمياً جيداً لدرجة أنه حتى أقوى مخرب لا يمكنه كسر الفريق دون تدمير قدرته على أداء مهمته الفعلية.

النتائج: أقوى وأذكى

اختبر البحث هذه الطريقة في ستة سيناريوهات مختلفة، من التخطيط للسفر إلى كتابة الأكواد البرمجية. وهذا ما وجدوه:

  • السلامة أولاً: كانت الفرق التي صممتها MaMa أكثر أماناً بشكل ملحوظ من الفرق التي صممها البشر أو الفرق المصممة لتكون سريعة فقط. عندما حاول المخرب اختراقها، صمدت فرق MaMa في وجهه.
  • لا فقدان للسرعة: عادةً، عندما تضيف ضوابط السلامة، تصبح الأشياء أبطأ أو أقل كفاءة. لكن MaMa تمكنت من الحفاظ على عمل الفرق بنفس الكفاءة (أو أحياناً بشكل أفضل) من النسخ غير الآمنة.
  • التعميم: الجزء الرائع هو أن هذه الفرق لم تتعلم فقط إيقاف نوع واحد محدد من الهجمات. نظرًا لأنها تدربت ضد "مخرب ذكي" يغير تكتيكاته باستمرار، فقد تعلمت الفرق أن تكون قوية ضد أي نوع من الهجمات، حتى تلك التي لم ترها من قبل.

تشبيه "شبكة الأمان"

فكر في فريق الروبوتات العادي كأنه مجموعة من الأصدقاء يحاولون بناء قلعة رملية. إذا غضب أحد الأصدقاء وبدأ في ركل القلعة، فسيتم تدمير الأمر برمته.

MaMa تشبه توظيف حارس أمن يراقب الأصدقاء.

  • إذا حاول أحد الأصدقاء ركل القلعة، فإن الحارس يوقفه.
  • لكن الحارس لا يقف هناك فحسب؛ بل يتعلم من كل محاولة ركل للقلعة.
  • في النهاية، يعرف الحارس تماماً كيف يوقف أي نوع من أنواع الركل، ويمكن للأصدقاء بناء قلعتهم الرملية بشكل مثالي، حتى لو كان أحدهم يحاول التخريب.

لماذا يهم هذا الأمر؟

يجادل البحث بأنه بينما نترك وكلاء الذكاء الاصطناه لدينا يقومون بمزيد من المهام الواقعية (مثل إدارة الأموال أو التحكم في البرمجيات)، لا يمكننا فقط أن نأمل في أن يتصرفوا بشكل جيد. نحن بحاجة إلى تصميمهم بطريقة تجعلهم آمنين من حيث التصميم والتركيب. توفر MaMa مخططاً لبناء هذه الفرق "غير القابلة للكسر" تلقائياً، مما يضمن أنه حتى لو فشلت بعض الأجزاء أو أصبحت شريرة، يظل النظام بأكمله آمناً وفعالاً.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →