AgentBound: Securing Execution Boundaries of AI Agents
تقدم هذه الورقة AgentBound، وهو أول إطار عمل للتحكم في الوصول لبروتوكول سياق النموذج (MCP) يجمع بين آلية سياسة تصريحية ومحرك إنفاذ غير اقتحامي لتأمين وكلاء الذكاء الاصطناعي ضد الوصول غير المقيد للأدوات مع الحفاظ على إنتاجية عالية وحمل إضافي ضئيل.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
إليك شرح لورقة بحثية بعنوان "AgentBound: تأمين حدود التنفيذ لوكلاء الذكاء الاصطناعي" باستخدام لغة بسيطة وتشبيهات من الحياة اليومية.
المشكلة: "الغرب المتوحش" لمساعدي الذكاء الاصطناعي
تخيل أنك وظفت مساعداً شخصياً ذكياً للغاية (وكيل ذكاء اصطناعي - AI Agent) للقيام بمهام معقدة نيابة عنك، مثل إدارة رسائل البريد الإلكتروني، أو حجز الرحلات الجوية، أو تنظيم ملفاتك. وللقيام بذلك، يحتاج المساعد إلى استخدام أدوات، مثل "مدير الملفات" أو "متصفح الويب".
في عالم الذكاء الاصطناعي الحالي، توجد طريقة قياسية لربط هؤلاء المساعدين بالأدوات تسمى MCP (بروتوكول سياق النموذج). فكر في MCP كجهاز تحكم عن بعد عالمي يسمح للذكاء الاصطنا الخاص بك بالتحدث مع آلاف التطبيقات والخوادم المختلفة.
الثغرة الأمنية:
في الوقت الحالي، عندما تقوم بتوصيل أداة جديدة بذكائك الاصطناعي، فالأمر يشبه إعطاء تلك الأداة مفتاحاً رئيسياً (Master Key) لمنزلك بأكمله.
- إذا كانت الأداة هي "تطبيق طقس"، فيجب أن يقتصر عمله على التحقق من حالة الطقس فقط.
- ولكن حالياً، إذا تم اختراق تطبيق الطقس هذا أو كان به خطأ برمجي، فيمكنه استخدام ذلك المفتاح الرئيسي لقراءة مذكراتك الخاصة، أو حذف كشوف حساباتك البنكية، أو سرقة كلمات المرور الخاصة بك.
- لا يوجد "حارس أمن" يتحقق مما إذا كانت الأداة تفعل حقاً ما تدعي فعله. إنه نظام قائم على "الثقة في الجميع"، وهو أمر خطير.
الحل: AgentBound (الـ "حارس الذكي")
قام مؤلفو هذه الورقة ببناء نظام يسمى AgentBound. فكر في AgentBound كـ حارس أمن ذكي وكتيب قواعد صارم يقف بين ذكائك الاصطناعي والعالم الخارجي.
يعمل النظام في جزأين رئيسيين:
1. كتيب القواعد (البيان - Manifest)
قبل السماح لأداة الذكاء الاصطناعي بالعمل، يجب أن تملأ "إذن عمل" (يسمى Manifest).
- التشبيه: تخيل أنك استأجرت مقاولاً لإصلاح مطبخك. أنت لا تعطيه مفتاح المنزل بأكمله فحسب، بل توقع ورقة تقول: "يُسمح لك بدخول المطبخ واستخدام الحوض، ولكن لا يُسمح لك بدخول غرفة النوم أو الخزنة".
- كيف يعمل: يقوم AgentBound بإنشاء قائمة بما تحتاجه الأداة بالضبط. إذا قالت أداة "مدير الملفات" إنها تحتاج لقراءة الملفات، فإن كتيب القواعد يقول: "حسناً، يمكنك قراءة الملفات". لكنه ينص صراحة على: "لا يمكنك الوصول إلى الإنترنت أو بريدك الإلكتروني".
- الأتمتة: تُظهر الورقة أن برنامج كمبيوتر يمكنه تلقائياً قراءة كود هذه الأدوات وكتابة 80% من كتيب القواعد هذا بشكل صحيح بمفرده، حتى لا يضطر المطورون للقيام بكل ذلك يدوياً.
2. الحارس (محرك الإنفاذ - Enforcement Engine)
هذا هو الجزء الذي يوقف الأشرار بالفعل.
- التشبيه: تخيل أن المقاول (أداة الذكاء الاصطناعي) محبوس داخل قفص زجاجي (حاوية آمنة). هذا القفص له باب لا يفتح إلا للأشياء المحددة في إذن العمل.
- كيف يعمل: إذا حاولت الأداة القيام بشيء غير مدرج في القائمة (مثل محاولة سرقة مفاتيح SSH الخاصة بك أو الاتصال بموقع إلكتروني خاص بهكر)، يقوم الحارس بإغلاق الباب فوراً. تصبح الأداة محاصرة في قفصها ولا يمكنها القيام إلا بما سُمح لها به تماماً.
- لا تغيير في الكود: الجزء الأفضل هو أن الأداة لا تحتاج إلى إعادة كتابة الكود الخاص بها؛ بل يتم تغليفها داخل هذا القفص تلقائياً.
ما الذي اختبروه؟ (اختبار الضغط)
لم يكتف الباحثون ببناء هذا النظام فحسب، بل اختبروه ليروا ما إذا كان يعمل حقاً.
هل غطوا كل شيء؟ (الاكتمال)
لقد فحصوا 296 من أشهر أدوات الذكاء الاصطناعي. ووجدوا أن نظام "إذن العمل" الخاص بهم يمكنه وصف ما تحتاجه هذه الأدوات بدقة بنسبة 100%. وقد نجح المولد التلقائي الخاص بهم في الحصول على النتيجة الصحيحة بنسبة 81% تقريباً دون أي مساعدة بشرية، وبنسبة 96% مع القليل من المراجعة البشرية.هل أوقفوا الأشرار؟ (الأمن)
قاموا بإنشاء أدوات "شريرة" وهمية مصممة لسرقة البيانات، أو حذف الملفات، أو خداع الذكاء الاصطناعي للقيام بأشياء سيئة.
- النتيجة: أوقف AgentBound جميع الهجمات تقريباً التي تضمنت سرقة البيانات أو العبث بملفات الكمبيوتر.
- الحدود: إذا كانت الأداة مسموحاً لها بالتحدث إلى موقع إلكتروني، وقامت الأداة بخداع الذكاء الاصطناعي لإرسال رسالة إلى جزء آخر من نفس الموقع، فلا يستطيع الحارس منع ذلك (لأن الأداة كانت مسموحاً لها أصلاً بالتحدث مع ذلك الموقع). ولكن بالنسبة للأمور الأكثر خطورة (مثل سرقة الملفات أو الوصول إلى الشبكة)، فقد عمل النظام بشكل مثالي.
- هل هو بطيء جداً؟ (الكفاءة)
يخشى الناس أن تؤدي الحماية إلى إبطاء العمليات.
- النتيجة: يضيف "الحارس" تأخيراً طفيفاً جداً (حوالي 0.6 مللي ثانية) للعمل الفعلي. إنه يشبه الفرق بين استغراق الباب ثانية واحدة ليفتح مقابل 1.001 ثانية. لن تلاحظ الفرق حتى. التأخير الوحيد الملحوظ هو عند بدء تشغيل الأداة لأول مرة (حوالي 150-300 مللي ثانية)، وهو ما يشبه الوقت الذي يستغرقه تشغيل محرك السيارة.
الخلاصة
AgentBound هو نظام سلامة جديد لوكلاء الذكاء الاصطناعي. إنه يعامل أدوات الذكاء الاصطناعي كضيوف في منزلك:
- سابقاً: كان الضيوف يمكنهم التجول في غرفة نومك وخزنتك لأنك وثقت بهم.
- الآن: يتم منح الضيوف غرفة محددة وقائمة بالأفعال المسموح بها. وإذا حاولوا مغادرة تلك الغرفة، يتم إيقافهم.
هذا يسمح لنا باستخدام أدوات ذكاء اصطناعي قوية دون القلق من أن خطأ واحداً أو أداة مخترقة قد يدمر حياتنا الرقمية. إنه يجعل الذكاء الاصطناعي أكثر أماناً دون جعله أبطأ أو أصعب في الاستخدام.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.