← أحدث الأبحاث
💬 NLP

MCPShield: A Security Cognition Layer for Adaptive Trust Calibration in Model Context Protocol Agents

تقدم هذه الورقة MCPShield، وهي طبقة إدراك أمني قابلة للإضافة تخفف من عدم توافق الثقة في وكلاء بروتوكول سياق النموذج (MCP) عبر توظيف الاستقصاء الموجه بالبيانات الوصفية والتفكير ما بعد الاستدعاء للدفاع بقوة ضد الهجمات المتنوعة مع الحفاظ على انخفاض التكاليف التشغيلية والقدرة العالية على التعميم عبر مختلف النماذج اللغوية الكبيرة.

المؤلفون الأصليون: Zhenhong Zhou, Yuanhe Zhang, Hongwei Cai, Moayad Aloqaily, Ouns Bouachir, Linsey Pang, Prakhar Mehrotra, Kun Wang, Qingsong Wen

نُشر 2026-02-25
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Zhenhong Zhou, Yuanhe Zhang, Hongwei Cai, Moayad Aloqaily, Ouns Bouachir, Linsey Pang, Prakhar Mehrotra, Kun Wang, Qingsong Wen

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك مساعداً آلياً ذكياً ومفيداً (وكيل ذكاء اصطناعي - AI Agent) يمكنه القيام بأشياء من أجلك، مثل التحقق من حالة الطقس، أو حجز الرحلات الجوية، أو إدارة حسابك البنكي. وللقيام بذلك، يحتاج الروبوت إلى التواصل مع خدمات خارجية (مثل تطبيق الطقس أو موقع بنك إلكتروني). في الماضي، كانت هذه الخدمات الخارجية بمثابة أصدقاء موثوقين، ولكن مع معيار جديد يسمى MCP، أصبح بإمكان الروبوت الآن الاتصال بخدمات أي شخص، حتى الغرباء على الإنترنت. هذا يشبه فتح باب منزلك للسماح بألف سائق توصيل بالدخول. وبينما يعد هذا الأمر مريحاً للغاية، إلا أنه خطير أيضاً: قد يطرق غريب بابك، ويقول إنه عامل توصيل بيتزا، لكنه في الواقع لص يحاول سرقة مجوهراتك.

هذه هي المشكلة التي تحلها ورقة البحث MCPShield.

المشكلة الجوهرية: الروبوت "الطيب جداً"

حالياً، إذا أخبر غريب (خادم/Server) الروبوت قائلاً: "أنا عامل توصيل بيتزا"، فإن الروبوت يصدقه فوراً. هو لا يتأكد مما إذا كان الرجل يحمل بيتزا بالفعل أم أنه يحمل عتلة حديدية.

  • المخاطرة: يمكن لخادم خبيث أن يتظاهر بكونه مفيداً ولكنه يسرق بياناتك سراً، أو يحذف ملفاتك، أو يرسل الأموال إلى المكان الخطأ.
  • الفجوة: أدوات الحماية الموجودة حالياً تشبه حارس الأمن الواقف خارج المنزل. قد يفحص هوية السائق عند البوابة، ولكن بمجرد دخول السائق إلى مطبخك، لا يستطيع الحارس رؤية ما يفعله.

الحل: MCPShield (الـ "حارس الشخصي الذكي")

يقترح المؤلفون MCPShield، وهو ليس مجرد حارس عند الباب، بل هو عقل أمني يعيش داخل رأس الروبوت. إنه يتعامل مع كل تفاعل كخبرة تعلمية، تماماً كما يتعلم الإنسان كيف يثق (أو لا يثق) في الناس بمرور الوقت.

إليك كيف يعمل، مقسماً إلى ثلاث خطوات بسيطة:

1. اختبار "الطلب الوهمي" (ما قبل الاستدعاء - Pre-Invocation)

  • التشبيه: قبل السماح لعامل توصيل جديد بالدخول إلى منزلك، تطلب منه أن "يتظاهر" بتوصيل بيتزا إلى طاولة وهمية في الردهة. تراقبه عن كثب. هل يحمل بيتزا حقاً؟ هل يحاول فتح خزنتك أثناء عملية "التوصيل"؟
  • كيف يفعلها MCPShield: قبل أن يستخدم الروبوت أداة ما ببياناتك الحقيقية، يرسل MCPShield طلباً "وهمياً" إلى الخادم. يتحقق من الآتي: "هل يتصرف الخادم تماماً كما وعد؟". إذا حاول الخادم القيام بشيء غريب خلال هذا الاختبار، يقول الروبوت: "لا، أنت محظور"، وذلك قبل وقوع أي ضرر حقيقي.

2. "الصندوق الزجاجي" (التنفيذ - Execution)

  • التشبيه: تخيل أن عامل التوصيل مسموح له بدخول مطبخك، لكنه يرتدي بدلة درع مصنوعة من الزجاج. يمكنه التحرك، لكنه محاصر داخل فقاعة صغيرة غير مرئية. إذا حاول لمس مجوهراتك أو فتح ثلاجتك، تتوقف الفقاعة فوراً وتطلق إنذاراً.
  • كيف يفعلها MCPShield: عندما يستخدم الروبوت الأداة فعلياً، يضع MCPShield الخادم في "بيئة معزولة" (Sandbox) - أي غرفة آمنة ومنفصلة. يراقب كل حركة يقوم بها الخادم. إذا حاول الخادم الوصول إلى ملف لم يكن من المفترض أن يصل إليه، يقوم MCPShield بحظره فوراً. إنه يشبه الحكم الذي يطلق الصافرة في اللحظة التي يخالف فيها اللاعب القواعد.

3. "الذاكرة طويلة المدى" (ما بعد الاستدعاء - Post-Invocation)

  • التشبيه: أحياناً يكون المعتدي بارعاً جداً في التظاهر. قد يتصرف بلطف خلال الزيارات الخمس الأولى، ولكن في الزيارة السادسة، يحاول سرقة شيء ما. الحارس البسيط عند الباب لن يكتشف ذلك. لكن الجار الذكي يتذكر: "مهلاً، هذا الرجل كان جيداً الأسبوع الماضي، لكنه اليوم يتصرف بغرابة".
  • كيف يفعلها MCPShield: يحتفظ MCPShield بمذكرات لكل تفاعل. يبحث عن الأنماط بمرور الوقت. إذا بدأ خادم كان آمناً في السابق بالتصرف بشكل مريب فجأة (انحراف/Drift)، يقوم الروبوت بتحديث ذاكرته: "هذا الشخص لم يعد جديراً بالثقة الآن". يمكنه أيضاً مشاركة قائمة "الأشرار" هذه مع روبوتات أخرى حتى لا يتم خداعها أيضاً.

لماذا يعد هذا أمراً مهماً؟

اختبرت الورقة هذا النظام ضد ستة أنواع مختلفة من المخترقين وستة أنواع من عقول الروبوتات.

  • بدون MCPShield: تعرضت الروبوتات للخداع في حوالي 90% من المرات.
  • مع MCPShield: أمسك الروبوت بالأشرار بنسبة 95% من المرات.

والأهم من ذلك، أنه لم يكتفِ بقول "لا" للجميع، بل سمح أيضاً للخوادم الجيدة والصادقة بالعمل بشكل مثالي، لذا لم يفقد الروبوت قدرته على إنجاز المهام.

الخلا سلفي (الخلاصة)

يحول MCPShield الروبوت من شخص ساذج يثق في الجميع إلى شخص حكيم وذو خبرة:

  1. يختبر الأشخاص الجدد قبل الوثوق بهم.
  2. يراقبهم عن كثب أثناء عملهم.
  3. يتذكر سلوكهم بمرور الوقت لكشف التهديدات بطيئة الحركة.

إنه "عقل أمني" يجعل مساعدينا من الذكاء الاصطناعي آمنين بما يكفي للسماح لهم بدخول بيوتنا الرقمية، حتى عندما يكون العالم مليئاً بالغرباء.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →