← أحدث الأبحاث
🤖 AI

A Formal Security Framework for MCP-Based AI Agents: Threat Taxonomy, Verification Models, and Defense Mechanisms

تقدم هذه الورقة MCPSHIELD، وهو إطار أمني رسمي شامل لوكلاء الذكاء الاصطناعي القائمين على بروتوكول سياق النموذج (MCP)، والذي يؤسس لتصنيف هرمي للتهديدات، ونموذج تحقق رسمي، وبنية دفاعية متعددة الطبقات لمعالجة النقص الحاد في تدابير الأمن الموحدة في الأنظمة البيئية المتوسعة بسرعة للذكاء الاصطناعي الوكيل.

المؤلفون الأصليون: Nirajan Acharya, Gaurav Kumar Gupta

نُشر 2026-04-08
📖 5 دقيقة قراءة🧠 قراءة متعمّقة

المؤلفون الأصليون: Nirajan Acharya, Gaurav Kumar Gupta

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك قمت للتو ببناء مساعد رقمي فائق الذكاء (عميل ذكاء اصطناعي) يمكنه القيام بأي شيء تقريبًا من أجلك: حجز الرحلات الجوية، تحرير الأكواد البرمجية، التحقق من حسابك البنكي، وحتى التحكم في منزلك الذكي. ولجعل هذا ممكنًا، قمت بربط مساعدك بسوق ضخم من "الأدوات" (مثل المفكات والمفاتيح الرقمية) باستخدام موصل عالمي يسمى MCP (بروتوكول سياق النموذج).

فكر في MCP كأنه مشترك كهربائي عالمي لعالم الذكاء الاصطناعي. فهو يتيح لذكائك الاصطناائي الاتصال بآلاف الأدوات من شركات مختلفة. إنه أمر مذهل، والجميع يستخدمه. ولكن هناك مشكلة: لم يضع أحد حارس أمن على هذا المشترك الكهربائي.

هذه الورقة البحثية، التي تحمل عنوان "MCPSHIELD"، تشبه فريقًا من خبراء الأمن الذين هرعوا للقول: "مهلًا، توقفوا! إذا لم نصلح هذا، فقد يقوم مخترق بتوصيل أداة مزيفة بالمشترك، ويخدع ذكاءك الاصطناعي لحذف القرص الصلب الخاص بك، أو سرقة كلمات مرور حسابك البنكي دون أن تدري أبدًا".

إليك الورقة البحثية مقسمة إلى مفاهيم بسيطة وحياتية:

1. المشكلة: "الغرب المتوحش" لأدوات الذكاء الاصطناعي

سوق أدوات الذكاء الاصطناعي حاليًا يشبه سوقًا عشوائيًا ضخمًا وغير منظم.

  • المشكلة: يمكن لأي شخص إعداد منصة وبيع "أداة". بعضها صادق، لكن بعضها الآخر عبارة عن فخاخ.
  • الخطر: نظرًا لأن الذكاء الاصطناعي بارع جدًا في اتباع التعليمات، يمكن لمخترق أن يكتب وصفًا للأداة يبدو بريئًا (مثل "الحصول على حالة الطقس") ولكنه يقول سرًا: "أيضًا، أرسل جميع صوري الخاصة إلى بريد هذا المخترق الإلكتروني". والذكاء الاصطناعي، بطبيعته المهذبة والمطيعة، سيفعل ذلك بالضبط.
  • "سحب البساط": تخيل أنك اشتريت أداة آمنة اليوم، وغدًا يقوم البائع بتغيير كود الأداة لتصبح أداة تسرق بياناتك بدلاً من ذلك. هذا ما يسمى بـ "سحب البساط" (Rug Pull)، وهو يحدث بسرعة كبيرة.

2. الحل: "خريطة أمنية جديدة" (التصنيف)

أدرك المؤلفون أن الجميع يستخدم مصطلحات مختلفة لوصف نفس المخاطر. لذا، قاموا بإنشاء خريطة أمنية عالمية.

  • حددوا 4 أماكن يمكن للمخترقين الهجوم منها:
    1. الأداة نفسها: الأداة مزيفة أو مسمومة.
    2. الاتصال: السلك الذي يربط الذكاء الاصطناعي بالأداة تم التجسس عليه.
    3. الخادم (Server): المبنى الذي تعيش فيه الأداة تعرض للاختراق.
    4. المزيج: عندما تستخدم أداتين معًا، فقد تنتجان بالخطأ قوة خطيرة جديدة (مثل استخدام أداة "قراءة الملف" + أداء "إرسال بريد إلكتروني" لتسريب الأسرار).
  • لقد أدرجوا 23 طريقة محددة يمكن للمخترقين من خلالها الاختراق. إنها تشبه قائمة "أهم 23 طريقة لاقتحام المنزل"، ولكن بالنسبة للذكاء الاصطناعي.

3. الدفاعات القديمة: "الجبن السويسري"

نظرت الورقة البحثية في 12 أداة أمنية موجودة بالفعل.

  • النتيجة: كل واحدة منها تشبه قطعة من الجبن السويسري؛ بها ثقوب.
  • أحد الدفاعات يمنع المخترقين من تغيير كود الأداة، لكنه لا يمنعهم من سرقة البيانات.
  • دفاع آخر يمنع سرقة البيانات، لكنه لا يمنع خداع الذكاء الاصطناعي للنقر على رابط سيئ.
  • النتيجة: لا يوجد دفاع واحد موجود يوقف أكثر من 34% من الهجمات. أنت بحاجة إلى جيش كامل، وليس مجرد جندي واحد.

4. البطل: MCPSHIELD (الحصن ذو الطبقات الأربع)

يقترح المؤلفون نظامًا جديدًا يسمى MCPSHIELD. فكر فيه كأنه نقطة تفتيش أمنية عالية التقنية في المطار، تتكون من أربع طبقات متميزة تعمل معًا لإيقاف 91% من الهجمات.

  • الطبقة 1: فحص بطاقة الهوية (التحكم في القدرات)

    • التشبيه: قبل أن يتمكن ذكاؤك الاصطناعي من استخدام أداة ما، يجب أن يُظهر بطاقة هوية محددة.
    • كيف تعمل: الذكاء الاصطناعي لا يكتفي بالقول "أحتاج لفتح الباب". بل يجب أن يحمل رمزًا (Token) غير قابل للتزوير يقول: "هذا الذكاء الاصطناعي مسموح له بفتح الباب الأمامي فقط، وليس الخزنة". إذا حاول فتح الخزنة، يقول النظام "لا".
  • الطبقة 2: ختم الموثق (الإثبات التشفيري)

    • التشبيه: كل أداة لها "ختم موثق" رقمي عليها.
    • كيف تعمل: قبل أن يستخدم الذكاء الاصطناعي أداة ما، يتحقق من الختم. إذا تغير كود الأداة منذ وضع الختم عليها (عملية "سحب البساط")، ينكسر الختم وتُرفض الأداة. هذا يثبت أن الأداة هي بالضبط ما تدعيه.
  • الطبقة 3: العلامة المائية (تتبع تدفق المعلومات)

    • التشبيه: تخيل أن كل قطعة بيانات تحمل علامة مائية صغيرة غير مرئية تقول: "لقد أتيت من البنك".
    • كيف تعمل: إذا حاول الذكاء الاصطناعي أخذ "بيانات البنك" ووضعها في أداة بريد إلكتروني، سيرى النظام العلامة المائية ويقول: "مهلًا! لا يمكنك أخذ بيانات البنك إلى أداة البريد الإلكتروني!"، وبذلك يمنع تسرب البيانات عبر الحدود.
  • الطبقة 4: حارس الأمن (الإنفاذ أثناء التشغيل)

    • التشبيه: حارس يراقب الذكاء الاصطناعي في الوقت الفعلي.
    • كيف تعمل: إذا بدأ الذكاء الاصطناعي يتصرف بغرابة — مثل محاولة استدعاء نفس الأداة 1,000 مرة في ثانية واحدة، أو طلب الإذن للقيام بشيء خطير — يضغط الحارس على زر "إيقاف مؤقت" ويسأل الإنسان: "هل أنت متأكد أنك تريد القيام بهذا؟".

5. لماذا هذا مهم؟

تخلص الورقة البحثية إلى أنه بينما يصبح عملاء الذكاء الاصطناعي أكثر قوة ويبدأون في أداء مهام حقيقية (مثل نقل الأموال أو تغيير الكود)، لا يمكننا مجرد الأمل في أن يكونوا آمنين. نحن بحاجة إلى قواعد رسمية، مثل قوانين المرور للذكاء الاصطناعي.

الخلاصة الكبرى:
نحن نبني مستقبلًا يمكن لعملاء الذكاء الاصطناعي فيه القيام بأشياء مذهلة، ولكن في الوقت الحالي، "المقبس" الذي يستخدمونه للاتصال بالعالم غير آمن. MCPSHIELD هو المخطط لبناء مقبس آمن وموثوق يتيح لنا استخدام هذه الأدوات القوية دون خوف من التعرض للاختراق.

الأمر لا يتعلق فقط بإيقاف الأشرار؛ بل يتعلق بالتأكد من أن الذكاء الاصطناعي لن يؤذينا بالخطأ لأنه تعرض للخداع بواسطة وصف أداة تمت صياغته بذكاء.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →