← أحدث الأبحاث
🤖 AI

How Adversarial Environments Mislead Agentic AI?

تقدم هذه الورقة مفهوم "فجوة الثقة" في وكلاء الذكاء الاصطناعي المتكاملين مع الأدوات عبر صياغة "الحقن البيئي العدائي" (AEI) كنموذج تهديد حيث تخدع مخرجات الأدوات المسمومة الوكلاء، وتثبت من خلال إطار عمل "POTEMKIN" أن الوكلاء الحاليين يفتقرون إلى المتانة ضد كل من الانحراف المعرفي القائم على الاتساع ("الوهم") والفخاخ الملاحية القائمة على العمق ("المتاهة").

المؤلفون الأصليون: Zhonghao Zhan, Huichi Zhou, Zhenhao Li, Peiyuan Jing, Krinos Li, Hamed Haddadi

نُشر 2026-04-22
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Zhonghao Zhan, Huichi Zhou, Zhenhao Li, Peiyuan Jing, Krinos Li, Hamed Haddadi

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ✨ هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك وظفت مساعداً بحثياً فائق الذكاء يدعى "الوكيل" (Agent). هذا الوكيل موهوب للغاية في إيجاد المعلومات، وقراءة الأوراق البحثية، وكتابة التقارير. لكن هناك عقبة واحدة: الوكيل لا يعرف العالم بشكل مباشر؛ هو يعرف العالم فقط من خلال الأدوات التي تقدمها له، مثل محرك بحث أو قاعدة بيانات مكتبية.

هذه الورقة البحثية تتحدث عن طريقة جديدة لخداع هذا الوكيل. يطلق عليها الباحثون اسم "مشكلة عرض ترومان" (The Truman Show Problem).

تماماً مثل شخصية "ترومان باربانك" في فيلم The Truman Show، الذي عاش حياته كلها في عالم مزيف صُنع من أجل برنامج تلفزيوني، تعيش وكلاء الذكاء الاصطناو عي في عالم بناه أدواتهم. وإذا تمكن مهاجم من اختراق تلك الأدوات، يمكنه إنشاء واقع مزيف سيصدقه الوكيل كأنه حقيقة بنسبة 100%.

لقد وجد الباحثون أن هناك طريقتين مختلفتين تماماً لكسر هؤلاء الوكلاء، وأن كونك بارعاً في صد إحداهما لا يساعدك في صد الأخرى. أطلقوا على ذلك اسم "الانقسام المتين" (Robustness Schism) (وهي طريقة منمقة للقول بوجود انقسام عميق في كيفية فشل الوكلاء).

إليك الطريقتان اللتان يتم بهما خداع الوكلاء:

1. الوهم (هجوم "الأخبار المزيفة")

الاستعارة: تخيل أنك سألت مساعدك لمعرفة ما إذا كانت فاكهة معينة سامة أم لا. المهاجم هنا لا يغير الفاكهة، بل يقوم باختراق الكتب المكتبية ومقالات الإنترنت التي يقرأها المساعد. يقوم باستبدال الحقيقة بآلاف المقالات المقنعة ذات النبرة المحايدة التي تقول: "نعم، هذه الفاكهة سامة بالتأكيد".

  • ماذا يحدث: يقرأ الوكيل كل هذه "الحقائق المزيفة"، ويصاب بالارتباك، ويبدأ في تصديق الكذبة. يتغير رأيه (ينحرف)، ويخبرك بأن الفاكهة سامة.
  • المفاجأة: وجد الباحثون أن الوكلاء يثقون بشكل مبالغ فيه في الحقائق ذات النبرة المحايدة. إذا بدا المقال وكأنه تقرير إخباري ممل، فإن الوكيل يصدقه. أما إذا بدا كإشاعة جامحة، فإنه يشكك فيه. ولكن إذا بدا تقريراً جافاً ومهنياً، فإن الوكيل يقبله دون تفكير.
  • "عقوبة الصدق": والأسوأ من ذلك، إذا ذُكرت الحقيقة بحذر (مثل: "تشير البيانات إلى أن هذا قد يكون صحيحاً")، فإن الوكيل غالباً ما يرفضها! ولكن إذا قال الكاذب ذلك بثقة ("هذا صحيح!")، فإن الوكيل يصدقه. الوكيل يعاقب الصدق ويكافئ الثقة.

2. المتاهة (هجوم "الممر اللانهائي")

الاستعار: هذه المرة، المهاجم لا يكذب بشأن الحقائق. بدلاً من ذلك، يبني فخاً هيكلياً. تخيل أن وكيلك يحاول العثور على غرفة معينة في مكتبة. يقوم المهاجم بإضافة ممر وهمي يؤدي إلى باب، يؤدي إلى باب آخر، يؤدي بدوره إلى الباب الأول. إنها حلقة مفرغة لا نهائية.

  • ماذا يحدث: لا يحتاج الوكيل لتصديق كذبة لكي يعلق؛ هو فقط يحتاج لاتباع الروابط. يقع في فخ "دورة الاستشهاد"، حيث ينتقل من ورقة بحثية مزيفة إلى أخرى، إلى الأبد.
  • التكلفة: يهدر الوكيل كل وقته وطاقته (ميزانية الخطوات الخاصة به) في الدوران في دوائر. لا ينهي المهمة، ليس لأنه غبي، بل لأن الخريطة التي أُعطيت له معطلة.
  • المفاجأة: حتى الوكلاء الجيدون جداً في كشف الأخبار المزيفة (الوهم) هم سيئون جداً في كشف هذه الفخاخ. يمكنهم تمييز أن الحقيقة المزيفة هي كذبة، لكن لا يمكنهم تمييز أن الممر الذي يسيرون فيه غير موجود أصلاً.

الاكتشاف الكبير: "الانقسام المتين"

الاكتشاف الأهم هو أن هاتين المهارتين غير مرتبطتين.

  • الوكيل الذي يعتبر عبقرياً في كشف الأخبار المزيفة (الوهم) قد يكون غبياً تماماً في التنقل عبر الخرائط (المتاهة).
  • والوكيل الذي يجيد التنقل قد يكون من السهل خداعه بالحقائق المزيفة.

الأمر يشبه شخصاً بارعاً جداً في تمييز الماس المزيف، ولكنه قد يسقط من فوق منحدر لأنه لم يلاحظ غياب الجسر. لا يمكنك إصلاح مشكلة عن طريق إصلاح الأخرى.

الحل: POTEMKIN

بنى الباحثون أداة تسمى POTEMKIN (سميت تيمناً بـ "قرى بوتيمكين"، وهي مستوطنات مزيفة بُنيت للإبهار).

فكر في POTEMKIN كأنه "صالة ألعاب رياضية لاختبار المتانة" لوكلاء الذكاء الاصطناعي. قبل أن تطلق وكيل الذكاء الاصطناعي في العالم الحقيقي (مثل مستشفى أو شركة محاماة)، يمكنك تشغيله عبر POTEMKIN:

  • يحاول تغذية الوكيل بأخبار مزيفة.
  • يحاول حصار الوكيل في حلقات لانهائية.
  • يخبرك بالضبط أين تكمن نقاط ضعف الوكيل.

لماذا يجب أن تهتم؟

بينما يبدأ وكلاء الذكاء الاصطناعي في القيام بأعمال حقيقية — مثل كتابة الأكواد البرمجية، أو فحص السجلات الطبية، أو إجراء البحوث القانونية — سيعتمدون بشكل كبير على الأدوات الخارجية. وإذا لم نختبرهم ضد هجمات "العالم المزيف" هذه، فقد يسهل التلاعب بهم لـ:

  1. تصديق الأكاذيب (مما يعطيك نصائح طبية خاطئة).
  2. الوقوع في حلقات مفرغة (مما يهدر المال والوقت).

تحذرنا الورقة البحثية: مجرد كون الذكاء الاصطناعي ذكياً لا يعني أنه آمن. نحن بحاجة لبناء وكلاء ليسوا فقط واسعي المعرفة، بل أيضاً متشككين وواعين بمحيطهم.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →