← أحدث الأبحاث
🤖 AI

Leave My Images Alone: Preventing Multi-Modal Large Language Models from Analyzing Images via Visual Prompt Injection

تقدم هذه الورقة "ImageProtector"، وهي طريقة من جانب المستخدم تقوم بتضمين اضطرابات بصرية غير مرئية تقريبًا في الصور لاستحثاث استجابات الرفض في النماذج اللغوية الكبيرة متعددة الوسائط، مما يمنع بفعالية الاستخراج غير المصرح به للمعلومات الحساسة مع إظهار المتانة ضد الإجراءات المضادة الشائعة.

المؤلفون الأصليون: Zedian Shao, Hongbin Liu, Yuepeng Hu, Neil Zhenqiang Gong

نُشر 2026-04-13
📖 3 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Zedian Shao, Hongbin Liu, Yuepeng Hu, Neil Zhenqiang Gong

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك صورة شخصية جميلة تود مشاركتها على وسائل التواصل الاجتماعي. أنت تحب الصورة، لكنك قلق من أن يقوم "محقق رقمي" (ذكاء اصطناعي) بمسحها، ومعرفة هويتك الحقيقية، أو أين تعيش، أو ماذا كنت تفعل، وسرقة هذه المعلومات الخاصة.

تقدم هذه الورقة البحثية حارساً رقمياً لصورك يسمى ImageProtector. وإليك كيف يعمل، مشروحاً ببساطة:

المشكلة: الذكاء الاصطناعي الفضولي للغاية

فكر في نماذج الذكاء الاصطنا-عي الحديثة (التي تسمى MLLMs) كأنها أمناء مكتبة أذكياء جداً، ولكنهم فضوليون بعض الشيء. إذا عرضت عليهم صورة لشارع، يمكنهم تحديد اسم الشارع، والمدينة، وحتى تخمين وقت اليوم. وبينما يعد هذا أمراً رائعاً لمساعدة الناس، إلا أنه يمثل كابوساً للخصوصية. فإذا استخدم شخص سيء هذه الأنواع من الذكاء الاصطناعي لمسح ملايين الصور عبر الإنترنت، فقد يتمكن من جمع التفاصيل الخاصة بالجميع في وقت واحد.

الحل: "الدرع الخفي"

ابتكر الباحثون أداة تسمى ImageProtector. وبدلاً من طمس وجهك أو وضع شريط أسود فوق صورتك (مما يفسد الصورة)، تضيف هذه الأداة طبقة "تشويش" ضئيلة وغير مرئية إلى الصورة.

بالنسبة لعين الإنسان، تبدو الصورة كما هي تماماً. الأمر يشبه إضافة حبة رمل واحدة إلى شاطئ؛ لا يمكنك رؤيتها، لكنها موجودة.

كيف يعمل: خدعة "الروبوت المرتبك"

هذا هو الجزء الذكي. هذا التشويش غير المرئي ليس مجرد ضجيج؛ بل هو أمر سري مكتوب بلغة يفهمها الذكاء الاصطناعي فقط.

  1. الإعداد: تأخذ صورتك وتمررها عبر ImageProtector. تقوم الأداة بإضافة هذا "الأمر السري" إلى البكسلات.
  2. الهجوم: يقوم شخص سيء بتحميل صورتك ويسأل الذكاء الاصطناعي: "من هذا الشخص؟" أو "أين هذا المكان؟".
  3. النتيجة: بدلاً من الإجابة على السؤال، يرى الذكاء الاصطناعي الأمر السري. يصاب بالارتباك ويعتقد: "أوه لا! يبدو أن هذا طلب غير مسموح لي بالإجابة عليه. يجب أن أرفض!".
  4. الرفض: يقول الذكاء الاصطناعي بأدب: "عذراً، لا يمكنني المساعدة في هذا الطلب"، ويتوقف عن تحليل الصورة.

الأمر يشبه وضع لافتة "الرجاء عدم الإزعاج" على باب منزلك، وهي لافتة غير مرئية للبشر ولكنها تتوهج باللون الأحمر الساطع لساعي البريد. يرى ساعي البريد (الذكاء الاصطنا-عي) اللافتة ويقرر عدم تسليم الطرد (المعلومات الخاصة)، رغم أن الباب يبدو طبيعياً للجميع.

لماذا هو مميز؟

  • إنه عالمي: اختبر الباحثون هذه الأداة على ستة أنواع مختلفة من "أمناء المكتبة" (نماذج الذكاء الاصطناعي). ومهما كان نوع الذكاء الاصطنا-عي الذي يستخدمه الشخص السيء، فإن الأمر السري يعمل.
  • إنه غير مرئي: التغييرات في الصورة صغيرة جداً لدرجة أنك لا تستطيع رؤيتها، لذا تظل صورتك رائعة لأصدقائك.
  • إنه استباقي: أنت تقوم بهذا قبل نشر الصورة. لست بحاجة لمعرفة من سيهاجمك؛ أنت فقط تحمي الصورة مسبقاً.

هل يمكن للأشرار المقاومة؟

سأل الباحثون أيضاً: "هل يمكن للأشرار مجرد تنظيف الصورة لإزالة هذا الدرع؟"
لقد جربوا ثلاث طرق شائعة:

  1. إضافة ضجيج عشوائي: مثل هز الصورة. ساعد هذا قليلاً، ولكنه جعل الصورة تبدو محببة وأفسد قدرة الذكاء الاصطنا-عي على الإجابة على أي أسئلة (حتى الآمنة منها).
  2. تنعيم الصورة: مثل طمسها قليلاً. أدى ذلك إلى إزالة الدرع، ولكنه جعل الذكاء الاصطنا-عي أقل ذكاءً وأبطأ.
  3. تدريب الذكاء الاصطنا-عي على تجاهله: مثل تعليم الذكاء الاصطنا-عي تجاهل لافتة "الرجاء عدم الإزعاج". نجح هذا قليلاً، لكنه تطلب الكثير من القدرة الحوسبية ولا يزال يجعل الذكاء الاصطنا-عي أقل دقة.

الخلاصة

ImageProtector هو وسيلة للأشخاص العاديين للسيطرة على خصوصيتهم الرقمية. إنه يحول الصورة إلى "فخ" للذكاء الاصطنا-عي الفضولي. إذا حاول شخص سيء تحليلها، فإن الذكاء الاصطنا-عي يتعثر في الفخ غير المرئي ويرفض الكشف عن أي أسرار. إنها طريقة بسيطة وفعالة لقول: "بياناتي ملكي، ولا يمكنك قراءتها".

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →