← أحدث الأبحاث
💻 computer science

VALD: Multi-Stage Vision Attack Detection for Efficient LVLM Defense

يُعد VALD وسيلة دفاع متعددة المراحل ولا تتطلب تدريباً لنماذج الرؤية واللغة الكبيرة، حيث يقوم بكشف الهجمات العدائية بكفاءة من خلال الجمع بين فحوصات اتساق الصور منخفضة التكلفة وتحليل تضمين النصوص مع توحيد البيانات عبر الوكيل، محققاً دقة تضاهي أحدث المعاياي التقنية مع تقليل العبء الحسابي للمدخلات السليمة.

المؤلفون الأصليون: Nadav Kadvil, Malak Fares, Ayellet Tal

نُشر 2026-03-18
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Nadav Kadvil, Malak Fares, Ayellet Tal

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك مساعداً آلياً ذكياً جداً، ولكنه ساذج قليلاً، يدعى LVML (نموذج لغوي بصري ضخم). يمكن لهذا الروبوت أن ينظر إلى صورة ويصفها بدقة مثالية، مثل المرشد السياحي. قد يقول: "هذا كلب من فصيلة جولدن ريتريفر يلعب بقرص طائر في الحديقة".

ومع ذلك، هناك مخترقون يمكنهم دس "خلل" صغير وغير مرئي داخل الصورة. بالنسبة لعينك البشرية، تبدو الصورة تماماً كما هي، ولكن بالنسبة للروبوت، فإن هذه الأعطال تشبه همساً مغناطيسياً يجعله يقول: "في الواقع، هذا عمود إطفاء أحمر!". لقد تم خداع الروبوت ليقول كذبة، رغم أنه يبذل قصارى جهده.

يقدم البحث نظام أمان جديد يسمى VALD (كشف الهجوم البصري) لإيقاف هذا. فكر في VALD ليس كحارس شخصي ثقيل ومكلف يفحص كل شخص يدخل المبنى، بل كفريق أمني ذكي متعدد المراحل يستخدم مزيجاً من الفحوصات السريعة والاستنتاج الذكي.

إليك كيف يعمل VALD، باستخدام تشبيهات بسيطة:

1. "النظرة الخاطفة" (المرحلة 1: الكشف المبكر)

معظم الأشخاص الذين يدخلون المبنى أبرياء. وفحص هوية الجميع بدقة يستغرق وقتاً طويلاً. لذا، يمتلك VALD مرحلة "النظرة الخاطفة".

  • التشبيه: تخيل أن لديك صورة لقطة. إذا أغمضت عينيك قليلاً (نظرت إليها بضبابية)، أو جعلتها ضبابية، أو قصصت زاوية منها، فستظل بوضوح قطة. "جوهرها" لم يتغير.
  • الاختراق: إذا كانت الصورة تحتوي على خلل مخفي من قبل مخترق، فإن التحديق الضبابي أو القص غالباً ما يؤدي إلى "كسر" هذا الخلل. قد يرى الروبوت فجأة كلباً بدلاً من قطة، أو يصاب بالارتباك.
  • الإجراء: يأخذ VALD الصورة بسرعة، ويطبق عليها بعض الفلاتر غير الضارة (مثل التضبيب أو القص)، ثم يسأل الروبوت: "هل لا تزال تبدو كشيء نفسه؟"
    • إذا كانت الإجابة "نعم، إنها متسقة": رائع! من المحتمل أن تكون صورة نظيفة. يسمح VALD للروبوت بالإجابة فوراً. يحدث هذا في 95% من المرات، مما يوفر وقتاً وطاقة هائلين.
    • إذا كانت الإجابة "مهلاً، هذا يبدو غريباً": يتم تحديدها كحالة مشبوهة وتنتقل إلى المرحلة التالية.

2. "حلقة النقاش" (المرحلة 2: الكشف المتأخر)

بالنسبة للصور المشبوهة، نحتاج إلى التعمق أكثر، ولكننا لا نزال نريد أن نكون فعالين.

  • التشبيه: تخيل أنك تطلب من 10 أشخاص مختلفين وصف نفس الصورة الضبابية. إذا قالوا جميعاً "إنها قطة"، فأنت تثق بهم. أما إذا قال أحدهم "إنها قطة" وقال آخر "إنها محمصة خبز"، فأنت تعلم أن هناك خطباً ما في الصورة أو أن أحد الأشخاص مرتبك.
  • الإجراء: يقوم VALD بإنشاء أوصاف للصورة الأصلية ولجميع النسخ المفلترة منها. ثم يقوم بفحص النص. إذا كانت الأوصاف متضاربة (بعضها يقول "قطة"، وبعضها "محمصة خبز"، وبعضها "عمود إطفاء")، فإنه يؤكد وقوع هجوم. أما إذا كان معظمهم متفقين، فقد يظل الأمر آمناً.

3. "المحرر الذكي" (المرحلة 3: الإصلاح النهائي)

فقط للصور التي فشلت في الاختبارين الأولين، يستدعي VALD "الرئيس الكبير" (ذكاء اصطناعي قوي جداً ومكلف).

  • التشبيه: تخيل أن لديك غرفة فوضوية بها 10 أوصاف مختلفة لما يوجد بداخلها. البعض يقول "كرسي أزرق"، والبعض يقول "كرسي أحمر"، وواحد يقول "يونيكورن طائر". أنت بحاجة إلى محرر ذكي لتنظيف هذا.
  • الإجراء: ينظر "الرئيس الكبير" إلى كل هذه الأوصاف المختلفة. ويستخدم قاعدة بسيطة: "ثق بالأغلبية، وتجاهل الاستثناءات".
    • إذا قال 9 من أصل 10 أوصاف "كلب"، وقال واحد "عمود إطفاء"، فإن المحرر يعرف أن "عمود الإطفاء" هو نتيجة الاختراق.
    • يقوم المحرر بدمج الأجزاء المتسقة ("كلب"، "حديقة"، "قرص طائر") ويرمي الأجزاء الغريبة وغير المتسقة.
    • الأمر الحاسم: "الرئيس الكبير" يقوم بهذا فقط للحالات الصعبة. إنه لا يضيع وقته في كل صورة.

لماذا يعتبر هذا تغييراً جذرياً؟

  1. إنه سريع: لأنه يستبعد 95% من الصور العادية فوراً، فإنه لا يبطئ النظام. إنه يشبه وجود مسار سريع لكبار الشخصيات (VIP) حيث ينتظر الأشخاص المشبوهون فقط.
  2. إنه رخيص: لا تحتاج إلى الذكاء الاصطناسي الأكثر قوة وتكلفة لكل صورة. أنت تستخدم "الرئيس الكبير" فقط عند الضرورة القصوى.
  3. إنه ذكي: بدلاً من محاولة "إصلاح" الصورة (وهو أمر صعب)، فإنه يصلح القصة التي يرويها الروبوت. إنه يدرك أنه إذا تغيرت القصة في كل مرة تنظر فيها إلى الصورة بشكل مختلف، فإن القصة هي كذبة.

الخلاصة

VALD يشبه وكالة تحريات تعلم أن 95% من عملائها أبرياء. بد way من استجواب الجميع، يقوم بإجراء فحص سريع للخلفية. إذا اجتزت الفحص، فأنت حر. وإذا بدوت مشبوهاً، فيحضرون فريقاً من الخبراء لمقارنة الملاحظات ومعرفة الحقيقة. بهذه الطريقة، يمسكون بالأشرار دون إضاعة الوقت على الأخيار.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →