← أحدث الأبحاث
💻 computer science

Low-Pass Filtering Improves Behavioral Alignment of Vision Models

تُثبت هذه الورقة أن تطبيق الترشيح منخفض التردد (التغبيش) على الصور عند وقت الاختبار يحسن بشكل كبير من التوافق السلوكي لنماذج الرؤية التمييزية مع المراقبين البشر، وذلك من خلال مطابقة الطيف الترددي للنظام البصري البشري، مما يؤدي إلى تقليص فجوة الأداء الحالية إلى النصف.

المؤلفون الأصليون: Max Wolff, Thomas Klein, Evgenia Rusak, Felix Wichmann, Wieland Brendel

نُشر 2026-02-17
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Max Wolff, Thomas Klein, Evgenia Rusak, Felix Wichmann, Wieland Brendel

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

الفكرة الكبرى: جعل الصور ضبابية يجعل الذكاء الاصطناعي يفكر مثل البشر

تخيل أن لديك روبوتًا فائق الذكاء يمكنه التعرف على صور القطط والكلاب والسيارات بشكل أفضل من أي إنسان؛ لقد قرأ كل كتاب في المكتبة ورأى كل صورة على الإنترنت. ولكن، هناك مشكلة: إنه يرى العالم بشكل مختلف عنك.

عندما تنظر إلى صورة كلب، ترى شكله (مثل ملامح أذنيه وذيله). أما الروبوت، فهو مهووس بـ الملمس (Texture). إذا عرضت عليه صورة قطة مصنوعة من فراء كلب، سيعتقد أنها كلب. وإذا عرضت عليه كلبًا مصنوعًا من فراء قطة، سيعتقد أنه قطة. الأمر يشبه كون الروبوت يقرأ "نسيج" الصورة بدلاً من "شكل" الشيء.

مؤخرًا، اكتشف العلماء نوعًا جديدًا من الذكاء الاصطناعي (يُسمى "نموذجًا توليديًا" مثل Imagen) كان يفكر بالفعل مثل البشر. اعتقدوا أن السبب هو أن هذا الذكاء الاصطناعي بُني باستخدام "دماغ إبداعي" خاص تعلم رسم الصور من الصفر.

تقول هذه الورقة البحثية: "مهلاً لحظة، ليس هذا هو السر!"

السبب الحقيقي وراء تفكير الذكاء الاصطناعي مثل البشر أبسط بكثير: لقد كان ينظر إلى صور ضبابية ومنخفضة الدقة.

تشبيه "تضييق العين" (Squinting)

فكر في كيفية عمل عينيك. عندما تنظر إلى شيء عن قرب شديد، أو عندما تضيق عينيك (تغمضها جزئيًا)، فإنك تفقد التفاصيل الدقيقة (الضجيج عالي التردد)، ولا ترى سوى الأشكال الكبيرة والناعمة.

  • الذكاء الاصطناعي القديم: كان مثل صقر يتمتع برؤية حادة ومثالية، يحدق في الصورة لدرجة أنه يستطيع رؤية البكسلات الفردية وحبيبات الورق. لقد تشتت انتباهه بالتفاصيل الصغيرة.
  • الذكاء الاصطناعي "الشبيه بالبشر": أُجبر على النظر إلى نسخة ضبابية وصغيرة جدًا (64×64 بكسل) من الصورة. لم يعد بإمكانه رؤية الملامس الدقيقة، لذا اضطر للتركوايز على الأشكال الكبيرة ليعرف ماهية الشيء.

أدرك مؤلفو هذه الورقة أن الذكاء الاصطناعي "الشبيه بالبشر" لم يكن مميزًا بسبب دماغه الإبداعي، بل كان مميزًا لأنه كان "يضيق عينيه".

التجربة: "اختبار الضباب"

لإثبات ذلك، أخذ الباحثون نموذج ذكاء اصطناعي قياسي وفائق الذكاء (نموذج "تمييزي") وفعلوا شيئًا بسيطًا للغاية: قاموا بتضبيب الصور قبل عرضها على الذكاء الاصطناعي.

لم يعيدوا تدريب الذكاء الاصطناعي، ولم يغيروا دماغه، بل وضعوا فقط "مرشح ضباب" أمام عينيه، مثل النظر من خلال نافذة مغطاة بالضباب.

كانت النتائج صادمة:

  1. التحيز للشكل: بدأ الذكاء الاصطناعي فجأة يهتم بالأشكال مرة أخرى، تمامًا كما يفعل البشر.
  2. اتساق الأخطاء: عندما يخطئ الذكاء الاصطناعي، أصبح يرتكب نفس الأخطاء التي يرتكبها البشر. في السابق، كان الذكاء الاصطناعي والبشر يرتكبون أخطاءً مختلفة تمامًا، أما الآن، فقد أصبحوا يرتكبون نفس الأخطاء.
  3. رقم قياسي جديد: هذه الحيلة البسيطة (التضبيب) جعلت الذكاء الاصطناعي يتفوق في الاختبارات "الشبيهة بالبشر" على أكثر النماذج التوليدية تعقيدًا وتطورًا التي تم بناؤها على الإطلاق.

لماذا ينجح هذا؟ "مرشح العين البشرية"

تشرح الورقة البحثية أن هذا ينجح بسبب كيفية عمل العين البشرية في الواقع.

تخيل أن عينك هي عدسة كاميرا:

  1. العدسة (البصريات): عينك ليست مثالية، فهي تسبب ضبابية بسي للضوء طبيعيًا قبل أن يصل إلى الجزء الخلفي من عينك (الشبكية).
  2. الدماغ (المعالجة): يقوم دماغك بعد ذلك بمعالجة هذه الإشارة الضبابية، وهو مهيأ لتجاهل التشويش الصغير (عالي التردد) والتركيز على الأشكال الناعمة (منخفضة التردد).

وجد الباحثون أن "الضباب" الذي طبقوه على الذكاء الاصطناعي يطابق الضباب الطبيعي للعين البشرية بشكل مثالي تقريبًا. من خلال إجبار الذكاء الاصطناعي على رؤية العالم بالطريقة التي تراه بها العين البشرية (بشكل ضبابي قليلاً، مع التركيز على الأشكال)، بدأ الذكاء الاصطناعي يتصرف مثل البشر.

"المقايضة" (جبهة باريتو - Pareto Frontier)

اكتشفت الورقة أيضًا قاعدة مضحكة حول الذكاء الاصطناعي والبشر: لا يمكنك أن تكون مثاليًا في كل شيء.

  • إذا حاول الذكاء الاصطناعي أن يكون دقيقًا بنسبة 100% في تحديد الأشياء (حتى تلك المشوهة غريبًا)، فإنه يتوقف عن التفكير مثل البشر، ويبدأ في استخدام "قوى خارقة" (مثل رؤية أنماط غير مرئية) لا يملكها البشر.
  • إذا حاول الذكاء الاصطناعي التفكير تمامًا مثل البشر، فعليه أن يقبل بأنه سيرتكب بعض الأخطاء التي يرتكبها البشر، مما يعني أن دقته الإجمالية ستنخفض قليلاً.

رسم المؤلفون "منحنى المقايضة" هذا، حيث أظهروا أن طريقة "التضبيب" تضع الذكاء الاصطناعي في المنطقة المثالية حيث يكون أكثر شبهاً بالبشر، حتى لو لم يكن الأكثر دقة كآلة مطلقة.

الخلاصة

لسنوات، اعتقد العلماء أنه لكي نجعل الذكاء الاصطناعي يفكر مثل البشر، نحتاج إلى بناء "أدمغة إبداعية" معقدة يمكنها إنتاج الفن أو القصص.

تقول هذه الورقة: "لا، كل ما عليك فعله هو إخبار الذكاء الاصطناعي بأن يتوقف عن التحديق بقوة في البكسلات."

ببساطة عن طريق تضبيب الصور المدخلة (وهي عملية تسمى الترشيح منخفض التردد - Low-Pass Filtering)، يمكننا جعل حتى أبسط نماذج الذكاء الاصطناعي تتصرف مثل المراقبين البشر. اتضح أنه في بعض الأحيان، لكي ترى العالم بوضوح، عليك أن تراه بشكل ضبابي قليلاً.

باختصار:

  • المشكلة: الذكاء الاصطناعي يرى الملامس؛ البشر يرون الأشكال.
  • اللغز: ذكاء اصطناعي ضبابي بدأ فجأة يرى الأشكال.
  • الحل: لم يكن الضباب خطأً؛ بل كان ميزة، لأنه يحاكي العين البشرية.
  • النتيجة: تضبيب الصور يجعل الذكاء الاصطناعي يتصرف كالبشر، دون الحاجة لإعادة بناء دماغه.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →