← أحدث الأبحاث
💻 computer science

Scalable Black-Box Model Attribution for Images

تقدم هذه الورقة البحثية طريقة RPA (نسب الرقعة الخام)، وهي طريقة "الصندوق الأسود" خفيفة الوزن والمتينة التي تتفوق على الأساليب المعقدة الموجودة في تحديد نماذج الصور التوليدية، مع تقديم قدرات متعددة الاستخدامات للتجميع غير الخاضع للإشراف والتكيف بلقطات قليلة دون الحاجة إلى إعادة التدريب.

المؤلفون الأصليون: Asaf Livne, Amir Jevnisek, Shai Avidan

نُشر 2026-08-18
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Asaf Livne, Amir Jevnisek, Shai Avidan

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

في السنوات القليية الماضية، أحدث نوع جديد من الذكاء الاصطناعي تحولاً في كيفية إنتاجنا للصور. هذه الأنظمة، المعروفة بالنماذج التوليدية، يمكنها تحويل الأوصاف النصية البسيطة إلى صور مذهلة وواقعية للغاية. لقد أصبحت شائعة جداً لدرجة أنها باتت الآن تشكل ركيزة أساسية في الكثير من عمليات الإنتاج الإعلامي والعمل الإبداعي الحديث. ومع ذلك، فقد أدى هذا الانتشار السريع إلى خلق مشكلة كبيرة: فعندما ترى صورة، غالباً ما يكون من المستحيل معرفة أي آلة محددة قامت بإنشائها. وهذا الغموض يكتسب أهمية لأسباب تتراوح بين حماية الملكية الفكرية للفنانين إلى تتبع أصل المحتوى المضلل. ولا يقتصر التحدي على مجرد اكتشاف أن الصورة مزيفة، بل في تحديد المحرك الذي أنتجها بالضبط من بين مئات المحركات المختلفة للذكال الاصطناعي. وتعد هذه المهمة، التي تسمى "نسب النموذج" (model attribution)، صعبة لأن هذه الآلات تتطور باستمرار، وغالباً ما تبدو مخرجاتها متطابقة تقريباً للعين البشرية. علاوة على ذلك، فإن العدد الهائل من النماذج المتاحة، بما في ذلك الآلاف من النسخ المخصصة، يجعل مهمة تتبعها تبدو مرهقة.

لقد وجد باحثون في جامعة تل أبيب حلاً بسيطاً بشكل مفاجئ لهذه المشكلة المعقدة. فبدلاً من بناء نظام ضخم ومعقد ليضاهي تعقيد المولدات، طوروا أداة خفيفة تعمل كصنف أساسي. يعمل نهجهم، المسمى RPA، في ظل نظام "الصندوق الأسود" الأكثر صرامة، مما يعني أنه ينظر فقط إلى الصورة النهائية دون الحاجة إلى الوصول إلى الكود الداخلي، أو الأوزان، أو الإعدادات السرية للذكاء الاصطناعي الذي صنعها. يقوم الأسلوب بتقسيم الصورة إلى مربعات صغيرة وتحليل أنماط الألوان الخام في كل منها. وعلى الرغم من التشابه البصري بين الصور الناتجة عن نماذج مختلفة، اكتشف الباحثون أن كل مولد يترك خلفه بصمة فريدة ومنخفضة المستوى في نسيج البكسلات. ومن خلال تدريب شبكة عصبية صغيرة للتعرف على هذه الأنماط الدقيقة، يمكن للنظام تحديد مصدر الصورة بدقة مذهلة. وفي مجموعة اختبار مكونة من خمسة وعشرين نموذجاً مختلفاً، حققت الأداة دقة بلغت 98.0 بالمئة، وفي مجموعة أكثر فوضوية من العالم الحقيقي مكونة من سبعة وعشرين نموذجاً، لا تزال تصل إلى 92.9 بالمئة.

وما يجعل هذا الاكتشاف مثيراً للاهتمام بشكل خاص هو كيفية تعامل الأداة مع الواقع الفوضوي للإنترنت. فالصور الموجودة في "البرية" نادراً ما تكون نقية؛ فهي غالباً ما تتعرض للضغط أو التمويه أو تغيير الحجم أثناء انتقالها عبر وسائل التواصل الاجتماعي ومواقع الأخبار. وقد فشلت العديد من الأساليب السابقة عند مواجهة هذه التغييرات الشائعة. ومع ذلك، يظل النظام الجديد قوياً؛ فعندما اختبره الباحثون ضد صور تعرضت لضغط شديد أو تغيير في الحجم، انخفضت الدقة بشكل طفيف فقط، مما يثبت أن البصمة التي يكتشفها هي سمة هيكلية أساسية وليست مجرد أثر عابر. كما أن النظام يتميز بكفاءة عالية؛ فخلافاً للأساليات الأخرى التي تتطلب مقارنة الصورة مع كل نموذج مرشح محتمل واحداً تلو الآخر - وهي عملية تتباطأ مع نمو عدد النماذج - تقوم هذه الأداة بتقييم الصورة في تمريرة واحدة. والوقت المستغرق لتحديد المصدر لا يزداد حتى لو توسعت قاعدة بيانات النماذج المعروفة من بضع عشرات إلى بضعة آلاف.

وإلى جانب مجرد تحديد النماذج المعروفة، وجد الباحثون أن الأداة تمتلك ذكاءً أعمق وأكثر تنوعاً. فعندما تواجه صورة من مولد لم تره من قبل، يمكنها ببراعة تصنيفها كـ "غير معروفة"، بدلاً من فرض تخمين خاطئ. وهذه القدرة على التعرف على غير المألوف تعد أمراً بالغ الأهمية في مجال تظهر فيه نماذج جديدة يومياً. علاوة على ذلك، يمكن للنظام التكيف مع هذه النماذج الجديدة بشكل فوري تقريباً. فبدلاً من طلب عملية إعادة تدريب طويلة، يمكن للباحثين ببساً إضافة نموذج جديد عن طريق ملاءمة طبقة صغيرة وبسيطة للشبكة الموجودة، وهي مهمة لا تستغرق سوى بضع دقائق. ويشير هذا المرونة إلى أن الأداة قد تعلمت خريطة عامة لكيفية عمل هذه الآلات، بدلاً من مجرد حفظ قائمة من الأمثلة المحددة.

كما استخدم الباحثون هذا الفهم المتعلم لاستكشاف العلاقات بين النماذج نفسها. فمن خلال تحليل الميزات الداخلية التي تستخدمها الأداة لاتخاذ قراراتها، تمكنوا من تجميع المولدات المختلفة في عائلات بناءً على تشابهاتها الهيكلية، حتى دون إخبارهم بالنماذج المرتبطة ببعضها. وقد حدد النظام بشكل صحيح أن نماذج معينة تشترك في سلالة أو تقنية أساسية واحدة، حيث جمعها معاً بطريقة تطابق الحقائق المعروفة عن تطويرها. وتمتد هذه القدرة إلى الصور من المولدات غير المرئية أيضاً، مما يسمح للأداة بتجميعها حسب مصدرها الحقيقي دون أي تدريب مسبق. وتثبت الدراسة أن نهجاً مباشً وبسيطاً يمكن أن يتفوق على الآلات الضخمة والمعقدة في مهمة تتبع الأصول الرقمية. وهي تشير إلى أن المفتاح لفهم هذه الأنظمة المعقدة لا يكمن في بناء كواشف أكثر تعقيداً، بل في التعرف على التواقيع الدقيقة والمستمرة التي تتركها كل آلة في الصور التي تبتكرها.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →