← أحدث الأبحاث
💻 computer science

DRL-Guided Neural Batch Sampling for Semi-Supervised Pixel-Level Anomaly Detection

تقترح هذه الورقة إطار عمل للتعلم التعزيزي العميق شبه الخاضع للإشراف يدمج بين عينة دفع عصبية، ومشفّر تلقائي، ومتنبئ لتحقيق دقة وتحديد موقع فائقين في الكشف عن الشذوذ على مستوى البكسل في العمليات الصناعية باستخدام بيانات مصنفة محدودة، متفوقة بذلك على الأساليب الرائدة في مجموعة بيانات MVTec AD.

المؤلفون الأصليون: Amirhossein Khadivi Noghredeh, Abdollah Safari, Fatemeh Ziaeetabar, Firoozeh Haghighi

نُشر 2026-08-18
📖 7 دقيقة قراءة🧠 قراءة متعمّقة

المؤلفون الأصليون: Amirhossein Khadivi Noghredeh, Abdollah Safari, Fatemeh Ziaeetabar, Firoozeh Haghighi

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

في المصانع التي تصنع كل شيء، من لوحات الدوائر الكهربائية إلى تغليف المواد الغذائية، تُعد مراقبة الجودة لعبة مستمرة من البحث عن الشيء الوحيد الذي لا ينتمي إلى المجموعة. لعقود من الزمن، تم تدريب الآلات على رصد هذه العيوب، لكنها تواجه مشكلة جوهرية: نادراً ما يتم عرض شكل المنتج المكسور عليها. فالعيوب نادرة، ومكلفة في إنتاجها، وغالباً ما تكون دقيقة، مثل خدش شعري على سطح مصقول أو شظية صغيرة في مكون زجاجي. وبسبب هذا الندرة، علم المهندسون الحواسيب تقليدياً أن تتعلم فقط شكل القطعة المثالية؛ حيث تحفظ الحواسيب ما يبدو عليه الشيء "الطبيعي"، وعندما ترى شيئاً يبتعد عن تلك الذاكرة، تصنفه كعيب. ومع ذلك، فإن هذا النهج يحتوي على نقطة عمياء؛ فإذا تعلم الكمبيوتر شكل القطعة الطبيعية بدقة مفرطة، فقد يرتبك أمام الأخطاء الصغيرة والهادئة التي تهمنا حقاً، أو قد يتجاهلها ببساطة لأنها لا تبدو مثل الأخطاء الكبيرة والواضيحة التي تم تدريبه عليها.

اقترح فريق من الباحثين من جامعة طهران طريقة جديدة لحل هذا اللغز، وهي طريقة تتجاوز مجرد حفظ الكمال. فبدلاً من الاعتماد على ذاكرة ثابتة لما هو طبيعي، ابتكروا نظاماً يتعلم بنشاط كيفية البحث عن المشاكل. وتجمع طريقتهم، المفصلة في دراسة حديثة، بين ثلاث أدوات متميزة في حلقة واحدة ذاتية التحسين. أولاً، "كشاف" رقمي يتحرك عبر الصورة، ويقرر أي الأجزاء الصغيرة تستحق نظرة فاحصة. ثان، محرك إعادة بناء يحاول إعادة بناء تلك الأجزاء من الذاكرة، مسلطاً الضوء على مواضع فشل الذاكرة في مطابقة الواقع. ثالثاً، مصنف يتعلم قراءة حالات الفشل هذه ويرسم خريطة دقيقة للعيب. ومن خلال السماح لهذه الأجز الثلاثة بالتواصل مع بعضها البعض، يتعلم النظام العثور على الشذوذ الدقيق بمستوى من الدقة عجزت عنه الطرق السابقة، وكل ذلك باستخدام عدد قليل فقط من الأمثلة المعروفة للمنتجات المعيبة لتوجيه العملية.

جوهر هذا الإطار الجديد هو وكيل رقمي يعمل كـ "مفتش فضولي". في الأنظمة التقليدية، قد يقوم الكمبيوتر بمسح صورة كاملة دفعة واحدة أو النظر إلى قطع عشوائية دون خطة. أما هذا الوكيل الجديد، فيستخدم تقنية تسمى "التعلم التعزيزي"، وهي في الأساس عملية تعلم قائمة على التجربة والخطأ مدفوعة بالمكافآت. تخيل شخصاً يسير في مستودع كبير بحثاً عن نوع معين من التلف؛ فهو لا يسير في خط مستقيم أو يفحص كل صندوق عشوائياً، بل يبحث عن أدلة، ويقرر أي منطقة تبدو أكثر إثارة للريبة، ثم يوجه انتباهه إليها. هذا الوكيل الرقمي يفعل الشيء نفسه؛ فهو ينظر إلى الصورة ويقرر أي مربع صغير سيفحصه تالياً بناءً على ما تعلمه حتى الآن. إذا اختار بقعة تساعد النظام على فهم الفرق بين الجزء الجيد والجزء السيئ، فإنه يحصل على مكافأة. وإذا اختار بقعة لا تضيف معلومات جديدة، فإنه يتعلم تجنب تلك المنطقة في المستقبل. وهذا يسمح للنظام بتركيز طاقته على الأجزاء الأكثر إفادة في الصورة، بدلاً من إضاعة الوقت في المناطق التي هي واضحة تماماً في مثاليّتها.

بمجرد أن يختار الوكيل قطعة (Patch)، يتم تمريرها إلى محرك إعادة البناء، وهو نوع من الشبكات العصبية المصممة لإعادة بناء الصور. لقد تم تدريب هذا المحرك بشكل مكثف على عينات مثالية خالية من العيوب. فعندما يتلقى قطعة من جزء جيد من المنتج، يمكنه إعادة بنائها بشكل شبه مثالي. ولكن عندما يتلقى قطعة تحتوي على خدش أو شظية، فإنه يعاني؛ لأنه لم يسبق له رؤية ذلك العيب المحدد أثناء تدريبه، فلا يمكنه إعادة بنائه بدقة. والفرق بين ما يراه المحرك وما يعيد بناءه يخلق "ملف تعريف الخسارة" (Loss Profile)، وهو عبارة عن خريطة للأخطاء تتوهج بوضوح حيث يختبئ العيب. هذه الخريطة هي مفتاح نجاح النظام؛ فبدلاً من محاولة تخمين العيب مباشرة من الصورة الخام، يحلل النظام خريطة أخطاء إعادة البناء هذه، والتي غالباً ما تجعل حتى أصغر العيوب أسه أسهل في الرؤية.

القطعة الأخيرة من اللغز هي "المتنبئ"، وهو شبكة متخصصة تأخذ خرائط الخطأ هذه وتحولها إلى قرار ثنائي واضح: هذه البكسل جيدة، أو هذا البكسل سيئة. وما يجعل نهج الباحثين فريداً هو كيفية تعلم هذه المكونات الثلاثة — الكشاف، والمحرك، والمتنبئ — معاً. في العديد من المحاولات السابقة لأنظمة مماثلة، كانت الأجزاء تُدرب بشكل منفصل أو تعتمد على قواعد جامدة حدت من قدرتها على التكيف. هنا، يستخدم النظام نهجاً "شبه مُشرف عليه" (Semi-supervised)، مما يعني أنه يتعلم من مجموعة كبيرة من البيانات الطبيعية ومجموعة صغيرة جداً من البيانات المعيبة المصنفة. ووجد الباحثون أنه من خلال إزالة بعض الآليات المعقدة المستخدمة في الإصدارات السابقة وتبسيط طريقة تعلم المتنبئ، أصبح النظام أكثر استقراراً وأفضل في التعميم على أنواع جديدة من العيوب. ويتعلم الوكيل موازنة احتياجين متنافسين: استكشاف مناطق جديدة في الصورة للعثور على بؤر المشاكل غير المعروفة، واستغلال المناطق التي يعرف بالفعل أنها مشبوهة لتدقيق الكشف.

تم اختبار نتائج هذا النهج على مجموعة مستخدمة على نطاق واسع من الصور الصناعية تُعرف باسم مجموعة بيانات MVTec AD، والتي تحتوي على صور عالية الدقة لمختلف الأشياء والأنسجة، من الكابلات وفرش الأسنان إلى الحبوب والألواح الخشبية. وقارن الباحثون طريقتهم بعدة تقنيات رائدة، بما في ذلك نماذج التعلم العميق القياسية وأنظمة أخرى متقدمة تعتمد على إعادة البناء. تفوق الإطار الجديد باستمرار على هؤلاء المنافسين؛ ففي المتوسط، حسّن قدرته على تحديد وتحديد موقع العيوب بفارق كبير. وفي الحالات الأكثر تحدياً، حيث كانت العيوب دقيقة للغاية، أظهرت الطريقة الجديدة تحسناً دراماتيكياً، محققة درجات دقة أعلى من الأنظمة الأخرى، وكشفت عن عيوب كانت الطرق السابقة تجد صعوبة في تحديد موقعها بفعالية. على سبيل المثال، في الاختبارات التي شملت الترانزستورات وفرش الأسنان، قفزت دقة النظام بشكل كبير فوق أفضل النتائج السابقة، مما أثبت أن استراتيجية أخذ العينات التكيفية استهدفت المناطق الصحيحة بفعالية.

وبعيداً عن مجرد العثور على العيوب، برع النظام أيضاً في تحديد مكانها بالضبط. ففي البيئات الصناعية، لا يكفي معرفة أن المنتج معيب؛ بل يجب أن تعرف الآلة بدقة أي جزء من السطح تالف حتى يمكن إصلاحه أو التخلص منه. وقد أظهر الباحثون أن طريقتهم أنتجت خرائط أكثر نظافة ودقة للأضرار؛ حيث أظهرت النتائج البصرية حدوداً حادة حول الخدوش وتحديدات واضحة للأجزاء المفقودة، حتى في الأنسجة المعقدة مثل عروق الخشب أو الشبكات المعدنية. هذه الدقة أمر بالغ الأهمية لأنها تقلل من الإنذارات الكاذبة، حيث يتم رفض قطعة مثالية عن طريق الخطأ، وتضمن عدم التغاضي عن العيب الحقيقية. حقق النظام هذا المستوى العالي من الأداء دون الحاجة إلى كميات هائلة من البيانات المعيبة المصنفة، والتي غالباً ما تكون أكبر عقبة في الأتمتة الصناعية.

كما سلطت الدراسة الضوء على أهمية كيفية تدريب النظام. فقد وجد الباحثون أنه إذا لم يتم تقديم الأجزاء المختلفة من النظام لبعضها البعض بالترتيب الصحيح، فقد تصبح العملية برمتها غير مستقرة. لذا طوروا جدولاً زمنياً محدداً للتدريب حيث يتعلم محرك إعادة البناء أولاً، يليه المتنبئ، وأخيراً الوكيل الذي يختار القطع. سمح هذا النهج التدريجي لكل مكون بالاستقرار قبل تحمل التعقيد الإضافي للمكونات الأخرى. وبحلول نهاية التدريب، كان النظام قد تعلم استراتيجية متطرفة للمسح، وهي استراتيجية أكثر كفاءة وفعالية بكثير من مجرد المسح الشامل أو الاعتماد على التخمينات العشوائية. وأشار الباحثون إلى أنه بينما يعد النظام أكثر تعقيداً في الإعداد من الماسح الضوئي البسيط، فإن المقابل هو كاشف أكثر قوة وموثوقية يمكنه التعامل مع الاختلافات الدقيقة والواقعية الموجودة في المصانع الفعلية.

يمثل هذا العمل تحولاً في كيفية تعلم الآلات للرؤية. فبدلاً من محاولة إجبار الكمبيوتر على حفظ كل طريقة ممكنة لتعطل المنتج، علم الباحثون الآلة كيف تكون فضولية. ومن خلال منح النظام القدرة على اختيار ما ينظر إليه وكيفية التعلم من أخطائه، خلقوا أداة قوية وقابلة للتكيف. وتشير النتائج إلى أن مستقبل مراقبة الجودة قد لا يكمن في قواعد بيانات أكبر للأجزاء المعيبة، بل في خوارزميات أذكى تعرف كيفية العثور على الإبرة في كومة القش من خلال تعلم كيفية النظر في الأماكن الصحيحة. إن نجاح هذه الطريقة على مجموعة متنوعة من الصور الصناعية يشير إلى أنها قد تكون أداة قيمة للمصنعين الذين يتطلعون إلى تحسين عمليات التفتيش لديهم دون التكلفة الباهظة لجمع آلاف العينات المعيبة.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →