MIRAGE: Model-agnostic Industrial Realistic Anomaly Generation and Evaluation for Visual Anomaly Detection
تُعد MIRAGE عبارة عن مسار عمل مؤتمت بالكامل ولا يتطلب تدريباً، يستفيد من النماذج التوليدية ذات الصندوق الأسود، ونماذج الرؤية واللغة، ووحدة كشف تغيير ثنائية الفرع لتوليد صور عيوب صناعية واقعية وأقنعة على مستوى البكسل دون الحاجة إلى بيانات عيوب حقيقية، مما يعزز أداء الكشف عن العيوب البصرية ويوفر مجموعة بيانات مفتوحة المصدر واسعة النطاق.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أنك مفتش جودة في مصنع ينتج آلاف المنتجات المتطابقة يومياً، مثل الزجاجات أو الرقائق الإلكترونية. مهمتك هي رصد المنتجات "السيئة" — تلك التي بها خدوش، أو شقوق، أو انبعاجات.
المشكلة؟ أنت لم ترَ منتجاً سيئاً من قبل. فالمصنع مثالي للغاية لدرجة أنك لا تملك سوى صور للمنتجات "الجيدة". تحاول نماذج الذكاء الاصطناعي التقليدية تعلم شكل "الكمال"، ثم تطلق "إنذاراً!" إذا بدا أي شيء مختلفاً ولو قليلاً. لكن هذا أمر صعب؛ فأحياناً يبدو الظل وكأنه خدش، أو تبدو البقعة وكأنها شق، مما يؤدي إلى إنذارات كاذبة.
لحل هذه المشكلة، تود أن تعرض على الذكاء الاصطوي صوراً لعيوب حقيقية. ولكن في المصنع المثالي، العيوب الحقيقية لا توجد (أو هي نادرة جداً بحيث يصعب جمعها).
إليك MIRAGE. فكر في MIRAGE كـ آلة "ماذا لو" السحرية التي يمكنها إنشاء صور مزيفة، ولكنها واقعية للغاية، لمنتجات مكسورة حتى يتعلم الذكاء الاصطناعي منها.
إليك كيف يعمل MIRAGE، مقسماً إلى خطوات بسيطة:
1. محرك "الخيال" (النموذج التوليدي)
حاولت معظم الطرق السابقة بناء محرك "خيال" خاص بها من الصفر، وكان الأمر يشبه محاولة بناء محرك سيارة جديد في كل مرة تريد فيها القيادة. كان ذلك مكلفاً، بطيئاً، وصعب التحديث.
MIRAGE مختلف. هو لا يبني محركاً؛ بل يستأجر سيارة خارقة.
- التشبيه: تخيل أنك تريد رؤية كيف تبدو "زجاجة مخدوشة". بدلاً من رسم الخدش بنفسك، تتصل بفنان محترف (نموذج ذكاء اصطناعي يسمى Gemini) عبر تطبيق هاتف (واجهة برمجة تطبيقات - API).
- تقول له: "هذه صورة لزجاجة مثالية. الآن، تخيل أن بها خدشاً على جانبها."
- يرسل لك الفنان فوراً صورة تبدو حقيقية جداً، لدرجة أنك تكاد تشعر بالخدش.
- السحر: إذا توفر فنان أفضل في العام المقبل، يمكنك ببساً تغيير رقم الهاتف الذي تتصل به. لا يتعين عليك إعادة بناء النظام بأكمله.
2. "الحارس" (فلتر الجودة)
أحياناً، يخطئ الفنان. قد يرسم خدشاً يبدو كأنه شق، أو قد يغير لون الزجاجة بالخطأ.
- التشبيه: MIRAGE لديه حارس صارم عند الباب (فلتر يعتمد على CLIP). قبل السماح للصورة المزيفة بالدخول إلى غرفة التدريب، يتحقق الحارس: "هل تبدو هذه الصورة حقاً لزجاجة مخدوشة، أم أنها مجرد زجاجة زرقاء؟"
- إذا لم تطابق الصورة الوصف تماماً، يطردها الحارس. هذا يضمن أن الذكاء الاصطناعي يتعلم فقط من الأمثلة عالية الجودة.
3. "الرؤية بالأشعة السينية" (مولد القناع)
هذا هو الجزء الأصعب. عندما يرسم الفنان خدشاً، يحتاج الذكاء الاصطناي لمعرفة بالضبط أي بكسلات هي الخدش وأيها هي الزجاجة. إنه يحتاج إلى "قناع" (stencil) لتحديد مكان الضرر.
- المشكلة: قد يغير الفنان الإضاءة قليلاً أو يغير الزاوية، مما يجعل من الصعب معرفة ما تغير بمجرد النظر إلى البكسلات.
- حل MIRAGE: يستخدم نهج العقلين:
- العقل الدلالي (Semantic Brain): يقرأ هذا العقل النص ("خدش") ويبحث عن أي شيء يبدو كأنه خدش.
- العقل الهيكلي (Structural Brain): يتجاهل هذا العقل النص ويبحث فقط عن أي تغيير فيزيائي في الشكل أو الملمس بين الصورة المثالية والصورة المزيفة.
- النتيجة: يدمج MIRAGE بين هذين المنظورين. إذا قال العقل الدلالي "هذا يبدو كخدش" وقال العقل الهيكلي "الملمس تغير هناك"، بام! يرسم قناعاً مثالياً حول العيب. يفعل ذلك دون الحاجة لأن يتم تعليمه كيفية القيام بذلك مسبقاً.
4. "التجربة الكبرى" (النتائج)
اختبر الفريق MIRAGE مقابل طرق أخرى باستخدام مجموعتي بيانات صناعيتين شهيرتين (MVTec AD و VisA).
- الاختبار البشري: عرضوا على بشر حقيقيين صوراً لعيوب حقيقية مقابل عيوب MIRAGE المزيفة. لم يستطع البشر التمييز بينهما في معظم الأوقات! تم تقييم عيوب MIRAGE المزيفة على أنها واقعية تقريباً مثل العيوب الحقيقية.
- اختبار الذكاء الاصطناعي: قاموا بتدريب مفتش ذكاء اصطناعي جديد باستخدام صور MIRAGE المزيفة فقط. أصبح هذا المفتش الجديد بارعاً للغاية في العثور على العيوب الحقيقية، متفوقاً على جميع الطرق الأخرى.
لماذا هذا مهم؟
- لا حاجة لعيوب حقيقية: لست بحاجة للانتظار حتى يتعطل مصنع لتدريب الذكاء الاصطناعي الخاص بك.
- رخيص وسهل: لا يتطلب أجهزة كمبيوتر باهظة الثمن. كل ما تحتاجه هو اتصال بالإنترنت للاتصال بـ "الفنان".
- جاهز للمستقبل: مع تحسن الذكاء الاصطناعي، يقوم MIRAGE ببساطة باستبدال "الفنان" بآخر أفضل.
- مفتوح المص المصدر: أصدر الفريق أكثر من 13,000 صورة وقناع للعيود المزيفة مجاناً، لكي يتمكن أي شخص من استخدامها لبناء أنظمة سلامة أفضل.
باختصار: MIRAGE هو نظام جاهز للاستخدام يستخدم قوة فناني الذكاء الاصطناعي المعاصرين لتخيل أمثلة مثالية لـ "ما يمكن أن يحدث خطأ"، مما يسمح للمصانع بتدريب أنظمة السلامة الخاصة بها دون الحاجة أبداً لمنتج مكسور واحد حقيقي.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.