Triggering hallucinations in model-based MRI reconstruction via adversarial perturbations
تُظهر هذه الدراسة أن النماذج التوليدية المتطورة لإعادة بناء صور الرنين المغناطيسي معرضة للغاية لاستحثاث هلاوس خطيرة من خلال اضطرابات تنافسية صغيرة، وهي ثغرة تتملص من مقاييس الجودة التقليدية وتبرز الحاجة الملحة لطرق كشف مبتكرة وتدريب تنافسي قوي.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أن لديك مرمماً فنياً موهوباً وعالي التقنية. مهمة هذا المرمم هي أخذ رسم تخطيطي ضبابي، أو محبب، أو غير مكتمل لمخ مريض أو لركبة، وتحويله إلى لوحة صافية تماماً ومثالية يمكن للأطباء استخدامها لتشخيص الأمراض.
في عالم التصوير الطبي، هذا "المرمم" هو نموذج ذكاء اصطناعي. إنه بارع للغاية في عمله، وغالباً ما يجعل الصور تبدو أفضل من الطرق التقليدية القديمة. ولكن، مثل فنان مبدع قد يطلق العنان لخيال واسع أحياناً، فإن هذا الذكاء الاصطناعي لديه عادة خطيرة: وهي الهلوسة.
المشكلة: "أحلام اليقظة" للذكاء الاصطناعي
أحياناً، عندما يحاول الذكاء الاصطناعي ملء الأجزاء المفقودة من صورة رنين مغناطيسي ضبابية، فإنه لا يكتفي بالتخمين فحسب؛ بل يخترع أشياء ليست موجودة أصلاً.
- قد يرسم ورماً صغيراً في دماغ سليم.
- قد يمحو رباطاً مكسوراً في ركبة.
في السياق الطبي، هذا أمر مرعب. إذا رأى الطبيب ورماً وهمياً، فقد يجري عملية جراحية غير ضرورية. وإذا أغفل تمزقاً حقيقياً لأن الذكاء الاصطناعي قام بـ "تنظيفه"، فقد يعاني المريض.
التجربة: خدعة "الغبار السحري"
سأل الباحثون في هذه الورقة سؤالاً مخيفاً: "ما مدى سهولة خداع هذا الذكاء الاصطناعي ليدخل في حالة أحلام اليقظة؟"
لم يحتاجوا إلى كسر الذكاء الاصطناعي أو تغيير برمجته. بدلاً من ذلك، استخدموا تقنية تسمى الاضطرابات العدائية (adversarial perturbations). فكر في هذا الأمر كأنك ترش كمية ضئيلة وغير مرئية من "الغبار السحري" على البيانات الخام قبل أن يراها الذكاء الاصطناعي.
- بالنسبة للعين البشرية: الغبار غير مرئي. يبدو الفحص الخام كما هو تماماً.
- بالنسبة للذكاء الاصطناعي: يعمل الغبار كإشارة سرية تقول: "مهلاً، انظر هنا! ارسم خطاً وهمياً في المنتصف تماماً!"
اختبر الباحثون هذا على نموذجين شهيرين للذكاء الاصطناعي (يُسميان UNet و VarNet) باستخدام صور حقيقية للمخ والركبة. استخدموا خوارزمية حاسوبية لحساب مقدار "الغبار" المطلوب إضافته بالضبط لإجبار الذكاء الاصطناعي على رسم تفصيل وهمي محدد (مثل خط أبيض) في منتصف الصورة.
النتائج: بيت من ورق
كانت النتائج صادمة.
- كان الأمر سهلاً للغاية: كانت نماذج الذكاء الاصطناعي هشة للغاية. بلمسة بسيطة وغير مرئية، بدأت فوراً في رسم هياكل وهمية.
- الشيء "الوهمي" بدا حقيقياً: لم تكن الهلوسات مجرد ضجيج عشوائي؛ بل بدت كأنها سمات بيولوجية واقعية.
- فشل نظام الإنذار: عادةً، عندما تكون الصورة سيئة، لدينا أدوات رياضية لقياسها (مثل التحقق من مدى "حدة" الصورة أو "تشابهها" مع الأصل). حاول الباحثون استخدام هذه الأدوات القياسية (مثل PSNR و SSIM وغيرها) لرصد الصور المزيفة.
- التشبيه: تخيل أنك تحاول معرفة ما إذا كانت اللوحة المزورة حقيقية أم لا عن طريق قياس حجم اللوحة. لقد صنع المزور اللوحة بنفس الحجم تماماً، لذا تقول مسطرتك: "إنها مثالية!"
- الواقع: لم تستطع الأدوات الرياضية التمييز بين المسح النظيف والمسح الذي يحتوي على هلوسة. الصور "السيئة" بدت "جيدة" تماماً مثل الصور الحقيقية وفقاً لهذه الاختبارات القياسية.
لماذا يهم هذا الأمر؟
تبدو هذه الورقة وكأنها تحذير من خبير أمني: "أفضل أقفالنا أسهل في الاختراق مما كنا نظن، وأجهزة الكشف عن المعادن لدينا لا تستطيع رؤية الأسلحة."
- المخاطرة: إذا استُخدمت نماذج الذكاء الاصطناعي هذه في المستشفيات، فإن القليل من الضجيج الإحصائي (الذي يحدث طبيعياً في الأجهزة) قد يؤدي بالخطأ إلى تحفيز حالة من الهلوسة، مما يؤدي إلى تشخيص خاطئ.
- الحل: لا يمكننا الاعتماد فقط على نماذج الذكاء الاصطناعي الحالية. نحن بحاجة إلى:
- تدريبها بشكل أفضل: تعليم الذكاء الاصطناعي تجاهل خدع "الغبار السحري" هذه (التدريب العدائي).
- بناء كواشف أفضل: إنشاء طرق جديدة وأكثر ذكاءً لرصد متى يكذب الذكاء الاصطناعي، لأن الأدوات الرياضية القديمة لا تعمل.
الخلاصة
الذكاء الاصطناعي مذهل في جعل الصور الطبية أكثر وضوحاً، لكن لديه نقطة ضعف خفية. يمكن خداعه ليرى أشياء ليست موجودة، وليس لدينا حالياً طريقة سهلة لكشف ذلك. هذا البحث هو دعوة للتحرك لجعل هذه الأدوات المنقذة للحياة أكثر متانة وأقل عرضة لـ "أحلام اليقظة" قبل أن نأتمنها على حياة المرضى.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.