← नवीनतम पेपर
🤖 machine learning

Exploring Adversarial Watermarking in Transformer-Based Models: Transferability and Robustness Against Defense Mechanism for Medical Images

यह शोधपत्र डर्मेटोलॉजिकल इमेज विश्लेषण में विजन ट्रांसफॉर्मर (ViTs) की एडवरसेरियल वॉटरमार्किंग के प्रति संवेदनशीलता की जांच करता है, यह प्रदर्शित करते हुए कि हालांकि ये मॉडल ऐसे हमलों से सटीकता में गिरावट के प्रति अत्यधिक संवेदनशील हैं, लेकिन एडवरसेरियल ट्रेनिंग के माध्यम से उनकी मजबूती को महत्वपूर्ण रूप से सुधारा जा सकता है।

मूल लेखक: Rifat Sadik, Tanvir Rahman, Arpan Bhattacharjee, Bikash Chandra Halder, Ismail Hossain, Mridul Banik, Jia Uddin

प्रकाशित 2026-02-10
📖 4 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Rifat Sadik, Tanvir Rahman, Arpan Bhattacharjee, Bikash Chandra Halder, Ismail Hossain, Mridul Banik, Jia Uddin

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

"मास्टर शेफ" और "अदृश्य नमक"

मेडिकल AI में एडवरसैरियल वॉटरमार्किंग की एक व्याख्या

कल्पना कीजिए कि आप एक विश्व स्तरीय मास्टर शेफ हैं। आपके पास सूप का स्वाद चखने और तुरंत यह जानने की एक असाधारण क्षमता है कि उसमें कौन से सटीक सामग्रियां मौजूद हैं—भले ही वे बहुत सूक्ष्म क्यों न हों। आधुनिक विज़न ट्रांसफॉर्मर्स (ViTs) मेडिकल इमेजिंग में इसी तरह काम करते हैं। वे इन मास्टर शेफ की तरह हैं; वे एक मेडिकल इमेज (जैसे कि त्वचा के घाव की फोटो) को देखते हैं और यह तय करने के लिए वैश्विक पैटर्न को "चखते" हैं कि वह एक हानिरहित तिल है या मेलानोमा जैसा कुछ खतरनाक।

लेकिन एक समस्या है: एक चालाक "साज़िशकर्ता" ने आपकी स्वाद की शक्ति को बिना आपके पता चले खराब करने का एक तरीका ढूंढ लिया है।

1. साज़िशकर्ता की चाल (एडवरसैरियल वॉटरमार्किंग)

कल्पना कीजिए कि कोई आपके सूप में एक विशेष, अदृश्य नमक की बहुत ही सूक्ष्म, सूक्ष्म मात्रा छिड़क देता है। एक साधारण व्यक्ति के लिए, सूप बिल्कुल वैसा ही दिखता और महकता है। लेकिन आपके विशेषज्ञ तालू के लिए, वह "अदृश्य नमक" का एक छोटा सा कण भी आपको पूरी तरह भ्रमित कर देता है। अचानक, आप एक स्वादिष्ट टमाटर के सूप का स्वाद लेते हैं और ज़ोर देकर कहते हैं कि यह वास्तव में चॉकलेट पुडिंग का कटोरा है।

इस शोध पत्र में, शोधकर्ताओं ने PGD (प्रोजेक्टेड ग्रेडिएंट डिसेंट) नामक विधि का उपयोग किया। PGD को एक उच्च-तकनीकी "अदृश्य नमक जनरेटर" के रूप में समझें। यह मेडिकल इमेजेस में पिक्सेल-स्तर पर बहुत छोटे बदलाव जोड़ता है। फोटो देख रहे डॉक्टर के लिए, त्वचा बिल्कुल सामान्य दिखती है। लेकिन AI "शेफ" के लिए, ये सूक्ष्म बदलाव एक भ्रमित करने वाले वॉटरमार्क की तरह काम करते हैं जो मॉडल को एक बड़ी गलती करने के लिए मजबूर कर देते—जैसे कि एक खतरनाक कैंसर को "सौम्य" (benign) बताना।

2. "ग्लोबल" कमजोरी (ट्रांसफॉर्मर्स क्यों संवेदनशील हैं)

शोधकर्ताओं ने कुछ आश्चर्यजनक पाया। जबकि पुराने AI मॉडल (जिन्हें CNNs कहा जाता है) उन शेफ की तरह हैं जो एक समय में एक सामग्री पर ध्यान केंद्रित करते हैं (छोटी, स्थानीय जगहों को देखते हैं), नए विज़न ट्रांसफॉर्मर्स (ViTs) वे शेफ हैं जो "बड़ी तस्वीर" पाने के लिए एक साथ सब कुछ चखने की कोशिश करते हैं।

चूंकि ट्रांसफॉर्मर यह समझने की कोशिश कर रहा है कि इमेज का हर एक हिस्सा दूसरे हिस्से से कैसे संबंधित है, इसलिए यह साज़िश के प्रति वास्तव में अधिक संवेदनशील है। यदि साज़िशकर्ता पिक्सेल के बीच के संबंध के साथ छेड़छाड़ करता है, तो ट्रांसफॉर्मर पूरी तरह से भटक जाता है। अध्ययन ने दिखाया कि जबकि ट्रांसफॉर्मर एक "साफ" डिश पर सबसे स्मार्ट शेफ था (94.4% सटीकता), वह सबसे आसानी से धोखा खाने वाला भी था, जिसकी सटीकता "अदृश्य नमक" डाले जाने पर गिरकर एक भयानक 27.6% रह गई।

3. समाधान: "तालू को प्रशिक्षित करना" (एडवरसैरियल ट्रेनिंग)

तो, हम साज़िशकर्ता को कैसे रोकें? हम शेफ को केवल बेहतर सामग्रियां ही नहीं देते; हम उन्हें कठोर प्रशिक्षण देते हैं।

शोधकर्ताओं ने एडवरसैरियल ट्रेनिंग नामक तकनीक का उपयोग किया। कल्पना कीजिए कि केवल एकदम साफ और शुद्ध सूप के साथ अभ्यास करने के बजाय, मास्टर शेफ महीनों तक "साज़िश किए गए" सूप के साथ अभ्यास करता है। वे उस अदृश्य नमक के स्वाद को पहचानना सीखते हैं और उसे अनदेखा करना सीखते हैं।

इन "चालाकी भरी" इमेजेस पर AI को प्रशिक्षित करके, ट्रांसफॉर्मर अविश्वसनीय रूप से मजबूत हो गया। इन साज़िश किए गए इमेजेस पर इसकी सटीकता विफल 27.6% से बढ़कर एक शानदार 90.0% तक पहुँच गई।

निचोड़

यह शोध चिकित्सा जगत के लिए एक "चेतावनी" है। यह हमें बताता है कि जहाँ नवीनतम, सबसे शक्तिशाली AI मॉडल (ट्रांसफॉर्मर्स) बीमारियों के निदान में अत्यंत बुद्धिमान हैं, वहीं उनमें एक "ब्लाइंड स्पॉट" (अंध बिंदु) भी है जिसका फायदा हैकर्स उठा सकते हैं। हालाँकि, अपने प्रशिक्षण के दौरान इन मॉडल्स को इन "अदृश्य" हमलों की उम्मीद करने और उनका प्रतिरोध करने के लिए सिखाकर, हम उन्हें वास्तविक अस्पतालों में भरोसेमंद बनाने के लिए पर्याप्त सुरक्षित बना सकते हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →