Image Tampering Region Localization Method Based on Pseudo Label Driver and Dynamic Multi branch Decoding
यह शोध पत्र एक छद्म-लेबल-संचालित (pseudo-label-driven) इमेज टैम्परिंग लोकलाइजेशन पद्धति प्रस्तावित करता है जिसमें एक टैम्पर-प्रकार-जागरूक गतिशील बहु-शाखा डिकोडर (tamper-type-aware dynamic multi-branch decoder) है जो मल्टी-स्केल फीचर्स के एकीकरण, कॉपी-मूव फोर्जरी के लिए सोर्स-टारगेट पत्राचार पर्यवेक्षण और विविध डेटासेट में उच्च सटीकता एवं सामान्यीकरण प्राप्त करने के लिए अनुकूली संकेत संलयन (adaptive cue fusion) के माध्यम से विषम फोरेंसिक निशानों को प्रभावी ढंग से संबोधित करता है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
आधुनिक दुनिया में, डिजिटल चित्र दृश्य सत्य की प्राथमिक भाषा बन गए हैं। वे अदालतों में साक्ष्य, चिकित्सा निदान में रिकॉर्ड और समाचार रिपोर्टिंग के आधार के रूप में कार्य करते हैं। फिर भी, वे उपकरण जो हमें इन क्षणों को कैद करने की अनुमति देते हैं, उन्हें बदलना भी अविश्वसनीय रूप से आसान बना देते हैं। एक व्यक्ति एक फोटो से चेहरा काटकर दूसरे पर चिपका सकता है, किसी अनचाही वस्तु को हटा सकता है, या अंतराल को भरने के लिए परिदृश्य के एक हिस्से को दोहरा सकता है। ये हेरफेर अक्सर इतने कुशलता से किए जाते हैं कि मानवीय आंख अंतर नहीं देख पाती। इसका परिणाम विश्वास का बढ़ता संकट है, जहाँ देखना अब विश्वास करना नहीं रह गया है। इससे निपटने के लिए, डिजिटल इमेज फोरेंसिक नामक एक क्षेत्र उभरा है, जो इन संपादनों द्वारा छोड़े गए अदृश्य फिंगरप्रिंट खोजने के लिए समर्पित है। एक मानव पर्यवेक्षक के विपरीत जो स्पष्ट विसंगतियों को देखता है, फोरेंसिक सॉफ्टवेयर उन सूक्ष्म सांख्यिकीय त्रुटियों, शोर पैटर्न और सीमा अनियमितताओं को स्कैन करता है जो कैमरा सेंसर या संपादन सॉफ्टवेयर अनिवार्य रूप से पीछे छोड़ देते हैं।
इस क्षेत्र के वैज्ञानिकों के लिए चुनौती यह है कि सभी संपादन एक ही प्रकार के फिंगरप्रिंट नहीं छोड़ते हैं। कुछ हेरफेर, जैसे दो अलग-अलग फोटो को आपस में जोड़ना (स्प्लिसिंग), स्पष्ट रेखाएं बनाते हैं जहाँ प्रकाश या बनावट अचानक बदल जाती है। अन्य, जैसे किसी भाग को कॉपी करके उसी चित्र के भीतर ही कहीं और पेस्ट करना, पकड़ में आना बहुत कठिन होता है क्योंकि कॉपी किया गया हिस्सा उसी स्रोत से आता है और उसमें बिल्कुल समान प्रकाश और बनावट होती है। इसके अलावा, कई मौजूदा उपकरण संघर्ष करते हैं जब संपादित क्षेत्र बहुत छोटा होता है या जब छवि को कंप्रेस (संकुचित) या रीसाइज (आकार बदलना) किया जाता है, जिससे वे सुराग धुंधले हो जाते हैं जिन्हें सॉफ्टवेयर को खोजने के लिए चाहिए। जिमेई यूनिवर्सिटी और ज़ियामेन सिक्योरिटी टेक्नोलॉजी वोकेशनल कॉलेज के शोधकर्ताओं द्वारा किए गए एक नए अध्ययन में एक ऐसा समाधान प्रस्तावित किया गया है जो इन विभिन्न प्रकार के सं 편집ों को एक एकल समस्या के रूप में नहीं, बल्कि अलग-अलग रणनीतियों की आवश्यकता वाले विशिष्ट पहेलियों के संग्रह के रूप में देखता है।
शोधकर्ताओं ने एक ऐसा सिस्टम विकसित किया है जो इमेज विश्लेषण के लिए एक 'मल्टी-टूल' की तरह कार्य करता है, जिसे सामना किए जाने वाले हेरफेर के विशिष्ट प्रकार के आधार पर अपने दृष्टिकोण को अनुकूलित करने के लिए डिज़ाइन किया गया है। प्रत्येक छवि को एक एकल, कठोर प्रक्रिया से गुजारने के बजाय, उनकी विधि पहले छवि का परीक्षण करती है ताकि यह समझा जा सके कि किस प्रकार का हेरफेर मौजूद हो सकता है। इसके बाद, यह उस प्रकार के संपादन से जुड़े विशिष्ट सुरागों की तलाश करने के लिए अपने सॉफ्टवेयर के भीतर विभिन्न विशिष्ट मार्गों (पाथवे) को सक्रिय करती है। उदाहरण के लिए, यदि सिस्टम को संदेह है कि छवि के एक हिस्से को उसी चित्र के भीतर से कॉपी और पेस्ट किया गया है, तो यह एक ऐसे मोड में बदल जाता है जो दो अलग-अलग क्षेत्रों के बीच मिलान वाले पैटर्न की तलाश करता है। यदि उसे संदेह है कि यह किसी अलग फोटो से कट-एंड-पेस्ट का काम है, तो वह बनावट या प्रकाश में विच्छिन्नता (discontinuities) खोजने के लिए उन किनारों पर ध्यान केंद्रित करता है जहाँ दो छवियां मिलती हैं।
टीम को एक प्रमुख बाधा का सामना करना पड़ा था—पूर्ण प्रशिक्षण डेटा (training data) की कमी। कई मामलों में, विशेषज्ञ यह चिह्नित कर सकते हैं कि छवि का नकली हिस्सा कहाँ है, लेकिन वे आसानी से यह चिह्नित नहीं कर सकते कि मूल, कॉपी किया गया हिस्सा कहाँ से आया था, विशेष रूप से यदि छवि को मूल रूप से उस जानकारी के साथ लेबल नहीं किया गया था। इसे हल करने के लिए, शोधकर्ताओं ने एक ऐसी विधि बनाई है जो कंप्यूटर को स्वयं को सिखाने की अनुमति देती है। सिस्टम एक शिक्षित अनुमान लगाता है कि कॉपी किए गए हिस्से का मूल स्रोत कहाँ हो सकता है, उसके लिए एक अस्थायी लेबल बनाता है, और फिर अपनी समझ को परिष्कृत करने के लिए उस लेबल का उपयोग करता है। यह एक अंतर्निर्मित आत्मविश्वास जांच (confidence check) के साथ करता है; यदि अनुमान संदिग्ध या अविश्वसनीय लगता है, तो सिस्टम उसे कम महत्व देता है, जिससे वह अपनी गलतियों से सीखने से बच जाता है। यह सॉफ्टवेयर को किसी मानव द्वारा हर एक विवरण को पहले से बताने की आवश्यकता के बिना, एक कॉपी किए गए क्षेत्र और उसके स्रोत के बीच के जटिल संबंध को सीखने की अनुमति देता है।
यह सिस्टम हेरफेर किए गए क्षेत्रों के किनारों पर भी विशेष ध्यान देता है। जब किसी क्षेत्र के साथ छेड़छाड़ की जाती है, तो नकली और वास्तविक के बीच की सीमा अक्सर सबसे अधिक बताने वाली होती है, फिर भी यह छवि को सिकोड़ने या कंप्रेस करने पर खो जाने वाली सबसे आसान चीज़ है। शोधकर्ताओं ने विश्लेषण के लिए एक विशिष्ट परत जोड़ी है जो इन सीमाओं को तेज करने के लिए समर्पित है, यह सुनिश्चित करती है कि संपादित क्षेत्र का अंतिम मानचित्र केवल एक धुंधला धब्बा नहीं है, बल्कि एक सटीक रूपरेखा है जो संपादन की वास्तविकता से मेल खाती है। सूक्ष्म सं 편집ों के लिए यह विवरण पर ध्यान देना महत्वपूर्ण है, जो अन्यथा फोटो के विशाल अछूते बैकग्राउंड में दब सकते हैं।
जब शोधकर्ताओं ने मौजूदा तकनीकों के विरुद्ध अपने नए तरीके का परीक्षण किया, तो परिणाम महत्वपूर्ण थे। उन परीक्षणों में जहाँ सॉफ्टवेयर को छवियों के एक सेट पर प्रशिक्षित किया गया था और फिर उसे छवियों के पूरी तरह से अलग सेट में हेरफेर खोजने के लिए कहा गया, इसने स्प्लिसिंग कार्यों पर 75.4% और कॉपी-मूव कार्यों पर 52.7% की सफलता दर हासिल की। ये संख्याएं पिछले तरीकों की तुलना में, विशेष रूप से कठिन कॉपी-मूव डिटेक्शन के क्षेत्र में, एक स्पष्ट सुधार का प्रतिनिधित्व करती हैं, जहाँ स्रोत और लक्ष्य इतने समान होते हैं कि वे अक्सर अन्य प्रणालियों को धोखा दे देते हैं। जब सॉफ्टवेयर का परीक्षण उसी डेटासेट की छवियों पर किया गया जिस पर इसे प्रशिक्षित किया गया था, तो इसकी सटीकता बढ़कर लगभग 99% हो गई, जो दर्शाता है कि यह एक डेटासेट के विशिष्ट पैटर्न को बहुत प्रभावी ढंग से सीख सकता है।
अध्ययन ने यह भी दिखाया कि सिस्टम वास्तविक दुनिया के नुकसान के प्रति मजबूत है। वास्तविक दुनिया में छवियों को अक्सर जांचे जाने से पहले कंप्रेस, रीसाइज या ब्लर किया जाता है। नया तरीका इन सामान्य गिरावटों के बावजूद उच्च प्रदर्शन बनाए रखता है, जहाँ अन्य सिस्टम विफल होने लगते हैं। एक लचीले, बहु-पथवे दृष्टिकोण को एक स्व-सुधार तंत्र के साथ जोड़कर, शोधकर्ताओं ने एक ऐसा उपकरण बनाया है जो डिजिटल जालसाजी की विविध और विकसित होती प्रकृति को संभालने के लिए बेहतर ढंग से सुसज्जित है। यह कार्य सुझाव देता है कि इमेज फोरेंसिक्स का भविष्य एक एकल, सर्व-उद्देश्यीय डिटेक्टर में नहीं, बल्कि उन अनुकूलन योग्य प्रणालियों में है जो हेरफेर के प्रत्येक प्रकार के अद्वितीय हस्ताक्षर को पहचान सकते हैं और सही रणनीति के साथ प्रतिक्रिया दे सकते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।