← नवीनतम पेपर
⚡ electrical engineering

Secret-Stego Dissimilarity as a Design Axis: Invertible Coverless Image Steganography with Diffusion Models

यह शोध पत्र InvCISD का प्रस्ताव करता है, जो एक इनवर्टिबल डिफ्यूजन फ्रेमवर्क है जो कवरलेस स्टेगो इमेज उत्पन्न करने के लिए एक संदर्भ छवि और एक विशिष्ट नेटवर्क (LIMNet) का उपयोग करता है, जिससे गुप्त छवि के साथ दृश्य समानता में काफी कमी आती है, जिससे उच्च पुनर्निर्माण निष्ठा बनाए रखते हुए सुरक्षात्मक कमजोरियों को दूर किया जा सके।

मूल लेखक: Hongxin Xu, Jianping Mei, Can Wang, Defang Chen

प्रकाशित 2026-08-17
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Hongxin Xu, Jianping Mei, Can Wang, Defang Chen

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक गुप्त संदेश भेजना चाह रहे हैं, लेकिन कागज पर लिखकर उसे किसी किताब के अंदर छिपाने के बजाय, आप उस संदेश को एक तस्वीर के अंदर छिपाना चाहते हैं। यह स्टेग्नोग्राफी (steganography) की दुनिया है, जो अदृश्य संचार की कला है। लंबे समय तक, मानक तरीका यह था कि एक निर्दोष दिखने वाली फोटो (जैसे कि बिल्ली की तस्वीर) ली जाए और उसमें एक गुप्त चित्र (जैसे कि एक नक्शा) छिपाने के लिए उसके सूक्ष्म पिक्सेल में थोड़ा सा बदलाव किया जाए। समस्या क्या थी? यदि कोई उस "बिल्ली" की फोटो को ध्यान से देखता है, तो छिपा हुआ नक्शा अभी भी एक धुंधली रूपरेखा छोड़ सकता है, या फोटो थोड़ी अजीब लग सकती है, जिससे खेल का पता चल सकता है।

हाल ही में, वैज्ञानिकों ने शक्तिशाली AI टूल का उपयोग करना शुरू कर दिया है जिन्हें डिफ्यूजन मॉडल्स (Diffusion Models) कहा जाता है। इन्हें ऐसे डिजिटल कलाकारों के रूप में समझें जो एक विवरण के आधार पर पूरी तरह से नई तस्वीरें बना सकते हैं। मौजूदा फोटो के अंदर कुछ छिपाने के बजाय, ये नए तरीके एक बिल्कुल नया फोटो पेंट करने की कोशिश करते हैं जो किसी पूरी तरह से अलग विषय (जैसे कि सूर्यास्त) जैसा दिखता है, लेकिन फिर भी अपने भीतर गुप्त नक्शे को समाहित रखता है। लक्ष्य यह है कि गुप्त संदेश और अंतिम चित्र एक-दूसरे से इतने अलग दिखें कि किसी को संदेह भी न हो। लेकिन यहाँ एक पेंच है: यदि AI उन्हें अलग बनाने की बहुत अधिक कोशिश करता है, तो अंतिम चित्र एक अजीब, ग्लिच वाला कचरा बन सकता है, या गुप्त नक्शा प्राप्त करना असंभव हो सकता है। यह एक सुंदर छलावरण बनाने और गुप्त जानकारी को सुरक्षित रखने के बीच का एक नाजुक संतुलन है।

यही वह पहेली है जिसे होंगक्सिन जू (Hongxin Xu) और उनकी टीम ने अपने नए शोध पत्र, "Secret-Stego Dissimilarity as a Design Axis" में हल किया है। उन्होंने देखा कि जबकि पिछले AI तरीकों से सुंदर "कवरलेस" चित्र बनाए जा सकते थे, फिर भी गुप्त चित्र और अंतिम चित्र एक-दूसरे के बहुत समान दिखते थे। यह एक लाल सेब को लाल सेबों की टोकरी में छिपाने जैसा था; भले ही आप टोकरी को नीला रंग दें, सेब का आकार अभी भी स्पष्ट रहता है। लेखक तर्क देते हैं कि वास्तविक सुरक्षा के लिए, गुप्त चित्र और अंतिम "स्टेगो" चित्र एक-दूसरे से जितना संभव हो सके उतना अलग दिखना चाहिए, बिना चित्र की गुणवत्ता खराब किए या गुप्त जानकारी को खोए।

इसे हल करने के लिए, उन्होंने InvCISD नामक एक नया सिस्टम बनाया। कल्पना कीजिए कि आपके पास कुत्ते की एक गुप्त फोटो है, और आप इसे अपने दोस्त को भेजना चाहते हैं। कुत्ते की फोटो में मामूली बदलाव करने के बजाय, InvCISD उस कुत्ते की फोटो और एक पूरी तरह से असंबंधित फोटो—मान लीजिए कि एक विंटेज टैक्सी की तस्वीर—को एक छिपे हुए गणितीय स्थान में मिला देता है। यह एक विशेष "जादुई पुल" (एक इनवर्टिबल नेटवर्क जिसे वे LIMNet कहते हैं) का उपयोग करता है ताकि कुत्ते के गुप्त विवरणों को एक ऐसे प्रारूप में अनुवादित किया जा सके जो टैक्सी की संरचना के भीतर पूरी तरह से फिट बैठता है। परिणाम? अंतिम चित्र एक शानदार, प्राकृतिक टैक्सी की फोटो जैसा दिखता है, लेकिन इसमें आपका कुत्ता का गुप्त संदेश समाहित है। जब आपका दोस्त टैक्सी की फोटो प्राप्त करता है, तो वे कुत्ते की फोटो को वापस निकालने के लिए उसी "जादुय पुल" का उलटे क्रम में उपयोग करते हैं, जिससे वह पूरी तरह से पुनर्गठित हो जाती है।

टीम ने पाया कि उनका तरीका एक गेम-चेंजर है। अपने AI को सावधानीपूर्वक प्रशिक्षित करके, वे गुप्त चित्र और अंतिम चित्र को नाटकीय रूप रूप से अलग बनाने में सफल रहे। अपने परीक्षणों में, दृश्य अंतर (जिसे LPIPS नामक मीट्रिक द्वारा मापा जाता है) पुराने तरीकों के लगभग 0.48 से उछलकर उनके नए सिस्टम के साथ 0.87 हो गया। यह एक बहुत बड़ी छलांग है, जिसका अर्थ है कि चित्र को देखकर गुप्त संदेश का पता लगाना बहुत कठिन है। साथ ही, उन्होंने टैक्सी की फोटो को एकदम स्पष्ट और प्राकृतिक बनाए रखा, और वे कुत्ते की फोटो को उच्च स्पष्टता (एक पुनर्निर्माण स्कोर 19.10 PSNR) के साथ पुनः प्राप्त करने में भी सक्षम थे।

हालाँकि, लेखक सावधान हैं कि वे इसे एक "परफेक्ट" समाधान नहीं कह सकते। उन्होंने यह देखने के लिए परीक्षण किए कि क्या कोई कंप्यूटर यह पकड़ सकता है कि कुछ गड़बड़ है। उनके अत्यधिक भिन्न दिखने वाले चित्रों के बावजूद, उन्होंने पाया कि एक विशेष डिटेक्शन मॉडल अभी भी उच्च सटीकता के साथ गुप्त और नकली चित्र के बीच अंतर बता सकता था। यह सुझाव देता है कि हालांकि छवियों को अलग दिखाना एक बड़ा कदम है, लेकिन यह सिस्टम को सभी प्रकार के डिटेक्शन से सुरक्षित नहीं बनाता है। शोध पत्र निष्कर्ष निकालता है कि जबकि InvCISD ने दृश्य सुरागों को सफलतापूर्वक छिपा दिया है, अगला बड़ा लक्ष्य इन प्रणालियों को उन जासूसों को मूर्ख बनाने के लिए पर्याप्त मजबूत बनाना है जो उनकी तलाश में हैं। यह एक सही दिशा में उठाया गया एक शानदार कदम है, जो एक "शायद" वाले छलावरण को एक "बहुत संभव" वाले छलावे में बदल देता है, लेकिन डिजिटल सुरक्षा का चूहे-बिल्ली का खेल अभी खत्म नहीं हुआ है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →