← नवीनतम पेपर
💻 computer science

Attacks on Approximate Caches in Text-to-Image Diffusion Models

यह शोध पत्र टेक्स्ट-टू-इमेज डिफ्यूजन मॉडल्स के लिए एप्रोक्सिमेट कैशिंग में महत्वपूर्ण सुरक्षा कमजोरियों को उजागर करता है, जो यह प्रदर्शित करता है कि कैसे हमलावर साझा मध्यवर्ती अवस्थाओं (shared intermediate states) का रिमोट शोषण करके गुप्त चैनल स्थापित कर सकते हैं, उपयोगकर्ता के प्रॉम्प्ट चुरा सकते हैं और अनधिकृत लोगो के साथ आउटपुट को दूषित कर सकते हैं।

मूल लेखक: Desen Sun, Shuncheng Jie, Sihang Liu

प्रकाशित 2026-05-26
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Desen Sun, Shuncheng Jie, Sihang Liu

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक व्यस्त, उच्च-स्तरीय आर्ट स्टूडियो में हैं जहाँ एक जादुई रोबोट (डिफ्यूजन मॉडल) आपके द्वारा बोले गए विवरणों (प्रॉम्प्ट्स) के आधार पर चित्र बनाता है। इन चित्रों को बनाना धीमा और महंगा है क्योंकि रोबोट को एक खाली, शोर वाले कैनवास से शुरू करना पड़ता है और धीरे-धीरे, कदम-दर-कदम इसे परिष्कृत करना पड़ता है।

इसे तेज़ और सस्ता बनाने के लिए, स्टूडियो ने एक "स्मार्ट स्केचबुक" (एप्रोक्सिमेट कैश) पेश की है। यह इस प्रकार काम करती है: यदि आप "लाल सेब" का चित्र मांगते हैं, और किसी और ने अभी-अभी "चमकदार लाल सेब" मांगा था, तो रोबोट शून्य से शुरुआत नहीं करता है। वह अपनी स्केचबुक में देखता है, लाल सेब के आधे-अधूरे बने चित्र को ढूंढता है, और बस उसके आखिरी कुछ विवरणों को पूरा कर देता है। इससे समय और पैसा बचता है।

हालाँकि, शोधकर्ताओं ने इस शोध पत्र में पाया है कि इस "स्मार्ट स्केचबुक" में एक बड़ी सुरक्षा खामी है। क्योंकि यह स्टूडियो अपनी स्केचबुक सभी ग्राहकों के साथ साझा करता है, यह हैकर्स के लिए एक गुप्त बैकडोर बनाता है जिसे तीन चतुर तरीकों से भुनाया जा सकता है।

1. गुप्त फुसफुसाहट नेटवर्क (कवरट चैनल)

उपमा: कल्पना कीजिए कि दो जासूस, एलिस और बॉब, एक-दूसरे से सीधे बात नहीं कर सकते। वे दोनों आर्ट स्टूडियो में आए हुए हैं।

  • चाल: एलिस बॉब को एक गुप्त संदेश भेजना चाहती है। वह रोबोट को एक बहुत ही विशिष्ट, अजीब शब्द (जैसे "Apricity," जो धूप के लिए एक पुराना शब्द है) फुसफुसाती है। रोबोट एक चित्र बनाता है और उसे साझा स्केचबुक में सहेज लेता है।
  • संकेत: बॉब बाद में उसी अजीब शब्द का उपयोग करके रोबोट को एक चित्र बनाने के लिए कहता है।
    • यदि रोबोट तेज़ है, तो इसका मतलब है कि उसने एलिस का स्केच किताब में पा लिया है (एक "हिट")।
    • यदि रोबोट धीमा है, तो इसका मतलब है कि उसे शुरुआत से शुरू करना पड़ा (एक "मिस")।
  • कोड: एलिस और बॉब एक अजीब शब्द की श्रृंखला के माध्यम से एक-दूसरे को गुप्त टेक्स्ट संदेश भेजने के लिए सहमत होते हैं कि "तेज़" का अर्थ अक्षर 1 है और "धीमा" का अर्थ अक्षर 0 है। वे रोबोट की पेंटिंग की गति के माध्यम से एक-दूसरे को गुप्त संदेश भेज सकते हैं।
  • छिपना: क्योंकि स्केचबुक दिनों तक इन "आधे-अधूरे" स्केचों को रखती है, बॉब जब चाहे संदेश की जांच कर सकता है। यह एक सार्वजनिक लाइब्रेरी की किताब में नोट छोड़ने जैसा है जो हफ्तों तक वहीं रहता है।

2. प्रॉम्प्ट चोर (कैशएक्सपोज़र)

उपमा: कल्पना कीजिए कि एक पेशेवर कलाकार रोबोट से उत्कृष्ट कृति प्राप्त करने के लिए घंटों तक एक आदर्श, जटिल विवरण तैयार करता है। यह विवरण उनका गुप्त नुस्खा (रेसिपी) है।

  • चाल: एक चोर इस नुस्खे को चाहता है। वह कलाकार की स्क्रीन नहीं देख सकता, लेकिन वह रोबंत से हजारों थोड़े अलग चित्र बनाने के लिए कह सकता है।
  • सुराग: चोर नोटिस करता है कि जब वह कलाकार के गुप्त नुस्खे के समान चित्र के लिए पूछता है, तो रोबोट तेज़ होता है (क्योंकि उसे कलाकार का कैश किया हुआ स्केच मिल जाता है)।
  • डकैती: अपने हजारों अनुमानों में से कौन से अनुमानों ने रोबोट को तेज़ बनाया, इसका विश्लेषण करके और परिणामी चित्रों में मामूली समानताएं देखकर, चोर कलाकार के मूल गुप्त नुस्खे को गणितीय रूप से रिवर्स-इंजीनियर कर सकता है।
  • परिणाम: चोर "प्रॉम्प्ट" (नुस्खा) चुरा लेता है और अब वह कलाकार को भुगतान किए बिना या प्रॉम्प्ट डिजाइन करने की मेहनत किए बिना वही उत्कृष्ट कृति बना सकता है।

3. लोगो स्टिकर बम (कैशपॉइज़न)

उपमा: कल्पना कीजिए कि एक शरारती व्यक्ति बिना किसी को पता चले सभी के चित्रों पर अपना लोगो लगाना चाहता है।

  • चाल: पहले, शरारती व्यक्ति एक लोकप्रिय नुस्खा चुराता है (ऊपर दिए गए तरीके का उपयोग करके)। फिर, वह उस नुस्खे में अपने लोगो का विवरण (जैसे "एक नाइकी स्वोश") चुपके से जोड़ देता है और उसे वापस साझा स्केचबुक में सहेज लेता है।
  • ज़हर: अब, जब एक निर्दोष ग्राहक उस नुस्खे के समान चित्र के लिए पूछता है, तो रोबोट बुक से ज़हरीला (पॉइज़न्ड) स्केच उठा लेता है।
  • परिणाम: भले ही ग्राहक ने कभी लोगो के लिए नहीं कहा था, रोबोट उस ज़हरीले स्केच का उपयोग करके पेंटिंग को पूरा करता है, और अंतिम चित्र में जादुई रूप से शरारती व्यक्ति का लोगो शामिल हो जाता है। ग्राहक को एक ऐसा चित्र मिलता है जिसमें उनकी इच्छा के विरुद्ध एक ब्रांड चिपका हुआ है, और शरारती व्यक्ति को मुफ्त विज्ञापन मिलता है।

यह क्यों मायने रखता है

यह शोध पत्र दिखाता है कि जबकि "स्मार्ट स्केचबुक" एआई आर्ट को तेज़ बनाते हैं, वे सिस्टम की गोपनीयता और सुरक्षा को तोड़ देते हैं।

  • गोपनीयता: आप अपने गुप्त संदेश या अपने कस्टम आर्ट नुस्खों को निजी नहीं रख सकते यदि सिस्टम अपना "आधा-अधूरा" काम सभी के साथ साझा करता है।
  • सुरक्षा: बुरे तत्व इस साझा स्थान का उपयोग आपकी जासूसी करने, आपका काम चुराने या आपके चित्रों पर अपनी सामग्री थोपने के लिए कर सकते हैं।

शोधकर्ता सरल समाधान सुझाते हैं, जैसे कि यादृच्छिक रूप से (randomly) किस स्केच का उपयोग करना है यह चुनना (ताकि जासूस गति का अनुमान न लगा सकें), संदिग्ध लोगो को फ़िल्टर करना, या उन उपयोगकर्ताओं पर नज़र रखना जो बहुत तेज़ी से बहुत अधिक प्रश्न पूछते हैं। जब तक ये सुधार लागू नहीं किए जाते, इन साझा "स्मार्ट स्केचबुक" का उपयोग करना एक सार्वजनिक पार्क की बेंच पर अपनी डायरी खुली छोड़ने जैसा है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →