InferDPT: Privacy-Preserving Inference for Closed-box Large Language Model
यह शोध पत्र InferDPT प्रस्तुत करता है, जो क्लोज्ड-बॉक्स लार्ज लैंग्वेज मॉडल्स के गोपनीयता-संरक्षित इन्फरेंस के लिए एक व्यावहारिक ढांचा है, जो एम्बेडिंग रिवीज़न हमलों के विरुद्ध मजबूत सुरक्षा के साथ उच्च टेक्स्ट जनरेशन गुणवत्ता को प्रभावी ढंग से संतुलित करने के लिए एक नवीन RANTEXT तंत्र का उपयोग करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपके पास एक प्रतिभाशाली, सर्वज्ञानी शेफ (एक Large Language Model, जैसे ChatGPT) है जो आपके लिए अद्भुत कहानियाँ, ईमेल या रिपोर्ट लिख सकता है। आप इस शेफ का उपयोग उस कहानी को पूरा करने के लिए करना चाहते हैं जिसे आपने शुरू किया था, लेकिन उस कहानी में आपकी गुप्त पारिवारिक रेसिपी या निजी डायरी प्रविष्टियाँ शामिल हैं।
समस्या यह है कि यदि आप अपना कच्चा (raw) ड्राफ्ट शेफ को भेजते हैं, तो वे आपके रहस्यों को याद कर सकते हैं, उन्हें लीक कर सकते हैं, या उन्हें बेच सकते हैं। आप शेफ के खाना पकाने के कौशल का उपयोग करना चाहते हैं, लेकिन अपने निजी मसालों को दिए बिना।
यह पेपर InferDPT पेश करता है, जो एक चतुर "प्राइवेसी रैपर" (privacy wrapper) है जो आपको इन शक्तिशाली AI शेफों का सुरक्षित रूप से उपयोग करने देता है। यह कैसे काम करता है, यहाँ सरल चरणों और उपमाओं के साथ बताया गया है।
मुख्य समस्या: "ग्लास बॉक्स" शेफ
वर्तमान में, यदि आप किसी AI को अपनी कहानी पूरी करने के लिए कहते हैं, तो आप उसे अपना टेक्स्ट (Prompt) भेजते हैं। AI इसे पढ़ता है और बाकी हिस्सा लिखता है।
- जोखिम: AI कंपनी ("ब्लैक बॉक्स") आपके निजी टेक्स्ट को देख सकती है। वे गलती से इसे लीक कर सकते हैं, या कोई हैकर उनके सर्वर से इसे चुरा सकता है।
- पुराने समाधान: पिछले तरीकों ने टेक्स्ट को एन्क्रिप्ट करने की कोशिश की (जैसे इसे एक अटूट तिजोरी में रखना), लेकिन यह इतना धीमा और महंगा था कि यह एक हथौड़े से भोजन पकाने जैसा था। अन्य तरीकों ने शब्दों को बस उलझाने (scramble) की कोशिश की, लेकिन परिणाम इतना बिखरा हुआ था कि AI समझ ही नहीं पाता था, जिससे केवल निरर्थक शब्द (gibberish) निकलते थे।
समाधान: InferDPT (एक "सीक्रेट ट्रांसलेटर" सिस्टम)
लेखकों ने InferDPT नामक दो-चरणीय प्रणाली प्रस्तावित की है। इसे एक सीक्रेट ट्रांसलेटर और एक रिकंस्ट्रक्शन आर्टिस्ट (पुनर्निर्माण कलाकार) के रूप में समझें।
चरण 1: द पर्टर्बेशन मॉड्यूल (द "कन्फ्यूजिंग ट्रांसलेटर")
इससे पहले कि आप अपनी गुप्त कहानी AI शेफ को भेजें, आप इसे एक विशेष ट्रांसलेटर के माध्यम से चलाते हैं।
- यह क्या करता है: यह आपके गुप्त शब्दों को लेता है और उन्हें अलग शब्दों से बदल देता है जो सुनने में या दिखने में समान होते हैं लेकिन वही नहीं होते।
- उदाहरण: यदि आपका गुप्त शब्द "Boston" है, तो यह इसे "Barcelona" से बदल सकता है। यदि यह "Immigrant" है, तो यह इसे "Student" से बदल सकता है।
- जादू (RANTEXT): पेपर में एक नई तकनीक पेश की गई है जिसे RANTEXT कहा जाता है।
- पुराना तरीका: ट्रांसलेटर के पास बदलाव के लिए एक विशाल, निश्चित सूची थी। कभी-कभी यह ऐसा शब्द चुन लेता था जिसका कोई अर्थ नहीं निकलता था (जैसे "Boston" को "Banana" से बदलना)।
- नया तरीका (RANTEXT): ट्रांसलेटर आपकी कहानी के हर एक शब्द के लिए, केवल उस क्षण के लिए, समान शब्दों की एक कस्टम, रैंडम सूची बनाता है। यह एक ऐसा प्रतिस्थापन चुनता है जो अर्थ में तो करीब है लेकिन पर्याप्त रूप से अलग है ताकि आपका रहस्य छिपा रहे।
- परिणाम: आप AI को अपनी कहानी का एक "स्क्रैम्बल" किया हुआ संस्करण भेजते हैं। AI आपके असली रहस्य नहीं जानता; वह केवल स्क्रैम्बल किए हुए संस्करण को देखता है।
चरण 2: द एक्सट्रैक्शन मॉड्यूल (द "रिकंस्ट्रक्शन आर्टिस्ट")
AI शेफ आपके स्क्रैम्बल किए गए टेक्स्ट को लेता है और उसके आधार पर कहानी को आगे बढ़ाता है।
- समस्या: AI का आउटपुट अब उन स्क्रैम्बल किए गए शब्दों पर आधारित है (उदाहरण के लिए, यह "Barcelona" के बारे में लिखेगा बजाय "Boston" के)। यह एक अच्छी कहानी है, लेकिन यह अब आपकी कहानी नहीं रही।
- समाधान: आप AI के आउटपुट को एक छोटे, स्थानीय कंप्यूटर (एक "रिकंस्ट्रक्शन आर्टिस्ट") के माध्यम से चलाते हैं जिसे आप नियंत्रित करते हैं।
- यह कैसे काम करता है: यह स्थानीय कंप्यूटर AI के आउटपुट और मूल स्क्रैम्बल किए गए प्रॉम्प्ट को देखता है। यह अपनी बुद्धिमत्ता का उपयोग करके यह पता लगाता है: "आह, AI ने Barcelona के बारे में लिखा, लेकिन उपयोगकर्ता का मूल प्रॉम्प्ट Boston के बारे में था। मुझे 'Barcelona' को वापस 'Boston' में बदलना होगा और व्याकरण ठीक करना होगा।"
- परिणाम: आपको एक उच्च-गुणवत्ता वाली कहानी मिलती है जो पूरी तरह से प्रवाहित होती है, लेकिन AI ने वास्तव में आपके वास्तविक शब्दों को कभी नहीं देखा।
यह पहले से बेहतर क्यों है? ("RANTEXT" का लाभ)
पेपर ने उनके नए तरीके (RANTEXT) की तुलना एक ताले और चाबी की उपमा का उपयोग करके पुराने तरीकों से की है:
- SANTEXT+ (एक विशाल चाबियों का गुच्छा): पुराने तरीके में संभावित शब्दों की एक विशाल सूची थी जिन्हें बदला जा सकता था। यह 50,000 चाबियों वाले एक चाबी के गुच्छे जैसा था। इसका अनुमान लगाना कठिन था, लेकिन AI अक्सर भ्रमित हो जाता था क्योंकि शब्द बहुत अलग थे।
- CUSTEXT+ (एक छोटा चाबियों का गुच्छा): एक अन्य पुराना तरीका जिसमें केवल 20 चाबियों की एक छोटी सूची थी। यह तेज़ था, लेकिन यदि आपका गुप्त शब्द उस सूची में होता, तो AI आसानी से उसका अनुमान लगा सकता था। यह ऐसा था जैसे अपने सामने के दरवाजे को खुला छोड़ देना और उस पर "प्रवेश निषेध" का बोर्ड लगा देना।
- RANTEXT (एक जादुई रूप बदलने वाली चाबी): यह विधि उस क्षण के लिए विशेष रूप से बनाई गई रैंडम-साइज़ की चाबियों की सूची बनाती है।
- यदि सूची बड़ी है, तो हैकर्स के लिए मूल शब्द का अनुमान लगाना कठिन है (बेहतरीन प्राइवेसी)।
- यदि सूची छोटी है, तो शब्द बहुत समान होते हैं, जिससे कहानी समझ में आती है (बेहतरीन क्वालिटी)।
- यह गतिशील रूप से दोनों के बीच संतुलन बनाता है, यह सुनिश्चित करते हुए कि कहानी पढ़ने योग्य हो लेकिन रहस्य सुरक्षित रहें।
परिणाम: "दोनों दुनियाओं का सर्वश्रेष्ठ"
शोधकर्ताओं ने तीन अलग-अलग प्रकार के लेखन कार्यों (समाचार, विकिपीडिया और शैक्षणिक शोध पत्र) पर इसका परीक्षण किया।
- प्राइवेसी (गोपनीयता): भले ही किसी हैकर ने स्क्रैम्बल किए गए टेक्स्ट को रिवर्स-इंजीनियर करने की कोशिश की, वे 90% से अधिक बार विफल रहे।
- क्वालिटी (गुणवत्ता): अंतिम कहानियाँ लगभग उतनी ही अच्छी थीं जितनी कि यदि आपने मूल टेक्स्ट सीधे AI को भेजा होता। "रिकंस्ट्रक्शन आर्टिस्ट" ने AI के भ्रम को ठीक करने में शानदार काम किया।
- स्पीड (गति): इसे एक सामान्य चैट की तुलना में बहुत अधिक समय नहीं लगा।
सारांश
InferDPT एक प्रसिद्ध घोस्टराइटर (ghostwriter) को अपनी निजी डायरी भेजने जैसा है, लेकिन एक जादुई दर्पण के माध्यम से।
- दर्पण आपके प्रतिबिंब को विकृत (टेक्स्ट को स्क्रैम्बल) कर देता है ताकि घोस्टराइटर आपका चेहरा न देख सके।
- घोस्टराइटर उस विकृत प्रतिबिंब के आधार पर एक सुंदर कहानी लिखता है।
- आप दर्पण के माध्यम से कहानी को फिर से देखते हैं और मानसिक रूप से विकृति को "अनडू" (undo) करते हैं ताकि आपको वापस एकदम सही कहानी मिल सके।
आपको दुनिया के सबसे स्मार्ट AI की शक्ति मिलती है, बिना अपने रहस्य उजागर किए।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।