SurrogateShield: Beyond Redaction for High-Utility, Privacy-Preserving LLM Interactions
SurrogateShield एक क्लाइंट-साइड प्रॉक्सी है जो पता लगाए गए PII (व्यक्तिगत पहचान योग्य जानकारी) को ट्रांसमिशन से पहले स्थानीय रूप से उत्पन्न, टाइप-संगत सरोगेट मानों (surrogate values) से बदलकर और प्रतिक्रियाओं में मूल मानों को पुनर्स्थापित करके गोपनीयता-संरक्षण वाले LLM इंटरैक्शन को बढ़ाता है, जिससे वास्तविक PII के प्रदर्शन को समाप्त किया जाता है और पारंपरिक रेडैक्शन (redaction) विधियों की तुलना में सिमेंटिक उपयोगिता (semantic utility) में महत्वपूर्ण सुधार किया जाता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने नहीं लिखा है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप किसी व्यक्तिगत कार्य के लिए, जैसे कि कोई पत्र लिखने या अपने चिकित्सा विकल्पों की जांच करने के लिए, एक सुपर-स्मार्ट, सर्वज्ञ रोबोट (एक लार्ज लैंग्वेज मॉडल या LLM) से मदद मांगना चाहते हैं। आप अपना असली नाम, अपना पता और अपना सोशल सिक्योरिटी नंबर टाइप करते हैं।
समस्या क्या है? उत्तर पाने के लिए, आपका संदेश इंटरनेट के माध्यम से एक कंपनी के सर्वर तक जाना चाहिए। एक बार वहां पहुँचने के बाद, आप यह नहीं देख सकते कि वे इसके साथ क्या करते हैं। वे इसे हमेशा के लिए रख सकते हैं, इसे हैक किया जा सकता है, या वे अपने नियम बदल सकते हैं।
लोग इसे ठीक करने के लिए आमतौर पर जिस तरीके का उपयोग करते हैं वह है रेडैक्शन (Redaction)। यह आपके विवरणों को काले रंग से मिटाने या छिपाने जैसा है।
- आपका संदेश: "मेरा नाम सारा है और मैं शिकागो में रहती हूँ।"
- रेडैक्टेड (छिपा हुआ) संदेश: "मेरा नाम [NAME] है और मैं [CITY] में रहती हूँ।"
पकड़ (The Catch): जब रोबोट को रेडैक्टेड नोट मिलता है, तो वह भ्रमित हो जाता है। उसे नहीं पता कि "सारा" कौन है, इसलिए वह उसके नाम से पत्र नहीं लिख सकता। वह जवाब दे सकता है, "प्रिय [NAME]," जो आपके लिए बेकार है। "ब्लैक मार्कर" वाक्य के अर्थ को नष्ट कर देता है।
पेश है SurrogateShield: "बॉडी डबल" रणनीति
यह पेपर SurrogateShield को पेश करता है, जो एक नए टूल की तरह है जो आपके कंप्यूटर पर एक प्राइवेसी बॉडीगार्ड की तरह बैठा है। आपके विवरणों को मिटाने के बजाय, यह आपके डिवाइस से संदेश बाहर जाने से ठीक पहले आपके वास्तविक विवरणों को नकली लेकिन वास्तविक दिखने वाले "बॉडी डबल्स" (surrogates) से बदल देता है।
यह इस प्रकार काम करता है, एक सरल उपमा का उपयोग करते हुए:
1. अदला-बदली (The "Surrogate")
अपने नाम को मिटाने के बजाय, SurrogateShield "सारा" को "ऐशले" जैसे पूरी तरह से काल्पनिक नाम से और आपके असली शिकागो पते को "स्प्रिंगफील्ड" के एक नकली पते से बदल देता है।
- आपका संदेश: "मेरा नाम सारा है..."
- SurrogateShield का संदेश: "मेरा नाम ऐशले है..."
रोबोट को संदेश प्राप्त होता है और उसे लगता है कि वह ऐशले से बात कर रहा है। क्योंकि "ऐशले" एक वास्तविक नाम की तरह दिखता और सुनाई देता है, रोबोट ऐशले को संबोधित करते हुए एक बेहतरीन, स्वाभाविक लगने वाला पत्र लिख सकता है। वाक्य की संरचना बरकरार रहती है; कुछ भी "ब्लैक आउट" नहीं किया गया है।
2. गुप्त स्विच (The "ShadowMap")
SurrogateShield आपके कंप्यूटर पर एक गुप्त, लॉक डायरी (जिसे ShadowMap कहा जाता है) रखता है। यह लिखता है: "जब मैंने 'ऐशले' कहा, तो मेरा मतलब वास्तव में 'सारा' था।" यह डायरी एक उच्च-तकनीकी डिजिटल ताले (AES-256 एन्क्रिप्शन) के साथ सुरक्षित है जिसे केवल आपका कंप्यूटर ही खोल सकता है। यह डायरी आपके डिवाइस को कभी नहीं छोड़ती।
3. बहाली (The "Magic Reveal")
जब रोबोट अपना उत्तर वापस भेजता है, तो वह कहता है, "प्रिय ऐशले..."
SurrogateShield उस जवाब को रोकता है, अपनी गुप्त डायरी देखता है, देखता है कि "ऐशले" = "सारा" है, और आपको स्क्रीन दिखाने से पहले तुरंत नाम को वापस बदल देता है।
- आपको क्या दिखता है: "प्रिय सारा..."
आपको एक बेहतरीन, व्यक्तिगत उत्तर मिलता है, लेकिन रोबोट ने कभी आपका असली नाम नहीं देखा।
यह सिर्फ टेक्स्ट को "ब्लैक आउट" करने से बेहतर क्यों है?
शोधकर्ताओं ने 1,124 अलग-अलग प्रश्नों का उपयोग करके इस पुराने "ब्लैक मार्कर" तरीके के मुकाबले इसका परीक्षण किया।
- बेहतर उत्तर: क्योंकि रोबोट को खाली जगह के बजाय एक वास्तविक नाम मिला, इसलिए इसके उत्तरों की गुणवत्ता बहुत अधिक थी। शोधकर्ताओं ने इसे एक "सिमेंटिक स्कोर" (अर्थ कितना संरक्षित रहा) का उपयोग करके मापा। SurrogateShield ने मूल अर्थ का 94.85% बनाए रखा, जबकि ब्लैक-मार्कर पद्धति ने केवल 81.59% ही बनाए रखा।
- हैक करना कठिन: शोधकर्ताओं ने एक अलग AI को वास्तविक नामों का अनुमान लगाने के लिए धोखा देने की कोशिश की।
- "ब्लैक मार्कर" पद्धति के साथ, हैकर AI ने 1.53% बार वास्तविक नामों का अनुमान लगाया (क्योंकि "[NAME]" देखना हैकर को ठीक वहीं देखने का संकेत देता है जहाँ उसे देखना चाहिए)।
- SurrogateShield के साथ, हैकर AI ने 0% बार अनुमान लगाया। चूंकि "ऐशले" एक वास्तविक व्यक्ति की तरह दिखता है, इसलिए हैकर को पता ही नहीं चलता कि यह नकली है। यह अजनबियों की भीड़ में से किसी विशिष्ट व्यक्ति का नाम अनुमान लगाने की कोशिश करने जैसा है; आप इसे नहीं कर सकते।
यह क्या बदलने के लिए जानता है?
SurrogateShield आपके व्यक्तिगत विवरणों को खोजने के लिए तीन-चरणीय "डिटेक्टिव टीम" का उपयोग करता है:
- PatternScan: स्पष्ट चीजों जैसे क्रेडिट कार्ड नंबर या सोशल सिक्योरिटी नंबर की तलाश करता है (जैसे किसी विशिष्ट आकार की तलाश करना)।
- EntityTrace: नाम, स्थान और संगठनों को खोजने के लिए एक स्मार्ट टूल का उपयोग करता है (जैसे एक इंसान द्वारा टेक्स्ट को पढ़ना)।
- ContextGuard: उन पेचीदा मामलों के लिए अंतिम जांच, जहाँ पहले दो चरण अनिश्चित हो सकते हैं (जैसे यह तय करना कि "वाशिंगटन" एक व्यक्ति है या एक स्थान)।
इसमें एक विशेष नियम भी है: यदि आप किसी सेवा के लिए पूछ रहे हैं (जैसे "निकटतम फार्मेसी कहाँ है?"), तो यह जानता है कि आपको एक अच्छे उत्तर के लिए एक वास्तविक स्थान की आवश्यकता होगी। इसलिए, यह आपके पते को पूरी तरह से बदलने के बजाय उसे थोड़ा सा बदल सकता है (उदाहरण के लिए, आपको दो ब्लॉक दूर ले जाना), ताकि रोबोट आपको उपयोगी निर्देश दे सके बिना आपका सटीक घर प्रकट किए।
निष्कर्ष
SurrogateShield यह साबित करता है कि आपको प्राइवेसी (निजता) और उपयोगी उत्तरों के बीच चयन करने की आवश्यकता नहीं है।
- पुराना तरीका: प्राइवेसी छोड़ दें या एक टूटा हुआ, बेकार उत्तर प्राप्त करें।
- SurrogateShield का तरीका: अपनी प्राइवेसी 100% बनाए रखें (आपका वास्तविक डेटा आपके कंप्यूटर को कभी नहीं छोड़ता) और एक बेहतरीन, स्वाभाविक दिखने वाला उत्तर प्राप्त करें।
यह यह सब आपके अपने डिवाइस पर एक सेकंड के अंश में (लगभग 26 मिलीसेकंड में) करता है, इसलिए आपको महसूस भी नहीं होता कि यह हो रहा है। यह एक जादुई अनुवादक की तरह है जो रोबोट के लिए "प्राइवेसी" और आपके लिए "वास्तविक जीवन" बोलता है, और वह भी एक ही समय में।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।