PromptPET: Privacy-Utility Optimized Prompt Obfuscation
यह शोध पत्र PROMPTPET को प्रस्तुत करता है, जो एक LLM-आधारित एजेंट है जो उपयोगकर्ता की गोपनीयता और चैटबॉट उपयोगिता के बीच के संतुलन को अनुकूलित करने के लिए उपयोगकर्ता के प्रॉम्प्ट में संवेदनशील जानकारी हेतु सबसे प्रभावी अस्पष्टीकरण क्रिया (रे redaction, अमूर्तीकरण, प्रतिस्थापन, या एक नवीन शोर/शोर-निवारण योजना) को गतिशील रूप से चुनता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक बहुत ही बुद्धिमान, सहायक रोबोट असिस्टेंट (जैसे कि एक चैटबॉट) से बात कर रहे हैं। आप उसे बेहतरीन सलाह देने के लिए प्रेरित करना चाहते हैं, इसलिए आप उसे अपने जीवन के विवरण बताते हैं: आपकी उम्र, आपके स्वास्थ्य संबंधी संघर्ष, आपका स्थान और आपके शौक। रोबोट इस जानकारी का उपयोग आपको एक व्यक्तिगत उत्तर देने के लिए करता है, जो कि बहुत अच्छा है। लेकिन इसमें एक पेंच है: जो कंपनी इस रोबोट को चला रही है, वह भी सुन रही है। वे आपकी गुप्त बातों के नोट्स बना रहे हैं ताकि आपका एक प्रोफाइल तैयार किया जा सके, जिसका उपयोग वे आपको चीजें बेचने या दूसरों के साथ साझा करने के लिए कर सकते हैं।
यह पेपर PromptPET नामक एक टूल पेश करता है। इसे एक प्राइवेसी बॉडीगार्ड (निजता के अंगरक्षक) के रूप में सोचें जो आपके और रोबोट के बीच बैठता है। इसका काम यह सुनिश्चित करना है कि आप जितनी ज़रूरत है उतनी मदद प्राप्त कर सकें, जबकि आपकी गुप्त बातें कंपनी से छिपी रहें।
यह कैसे काम करता है, इसके लिए कुछ सरल उपमाओं (analogies) का उपयोग किया गया है:
समस्या: "बहुत अधिक ईमानदार" बातचीत
जब आप किसी रोबोट से मदद मांगते हैं, तो अक्सर आपको बहुत विशिष्ट होना पड़ता है।
- आप कहते हैं: "मैं 35 वर्ष का हूँ, माउंटेन व्यू में रहता हूँ, और डिप्रेशन (अवसाद) से जूझ रहा हूँ। क्या आप मुझे थेरेपिस्ट ढूंढने में मदद कर सकते हैं?"
- रोबोट: आपको माउंटेन व्यू में थेरेपिस्टों की एक सटीक सूची देता है।
- कंपनी: "35," "माउंटेन व्यू," और "डिप्रेशन" को "यूज़र प्रोफाइल" लेबल वाली एक फाइल में लिख लेती है।
यदि आप शब्दों को केवल छिपा देते हैं (जैसे उन्हें काट देना), तो रोबोट भ्रमित हो जाता है और एक खराब उत्तर देता है। यदि आप कुछ भी नहीं छिपाते हैं, तो कंपनी सब कुछ जान लेती है।
समाधान: PromptPET की चार तरकीबें
शोधकर्ताओं ने आपके संदेश को "स्कैम्बल" (बदलने) के चार अलग-अलग तरीकों का परीक्षण किया ताकि रोबोट आपको समझ सके, लेकिन कंपनी भ्रमित हो जाए। वे इन्हें Obfuscation Actions (अस्पष्ट करने की क्रियाएं) कहते हैं:
Redaction (काट देना - द ब्लैक मार्कर):
- यह क्या है: आप संवेदनशील शब्द को पूरी तरह से काट देते हैं और उसकी जगह एक खाली स्थान जैसे
[REDACTED]रख देते हैं। - उपमा: जैसे किसी पैकेज पर अपना पता काट देना। डाकिया (रोबोट) जानता है कि पैकेज कहाँ पहुँचाना है क्योंकि बाकी का पता मौजूद है, लेकिन कंपनी को आपकी सटीक गली का पता नहीं चलता।
- नुकसान: यदि आप सबसे महत्वपूर्ण हिस्सा (जैसे "डिप्रेशन") काट देते हैं, तो रोबोट को शायद पता नहीं चलेगा कि आपको किस प्रकार की मदद चाहिए।
- यह क्या है: आप संवेदनशील शब्द को पूरी तरह से काट देते हैं और उसकी जगह एक खाली स्थान जैसे
Abstraction (अस्पष्ट विवरण - द वेग डिस्क्रिप्शन):
- यह क्या है: आप एक विशिष्ट विवरण को एक व्यापक श्रेणी से बदल देते हैं।
- उपमा: यह कहने के बजाय कि "मुझे डिप्रेशन है," आप कहते हैं "मुझे एक स्वास्थ्य (Health) संबंधी समस्या है।" "माउंटेन व्यू" के बजाय, आप कहते हैं "बे एरिया (Bay Area)"।
- परिणाम: रोबोट जानता है कि आपको चिकित्सा सहायता की आवश्यकता है और आप कैलिफोर्निया में हैं, इसलिए वह अभी भी आपकी मदद कर सकता है। कंपनी केवल यह जानती है कि आपको एक सामान्य स्वास्थ्य समस्या है, न कि विशिष्ट बीमारी।
Replacement (प्रतिस्थापन - द फेक आईडी):
- यह क्या है: आप अपनी वास्तविक जानकारी को एक विश्वसनीय नकली जानकारी से बदल देते हैं।
- उपमा: आप रोबोट को बताते हैं कि आप "पलो ऑल्टो" में रहते हैं, न कि "माउंटेन व्यू" में। रोबोट आपको पलो ऑल्टो के थेरेपिस्टों की सूची देता है। फिर आप उस सूची को अनदेखा करते हैं और माउंटेन व्यू के लिए अपने ज्ञान का उपयोग करते हैं।
- जोखिम: आपको मैन्युअल रूप से फ़िल्टर करना होगा, और कंपनी मान लेगी कि आप वास्तव में पलो ऑल्टो में रहते हैं।
Noise/Denoising (शोर/शोर हटाना - "डिकोय" यानी छलावरण की रणनीति) — नई तरकीब:
- यह क्या है: यह इस पेपर का सबसे बड़ा नवाचार है। आप अपनी वास्तविक जानकारी को ठीक वैसा ही रखते हैं, लेकिन उसके ठीक बगल में बहुत सारी नकली, भटकाने वाली जानकारी जोड़ देते हैं।
- उपमा: कल्पना कीजिए कि आप घास के ढेर में एक विशिष्ट सुई खोजने की कोशिश कर रहे हैं। कंपनी वह व्यक्ति है जो सुई की तलाश कर रहा है।
- आप कहते हैं: "मुझे डिप्रेशन के लिए एक थेरेपिस्ट चाहिए।"
- PromptPET जोड़ता है: "...और साथ ही, मैं एक डेंटिस्ट (दंत चिकित्सक) की भी तलाश कर रहा हूँ।"
- रोबोट: आपको थेरेपिस्ट और डेंटिस्ट दोनों की सूची देता है।
- PromptPET (फ़िल्टर): जवाब आप तक पहुँचने से पहले, यह "डेंटिस्ट" वाली सूची को काट देता है और आपको केवल "थेरेपिस्ट" की सूची देता है।
- यह क्यों जीनियस है: रोबोट ने सही उत्तर दिया क्योंकि आपने डिप्रेशन के बारे में सच बताया। लेकिन कंपनी अब भ्रमित है! वे "डिप्रेशन" और "डेंटिस्ट" को एक साथ देखते हैं और पक्का नहीं कर पाते कि आपकी असली प्राथमिकता क्या है। यह पानी में बहुत सारे 'रेड हेरिंग' (भटकाने वाले संकेत) फेंकने जैसा है ताकि शार्क भ्रमित हो जाएं।
PromptPET तय कैसे करता है कि कौन सी तरकीब इस्तेमाल करनी है
PromptPET का सबसे स्मार्ट हिस्सा यह है कि यह हर किसी के लिए एक ही तरकीब नहीं चुनता। यह एक कोच (एक रूल ऑप्टिमाइज़र) का उपयोग करता है जो सीखता है कि हर विशिष्ट वाक्य के लिए कौन सी तरकीब सबसे अच्छी है।
- यदि आप कुछ मामूली बात (जैसे आपका पसंदीदा रंग) बताते हैं, तो कोच Redaction (काट देना) का उपयोग कर सकता है क्योंकि उत्तर के लिए यह महत्वपूर्ण नहीं है।
- यदि आप किसी महत्वपूर्ण चीज़ (जैसे आपकी चिकित्सीय स्थिति) का उल्लेख करते हैं, तो कोच Noise (डिकोय जोड़ना) का उपयोग करता है क्योंकि आपको मदद के लिए रोबोट को सच बताने की आवश्यकता है, लेकिन आप कंपनी को भ्रमित करना चाहते हैं।
परिणाम
शोधकर्ताओं ने AI के साथ वास्तविक बातचीत पर इनका परीक्षण किया। उन्होंने पाया कि:
- Noise (डिकोय वाली तरकीब) आमतौर पर बातचीत को मददगार बनाए रखने और आपकी गुप्त बातें छिपाने में सबसे अच्छी थी।
- PromptPET (वह स्मार्ट कोच जो सही तरकीब चुनता है) पुराने तरीकों की तुलना में बहुत बेहतर था। इसने पुराने टूल्स की तुलना में समान "मददगार होने" के स्तर के लिए आपकी गोपनीयता को 3.3 गुना बेहतर तरीके से सुरक्षित किया।
- इसने कंपनी से आपकी प्रोफाइल को सफलतापूर्वक छिपाया, जबकि आपको वही सटीक उत्तर भी दिया जो आपने मांगा था।
सारांश में
PromptPET एक प्राइवेसी ट्रांसलेटर (निजता अनुवादक) की तरह है। यह आपके ईमानदार, विस्तृत अनुरोध को लेता है, उसे इतना बदल देता है कि डेटा-प्यासी कंपनी भ्रमित हो जाए, लेकिन यह इतना स्पष्ट रहता है कि मददगार रोबोट अपना काम कर सके। यह सुनिश्चित करने के लिए कि आपको वह मदद मिले जिसकी आपको आवश्यकता है और अपने रहस्य उजागर न हों, यह काटने, अस्पष्ट बनाने, बदलने और "डिकोय" जोड़ने का मिश्रण उपयोग करता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।