PRAG: Efficient Privacy-Preserving RAG Service Supporting Arbitrary Top- Retrieval
यह शोध पत्र PRAG का प्रस्ताव करता है, जो एक कुशल गोपनीयता-संरक्षित रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) सेवा है, जो सुरक्षित सॉर्टिंग के बिना मनमाने top- रिट्रीवल को सपोर्ट करने के लिए एक इंटरैक्टिव बाइसेक्शन (bisection) विधि और सीक्रेट शेयरिंग का उपयोग करती है, जिससे डेटा और उपयोगकर्ता प्रॉम्प्ट की सुरक्षा करते हुए मौजूदा प्रणालियों की तुलना में महत्वपूर्ण गति प्राप्त होती है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपके पास दस्तावेज़ों का एक विशाल, गुप्त पुस्तकालय है (जैसे मेडिकल रिकॉर्ड, कानूनी अनुबंध, या वित्तीय रिपोर्ट) जिसका उपयोग आप प्रश्नों के उत्तर देने के लिए करना चाहते हैं। आप इस पूरे पुस्तकालय को किसी सर्च इंजन कंपनी को नहीं देना चाहते क्योंकि यह बहुत संवेदनशील है। साथ ही, आप यह भी नहीं चाहते कि सर्च इंजन को ठीक-ठीक पता चले कि आप क्या पूछ रहे हैं, क्योंकि इससे आपके निजी विचार या व्यावसायिक रणनीतियाँ उजागर हो सकती हैं।
यही वह समस्या है जिसे P2RAG हल करता है। यह एक "रिट्रीवल-ऑगमेंटेड जनरेशन" (RAG) सेवा चलाने का एक नया तरीका है—जो एक "फैंसी" शब्द है "एक ऐसा AI जो आपके निजी दस्तावेज़ों का उपयोग करके प्रश्नों के उत्तर देता है"—बिना किसी को राज उगलने दिए।
यह कैसे काम करता है, यहाँ सरल अवधारणाओं में दिया गया है:
1. पुराना तरीका: पूरे डेक की छंटनी करना
कल्पना कीजिए कि आपके पास 1,000 कार्डों का एक डेक है, जिनमें से प्रत्येक का एक स्कोर है। आप उच्चतम स्कोर वाले शीर्ष 10 कार्ड खोजना चाहते हैं।
- समस्या: पिछले सुरक्षित सिस्टमों में, शीर्ष 10 खोजने के लिए, कंप्यूटर को उच्चतम से निम्नतम तक क्रमबद्ध करने के लिए हर एक कार्ड की दूसरे हर कार्ड के साथ गुप्त रूप से तुलना करनी पड़ती थी। यह एक भीड़ में सबसे लंबे व्यक्ति को खोजने जैसा है जैसे कि आप सबको एक लाइन में खड़ा करें और एक-एक करके मापें, लेकिन इस तरह से कि कोई भी माप देख न सके।
- बाधा (Bottleneck): यदि आप 10 के बजाय शीर्ष 100 कार्ड चाहते हैं, तो यह "सॉर्टिंग" प्रक्रिया अविश्वसनीय रूप से धीमी और महंगी हो जाती है। यह केवल 5 बेहतरीन किताबें खोजने के लिए लाइब्रेरी की किताबों को छाँटने जैसा है; आपके पास जितनी अधिक किताबें होंगी, उतना ही अधिक समय लगेगा।
2. P2RAG समाधान: "सीमा का अनुमान लगाने" का खेल
P2RAG खेल को बदल देता है। पूरे डेक को सॉर्ट करने के बजाय, यह एक "हॉट एंड कोल्ड" (विशेष रूप से, बाइनरी सर्च या "बाइसेक्शन") का खेल खेलता है ताकि एक कटऑफ लाइन (सीमा रेखा) खोजी जा सके।
- सेटअप: कल्पना कीजिए कि दो सर्वर (मान लीजिए सर्वर A और सर्वर B) गुप्त पुस्तकालय रखते हैं। वे हर दस्तावेज़ को आधा कर देते हैं ताकि कोई भी सर्वर पूरी कहानी न जान सके। आप (उपयोगकर्ता) भी अपने प्रश्न को आधा करते हैं और उसका एक हिस्सा प्रत्येक सर्वर को भेजते हैं।
- खेल:
- आप सर्वरों से पूछते हैं: "यदि हम इस विशिष्ट स्तर पर एक बार (bar) सेट करें, तो मेरे प्रश्न के कितने दस्तावेज़ पर्याप्त समान हैं?"
- सर्वर बिना आपको यह बताए कि वे कौन से दस्तावेज़ हैं, और बिना आपको स्कोर दिखाए, मिलानों की गिनती करते हैं। वे बस कहते हैं, "50 मैच हैं।"
- आप सोचते हैं: "मुझे केवल 10 चाहिए थे। यह बहुत अधिक है। चलिए बार (स्तर) को थोड़ा ऊपर उठाते हैं।"
- आप ऊंचे बार के साथ फिर से पूछते हैं। वे कहते हैं, "अब 5 मैच हैं।"
- आप सोचते हैं: "बहुत कम। चलिए बार को थोड़ा नीचे करते हैं।"
- आप ठीक वही संख्या प्राप्त करने के लिए (जैसे, 10 दस्तावेज़) बार को आगे-पीछे एडजस्ट करते रहते हैं जब तक कि आपको सटीक संख्या न मिल जाए।
जादू: क्योंकि आप केवल एक "बार" को एडजस्ट कर रहे हैं और गिनती कर रहे हैं, इसलिए आपको पूरे पुस्तकालय को सॉर्ट करने की आवश्यकता नहीं है। आपको बस बार की सही ऊंचाई खोजने की आवश्यकता है। यह प्रक्रिया को अविश्वसनीय रूप से तेज़ बनाता है, भले ही आप बड़ी संख्या में परिणाम (जैसे, 1,000 दस्तावेज़) चाहते हों।
3. रहस्यों को सुरक्षित रखना ("विश्वास न करने" का नियम)
पेपर का दावा है कि यह सिस्टम तब भी सुरक्षित है जब सर्वर "ईमानदार लेकिन जिज्ञासु" (नियमों का पालन करते हैं लेकिन तांक-झांक करने की कोशिश करते हैं) हों या उपयोगकर्ता "दुर्भावनापूर्ण" (सिस्टम को धोखा देने की कोशिश करता है) हो।
- जिज्ञासु सर्वरों के विरुद्ध: क्योंकि डेटा विभाजित (सीक्रेट-शेयर्ड) है, सर्वर A केवल नंबरों का एक रैंडम मिश्रण देखता है, और सर्वर B एक अलग रैंडम मिश्रण देखता है। जब तक वे दोनों मिलकर काम न करें, कोई भी दस्तावेज़ या आपके प्रश्न को पुनर्गठित नहीं कर सकता। पेपर यह मान लेता है कि वे मिलकर काम नहीं करेंगे (जैसे दो अलग-अलग देशों में स्थित दो कंपनियां)।
- चालाक उपयोगकर्ताओं के विरुद्ध: एक चालाक उपयोगकर्ता सर्वरों को बार को इतना नीचे गिराने के लिए कहने की कोशिश कर सकता है कि सभी दस्तावेज़ मैच हो जाएं, जिससे प्रभावी रूप से पूरा पुस्तकालय चुरा लिया जा सके। P2RAG कितनी बार पूछा जा सकता है इस पर "स्पीड लिमिट" लगाता है और गणित की जांच करता है ताकि यह सुनिश्चित हो सके कि आप केवल वही दस्तावेज़ देख सकें जिनकी आपको अनुमति है। यह एक बुरा उपयोगकर्ता कितना भी डेटा चुरा सकता है, उस पर कड़ा नियंत्रण रखता है।
4. यह क्यों मायने रखता है (परिणाम)
लेखकों ने इस सिस्टम का परीक्षण किया और पाया:
- गति: यह वर्तमान सर्वोत्तम सुरक्षित सिस्टमों की तुलना में 3 से 300 गुना तेज़ है जब आप बड़ी संख्या में दस्तावेज़ (16 से लेकर 1,024 तक) प्राप्त करना चाहते हैं।
- लचीलापन: आप परिणामों की कोई भी संख्या (arbitrary k) मांग सकते हैं, जो वित्त या कानून जैसे क्षेत्रों में महत्वपूर्ण है जहाँ आपको सही उत्तर पाने के लिए बहुत अधिक संदर्भ देखने की आवश्यकता हो सकती है।
- सटीकता: सिस्टम इतना सटीक है कि यह लगभग बिना किसी गणितीय त्रुटि के ठीक वही दस्तावेज़ खोज लेता है जो एक गैर-सुरक्षित सिस्टम खोजता।
निचोड़
P2RAG एक सुरक्षित, उच्च-गति वाले लाइब्रेरियन की तरह है जो एक विशाल, लॉक तिजोरी में आपके विशिष्ट दस्तावेज़ों को ढूंढ सकता है, बिना कभी तिजोरी खोले आपको किताबें दिखाए, और बिना आपको तिजोरी के अन्य दस्तावेज़ों को देखे। यह पूरे संग्रह को सॉर्ट करने के बजाय "कटऑफ पॉइंट" खोजने के लिए एक स्मार्ट अनुमान लगाने वाले खेल का उपयोग करके करता है, जिससे यह वास्तविक दुनिया में उपयोगी होने के लिए पर्याप्त तेज़ हो जाता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।