← नवीनतम पेपर
🤖 machine learning

Gecko: Fast Private Inference via Secure Public Encoder Offloading

Gecko एक तेज़ और सुरक्षित निजी अनुमान (private inference) ढांचा है जो फीचर-स्पेस निष्कर्षण हमलों (feature-space extraction attacks) को रोकने के लिए फिक्स्ड प्रोजेक्शन और प्राइवेट फीचर गेटिंग का उपयोग करते हुए एक फ्रोजन पब्लिक एनकोडर को ऑफलोड करता है, जिससे न्यूनतम संचार ओवरहेड के साथ कम-विलंबता वाला अनुमान प्राप्त होता है।

मूल लेखक: Cheng'an Wei, Kai Chen, Yue Zhao, Congyi Li, Shenchen Zhu

प्रकाशित 2026-08-04
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Cheng'an Wei, Kai Chen, Yue Zhao, Congyi Li, Shenchen Zhu

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप अपने एक मित्र को एक गुप्त संदेश भेजना चाहते हैं जो एक सुपर-स्मार्ट, लॉक-डाउन फैक्ट्री चलाता है। आप चाहते हैं कि वह आपकी समस्या को हल करने के लिए अपनी शानदार मशीन का उपयोग करे, लेकिन आप नहीं चाहते कि वह देख सके कि आप क्या भेज रहे हैं, और आप यह भी नहीं चाहते कि वह अपनी मशीन के काम करने के तरीके की गुप्त रेसिपी चुरा ले। यह प्राइवेट इन्फरेंस (Private Inference) की दुनिया है, जो कंप्यूटर विज्ञान की एक शाखा है जो आपके डेटा और कंपनी के AI मॉडल दोनों को सुरक्षित रखने के लिए समर्पित है।

इसे करने के लिए, वैज्ञानिक एक जादुई उपकरण का उपयोग करते हैं जिसे होमोमोर्फिक एन्क्रिप्शन (Homomorphic Encryption) कहा जाता है। इसे एक ताले लगे, पारदर्शी बॉक्स की तरह समझें। आप अपना डेटा उस बॉक्स के अंदर रख सकते हैं, और फैक्ट्री उस बॉक्स पर बिना उसे खोले अपनी मशीन चला सकती है। मशीन संख्याओं को तब भी प्रोसेस करती है जब वे अभी भी बंद होती हैं। जब काम पूरा हो जाता है, तो परिणाम बॉक्स से बाहर आता है, जो अभी भी लॉक होता है। आप इसे घर ले जाते हैं, इसे खोलते हैं, और उत्तर देखते हैं। समस्या क्या है? यह "लॉक किए गए बॉक्स" वाली गणित अविश्वसनीय रूप से धीमी और भारी है। यह एक मानक AI मॉडल के लिए, एक सिंगल तस्वीर को देखने में भी एक मिनट से अधिक का समय ले सकता है।

हाल ही में, कुछ इंजीनियरों ने एक शॉर्टकट आज़माया: "क्यों न आप फोटो को पहचानने का भारी काम फैक्ट्री को भेजने से पहले ही खुद कर लें?" उन्होंने सुझाव दिया कि आप अपने फोन पर एक सामान्य, सार्वजनिक AI चलाएं ताकि तस्वीर को संख्याओं की एक सरल सूची (एक "फीचर") में बदल दिया जाए, फिर केवल वह सूची फैक्ट्री को भेज दी जाए, और फैक्ट्री को केवल अंतिम, छोटे कदम को पूरा करने दें। यह गति के लिए बहुत अच्छा लगता है, लेकिन इसमें एक पेंच है। यदि आप उस संख्याओं की सूची को बहुत स्पष्ट रूप से भेजते हैं, तो एक चालाक जासूस फैक्ट्री के गुप्त नुस्खे (रेसिपी) को उजागर करने के लिए पहले की तुलना में बहुत आसानी से धोखा दे सकता है। यह एक चोर को दिए गए नक्शे की तरह है जो भूलभुलैया के कठिन हिस्सों को छोड़ देता है और सीधे खजाने तक जाने वाले गुप्त रास्ते को दिखा देता है।

यहीं गेको (Gecko) काम आता है। गेको के पीछे के शोधकर्ताओं ने महसूस किया कि हालांकि हम गति बढ़ाने के लिए उपयोगकर्ता को भारी काम सौंप सकते हैं, हमें बहुत सावधान रहना होगा ताकि हम जासूस को एक "शॉर्टकट" न दे दें। उन्होंने एक नया सिस्टम बनाया जो गति को बनाए रखता है लेकिन गुप्त रास्ते को लॉक भी रखता है।

गेको समाधान: एक मनोरंजक विवरण

गेको टीम ने महसूस किया कि पुराना "शॉर्टकट" तरीका बहुत ही अनाड़ी था। यह आमतौर पर सार्वजनिक AI से प्राप्त अंतिम, सबसे विशिष्ट संख्याओं की सूची लेता था और उसे सीधे फैक्ट्री को भेज देता था। यह खतरनाक था क्योंकि वह सूची इतनी विशिष्ट थी कि उससे एक चोर के लिए फैक्ट्री के गुप्त चरणों को रिवर्स-इंजीनियर करना बहुत आसान हो जाता था।

गेको खेल बदल देता है क्योंकि यह एक सुपर-स्मार्ट अनुवादक की तरह काम करता है जो पहेलियों में बात करता है। यहाँ बताया गया है कि यह कैसे काम करता है, चरण-दर-चरण:

1. बहु-स्तरीय स्केच (द पब्लिक एनकोडर)
केवल तस्वीर के अंतिम, पॉलिश किए गए चित्र को भेजने के बजाय, गेको सार्वजनिक AI से पूछता है कि वह विवरण के विभिन्न स्तरों पर जो कुछ भी देखता है, वह सब भेजे। कल्पना कीजिए कि आप एक कुत्ते को देख रहे हैं। एक साधारण AI केवल "कुत्ता" कह सकता है। लेकिन गेको पूछता है कि एक साथ फर का स्केच, कानों का आकार, नाक की बनावट और समग्र मुद्रा (pose) सब कुछ भेजा जाए। यह इनपुट की एक बहुत अधिक समृद्ध, अधिक जटिल तस्वीर बनाता है।

2. जादुई संकुचन किरण (फास्टफूड प्रोजेक्शंस)
उन सभी विवरणों को भेजना बहुत अधिक डेटा होगा (जैसे एक पोस्टकार्ड के बजाय पूरी लाइब्रेरी भेजना)। इसलिए, गेको "फास्टफूड प्रोजेक्शंस" नामक एक चतुर गणितीय ट्रिक का उपयोग करता है। इसे एक जादुई संकुचन किरण (shrink ray) के रूप में सोचें जो उन विस्तृत स्केच को एक संक्षिप्त, स्कैम्बल की गई (scrambled) कोड में कंप्रेस कर देती है। यह सभी महत्वपूर्ण जानकारी को बनाए रखता है लेकिन बिना चाबी के इसे पढ़ना असंभव बना देता है। महत्वपूर्ण बात यह है कि यह संकुचन किरण स्थिर और सार्वजनिक है; यह गुप्त नहीं है, लेकिन यह कोई शॉर्टकट भी नहीं है।

3. गुप्त फ़िल्टर (हाइरार्किकल फीचर गेटिंग)
अब, फैक्ट्री को यह कंप्रेस्ड, स्कैम्बल किया हुआ कोड प्राप्त होता है। लेकिन रुकिए! कोड के अलग-अलग हिस्से हैं जिनकी अलग-अलग "आवाज़" (loudness) है (कुछ विवरण बहुत बड़े हैं, कुछ बहुत छोटे)। यदि फैक्ट्री उन्हें ज्यों का त्यों पढ़ती है, तो तेज़ हिस्से शांत और महत्वपूर्ण हिस्सों को दबा सकते हैं। गेको फैक्ट्री के गुप्त मस्तिष्क से ठीक पहले एक छोटा, निजी "वॉल्यूम नॉब" लेयर जोड़ता है। यह लेयर, जिसे हाइरार्किकल फीचर गेटिंग (HFG) कहा जाता है, चुपचाप प्रत्येक विवरण की आवाज़ को एडजस्ट करती है ताकि फैक्ट्री सब कुछ स्पष्ट रूप से सुन सके। यह हिस्सा सीखा गया है और गुप्त रखा गया है, यह सुनिश्चित करता है कि फैक्ट्री केवल सबसे तेज़ सिग्नल पर निर्भर न रहे।

4. अंतिम ताला (प्राइवेट प्रेडिक्टर)
केवल यह छोटा, एडजस्ट किया गया और स्कैम्बल किया हुआ कोड फैक्ट्री की गुप्त मशीन (प्राइवेट प्रेडिक्टर) में जाता है। फैक्ट्री अपना काम करती है, और परिणाम वापस भेजा जाता है। क्योंकि फैक्ट्री केवल स्कैम्बल किए गए, बहु-स्तरीय कोड को देखती है, इसलिए एक जासूस के लिए जो गुप्त रेसिपी चुराने की कोशिश कर रहा है, उसके लिए काम बहुत कठिन हो जाता है। वे केवल अंतिम चित्र को नहीं देख सकते; उन्हें पहले पहेलियों को अनस्कैम्बल करना सीखना होगा।

उन्होंने क्या पाया?

गेको टीम ने बिल्लियों और कुत्तों की तस्वीरों को पहचानने से लेकर ऑडियो फाइलों में आवाज़ों को पहचानने और यहाँ तक कि मेडिकल इमेज में बीमारियों का पता लगाने जैसे विभिन्न कार्यों पर इस विचार का परीक्षण किया।

  • गति: उन्होंने पाया कि गेको अविश्वसनीय रूप से तेज़ है। मिनटों के बजाय, पूरी प्रक्रिया में 0.4 और 2.2 सेकंड का समय लगता है। यह वास्तविक जीवन में उपयोग करने के लिए पर्याप्त तेज़ है!
  • डेटा का आकार: इधर-उधर भेजा जाने वाला डेटा बहुत कम है, अधिकतम 10.8 MB
  • सटीकता: स्कैम्बलिंग और संकुचन के बावजूद, गेको मानक, धीमी विधियों की तरह ही सही उत्तर पहचानने में सक्षम है। गति पाने के लिए इसने अपनी "बुद्धिमानी" का नुकसान नहीं किया।
  • सुरक्षा: यह सबसे बड़ी बात है। उन्होंने फैक्ट्री की गुप्त रेसिपी चुराने की कोशिश करने वाले चालाक जासूसों का अनुकरण किया। उन्होंने पाया कि भले ही जासूस को पता हो कि सार्वजनिक AI कैसे काम करता है और वह "शॉर्टकट" विधि का उपयोग करने की कोशिश करे, तो भी उन्हें चुराने में कोई आसानी नहीं होती। वास्तव में, सार्वजनिक हिस्सों का पुन: उपयोग करने की कोशिश ने जासूस के काम को पहले की तुलना में कठिन या पहले जैसा ही बना दिया। "फीचर-स्पेस शॉर्टकट" जो अन्य तरीकों ने बनाया था, उसे सफलतापूर्वक ब्लॉक कर दिया गया।

निष्कर्ष

यह पेपर सुझाव देता है कि गेको निजी AI को वास्तव में उपयोगी बनाने का एक आशाजनक तरीका है। यह साबित करता है कि आपको गति और सुरक्षा के बीच चुनाव करने की आवश्यकता नहीं है। यह सावधानीपूर्वक डिजाइन करके कि हम जानकारी कैसे साझा करते—सार्वजनिक हिस्से को समृद्ध लेकिन स्कैम्बल किया हुआ रखकर, और निजी हिस्से को छोटा और सुरक्षित रखकर—हम अपनी इच्छा पूरी कर सकते हैं।

हालाँकि, लेखक सावधानी बरतते हुए कहते हैं कि यह कोई जादुई छड़ी नहीं है जो हर समस्या को हल कर दे। उन्होंने इमेज और ऑडियो कार्यों के लिए विशिष्ट प्रकार के AI मॉडल (जैसे ResNet और MobileNet) का उपयोग करके इसका परीक्षण किया। वे स्वीकार करते हैं कि भविष्य के काम को यह देखने की आवश्यकता होगी कि क्या यह नए, अधिक जटिल AI मॉडल (जैसे जो कहानियाँ लिखते हैं या कला उत्पन्न करते हैं) पर काम करता है। लेकिन फिलहाल, गेको हमें एक स्पष्ट रास्ता दिखाता है: अपने रहस्यों को बताए बिना क्लाउड का उपयोग करने का एक तेज़, निजी और सुरक्षित तरीका।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →