← नवीनतम पेपर
💻 computer science

OTRO: Oblivious Tokenization Path with Square-Root ORAM

OTRO एक कुशल, ओब्लिवियस टोकेनाइजेशन सिस्टम है जिसे कॉन्फिडेंशियल LLM सर्विंग के लिए डिज़ाइन किया गया है जो एपोक-आधारित रोटेशन और चंक्ड KV-कैश-अवेयर ओवरलैप के साथ स्क्वायर-रूट ORAM इंस्टेंस के एक पूल का लाभ उठाकर मेमोरी एक्सेस पैटर्न्स से होने वाले साइड-चैनल लीक्स को कम करता है, जिससे नगण्य लेटेंसी ओवरहेड प्राप्त होता है और दृश्यमान लीकेज में महत्वपूर्ण रूप से कमी आती है।

मूल लेखक: Jonghyun Lee, Yongqin Wang, Rachit Rajat, Daniel Wong, Mengyuan Li, Murali Annavaram

प्रकाशित 2026-06-17
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Jonghyun Lee, Yongqin Wang, Rachit Rajat, Daniel Wong, Mengyuan Li, Murali Annavaram

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक अत्यधिक सुरक्षित, कांच की दीवारों वाले पोस्ट ऑफिस के माध्यम से अपने मित्र को एक गुप्त पत्र भेज रहे हैं। यह पोस्ट ऑफिस एक "ट्रस्टेड एक्ज़ीक्यूशन एनवायरनमेंट" (TEE) द्वारा चलाया जाता है, जो एक सुपर-सिक्योर वॉल्ट की तरह है जहाँ आपका पत्र एक सुरक्षित बॉक्स में बंद है जिसे कोई भी नहीं खोल सकता—यहाँ तक कि पोस्ट ऑफिस मैनेजर भी नहीं। वे इसके अंदर के शब्दों को नहीं पढ़ सकते।

समस्या: "टोकन" अनुवादक (The "Token" Translator)
आपके पत्र को प्रोसेस करने से पहले, इसे उस कोड में अनुवादित करना होगा जिसे कंप्यूटर समझ सके। यह काम एक टूल द्वारा किया जाता है जिसे टोकेनाइज़र (Tokenizer) कहते हैं। टोकेनाइज़र को एक ऐसे अनुवादक के रूप में सोचें जो आपके पत्र के हर शब्द को खोजने के लिए एक विशाल, निश्चित शब्दकोश (dictionary) का उपयोग करता है ताकि उसका गुप्त कोड नंबर मिल सके।

दिक्कत यह है कि भले ही शब्द सुरक्षित बॉक्स के अंदर बंद हों, लेकिन अनुवादक की उंगलियों की हरकत का पैटर्न दिखाई देता है।

  • यदि आप "The cat" लिखते हैं, तो अनुवादक "The" को देखता है, फिर "cat" को।
  • यदि आप "The dog" लिखते हैं, तो वह "The" को देखता है, फिर "dog" को।

एक चालाक जासूस (जैसे कि एक दुर्भावनापूर्ण क्लाउड सर्वर एडमिन) जो अनुवादक की उंगलियों की हलचल को देख रहा है, वह देख सकता है कि शब्दकोश के कौन से पन्ने पलटे जा रहे हैं। इन "लुकअप्स" (lookups) के क्रम और आवृत्ति को देखकर, वह आपके मूल पत्र को फिर से बना सकता है, भले ही उसने कभी शब्द न देखे हों। इसे साइड-चैनल अटैक (side-channel attack) कहा जाता है।

पुराना समाधान: "पाथओराम" शफल (The "PathORAM" Shuffle)
जासूस को रोकने के लिए, शोधकर्ताओं ने पहले PathORAM नामक एक विधि का उपयोग करने की कोशिश की थी। कल्पना कीजिए कि यह एक जादुई पुस्तकालय है जहाँ, हर बार जब आप एक किताब मांगते हैं, तो लाइब्रेरियन केवल उसे लाता ही नहीं; बल्कि वह पूरे पुस्तकालय की हर एक किताब को एक नई यादृच्छिक (random) जगह पर खिसका देता है। इससे यह पता लगाना असंभव हो जाता है कि आपने वास्तव में कौन सी किताब मांगी थी।

  • परिणाम: यह सुरक्षा के लिए पूरी तरह से काम करता है, लेकिन यह अविश्वसनीय रूप से धीमा है। यह ऐसा है जैसे आप एक किताब मांगें और आपको तब तक इंतजार करना पड़े जब तक लाइब्रेरियन पूरी इमारत को फिर से व्यवस्थित नहीं कर देता। इस पेपर में, इसने सिस्टम को 13 गुना धीमा कर दिया, जिससे एआई (AI) के आपसे बात करना शुरू करने से पहले ही एक बहुत बड़ा विलंब (delay) हो गया।

नया समाधान: OTRO (एक "रोटेटिंग लाइब्रेरी" सिस्टम)
इस पेपर के लेखकों ने बनाया है OTRO, उन्होंने महसूस किया कि जिस शब्दकोश का अनुवादक उपयोग करता है वह कभी बदलता नहीं है। शब्द हमेशा वही रहते हैं; केवल वह क्रम बदलता है जिसे जासूस देखता है।

उन्होंने तीन चतुर तरीकों का उपयोग करके एक स्मार्ट सिस्टम बनाया है:

  1. समान पुस्तकालयों का पूल (The Pool of Identical Libraries): एक ऐसे पुस्तकालय के बजाय जिसे लगातार शफल किया जाता है, OTRO समान पुस्तकालयों का एक पूल बनाता है। कल्पना कीजिए कि आपके पास एक ही शब्दकोश की 50 प्रतियां हैं।
  2. "शिफ्ट" प्रणाली (The "Shift" System): जब अनुवादक को शब्दों को खोजने की आवश्यकता होती है, तो वह लाइब्रेरी #1 का उपयोग करता है। एक बार जब लाइब्रेरी #1 का एक निश्चित संख्या में बार (मान लीजिए, 1,000 लुकअप) उपयोग हो जाता है, तो अनुवादक चुपचाप लाइब्रेरी #2 पर स्विच कर जाता है।
    • जादू: जब अनुवादक लाइब्रेरी #2 का उपयोग करने में व्यस्त होता है, तब एक बैकग्राउंड वर्कर साये में चुपचाप और धीरे-धीरे लाइब्रेरी #1 को पुनर्गठित (reorganizing) कर रहा होता है। क्योंकि वर्कर अगले पुस्तकालय के साथ व्यस्त होने के दौरान यह काम कर रहा है, इसलिए पुनर्गठन कभी भी अनुवादक को धीमा नहीं करता है।
  3. पत्र का विभाजन (Chunking the Letter): बहुत लंबे पत्रों के लिए, OTRO पत्र को छोटे टुकड़ों (chunks) में तोड़ देता है। यह पहले टुकड़े का अनुवाद तब करता है जब GPU (एआई का मस्तिष्क) पहले से ही उस पर सोचना शुरू कर देता है। यह "पुनर्गठित करने" के काम को मुख्य प्रक्रिया को रोके बिना बैकग्राउंड में होने की अनुमति देता है।

परिणाम

  • गति (Speed): क्योंकि भारी "पुनर्गठित करने" का काम बैकग्राउंड में होता है, इसलिए सिस्टम मूल, असुरक्षित संस्करण के लगभग उतना ही तेज़ है। पेपर दिखाता है कि यह इसे केवल लगभग 4.5% धीमा करता है, जो कि मुश्किल से पता चलता है।
  • सुरक्षा (Security): जासूस अब यह नहीं देख सकता कि कौन से विशिष्ट शब्दों को खोजा गया था। वह केवल इतना देख सकता है कि "एक लुकअप हुआ।" जासूस केवल यह अनुमान लगा सकता है कि आपका पत्र कितना लंबा था (क्योंकि लंबे पत्रों के लिए अधिक लुकअप की आवश्यकता होती है), लेकिन वह यह अनुमान नहीं लगा सकता कि आपके पत्र में क्या लिखा था।
  • मेमोरी (Memory): यह थोड़ी अधिक मेमोरी का उपयोग करता है (प्रति उपयोगकर्ता आधा गीगाबाइट से भी कम), जो आपके रहस्यों को सुरक्षित रखने के लिए एक छोटी सी कीमत है।

सारांश में
OTRO एक ऐसी टीम को काम पर रखने जैसा है जो शिफ्ट बदलती रहती है। जबकि एक अनुवादक काम कर रहा होता है, दूसरा बैकग्राउंड में चुपचाप किताबें खिसका रहा होता है। इस तरह, दरवाजे पर नजर रखने वाला जासूस यह नहीं बता सकता कि कौन सी किताब चुनी गई थी, लेकिन काम लगभग तुरंत हो जाता है। यह सुरक्षा की समस्या को, जिसने पहले सिस्टम को 13 गुना धीमा कर दिया था, एक ऐसे समाधान में बदल देता है जो लगभग तत्काल है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →