← नवीनतम पेपर
💬 NLP

PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing

यह शोध पत्र PATCH को प्रस्तुत करता है, जो एक नवीन विधि है जो भाषा मॉडल में व्यक्तिगत रूप से पहचान योग्य जानकारी (PII) के रिसाव के लिए जिम्मेदार विशिष्ट कम्प्यूटेशनल सर्किट की पहचान करती है और उन्हें सीधे संपादित करती है, जिससे मौजूदा सुरक्षा प्रणालियों की तुलना में डिफरेंशियल प्राइवेसी के साथ मिलकर काफी बेहतर प्राइवेसी-यूटिलिटी ट्रेड-ऑफ और लगभग शून्य अवशिष्ट रिसाव प्राप्त होता है।

मूल लेखक: Anthony Hughes, Vasisht Duddu, N. Asokan, Nikolaos Aletras, Ning Ma

प्रकाशित 2026-02-27
📖 4 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Anthony Hughes, Vasisht Duddu, N. Asokan, Nikolaos Aletras, Ning Ma

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपके पास एक बहुत ही बुद्धिमान, विद्वान लाइब्रेरियन (भाषा मॉडल) है जिसने लाखों किताबें याद कर रखी हैं। समस्या यह है कि उनमें से कुछ किताबों में लोगों के निजी रहस्य हैं: उनके घर के पते, फोन नंबर और पूरे नाम।

यदि आप लाइब्रेरियन से सही सवाल पूछते हैं, तो वे अनजाने में ये रहस्य उगल सकते हैं। इसे PII लीकेज (व्यक्तिगत पहचान योग्य जानकारी का रिसाव) कहा जाता है।

इसे ठीक करने के पुराने तरीके

पहले, लोगों ने लाइब्रेरियन को रहस्य बताने से रोकने के लिए दो मुख्य तरीकों का उपयोग किया था, लेकिन दोनों में बड़ी समस्याएं थीं:

  1. "स्क्रबर" (डेटा की सफाई): लाइब्रेरियन को किताबें देने से पहले, कोई व्यक्ति हर उस पन्ने को निकाल देता है जिसमें कोई नाम या पता हो।
    • समस्या: यह महंगा और समय लेने वाला है, और अक्सर इससे लाइब्रेरियन भ्रमित हो जाता है क्योंकि वह महत्वपूर्ण संदर्भ (context) खो देता है।
  2. "स्टैटिक नॉइज़" (डिफरेंशियल प्राइवेसी): आप लाइब्रेरियन को सिखाते समय बैकग्राउंड में तेज़ 'स्टैटिक नॉइज़' (शोर) बजाते हैं। यह उन्हें विशिष्ट विवरण याद रखने में कठिन बनाता है।
    • समस्या: लाइब्रेरियन थोड़ा "धुंधला" हो जाता है। वे रहस्य तो भूल जाते हैं, लेकिन वे अच्छी कहानियाँ लिखना या सरल सवालों के जवाब देना भी भूल जाते हैं। उनका प्रदर्शन काफी गिर जाता है।

नया समाधान: PATCH

इस शोध पत्र के लेखक एक नया तरीका प्रस्तावित करते हैं जिसे PATCH (प्राइवेसी-अवेयर टार्गेटेड सर्किट पैचिंग) कहा जाता है।

लाइब्रेरियन के मस्तिष्क को एक विशाल, बिखरे हुए नोट्स के ढेर के रूप में नहीं, बल्कि एक जटिल सड़कों और ट्रैफिक लाइटों के शहर (यह "सर्किट" है) के रूप में सोचें।

  • खोज: शोधकर्ताओं ने एक विशेष उपकरण (एक हाई-टेक ट्रैफिक कैमरे की तरह) का उपयोग किया जिससे उन्होंने देखा कि जब लाइब्रेरियन कोई रहस्य बताने वाला होता है, तो कौन सी सटीक सड़कें और लाइटें उपयोग की जाती हैं। उन्होंने पाया कि लाइब्रेरियन किसी रहस्य को याद करने के लिए सभी सड़कों का उपयोग नहीं करता है; वे केवल विशिष्ट, छोटे "सीक्रेट हाईवे" (गुप्त राजमार्गों) का उपयोग करते हैं।
  • द पैच (पैच लगाना): पूरे शहर को बंद करने के बजाय (जो लाइब्रेरियन की सोचने की क्षमता को बर्बाद कर देता है) या हर किताब को साफ करने के बजाय, वे बस उन विशिष्ट गुप्त राजमार्गों पर एक "रास्ता बंद है" का साइन बोर्ड लगा देते हैं।

यह कैसे काम करता है (चरण-दर-चरण)

  1. गुप्त सड़कों का मानचित्र बनाना: वे लाइब्रेरियन से नाम, स्थान और नस्ल के बारे में सवाल पूछते हैं। वे मस्तिष्क को देखते हैं कि जब लाइब्रेरियन कोई रहस्य प्रकट करने वाला होता है, तो कौन से विशिष्ट "ट्रैफिक लाइट" (न्यूरॉन्स) जल उठते हैं।
  2. सामान्य पथों को खोजना: उन्होंने देखा कि चाहे रहस्य कोई नाम हो या स्थान, लाइब्रेरियन अक्सर वहां तक पहुँचने के लिए उन्हीं कुछ सड़कों का उपयोग करता है।
  3. सड़कों को रोकना: वे उन विशिष्ट सड़कों को "पैच" (संपादित) करते हैं। वे या तो सड़क का वजन शून्य कर देते हैं (उसे पूरी तरह से बंद कर देते हैं) या उसे औसत बना देते हैं (उसे एक धीमी, डेड-एंड सड़क बना देते हैं)।
  4. परिणाम: लाइब्रेरियन अब जानकारी लीक करने के लिए "सीक्रेट हाईवे" पर नहीं जा सकता, लेकिन वे अभी भी शानदार कहानियाँ सुनाने और सामान्य रूप से सवालों के जवाब देने के लिए अन्य सभी सड़कों का उपयोग कर सकते हैं।

यह बेहतर क्यों है?

  • सटीकता: यह घर में एक एकल लीकी पाइप (रिसाव करने वाला पाइप) को हटाने जैसा है, न कि पूरे घर को ठीक करने के लिए उसे बाढ़ में डुबोने जैसा।
  • प्रदर्शन: क्योंकि वे केवल विशिष्ट "लीक" वाली सड़कों को ब्लॉक करते हैं, इसलिए लाइब्रेरियन तेज और बुद्धिमान बना रहता है। शोध पत्र दिखाता है कि PATCH गुप्त रिसाव को 65% तक कम कर देता है जबकि लाइब्रेरियन की बुद्धिमत्ता लगभग समान रहती है।
  • अल्टीमेट कॉम्बो: यदि आप PATCH को पुराने "स्टैटिक नॉइज़" तरीके के साथ मिलाते हैं, तो आप लीकेज दर को लगभग शून्य (0.01%) तक ला सकते हैं, बिना लाइब्रेरियन की काम करने की क्षमता को नष्ट किए।

चुनौती

शोधकर्ता स्वीकार करते हैं कि यह माइक्रो-सर्जरी करने जैसा है। सड़कों का मानचित्र बनाने के लिए बहुत अधिक कंप्यूटिंग पावर की आवश्यकता होती है, और उन्होंने अभी तक सबसे बड़े "लाइब्रेरी" (विशाल AI मॉडल) पर इसका परीक्षण नहीं किया है क्योंकि इसमें बहुत अधिक समय और ऊर्जा लगती है। लेकिन फिलहाल, यह गोपनीयता की रक्षा करने का पुराने तरीकों की तुलना में बहुत अधिक स्मार्ट और कम विनाशकारी तरीका है।

संक्षेप में: लाइब्रेरियन को रहस्य सुरक्षित रखने के लिए अंधा बनाने के बजाय, PATCH बस उस रास्ते पर "प्रवेश निषेध" का साइन बोर्ड लगा देता है जिसका उपयोग लाइब्रेरियन उन्हें प्रकट करने के लिए करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →