← नवीनतम पेपर
🤖 machine learning

Locket: Robust Feature-Locking Technique for Language Models

यह शोध पत्र Locket को प्रस्तुत करता है, जो एक सुदृढ़ और स्केलेबल फीचर-लॉकिंग तकनीक है जो एडवर्सियल ट्रेनिंग (adversarial training) और अडैप्टर मर्जिंग (adapter merging) का उपयोग करके भाषा मॉडलों के लिए 'पे-टू-अनलॉक' (pay-to-unlock) योजनाओं को प्रभावी ढंग से सक्षम बनाती है, जिससे समग्र उपयोगिता को बनाए रखते हुए विशिष्ट क्षमताओं को चुनिंदा रूप से अक्षम किया जा सकता है और इवेजन हमलों (evasion attacks) का प्रतिरोध किया जा सकता है।

मूल लेखक: Lipeng He, Vasisht Duddu, N. Asokan

प्रकाशित 2026-03-27
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Lipeng He, Vasisht Duddu, N. Asokan

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक हाई-टेक कॉफी शॉप में कदम रखते हैं। इस दुकान में, मालिक (AI प्रदाता) के पास एक जादुई एस्प्रेसो मशीन है जो सब कुछ कर सकती है: कॉफी बनाना, केक बेक करना, आपकी कार ठीक करना और यहाँ तक कि आपके टैक्स भी लिख सकती है।

समस्या: "सब-या-कुछ-नहीं" वाला मेनू (The "All-or-Nothing" Menu)
अभी, अधिकांश AI कंपनियाँ (जैसे OpenAI) इस दुकान को एक सख्त क्लब की तरह चलाती हैं।

  • फ्री यूजर्स: उन्हें इंस्टेंट कॉफी मिलती है (बेसिक AI)।
  • पेड सब्सक्राइबर्स: उन्हें फैंसी एस्प्रेसो मशीन मिलती है जो केक बना सकती है और कारें ठीक कर सकती है (एडवांस AI)।

समस्या यह है कि यह बिजनेस के लिए बुरा है। मालिक फैंसी मशीनों के कारण पैसा खो रहा है क्योंकि उसे उन लोगों के लिए एक पूरी नई, महंगी मशीन बनानी पड़ती है जो सिर्फ केक बेक करना चाहते हैं। यह यूजर्स के लिए भी परेशान करने वाला है जो सिर्फ एक केक चाहते हैं लेकिन उन्हें कार ठीक करने वाले फीचर की जरूरत नहीं है।

समाधान: "पे-टू-अनलॉक" मेनू (The "Pay-to-Unlock" Menu)
इस पेपर के लेखक, LOCKET, एक बेहतर विचार प्रस्तावित करते हैं: पे-टू-अनलॉक
कल्पना कीजिए कि यदि आप सिर्फ "केक बेकिंग" का अपग्रेड खरीद सकते, या सिर्फ "टैक्स राइटिंग" का अपग्रेड खरीद सकते, जबकि बुनियादी कॉफी मशीन को मुफ्त में चलते रहने दे सकते हैं।

लेकिन एक पेच है: आप कैसे रोकेंगे कि लोग अपने "केक बेकिंग" की चाबी अपने उन दोस्तों के साथ साझा न करें जिन्होंने भुगतान नहीं किया है? या आप हैकर्स को मशीन को धोखा देने से कैसे रोकेंगे ताकि वे भुगतान किए बिना भी केक बेक कर सकें?

पुराना तरीका: पासवर्ड का जाल (The Old Way: The Password Trap)
पिछले प्रयासों को इस तरह हल करने की कोशिश की गई जैसे मशीन को एक पासवर्ड दिया गया हो।

  • यह कैसे काम करता था: "यदि आप 'SecretWord123' टाइप करते हैं, तो मैं केक बनाऊँगा।"
  • यह क्यों विफल हुआ:
    1. साझा करना (Sharing): एक बार जब आप अपने दोस्त को पासवर्ड बता देते हैं, तो वह भी उसका उपयोग कर सकता है।
    2. हैकिंग (Hacking): हैकर्स पासवर्ड का अनुमान लगा सकते हैं या मशीन को यह समझाने की कोशिश कर सकते हैं कि वह पासवर्ड को अनदेखा कर दे।
    3. बिखरना (Breakage): जब आपने दूसरा पासवर्ड (जैसे "टैक्स राइटिंग" के लिए) जोड़ने की कोशिश की, तो मशीन अक्सर भ्रमित हो जाती थी और ठीक से केक बनाना या कार ठीक करना बंद कर देती थी। यह ऐसा था जैसे एक साथ दो अलग-अलग चश्मे पहनने की कोशिश करना; सब कुछ धुंधला हो जाता था।

नया तरीका: LOCKET (जादुई एप्रन/Apron)
LOCKET एक नई तकनीक है जो कॉफी मशीन के लिए एक स्मार्ट, जादुई एप्रन की तरह काम करती है।

यह कैसे काम करता है, स्टेप-बाय-स्टेप:

1. जमी हुई मशीन (द बेस मॉडल - The Frozen Machine)

मुख्य मशीन (AI) बिल्कुल वैसी ही रहती है। जब भी कोई भुगतान करता है, तो इसे फिर से लिखा या री-ट्रेन नहीं किया जाता है। यह ऐसा है जैसे एस्प्रेसो मशीन फर्श से जुड़ी हुई है और कभी नहीं बदलती।

2. एडैप्टर्स (एप्रन - The Adapters)

मशीन को बदलने के बजाय, LOCKET छोटे, हटाने योग्य "एप्रन" (जिन्हें एडैप्टर्स कहा जाता है) बनाता है।

  • यदि आप "केक बेकिंग" फीचर को लॉक करना चाहते हैं (क्योंकि आपने भुगतान नहीं किया है), तो सिस्टम एक "नो बेकिंग" एप्रन पहना देता है।
  • यदि आपने भुगतान किया है, तो सिस्टम उस एप्रन को उतार देता है।
  • महत्वपूर्ण बात यह है कि ये एप्रन बहुत छोटे और हल्के होते हैं। आप बिना मशीन को धीमा किए 10 अलग-अलग फीचर्स के लिए 10 अलग-अलग एप्रन रख सकते हैं।

3. "रिफ्यूज़ल" ट्रेनिंग (एप्रन को सिखाना - The "Refusal" Training)

एप्रन को कैसे पता चलता है कि "ना" कैसे कहना है?
शोधकर्ताओं ने इन एप्रन को एक विशेष तकनीक का उपयोग करके प्रशिक्षित किया जिसे लेटेंट एडवरसैरियल ट्रेनिंग (Latent Adversarial Training) कहा जाता है।

  • कल्पना कीजिए कि आप एक क्लब के बाउंसर को सिखा रहे हैं। आप उसे सिर्फ यह नहीं कहते कि "लोगों को अंदर मत जाने दो।" बल्कि आप उसे हजारों ऐसे परिदृश्य दिखाते हैं जहाँ लोग अंदर घुसने की कोशिश करते हैं (जेलब्रेक्स) और उसे दृढ़ता से "ना" कहना सिखाते हैं, भले ही वे फर्जी आईडी या किसी मजेदार कहानी के साथ उसे धोखा देने की कोशिश करें।
  • एप्रन यह सीख जाता है कि, "क्षमा करें, आप इस केक को बनाने के लिए अधिकृत नहीं हैं," और यह इतना मजबूती से "ना" कहना सीख जाता है कि कोई भी चतुर हैकर इसे चकमा नहीं दे सकता।

4. मर्जिंग मैजिक (स्पेक्ट्रल नॉर्म क्लिप - The Merging Magic)

यह सबसे रचनात्मक हिस्सा है।
जब आप एक साथ दो एप्रन पहनने की कोशिश करते हैं (जैसे, "नो बेकिंग" और "नो कार फिक्सिंग"), तो आमतौर पर वे आपस में टकराते हैं। एक एप्रन गलती से कॉफी के नोजल को ढक सकता है, जिससे सभी के लिए कॉफी खराब हो सकती है।

  • पुराना तरीका: एप्रन आपस में लड़ते थे, और मशीन सभी के लिए काम करना बंद कर देती थी (इसे "ओवर-रिफ्यूज़ल" कहा जाता है)।
  • LOCKET का तरीका: शोधकर्ताओं ने एक "साइज-लिमिटिंग" नियम का आविष्कार किया। एप्रन को मशीन पर लगाने से पहले, वे उन्हें मापते हैं। यदि संयुक्त एप्रन बहुत बड़े या भारी हो जाते हैं (जिससे मशीन में गड़बड़ी आती है), तो वे उन्हें धीरे से सही आकार तक सिकोड़ देते हैं।
  • परिणाम: मशीन भुगतान किए गए फीचर्स के लिए बिल्कुल सही तरीके से "ना" कहती है, लेकिन बाकी चीजों के लिए अभी भी बेहतरीन कॉफी बनाती रहती है। यह एक टेलर्ड सूट पहनने जैसा है जो केवल उन्हीं विशिष्ट तरीकों में आपकी गति को रोकता है जिनकी आवश्यकता है, बिना आपको गिराए।

यह बड़ी बात क्यों है?

  • शेयर करने के लिए कोई पासवर्ड नहीं: आपको किसी गुप्त कोड की आवश्यकता नहीं है। सिस्टम आपके "सब्सक्रिप्शन प्रोफाइल" (जैसे डिजिटल आईडी) की जांच करता है और मशीन पर सही एप्रन स्वचालित रूप से लगा देता है।
  • सुपर सिक्योर: भले ही कोई हैकर चतुर प्रॉम्प्ट के साथ मशीन को धोखा देने की कोशिश करे, एप्रन अडिग रहता है। परीक्षणों में, इसने 100% अनधिकृत प्रयासों को रोका।
  • क्वालिटी बनी रहती है: पुराने तरीकों के विपरीत, जिन्होंने फीचर्स को लॉक करने पर AI को "मंद" बना दिया था, LOCKET बाकी सब चीजों के लिए AI को स्मार्ट बनाए रखता है। "कॉफी" का स्वाद अभी भी लाजवाब रहता है।
  • स्केलेबल (Scalable): आप मशीन को खराब किए बिना 10, 20, या यहाँ तक कि 50 अलग-अलग "ना" वाले एप्रन जोड़ सकते हैं।

सारांश में
LOCKET AI के लिए एक स्मार्ट, मॉड्यूलर सुरक्षा प्रणाली की तरह है। हर फीचर के लिए एक नया, महंगा किला बनाने के बजाय, यह बस उन विशिष्ट चीजों के चारों ओर एक अस्थायी, अटूट घेरा बना देता है जिनके लिए लोगों ने भुगतान नहीं किया है, जबकि बाकी बगीचे को सभी के लिए खुला और सुंदर छोड़ देता है। यह "पे-टू-अनलॉक" के सपने को हकीकत बनाता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →