← नवीनतम पेपर
💬 NLP

Knowledge Beyond Language: Bridging the Gap in Multilingual Machine Unlearning Evaluation

यह शोध पत्र दो नए मेट्रिक्स, नॉलेज सेपेरेबिलिटी स्कोर (KSS) और नॉलेज पर्सिस्टेंस स्कोर (KPS) का प्रस्ताव देकर मौजूदा मल्टीलिंगुअल मशीन अनलर्निंग (MMU) मूल्यांकनों की सीमाओं को संबोधित करता है, ताकि क्रॉस-लिंग्विस्टिक सूचना निष्कासन का बेहतर आकलन किया जा सके और MMU घटनाओं में गहरी अंतर्दृष्टि प्रदान की जा सके।

मूल लेखक: Kyomin Hwang, Hyeonjin Kim, Sangyeon Cho, Nojun Kwak

प्रकाशित 2026-05-15
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Kyomin Hwang, Hyeonjin Kim, Sangyeon Cho, Nojun Kwak

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

यहाँ "Knowledge Beyond Language: Bridging the Gap in Multilingual Machine Unlearning Evaluation" पेपर का सरल भाषा और रचनात्मक उपमाओं (analogies) के साथ विवरण दिया गया है।

बड़ी समस्या: "इको चैंबर" (Echo Chamber) प्रभाव

कल्पना कीजिए कि आपके पास एक बहुत ही बुद्धिमान, बहुभाषी लाइब्रेरियन (AI) है जिसने अंग्रेजी, स्पेनिश, चीनी और कई अन्य भाषाओं में लाखों किताबें पढ़ी हैं। एक दिन, आपको एहसास होता है कि लाइब्रेरियन ने "वेरोनिका बॉमन" नामक एक विशिष्ट व्यक्ति के बारे में एक गुप्त बात याद कर ली है, और गोपनीयता कारणों से आप चाहते हैं कि वह इस रहस्य को अपने दिमाग से मिटा दे।

अतीत में, शोधकर्ताओं ने लाइब्रेरियन को यह गुप्त बात भुलाने के लिए केवल अंग्रेजी में बात करने की कोशिश की। वे कहते, "वेरोनिका बॉमन के बारे में सब कुछ भूल जाओ।"

पेंच (The Catch): यह पेपर तर्क देता है कि यह दृष्टिकोण अंग्रेजी कोने को पोंछकर कमरे को साफ करने जैसा है। क्योंकि लाइब्रेरियन ने वह रहस्य कई भाषाओं में सीखा था, इसलिए वह जानकारी एक अफवाह की तरह "फैल" सकती थी। भले ही लाइब्रेरियन अंग्रेजी में उस रहस्य को भूल जाए, लेकिन यदि आप उससे स्पेनिश या स्वाहिली में पूछें, तो उसे वह अभी भी अच्छी तरह से याद हो सकता है। वह रहस्य लाइब्रेरियन के मस्तिष्क के भीतर अन्य भाषाओं में "सीमा पार" कर गया है।

परीक्षण करने का पुराना तरीका (दोषपूर्ण दर्पण)

पहले, यह जांचने के लिए कि क्या लाइब्रेरियन ने रहस्य को भुला दिया है, शोधकर्ता एक समय में एक भाषा में प्रश्न पूछते थे।

  • अंग्रेजी में पूछें: "क्या तुम वेरोनिका को जानते हो?" -> लाइब्रेरियन: "नहीं।" (सफलता!)
  • स्पेनिश में पूछें: "क्या तुम वेरोनिका को जानते हो?" -> लाइब्रेरियन: "हाँ।" (विफलता!)

पुराना तरीका केवल अंग्रेजी उत्तर को देखता और घोषित कर देता, "बहुत बढ़िया, रहस्य चला गया!" यह पेपर कहता है कि यह भ्रामक है। यह एक लीक होती नाव को केवल उसके अगले डेक को देखकर यह जाँचने जैसा है कि क्या नाव सूखी है, जबकि पिछला हिस्सा अभी भी जलमग्न है।

नया समाधान: दो नए "थर्मामीटर"

इसे ठीक करने के लिए, लेखकों ने लाइब्रेरियन का परीक्षण करने का एक नया तरीका और दो नए "थर्मामीटर" (metrics) बनाए ताकि यह मापा जा सके कि सभी भाषाओं में विस्मरण (forgetting) कितनी अच्छी तरह काम कर रहा है।

1. "नॉलेज सेपरेबिलिटी स्कोर" (KSS - ज्ञान पृथक्करण स्कोर)

उपमा: कल्पना कीजिए कि आपके पास लाल मार्बल्स (वह रहस्य जिसे आप भुलाना चाहते हैं) और नीले मार्बल्स (सुरक्षित जानकारी जिसे आप रखना चाहते हैं) का एक बैग है।

  • लक्ष्य: आप चाहते हैं कि लाइब्रेरियन लाल मार्बल्स को नीले मार्बल्स से पूरी तरह अलग कर सके।
  • KSS क्या मापता है: यह जाँचता है कि क्या लाइब्रेरियन सभी भाषाओं में एक साथ "भूलने वाली चीजों" और "रखने वाली चीजों" के बीच स्पष्ट अंतर कर सकता है। यदि लाइब्रेरियन भ्रमित हो जाता है और सोचता है कि कुछ नीले मार्बल्स लाल हैं (सुरक्षित जानकारी भूल जाना) या कुछ लाल मार्बल्स नीले हैं (रहस्य को रखना), तो स्कोर कम हो जाता है।
  • पेपर का निष्कर्ष: उन्होंने पाया कि कुछ तरीके (जैसे "प्रूनिंग", जो लाइब्रेरियन के मस्तिष्क के कुछ हिस्सों को काटने जैसा है) सामान्य रूप से मार्बल्स को अलग करने में अच्छे थे, लेकिन वे अव्यवस्थित थे और गलती से कुछ सुरक्षित नीले मार्बल्स को भी फेंक रहे थे।

2. "नॉलेज पर्सिस्टेंस स्कोर" (KPS - ज्ञान निरंतरता स्कोर)

उपमा: यह "अफवाह परीक्षण" (Rumor Test) है।

  • परिदृश्य: आप लाइब्रेरियन को अंग्रेजी में रहस्य भूलने के लिए कहते हैं।
  • परीक्षण: फिर आप लाइब्रेरियन से ऐसी भाषा में पूछते हैं जिसका उपयोग उसने रहस्य सीखने के लिए नहीं किया था ("होल्ड-आउट" भाषा)।
  • KPS क्या मापता है: यह मापता है कि वह रहस्य उस नई भाषा में कितना "बना रहा" (persist) या लीक हुआ। यदि लाइब्रेरियन को उस नई भाषा में भी रहस्य पता है, तो स्कोर उच्च है (जो कि बुरा है)। यदि वह वास्तव में हर जगह भूल गया है, तो स्कोर कम है (जो कि अच्छा है)।
  • पेपर का निष्कर्ष: उन्होंने पाया कि भले ही लाइब्रेरियन प्रशिक्षण भाषाओं में रहस्य को भूल गया हो, लेकिन वह रहस्य अक्सर अन्य भाषाओं में "बना रहता" है। रहस्य भाषा की सीमाओं के पार यात्रा कर गया था और वहां छिपा हुआ था।

उन्होंने प्रयोग कैसे किया

इसे सिद्ध करने के लिए, लेखकों ने वास्तविक लोगों के रहस्यों का उपयोग नहीं किया (जो अनैतिक होगा)। इसके बजाय, उन्होंने एक विशाल, नकली लाइब्रेरी बनाई:

  1. 200 काल्पनिक लोग बनाए: उन्होंने 200 काल्पनिक पात्रों के नाम, जन्मदिन और शौक के साथ बनाया।
  2. सब कुछ अनुवादित किया: उन्होंने इन काल्पनिक लोगों के बारे में प्रश्न और उत्तर 10 अलग-अलग भाषाओं (बड़ी भाषाओं जैसे अंग्रेजी और चीनी से लेकर अल्बानियाई और बंगाली जैसी छोटी भाषाओं तक) में लिखे।
  3. "भूलने का खेल": उन्होंने इस नकली डेटा पर एक AI को प्रशिक्षित किया, फिर विभिन्न तकनीकों का उपयोग करके विशिष्ट लोगों को भुलाने की कोशिश की।
  4. परीक्षण: उन्होंने यह देखने के लिए अपने दो नए थर्मामीटर (KSS और KPS) का उपयोग किया कि क्या AI ने 10 में से सभी भाषाओं में उन काल्पनिक लोगों को वास्तव में भुला दिया है।

मुख्य निष्कर्ष

  1. भाषा अलग-थलग नहीं है: AI में जानकारी एक भाषा तक सीमित नहीं रहती। यदि आप किसी AI को अंग्रेजी में एक रहस्य सिखाते हैं, तो वह अक्सर इसे स्पेनिश, फ्रेंच और अन्य भाषाओं में भी स्वतः सीख लेता है।
  2. पुराने परीक्षण हमें झूठ बोल रहे हैं: यह जाँचने के लिए कि क्या एक AI कुछ भूल गया है, केवल एक भाषा में जाँच करना पर्याप्त नहीं है। यह सुनिश्चित करने के लिए कि रहस्य वास्तव में चला गया है, आपको सभी भाषाओं की जाँच करनी होगी।
  3. "होल्ड-आउट" का खतरा: पेपर ने पाया कि रहस्य अक्सर उन भाषाओं में छिपे रहते हैं जिनका उपयोग AI को स्पष्ट रूप से भूलने के लिए प्रशिक्षित नहीं किया गया था। भले ही आप अंग्रेजी में स्मृति को साफ कर दें, उस रहस्य की "गूँज" (echo) अभी भी अन्य भाषाओं में सुनी जा सकती है।

निष्कर्ष

पेपर निष्कर्ष निकालता है कि हमें भाषाओं को अलग-अलग कमरों के रूप में देखना बंद करना चाहिए और उन्हें एक बड़े, जुड़े हुए घर के रूप में देखना शुरू करना चाहिए। AI में गोपनीयता की वास्तव में रक्षा करने के लिए, हमें नए उपकरणों (जैसे KSS और KPS) की आवश्यकता है जो पूरे घर की जाँच करें, न कि केवल एक कमरे की, ताकि यह सुनिश्चित हो सके कि रहस्य वास्तव में चला गया है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →