← नवीनतम पेपर
🤖 AI

Selective Fine-Tuning for Targeted and Robust Concept Unlearning

TRUST (टारगेटेड रोबस्ट सिलेक्टिव फाइन ट्यूनिंग) एक नवीन दृष्टिकोण है जो डायनेमिक न्यूरॉन लोकलाइजेशन और हेसियन-आधारित रेगुलराइजेशन का उपयोग करके टेक्स्ट-गाइडेड डिफ्यूजन मॉडल्स में विशिष्ट अवधारणाओं और उनके संयोजनों को लक्षित करता है, जिससे पूर्ण फाइन-ट्यूनिंग की कम्प्यूटेशनल लागत के बिना कुशल और रोबस्ट कॉन्सेप्ट अनलर्निंग सक्षम होती है।

मूल लेखक: Mansi, Avinash Kori, Francesca Toni, Soteris Demetriou

प्रकाशित 2026-02-10
📖 4 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Mansi, Avinash Kori, Francesca Toni, Soteris Demetriou

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपके कंप्यूटर के भीतर एक अत्यंत प्रतिभाशाली, विश्व स्तरीय कलाकार रहता है। इस कलाकार ने अब तक बनी हर पेंटिंग, फोटो और ड्राइंग देखी है। आप उनसे "टक्सीडो पहने हुए एक बिल्ली" बनाने के लिए कह सकते हैं, और वे इसे तुरंत कर देंगे।

हालाँकि, एक समस्या है: क्योंकि इस कलाकार ने सब कुछ देखा है, इसलिए वह खतरनाक, बुरे या अनुपयुक्त चीजें भी बनाना जानता है। यदि कोई कुछ हानिकारक बनाने के लिए कहता है, तो कलाकार—एक पेशेवर होने के नाते—उसे बनाने की कोशिश करेगा।

इस शोध पत्र को लिखने वाले शोधकर्ताओं ने TRUST नामक एक टूल बनाया है। TRUST को इस डिजिटल कलाकार के लिए एक "सटीक स्मृति विलोपन उपकरण" (Precision Memory Eraser) के रूप में समझें।

यह कैसे काम करता है, इसे तीन सरल विचारों के माध्यम से समझाया गया है:

1. "स्मार्ट हाइलाइटर" (डायनेमिक लोकलाइजेशन)

अतीत में, यदि आप चाहते थे कि कलाकार "जहरीले मशरूम" बनाना बंद कर दे, तो आप शायद उन्हें ब्रेन ट्रांसप्लांट देने या उनकी पूरी नियम पुस्तिका को फिर से लिखने की कोशिश करते। यह धीमा, महंगा था, और अक्सर कलाकार को अन्य चीजें बनाना भुला देता था (जैसे कि फूलों को बनाना भूल जाना क्योंकि आपने उनके "प्रकृति" के ज्ञान के साथ छेड़छाड़ की थी)।

TRUST अलग है। पूरी किताब को फिर से लिखने के बजाय, यह एक "स्मार्ट हाइलाइटर" का उपयोग करता है। यह कलाकार के मस्तिष्क को देखता है और कहता है, "ठीक है, मैं देख सकता हूँ कि 'जहरीले मशरूम' की अवधारणा के लिए कौन से विशिष्ट सूक्ष्म न्यूरॉन्स जिम्मेदार हैं। मैं केवल उन विशिष्ट स्थानों को हाइलाइट करने जा रहा हूँ।"

महत्वपूर्ण बात यह है कि यह केवल एक बार हाइलाइट नहीं करता है। जैसे-जैसे कलाकार भूलना सीखता है, उसका मस्तिष्क थोड़ा बदल जाता है। TRUST इतना स्मार्ट है कि वह हर बार नए स्थानों को पुनः हाइलाइट (re-highlight) करता है, जिससे यह सुनिश्चित होता है कि वह लक्ष्य से कभी न भटके।

2. "भूलने के दो तरीके" (CIP बनाम CSR)

शोधकर्ताओं ने पाया कि किसी चीज़ को भूलने के दो तरीके हैं, और उन्होंने दोनों के लिए एक टूल बनाया है:

  • "कठोर इरेज़र" (CIP): कल्पना कीजिए कि एक भारी-भरक इरेज़र लेकर "जहरीले मशरूम" की ड्राइंग को तब तक रगड़ने तक कि कागज लगभग खाली न हो जाए। यह बहुत प्रभावी है—मशरूम गायब है—लेकिन यह बाकी ड्राइंग पर थोड़ा दाग छोड़ सकता है। यह उन चीजों के लिए बेहतरीन है जो सख्त वर्जित हैं।
  • "कोमल फुसफुसाहट" (CSR): कल्पना कीजिए कि मिटाने के बजाय, आप बस कलाकार के कान में फुसफुसाते हैं, "जब भी तुम मशरूम के बारे में सोचो, तो कुछ और सोचने की कोशिश करो।" कलाकार मशरूम बनाने की अपनी क्षमता पूरी तरह से नहीं खोता है, लेकिन वह जहरीले मशरूम बनाने की "इच्छा" खो देता है। यह बहुत अधिक कोमल है और कलाकार की समग्र प्रतिभा को काफी ऊँचा बनाए रखता है।

3. "सामाजिक शिष्टाचार" परीक्षण (कॉन्सेप्ट कॉम्बिनेशन)

यह सबसे प्रभावशाली हिस्सा है। कभी-कभी कोई अवधारणा अपने आप में बुरी नहीं होती, लेकिन जब उसे किसी और चीज़ के साथ मिलाया जाता है, तो वह बुरी हो जाती है।

इसे इस तरह समझें:

  • "एक बच्चा" एक पूरी तरह से ठीक अवधारणा है।
  • "एक बीयर" एक पूरी तरह से ठीक अवधारणा है।
  • लेकिन "बीयर पीता हुआ एक बच्चा" एक बुरी अवधारणा है।

पुराने तरीके यहाँ संघर्ष करते थे। वे या तो "बच्चे" की अवधारणा को पूरी तरह से भूल जाते, या उन्हें पता ही नहीं चलता कि संयोजन (combination) ही समस्या है। TRUST एक परिष्कृत सामाजिक कोच की तरह है। यह सीख सकता है कि, "तुम बच्चों को बना सकते हो, और तुम बीयर को भी बना सकते हो, लेकिन तुम्हें उन्हें एक साथ बनाने से सख्ती से रोका जाता है।" यह व्यक्तिगत टुकड़ों को नष्ट किए बिना उनके बीच के संबंध को सुलझा देता है।

निचोड़ (The Bottom Line)

TRUST AI को सुरक्षित बनाता है क्योंकि यह एक हथौड़े के बजाय एक सर्जिकल विशेषज्ञ की तरह काम करता है। यह है:

  • तेज़: यह पूरे मस्तिष्क को फिर से प्रशिक्षित करने में समय बर्बाद नहीं करता है।
  • स्मार्ट: यह विचारों के जटिल "बुरे संयोजनों" को संभाल सकता है।
  • कोमल: यह कलाकार की रचनात्मक "आत्मा" को बरकरार रखता है ताकि वह अभी भी सुंदर और हानिरहित चीजें पूरी तरह से बना सके।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →