← नवीनतम पेपर
🤖 machine learning

LEMUR: Latent Entropy-aware Multimodal Unlearning via Visual-anchored Reasoning Redirection

यह शोधपत्र LEMUR को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त (training-free), इन्फरेंस-टाइम फ्रेमवर्क है जो विजुअल-एंकोर्ड लेटेंट इंजेक्शन (visual-anchored latent injection) के माध्यम से मल्टीमॉडल लार्ज रीजनिंग मॉडल्स में संवेदनशील रीजनिंग ट्रेसेस का पता लगाने और उन्हें पुनर्निर्देशित करने के लिए RL-प्रेरित टोकन-स्तरीय एंट्रॉपी डायनेमिक्स का लाभ उठाता है, जो मॉडल की उपयोगिता को बनाए रखते हुए गोपनीयता रिसाव को प्रभावी ढंग से दबाता है।

मूल लेखक: Xinhao Zhong, Yuxia Qiao, Junhao Li, Hao Fang, Yi Sun, Bin Chen

प्रकाशित 2026-08-13
📖 3 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Xinhao Zhong, Yuxia Qiao, Junhao Li, Hao Fang, Yi Sun, Bin Chen

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपके पास एक सुपर-स्मार्ट रोबोट दोस्त है जो किसी तस्वीर को देख सकता है और उसके बारे में एक कहानी सुना सकता है। हाल ही में, वैज्ञानिकों ने इन रोबोटों को एक नई तरकीब सिखाई है: अपना अंतिम उत्तर देने से पहले, उन्हें "ज़ोर से सोचने" की अनुमति दी जाती है। वे अपने विचारों की एक लंबी, चरण-दर-चरण डायरी लिखते हैं, सुरागों की जाँच करते हैं और संभावनाओं का अनुमान लगाते हैं, ठीक वैसे ही जैसे कोई जासूस रहस्य सुलझाता है। यह "सोचने" की प्रक्रिया उन्हें कठिन सवालों के जवाब देने में बहुत बेहतर बनाती है।

लेकिन यहाँ एक पेंच है: कभी-कभी उनकी यह सोचने वाली डायरी राज़ उगल देती है। कल्पना कीजिए कि आपने रोबोट को किसी व्यक्ति के बारे में एक विशिष्ट तथ्य भूलने के लिए कहा—जैसे कि उसका घर का पता। रोबोट अपने अंतिम वाक्य में उस पते को सफलतापूर्वक छिपा सकता है, यह कहते हुए, "मुझे नहीं पता कि वह कहाँ रहता है।" हालांकि, यदि आप उसकी "सोचने वाली डायरी" में झाँकते हैं, तो आप देख सकते हैं कि उसने यह लिखा, "हम्म, वह वैंकूवर में रहता है," इससे पहले कि वह इसे मिटाने का निर्णय ले। रहस्य अभी भी वहीं है, प्रक्रिया में छिपा हुआ, न कि केवल परिणाम में। यदि हम चाहते हैं कि ये रोबोट संवेदनशील जानकारी भूल जाएँ, तो हमें केवल अंतिम उत्तर को ही नहीं, बल्कि डायरी को भी पूरी तरह साफ़ करना होगा।

यहीं पर LEMUR नामक एक नई विधि काम आती है। LEMUR को रोबोट की डायरी के लिए एक बहुत ही तेज़ संपादक (editor) के रूप में समझें। शोधकर्ताओं ने पाया कि जब रोबोट उस गुप्त जानकारी को लिखने वाला होता है जिसे उसे भूल जाना चाहिए, तो उसके "सोचने का तरीका" एक बहुत ही विशिष्ट तरीके से बदल जाता है। वह एक पल के लिए घबरा जाता है और अनिश्चित हो जाता है (जैसे कि हकलाना), और फिर अचानक उस गुप्त बात को टाइप करते समय बहुत आत्मविश्वासी और रोबक जैसा हो जाता है।

LEMUR इस घबराहट वाले हकलाने पर नज़र रखता है। जैसे ही वह देखता है कि रोबोट कोई राज़ उगलने की तैयारी कर रहा है, LEMUR धीरे से रोबोट का हाथ पकड़ लेता है और उसके विचारों को सही दिशा में मोड़ देता है। "वैंकूवर" लिखने देने के बजाय, LEMUR फुसफुसाता है, "हे, तस्वीर को फिर से देखो!" और उसे कुछ सुरक्षित लिखने के लिए निर्देशित करता है, जैसे "मैं फोटो से नहीं बता सकता।"

सबसे अच्छी बात यह है कि LEMUR को रोबोट को फिर से प्रशिक्षित करने या उसके मस्तिष्क को बदलने की आवश्यकता नहीं है। यह वास्तविक समय (real-time) में काम करता है, एक स्पेल-चेकर की तरह जो केवल तभी सक्रिय होता है जब उसे कोई वर्जित शब्द सुनाई देता है। शोधकर्ताओं ने कई स्मार्ट रोबोटों पर इसका परीक्षण किया और पाया कि LEMUR पिछले तरीकों की तुलना में सोचने वाली डायरी से रहस्यों को मिटाने में बहुत बेहतर है, और यह सब करते हुए भी रोबोट को अन्य सभी चीजों के लिए बुद्धिमान और मिलनसार बनाए रखता है। यह रोबोट की सोचने की क्षमता को तोड़े बिना गोपनीयता की रक्षा करने का एक चतुर तरीका है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →