← नवीनतम पेपर
💬 NLP

Continual Visual Learning under Evolving Semantic Concept Shift

यह शोधपत्र SemReWrite प्रस्तुत करता है, जो एक ऐसा ढांचा है जिसे वैध ज्ञान को संरक्षित करते हुए अप्रचलित दृश्य-सिमेंटिक मैपिंग को चुनिस्कर रूप से अपडेट करके विजुअल फाउंडेशन मॉडल्स में विकसित होते सिमेंटिक कॉन्सेप्ट शिफ्ट्स को संभालने के लिए डिज़ाइन किया गया है, जिसे एक नए बेंचमार्क (EvoShift-Bench) और विशिष्ट मूल्यांकन मेट्रिक्स के माध्यम से मान्य किया गया है।

मूल लेखक: Ismail Lamaakal, Chaymae Yahyati, Yassine Maleh, Khalid El Makkaoui, Ibrahim Ouahbi

प्रकाशित 2026-08-26
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Ismail Lamaakal, Chaymae Yahyati, Yassine Maleh, Khalid El Makkaoui, Ibrahim Ouahbi

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

एक ऐसी दुनिया की कल्पना करें जहाँ चीजों को नाम देने के नियम बदल जाते हैं, लेकिन वे चीजें स्वयं नहीं बदलतीं। एक कार हर तस्वीर में कार ही रहती है, फिर भी एक नया यातायात कानून अचानक हमसे यह पहचानने की मांग कर सकता है कि वह एक "निजी वाहन" है, एक "व्यावसायिक ट्रक" है, या एक "आपातकालीन प्रतिक्रियाकर्ता" है, जो उन सूक्ष्म विवरणों पर आधारित हो जिन्हें पहले अनदेखा किया जाता था। इसी तरह, एक पक्षी जिसे कभी केवल एक "गौरैया" कहा जाता था, उसे एक नए वैज्ञानिक अध्ययन द्वारा दो अलग-अलग प्रजातियों में पुनर्वर्गीकृत किया जा सकता है, या एक फैक्ट्री दोष को सख्त सुरक्षा मानक के आधार पर पुनर्वर्गीकृत किया जा सकता है। यह लंबे समय तक चलने वाले कंप्यूटर विज़न सिस्टम की वास्तविकता है: दृश्य दुनिया वही रहती है, लेकिन हम उसे जो अर्थ देते हैं वह विकसित होता रहता है। दशकों से, आर्टिफिशियल इंटेलिजेंस शोधकर्ता कंप्यूटर को वस्तुओं को पहचानने के लिए सिखाने पर ध्यान केंद्रित कर रहे हैं, भले ही रोशनी बदल जाए या कैमरा एंगल बदल जाए। हालाँकि, एक नई चुनौती उभर कर आई है: हम कंप्यूटर को अपने अर्थों के शब्दकोश को अपडेट करना कैसे सिखाएं बिना उस ज्ञान को मिटाए जो उसने पहले ही सीख लिया है?

शोधकर्ताओं की एक टीम ने SemReWrite नामक एक नया ढांचा (framework) विकसित करके इस समस्या का समाधान निकाला है। उनका कार्य एक विशिष्ट और कठिन परिदृश्य को संबोधित करता है जिसे "इवॉल्विंग सिमेंटिक कॉन्सेप्ट शिफ्ट" (विकसित होते अर्थ संबंधी अवधारणा परिवर्तन) के रूप में जाना जाता है। इस स्थिति में, एआई (AI) जो दृश्य साक्ष्य देखता है वह नहीं बदलता, बल्कि वह साक्ष्य क्या दर्शाता है, उसकी परिभाषा बदल जाती है। एक स्वायत्त ड्राइविंग सिस्टम (autonomous driving system) पर विचार करें जो शुरू में सभी चलते हुए वाहनों को एक ही श्रेणी के रूप में मानता है। बाद में, एक नई नीति सिस्टम को यात्री कारों को आपातकालीन वाहनों से अलग करने की आवश्यकता बताती है क्योंकि उन्हें अलग-अलग कार्यों की आवश्यकता होती है। कारों की छवियां दिखने में समान होती हैं, लेकिन कंप्यूटर के लिए सही उत्तर मौलिक रूप से बदल गया है। पारंपरिक तरीके अक्सर यहाँ विफल हो जाते हैं। यदि आप केवल नए नियमों पर मॉडल को फिर से प्रशिक्षित करते हैं, तो यह नए अंतरों को सीख सकता है लेकिन पुराने, अभी भी वैध श्रेणियों को संभालने का तरीका भूल सकता है। यदि आप पुराने ज्ञान को बहुत सख्ती से सुरक्षित रखने की कोशिश करते हैं, तो मॉडल नए नियमों को सीखने से इनकार कर सकता है। शोधकर्ताओं ने पाया कि समाधान सीखने और याद रखने के बीच चुनाव करने में नहीं है, बल्कि दोनों को चुनिलेक्टिवली (चयनात्मक रूप से) करने में है।

उनका दृष्टिकोण एक सावधानीपूर्वक संपादक की तरह कार्य करने वाला सिस्टम है, न कि एक खाली स्लेट की तरह। जब अर्थ संबंधी नियम बदलते हैं, तो सिस्टम पहले पुराने परिभाषा और नई परिभाषा के बीच के अंतर का विश्लेषण करता है। यह अपडेट किए गए नियमों के साथ लेबल किए गए नए उदाहरणों की एक छोटी संख्या का उपयोग करके ठीक से पहचान करता है कि इस परिवर्तन से दृश्य दुनिया के कौन से हिस्से प्रभावित हुए हैं। उदाहरण के लिए, यदि नियम वाहनों के प्रकारों के बीच अंतर करने के लिए बदलता है, तो सिस्टम पहचानता है कि वाहन के आकार या आकृति की दृश्य विशेषताएं अब महत्वपूर्ण हैं, जबकि सड़क या मौसम की विशेषताएं नए परिभाषा के लिए अप्रासंगिक हैं। एक बार जब उसे पता चल जाता है कि परिवर्तन कहाँ मायने रखता है, तो वह मॉडल की निर्णय लेने की प्रक्रिया के केवल उन विशिष्ट क्षेत्रों पर लक्षित अपडेट लागू करता है। बाकी मॉडल, जो दुनिया के उन हिस्सों को संभालता है जो बदले नहीं हैं, उसे अछूता छोड़ दिया जाता है। यह सुनिश्चित करता है कि सिस्टम नए अर्थों को सीखता है बिना अनजाने में पुराने, सही अर्थों को भूले बिना।

इस विचार का परीक्षण करने के लिए, शोधकर्ताओं ने EvoShift-Bench नामक एक नया बेंचमार्क बनाया, जो अर्थों के विकसित होने के विभिन्न तरीकों का अनुकरण करता है। उन्होंने उन परिदृश्यों का परीक्षण किया जहाँ एक श्रेणी दो में विभाजित होती है, जहाँ दो श्रेणियाँ एक में विलीन हो जाती हैं, जहाँ श्रेणियों के बीच की सीमा बदल जाती है, और जहाँ पूरी तरह से नई श्रेणियाँ डाली जाती हैं। उन्होंने उन स्थितियों का भी परीक्षण किया जहाँ परिभाषाओं के साथ-साथ दुनिया का दृश्य स्वरूप भी बदल जाता है, जैसे कि एक सिस्टम जिसे स्पष्ट तस्वीरों पर प्रशिक्षित किया गया है, उसे स्केच या कम रोशनी वाली छवियों के अनुकूल होना पड़ता है। इन परीक्षणों में, नया ढांचा लगातार मौजूदा तरीकों से बेहतर प्रदर्शन करता रहा। जबकि अन्य दृष्टिकोण या तो नए नियम सीखने में विफल रहे या पुराने को भूल गए, इस चयनात्मक लेखन पद्धति ने दोनों क्षेत्रों में उच्च स्कोर प्राप्त किया। इसने नए अंतरों को सफलतापूर्वक सीखा और अपरिवर्तित अवधारणाओं की सटीकता को भी सुरक्षित रखा।

परिणाम बताते हैं कि यह सिस्टम विशेष रूप से कुशल है। यह इन नए अर्थ संबंधी नियमों को बहुत कम उदाहरणों का उपयोग करके सीख सकता है—कभी-कभी प्रति नई श्रेणी केवल एक या दो छवियां। यह अत्यंत महत्वपूर्ण है क्योंकि वास्तविक दुनिया में, बड़ी संख्या में नए, सही ढंग से लेबल किए गए चित्र प्राप्त करना अक्सर कठिन और महंगा होता है। शोधकर्ताओं ने यह भी पाया कि सिस्टम समय के साथ परिवर्तनों के एक क्रम को संभाल सकता है। जैसे-जैसे नियम कई चरणों के माध्यम से विकसित हुए, सिस्टम बिना त्रुटियों को संचित किए या स्थिर अवधारणाओं को पहचानने की अपनी क्षमता खोए बिना अनुकूलित होता रहा। महत्वपूर्ण बात यह है कि सिस्टम पुराने, गलत जुड़ावों को दबाने में सक्षम था। इसने केवल नया उत्तर नहीं सीखा; इसने सक्रिय रूप से प्रभावित छवियों के लिए पुराने, अब-गलत उत्तर की भविष्यवाणी करना बंद कर दिया। यह अंतर महत्वपूर्ण है: एक अच्छा अनुकूलन सिस्टम न केवल यह जानना चाहिए कि अब क्या सत्य है, बल्कि यह भी जानना चाहिए कि अब क्या सत्य नहीं है।

अध्ययन सुझाव देता है कि लंबे समय तक चलने वाले विजुअल सिस्टम का भविष्य इस प्रकार के चयनात्मक अपडेटिंग में निहित है। सभी ज्ञान को समान रूप से स्थायी या समान रूप से डिस्पोजेबल मानने के बजाय, इन सिस्टम को यह पहचानने में सक्षम होना चाहिए कि उनकी समझ के कौन से हिस्से अप्रचलित हो गए हैं और कौन से हिस्सा वैध बने हुए हैं। स्पष्ट समझ कि परिभाषाएं कैसे बदली हैं और मॉडल के आवश्यक हिस्सों को अपडेट करने के सटीक तंत्र को जोड़कर, शोधकर्ताओं ने एक ऐसे एआई के लिए आगे का रास्ता प्रदर्शित किया है जो उसके द्वारा देखे जाने वाले संसार के साथ बढ़ और बदल सकता है। यह कार्य आर्टिफिशियल इंटेलिजेंस की हर समस्या को हल करने का दावा नहीं करता है, लेकिन यह स्थिर दृश्य दुनिया में बदलते अर्थों को संभालने के लिए एक ठोस और प्रभावी तरीका प्रदान करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →