← नवीनतम पेपर
💬 NLP

Context Tuning for In-Context Optimization

यह शोधपत्र कॉन्टेक्स्ट ट्यूनिंग (Context Tuning) को प्रस्तुत करता है, जो एक वेट-फ्री (weight-free) विधि है जो इन-कॉन्टेक्स्ट लर्निंग के माध्यम से प्रदर्शनों (demonstrations) से एक प्रशिक्षण योग्य मेमोरी प्रतिनिधित्व को इनिशियलाइज़ करके और तत्पश्चात ग्रेडिएंट-आधारित अनुकूलन के माध्यम से इसे परिष्कृत करके बड़े भाषा मॉडलों में फ्यू-शॉट अनुकूलन को बढ़ाता है, जिससे यह मानक इन-कॉन्टेक्स्ट और प्रॉम्प्ट-आधारित दृष्टिकोणों से बेहतर प्रदर्शन करता है और उच्च दक्षता के साथ टेस्ट-टाइम ट्रेनिंग के साथ प्रतिस्पर्धी सटीकता प्राप्त करता है।

मूल लेखक: Jack Lu, Ryan Teehan, Zhenbang Yang, Mengye Ren

प्रकाशित 2026-07-07
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Jack Lu, Ryan Teehan, Zhenbang Yang, Mengye Ren

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपके पास एक प्रतिभाशाली, सुशिक्षित लाइब्रेरियन (लार्ज लैंग्वेज मॉडल) है, जिसने अस्तित्व में मौजूद लगभग हर किताब को पढ़ा है। आप उनसे एक नए विषय के बारे में एक विशिष्ट प्रश्न पूछना चाहते हैं, जैसे कि "मैं टपकते हुए नल को कैसे ठीक करूँ?"

आमतौर पर, आपको उत्तर प्राप्त करने के दो तरीके मिलते हैं:

  1. "दिखाओ, बताओ मत" विधि (इन-कॉन्टेक्स्ट लर्निंग): आप लाइब्रेरियन को नल ठीक करने वाले किसी व्यक्ति के कुछ उदाहरण देते हैं और कहते हैं, "देखो उन्होंने इसे कैसे किया? अब इसी तरह इस नए रिसाव के लिए भी करो।" लाइब्रेरियन आपके उदाहरणों को देखता है, एक त्वरित मानसिक चित्र बनाता है, और उत्तर देता है। यह तेज़ है, लेकिन कभी-कभी लाइब्रेरियन भ्रमित हो सकता है यदि उदाहरण सटीक न हों या कार्य कठिन हो।

  2. "कड़ी मेहनत से पढ़ाई करने" की विधि (पारंपरिक फाइन-ट्यूनिंग): आप लाइब्रेरियन को लाइब्रेरी से बाहर ले जाते हैं, उन्हें एक कक्षा में बिठाते हैं, और उन्हें नल के उदाहरणों को घंटों तक याद करने के लिए अध्ययन करवाते हैं जब तक कि वे समाधान को कंठस्थ न कर लें। यह अच्छा काम करता है, लेकिन इसमें बहुत समय और ऊर्जा लगती है, और आपको हर नए विषय के लिए इसे फिर से करना पड़ता है।

"कॉन्टेक्स्ट ट्यूनिंग" (Context Tuning) में प्रवेश करें: एक नया मध्य मार्ग

लेखक एक चतुर तीसरा विकल्प पेश करते हैं जिसे "कॉन्टेक्स्ट ट्यूनिंग" कहा जाता है। इसे लाइब्रेरियन को एक "स्मार्ट चीट शीट" देने के रूप में सोचें जिसे वे वास्तविक समय में बदल सकते हैं।

केवल उदाहरण देने और उम्मीद करने के बजाय, या लाइब्रेरियन को घंटों के लिए कक्षा में बंद करने के बजाय, कॉन्टेक्स्ट ट्यूनिंग यह करती है:

  1. उदाहरणों से शुरुआत करें: यह आपके द्वारा दिए गए कुछ उदाहरणों (डेमोंस्ट्रेशन) को लेती है और उनका उपयोग एक विशेष, प्रशिक्षण योग्य "मेमोरी नोट" (एक प्रॉम्प्ट या छिपे हुए निर्देशों का सेट) बनाने के लिए करती है।
  2. नोट को परिष्कृत करें: यह उस नोट को बदलने के लिए एक त्वरित, स्मार्ट अनुकूलन प्रक्रिया चलाती है। यह पूछती है, "यदि मैं इस नोट के इस हिस्से को थोड़ा बदल दूँ, तो क्या लाइब्रेरियन सही उत्तर देगा?" यह तब तक बार-बार यह प्रक्रिया करती है जब तक कि नोट समस्या को हल करने के लिए पूरी तरह से ट्यून न हो जाए।
  3. परिणाम: अब लाइब्रेरियन के पास कार्य का एक सुपर-चार्ज्ड मानसिक मॉडल है, जो सीधे आपके उदाहरणों से प्राप्त हुआ है, लेकिन बिना अपनी पूरी लाइब्रेरी को फिर से सीखने के।

कॉन्टेक्स्ट ट्यूनिंग के दो रूप

पेपर इस "स्मार्ट चीट शीट" को बनाने के दो तरीके प्रस्तावित करता है:

  • CT-Prompt (एक स्टिकी नोट): यह एक विशेष स्टिकी नोट लिखने और उसे हर उस पन्ने के ऊपर चिपकाने जैसा है जिसे लाइब्रेरियन पढ़ता है। नोट को लाइब्रेरियन की सोच को निर्देशित करने के लिए प्रशिक्षित किया जाता है। हालाँकि, पेपर नोट करता है कि यदि आपके पास कई उदाहरण हैं, तो इस नोट को लिखना और समायोजित करना धीमा और बोझिल हो जाता है (जैसे स्टिकी नोट पर उपन्यास लिखने की कोशिश करना)।
  • CT-KV (एक आंतरिक इंडेक्स): यह इस पेपर की मुख्य विधि है। एक स्टिकी नोट के बजाय, यह लाइब्रेरियन की आंतरिक फाइलिंग प्रणाली (विशेष रूप से "की-वैल्यू" कैश, जिससे मॉडल याद रखता है कि उसने अभी क्या पढ़ा है) को बदलता है।
    • उपमा: कल्पना कीजिए कि लाइब्रेरियन के पास एक विशाल फाइलिंग कैबिनेट है। जब आप उन्हें नल के उदाहरण दिखाते हैं, तो वे आमतौर पर फाइलों पर केवल एक नज़र डालते हैं। CT-KV वास्तव में कैबिनेट में फाइलों को विशेष रूप से इस कार्य के लिए पुनर्व्यवस्थित करता है ताकि सही जानकारी तुरंत सामने आ सके।
    • यह बेहतर क्यों है: फाइलों को पुनर्व्यवस्थित करना एक लंबा स्टिकी नोट लिखने की तुलना में बहुत तेज़ है। यह अधिक सटीक भी है क्योंकि यह लाइब्रेरियन के मस्तिष्क के प्रत्येक स्तर पर स्मृति को व्यवस्थित करता है, न कि केवल शीर्ष पर।

प्रमुख विशेषताएं जो इसे प्रभावी बनाती हैं

पेपर बताता है कि दो "सीक्रेट सॉस" क्या हैं जो CT-KV को इतना प्रभावी बनाते हैं:

  1. "लीव-वन-आउट" नियम: प्रशिक्षण के दौरान, सिस्टम उस विशिष्ट उदाहरण का उत्तर छिपा देता है जिसे वह वर्तमान में देख रहा है।
    • उपमा: कल्पना कीजिए कि आप लाइब्रेरियन को सिखा रहे हैं। यदि आप उन्हें नल की एक तस्वीर दिखाते हैं और पूछते हैं, "इसे कैसे ठीक करें?", तो आपको उन्हें उत्तर कुंजी देखने नहीं देनी चाहिए जो तस्वीर के ठीक बगल में है। आपको उन्हें सोचने के लिए मजबूर करना होगा। प्रशिक्षण के दौरान उत्तर को छिपाकर, सिस्टम "नोट" को नल ठीक करने के तर्क को सीखने के लिए मजबूर करता है, न कि केवल उत्तर को याद करने के लिए।
  2. टोकन ड्रॉपआउट (Token Dropout): सिस्टम प्रशिक्षण के दौरान नोट के हिस्सों को बेतरतीब ढंग से छिपा देता है।
    • उपमा: यह एक भाषण का अभ्यास करने जैसा है जहाँ आप कभी-कभी अपनी आँखें या कान ढक लेते हैं। यह लाइब्रेरियन को पूरी तस्वीर पर निर्भर रहने के लिए मजबूर करता है बजाय इसके कि वह किसी एक विशिष्ट शब्द पर अटक जाए, जिससे समाधान अधिक मजबूत बनता है।

पेपर ने क्या पाया

लेखकों ने कई अलग-अलग चुनौतियों पर इसका परीक्षण किया, जिसमें ट्रिविया का उत्तर देना, तर्क पहेलियों को हल करना और अमूर्त ग्रिड पैटर्न (जैसे वीडियो गेम लेवल) को ठीक करना शामिल है।

  • "सिर्फ देखने" से बेहतर: कॉन्टेक्स्ट ट्यूनिंग (विशेष रूप से CT-KV) ने मानक "दिखाओ, बताओ मत" विधि को लगातार मात दी। लाइब्रेरियन ने अधिक समस्याओं को सही ढंग से हल किया।
  • "कड़ी मेहनत से पढ़ाई करने" से बेहतर: यह उन पारंपरिक तरीकों की तुलना में बहुत तेज़ था जो लाइब्रेरियन के मस्तिष्क को फिर से प्रशिक्षित करने का प्रयास करते हैं। CT-KV ने भारी "टेस्ट-टाइम ट्रेनिंग" पद्धति के समान परिणाम लगभग आधे समय में प्राप्त किए।
  • पावर कॉम्बो: पेपर ने पाया कि आप भारी "कड़ी मेहनत से पढ़ाई करने" वाली विधि का पहले उपयोग कर सकते हैं, और फिर परिणाम को पॉलिश करने के लिए CT-KV का उपयोग कर सकते हैं। यह परीक्षा के लिए अध्ययन करने और फिर परीक्षा से ठीक पहले एक त्वरित रिव्यु सेशन करने जैसा है ताकि आप और भी बेहतर स्कोर कर सकें।
  • मजबूती (Robustness): भले ही आपके द्वारा दिए गए उदाहरण थोड़े अस्त-व्यस्त हों या उनमें गलत उत्तर हों (शोर/नॉइज़), CT-KV सही रास्ता खोजने में आश्चर्यजनक रूप से सक्षम है।

निष्कर्ष

कॉन्टेक्स्ट ट्यूनिंग AI मॉडल को उसके मूल मस्तिष्क को बदले बिना नए कार्यों के लिए स्मार्ट बनाने का एक तरीका है। यह आपके द्वारा दिए गए उदाहरणों को लेती है, उन्हें एक अत्यधिक अनुकूलित "मेमोरी सेटिंग" में बदल देती है, और इस सेटिंग को तब तक परिष्कृत करती है जब तक कि यह पूरी तरह से काम न करने लगे। यह मॉडल को फिर से प्रशिक्षित करने की तुलना में तेज़ है और केवल एक बार उदाहरण दिखाने की तुलना में अधिक सटीक है।

पेपर निष्कर्ष निकालता है कि कॉन्टेक्स्ट (मेमोरी नोट) को अनुकूलित करना, मॉडल (लाइब्रेरियन के मस्तिष्क) को अनुकूलित करने का एक शक्तिशाली और कुशल विकल्प है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →