Evidence for timing in the midsession reversal task with rats in operant conditioning boxes
यह अध्ययन प्रदर्शित करता है कि मिड-सेशन रिवर्सल टास्क (midsession reversal task) में चूहे स्थानीय सुदृढीकरण संकेतों (local reinforcement cues) को वैश्विक टेम्पोरल सूचना (global temporal information) के साथ एकीकृत करने वाली एक मिश्रित रणनीति का उपयोग करते हैं, जैसा कि निश्चित ट्रायल संख्या के बजाय हेरफेर किए गए इंटरट्रायल अंतराल (intertrial intervals) के आधार पर अपने स्विचिंग व्यवहार को समायोजित करने की उनकी क्षमता से सिद्ध होता है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
मुख्य विचार: क्या चूहे घड़ी देखते हैं या वे सिर्फ "विजेता" हैं?
कल्पना कीजिए कि आप एक वीडियो गेम खेल रहे हैं जहाँ आपको दो दरवाजों, दरवाजा A और दरवाजा B के बीच चुनाव करना है।
- पहले 40 राउंड के लिए, दरवाजा A हमेशा आपको इनाम देता है।
- अचानक, बिना किसी चेतावनी के, नियम बदल जाते हैं। अगले 40 राउंड के लिए, दरवाजा B वह दरवाजा है जो आपको इनाम देता है।
वैज्ञानिक सालों से यह सवाल पूछ रहे हैं कि: जानवर यह कैसे पता लगाते हैं कि कब स्विच (बदलना) करना है?
इसके दो मुख्य सिद्धांत हैं:
- "स्मार्ट टाइमर" सिद्धांत: जानवर समय गिनते हैं। "ठीक है, मैं 5 मिनट से खेल रहा हूँ; अब शायद दरवाजा B की ओर स्विच करने का समय हो गया है।"
- "जीतो-रुको, हारो-बदलो" (Win-Stay, Lose-Shift) सिद्धांत: जानवर को समय की परवाह नहीं है। वह बस पिछले परिणाम को देखता है। "मुझे इनाम मिला? तो मैं फिर से दरवाजा A चुनूँगा। मुझे इनाम नहीं मिला? ठीक है, मैं दरवाजा B की ओर स्विच करूँगा।"
चौंकाने वाली बात:
पिछले अध्ययनों ने दिखाया था कि पक्षी (जैसे कबूतर) "स्मार्ट टाइमर" होते हैं। वे अक्सर घड़ी के आधार पर अनुमान लगाते हुए बहुत जल्दी या बहुत देर से स्विच करते हैं। हालाँकि, चूहे बेहतरीन "विजेता" लग रहे थे। वे नियम बदलने पर लगभग तुरंत स्विच कर गए, जिससे पता चलता है कि वे केवल पिछले इनाम को देखते थे और घड़ी को पूरी तरह से नजरअंदाज कर देते थे।
इस अध्ययन का लक्ष्य:
शोधकर्ता यह देखना चाहते थे कि क्या चूहे वाकई घड़ी को नजरअंदाज कर रहे थे, या वे बस अपनी टाइमिंग स्किल्स को छिपा रहे थे क्योंकि "जीतो-रुको" (Win-Stay) रणनीति इतनी अच्छी तरह काम कर रही थी। उन्होंने खेल की गति बदलकर चूहों को चकमा देने का फैसला किया।
प्रयोग: गति को बदलना
शोधकर्ताओं ने दो समूहों के चूहों के साथ एक ही खेल सेट किया, लेकिन एक ट्विस्ट के साथ: राउंड के बीच का समय (जिसे "इंटरट्रायल इंटरवल" या ITI कहा जाता है) बदल दिया गया।
- ग्रुप शॉर्ट (Group Short): खेल तेज़ था। राउंड के बीच में केवल 5 सेकंड का अंतराल था।
- ग्रुप लॉन्ग (Group Long): खेल धीमा था। राउंड के बीच में 10 सेकंड का अंतराल था।
चरण 1: प्रशिक्षण (सामान्य खेल)
दोनों समूहों ने खेल को पूरी तरह से सीख लिया। उन्होंने समझ लिया कि पहले आधे भाग के लिए दरवाजा A अच्छा है, और दूसरे आधे भाग के लिए दरवाजा B अच्छा है। उन्होंने लगभग कोई गलती नहीं की। एक पर्यवेक्षक के लिए, वे केवल पिछले इनाम पर प्रतिक्रिया देते हुए लग रहे थे, समय को नजरअंदाज कर रहे थे।
चरण 2: जाल (प्रोब टेस्ट)
यहीं पर असली जादू हुआ। शोधकर्ताओं ने अचानक चूहों के लिए खेल की गति बदल दी, लेकिन राउंड की संख्या वही रखी।
फास्ट ग्रुप (शॉर्ट ITI) को धीमा कर दिया गया: वे 5 सेकंड के अंतराल के आदी थे, लेकिन अचानक उन्हें 10 सेकंड का अंतराल मिला।
- परिणाम: चूहे भ्रमित हो गए! उन्होंने सोचा, "रुको, हम काफी लंबे समय से खेल रहे हैं। अब स्विच करने का समय हो गया होगा!" वे दरवाजा B चुनने लगे, और वह भी बहुत जल्दी, जबकि दरवाजा A अभी भी उन्हें इनाम दे रहा था। वे अपने आंतरिक क्लॉक (घड़ी) पर भरोसा कर रहे थे, इनाम पर नहीं।
स्लो ग्रुप (लॉन्ग ITI) को तेज़ कर दिया गया: वे 10 सेकंड के अंतराल के आदी थे, लेकिन अचानक उन्हें 5 सेकंड का अंतराल मिला।
- परिणाम: इन चूहों ने सोचा, "अभी तक पर्याप्त समय नहीं हुआ है! दरवाजा A चुनते रहो!" वे दरवाजा A चुनते रहे, और वह भी बहुत देर से, यहाँ तक कि दरवाजा B से इनाम मिलने के बाद भी। फिर से, वे अपनी आंतरिक घड़ी पर भरोसा कर रहे थे।
उदाहरण: यात्री और ट्रैफिक लाइट
कल्पना कीजिए कि दो यात्री हैं, एलेक्स और सैम, जो रोज़ काम पर जाते हैं।
- एलेक्स एक ऐसे रास्ते पर चलता है जहाँ ट्रैफिक लाइट छोटी होती है (5 सेकंड)।
- सैम एक ऐसे रास्ते पर चलता है जहाँ ट्रैफिक लाइट लंबी होती है (10 सेकंड)।
दोनों सीखते हैं कि उनके सफर के ठीक बीच में लाइट लाल हो जाती है। दोनों रेड लाइट से बचने के लिए सही समय पर लेन बदलने की कला सीख लेते हैं।
एक दिन, शहर ने समय बदल दिया:
- एलेक्स की लाइटें अचानक 10 सेकंड पर अटक गईं। उसने सोचा, "मैं काफी समय से गाड़ी चला रहा हूँ; मुझे जरूर आधा रास्ता तय कर लेना चाहिए!" इसलिए, वह लेन बदल लेता है, भले ही रास्ता साफ हो।
- सैम की लाइटें अचानक 5 सेकंड पर अटक गईं। उसने सोचा, "मैंने अभी तक पर्याप्त समय तक गाड़ी नहीं चलाई है!" इसलिए, वह अपनी लेन में बहुत देर तक बना रहता है, भले ही उसे स्विच कर लेना चाहिए था।
निष्कर्ष: भले ही दोनों ड्राइवर सड़क की स्थितियों (इनामों) पर प्रतिक्रिया देते हुए लग रहे थे, लेकिन वे वास्तव में अपने दिमाग में एक मानसिक घड़ी रख रहे थे। जब सड़क की स्थितियाँ बदलीं, तो उनकी घड़ी ने नियंत्रण ले लिया।
इसका क्या अर्थ है?
- चूहे हमारी सोच से अधिक स्मार्ट हैं: वे केवल पिछले इनाम पर प्रतिक्रिया करने वाले बेजान रोबोट नहीं हैं। वे समय का भी हिसाब रखते हैं।
- यह एक "मिश्रित रणनीति" (Mixed Strategy) है: चूहे एक हाइब्रिड दृष्टिकोण का उपयोग करते हैं।
- आमतौर पर, वे "जीतो-रुको" (Win-Stay) रणनीति का उपयोग करते हैं (पिछले इनाम को देखना) क्योंकि यह सबसे विश्वसनीय है और इससे उन्हें सबसे ज्यादा भोजन मिलता है।
- लेकिन उनके बैकग्राउंड में एक "समय" (Time) रणनीति भी चलती रहती है।
- जब "जीतो-रुको" रणनीति भ्रमित करने वाली हो जाती है (क्योंकि खेल की गति बदल जाती है), तो "समय" रणनीति कमान संभाल लेती है।
- "छिपी हुई" कुशलता: तथ्य यह है कि सामान्य प्रशिक्षण के दौरान चूहों ने समय संबंधी गलतियाँ नहीं कीं, इसका मतलब यह नहीं है कि उनमें समय पहचानने का कौशल नहीं है। इसका मतलब सिर्फ यह है कि दूसरी रणनीति इतनी अच्छी तरह काम कर रही थी कि उनकी टाइमिंग स्किल छिप गई थी।
मुख्य निष्कर्ष
यह पेपर साबित करता है कि चूहे निर्णय लेने में "द्विभाषी" (Bilingual) हैं। वे "पुरस्कारों" (स्थानीय संकेतों) की भाषा और "समय" (वैश्विक संकेतों) की भाषा, दोनों बोलते हैं। आमतौर पर, वे "पुरस्कारों" की भाषा बोलते हैं क्योंकि यह आसान है। लेकिन यदि वातावरण बदल जाता है, तो वे समझने के लिए तुरंत "समय" की भाषा पर स्विच कर जाते हैं।
यह इस बात के बीच के अंतर को पाटता है कि पक्षी और स्तनधारी कैसे सोचते हैं, यह दिखाते हुए कि इन खेलों में "परफेक्ट" प्रदर्शन करने वाले भी वास्तव में मानसिक उपकरणों के एक जटिल मिश्रण का उपयोग कर रहे होते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।