Electrophysiological Correlates of Reward Processing in the Human Ventral Tegmental Area
यह अध्ययन मानव इंट्राक्रैनील रिकॉर्डिंग से प्राप्त पहला प्रत्यक्ष इलेक्ट्रोफिजियोलॉजिकल साक्ष्य प्रदान करता है कि वेंट्रल टेगमेंटल एरिया रिवॉर्ड-संबंधित संकेतों को एनकोड करता है जो सुदृढीकरण शिक्षण (reinforcement learning) तंत्र के अनुरूप हैं, जिसमें पुरस्कृत परिणामों का विभेदीकरण और निर्णय लेने के दौरान अपेक्षित मूल्य का प्रतिनिधित्व शामिल है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपके मस्तिष्क के भीतर बहुत गहराई में एक छोटा, छिपा हुआ नियंत्रण कक्ष है जिसे वेंट्रल टेगमेंटल एरिया (VTA) कहा जाता है। वैज्ञानिक लंबे समय से संदेह कर रहे थे कि यह कमरा वह "कमांड सेंटर" है जो यह सीखता है कि क्या अच्छा महसूस होता है और क्या बुरा, लेकिन अब तक, हम केवल अनुमान लगा रहे थे कि इसके भीतर क्या हो रहा है क्योंकि बिना सर्जरी के हम दीवारों के पार झाँक नहीं सकते थे।
यह शोध पत्र उस नियंत्रण कक्ष के भीतर एक लाइव माइक्रोफ़ोन मिलने जैसा है।
प्रयोग: मस्तिष्क की "हाई-फाइव" को सुनना
शोधकर्ताओं ने 13 लोगों का अध्ययन किया जो पहले से ही किसी अन्य कारण (गंभीर सिरदर्द) से मस्तिष्क की सर्जरी करा रहे थे। जबकि ये मरीज जाग रहे थे और यह सीखने के लिए एक साधारण खेल खेल रहे थे कि किन विकल्पों से पुरस्कार (जैसे अंक या पैसा) मिलते हैं, वैज्ञानिकों ने सीधे VTA से विद्युत संचार (electrical chatter) को रिकॉर्ड किया।
VTA को अपने मस्तिष्क के प्रेरणा तंत्र (motivation system) के लिए एक ट्रैफिक लाइट के रूप में सोचें। अध्ययन में पाया गया कि यह लाइट केवल बेतरतीब ढंग से नहीं चमकती; यह विशेष रूप से तब चमकती है जब आपको पुरस्कार (एक "अच्छा" परिणाम) मिलता है, लेकिन नुकसान होने या कुछ न होने पर यह मंद रहती है। महत्वपूर्ण बात यह है कि यह लाइट पुरस्कारों के लिए तब भी चमकी, भले ही व्यक्ति ने अभी तक खेल को पूरी तरह से समझ न लिया हो। यह बिल्कुल वैसा ही है जैसे इनाम दिखने के क्षण ही ट्रैफिक लाइट का हरा हो जाना, चाहे ड्राइवर को सड़क के नियमों का पता हो या न हो।
"आश्चर्य" का कारक
खिलाड़ियों के एक छोटे समूह में, जिन्होंने वास्तव में सबसे अच्छा विकल्प चुनना सीख लिया था, शोधकर्ताओं ने आश्चर्यों के बारे में कुछ दिलचस्प देखा।
- अपेक्षित पुरस्कार: यदि आपको पता है कि कोई चीज़ मिलने वाली है, तो VTA एक विनम्र संकेत देता है।
- अप्रत्याशित पुरस्कार: यदि अचानक कहीं से कोई चीज़ सामने आ जाए, तो VTA एक विशाल पार्टी मनाता है।
यह आपके द्वारा माँगे गए जन्मदिन के उपहार (अच्छा, लेकिन अपेक्षित) बनाम अपने पुराने कोट में मिली $20 की नोट (एक बड़ा, रोमांचक सरप्राइज) के बीच के अंतर जैसा है। मस्तिष्क का नियंत्रण कक्ष आश्चर्य के प्रति बहुत अधिक तीव्रता से प्रतिक्रिया करता है।
"वैल्यू" मीटर
उन दो खिलाड़ियों के लिए जिन्होंने खेल में दोनों विकल्पों को आज़माया, VTA एक स्मार्ट शॉपिंग ऐप की तरह मूल्य (value) की गणना कर रहा था। उनके विकल्प चुनने से पहले ही, VTA में विद्युत गतिविधि से ऐसा लग रहा था जैसे वह उस विशिष्ट विकल्प के मूल्य को दर्शा रही हो जिसकी उम्मीद की जा सकती थी। यह ऐसा था मानो मस्तिष्क फुसफुसा रहा हो, "यह विकल्प एक अच्छी डील लग रही है," इससे पहले कि व्यक्ति बटन दबाता।
बड़ी तस्वीर
मुख्य निष्कर्ष सरल है: यह अध्ययन पहली बार है जब हमने मानव मस्तिष्क के "रिवॉर्ड कंट्रोल रूम" को सीधे बात करते सुना है। हमने जो संकेत सुने वे बिल्कुल वही हैं जो वैज्ञानिकों ने वर्षों से पशु अध्ययनों में देखे हैं। यह पुष्टि करता है कि हमारे मानव मस्तिष्क भी जानवरों वाले ही बुनियादी "रीइन्फोर्समेंट लर्निंग" सॉफ्टवेयर का उपयोग करते हैं: हमारे पास एक समर्पित प्रणाली है जो पुरस्कारों के लिए चमकती है, आश्चर्यों से उत्साहित होती है, और हमारे विकल्पों के मूल्य की गणना करने में मदद करती है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।