QuantFormer: Learning to Quantize for Neural Activity Forecasting in Mouse Visual Cortex
यह शोध पत्र QuantFormer को प्रस्तुत करता है, जो एक नवीन ट्रांसफॉर्मर-आधारित मॉडल है जो गतिशील सिग्नल क्वांटाइजेशन (dynamic signal quantization) और न्यूरॉन-विशिष्ट टोकन के माध्यम से तंत्रिका गतिविधि पूर्वानुमान (neural activity forecasting) को एक वर्गीकरण समस्या के रूप में पुनर्गठित करता है, जिससे टू-फोटॉन कैल्शियम इमेजिंग डेटा से माउस विजुअल कॉर्टेक्स डायनेमिक्स की भविष्यवाणी करने में अत्याधुनिक प्रदर्शन प्राप्त होता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
मस्तिष्क अरबों कोशिकाओं का एक विशाल, गूँजता हुआ नेटवर्क है, जिनमें से प्रत्येक विचार, गति और संवेदना उत्पन्न करने के लिए एक जटिल लय में सक्रिय होती है। यह मशीनरी कैसे काम करती है, इसे समझने के लिए वैज्ञानिक अक्सर इन कोशिकाओं को क्रिया में देखते हैं, और यह देखने के लिए विशेष सूक्ष्मदर्शी (microscopes) का उपयोग करते हैं कि वे रासायनिक संकेतों के साथ कब चमकती हैं। यह गतिविधि निरंतर नहीं होती; यह अचानक, विरल विस्फोटों (sparse bursts) के रूप में आती है, जैसे कि एक शहर जहाँ अधिकांश लाइटें बंद हैं, लेकिन विशिष्ट खिड़कियाँ तब जल उठती हैं जब कुछ दिलचस्प होता है। दशकों से, शोधकर्ताओं ने ऐसे कंप्यूटर मॉडल बनाने की कोशिश की है जो इन चमकों की भविष्यवाणी कर सकें, इस उम्मीद में कि एक दिन वे अनुमान लगा सकेंगे कि मस्तिष्क आगे क्या करेगा। यह एक कठिन कार्य है क्योंकि संकेत अव्यवस्थित हैं, पैटर्न क्षणिक हैं, और शामिल कोशिकाओं की विशाल संख्या डेटा को अत्यधिक बोझिल बना देती है। यदि वैज्ञानिक इन तंत्रिका स्पार्क्स (neural sparks) की विश्वसनीय रूप से भविष्यवाणी कर सकें, तो वे ऐसे प्रयोगों को डिजाइन कर सकते हैं जो वास्तविक समय में समायोजन करें, जिससे शायद कार्यक्षमता को बहाल करने या व्यवहार की गहरी समझ विकसित करने में मदद मिल सके।
शोधकर्ताओं की एक टीम ने अब इस समस्या के लिए एक नया दृष्टिकोण पेश किया है, जिसमें उन्होंने 'क्वांटफॉर्मर' (QuantFormer) नामक एक प्रणाली बनाई है। सिग्नल की हर एक क्षण में सटीक चमक की भविष्यवाणी करने की कोशिश करने के बजाय, जो कि हर सेकंड कमरे के सटीक तापमान का अनुमान लगाने जैसा है, टीम ने इस समस्या को अलग तरह से देखने का निर्णय लिया। उन्होंने महसूस किया कि चूंकि तंत्रिका गतिविधि बहुत विरल होती है, इसलिए यह समझना अधिक उपयोगी है कि कोई कोशिका सक्रिय है या नहीं, बजाय इसके कि उसके चमकने की सटीक डिग्री को मापने की कोशिश की जाए। ऐसा करने के लिए, उन्होंने एक कंप्यूटर मॉडल बनाया जो तंत्रिका डेटा के निरंतर, बहते हुए प्रवाह को अलग-अलग, स्पष्ट चरणों में अनुवादित करना सीखता है। एक बहती हुई नदी की कल्पना करें जिसे आप पत्थरों की एक श्रृंखला के साथ चिह्नित करते हैं; मॉडल एक पत्थर से दूसरे पत्थर पर कूदना सीखता है, प्रभावी रूप से एक तरल सिग्नल की भविष्यवाणी को सही पत्थर चुनने के खेल में बदल देता है। यह बदलाव कंप्यूटर को सबसे महत्वपूर्ण क्षणों—वास्तविक गतिविधि के विस्फोटों—पर ध्यान केंद्रित करने की अनुमति देता है, बजाय इसके कि वह शांत पृष्ठभूमि के शोर में खो जाए।
शोधकर्ताओं ने इस मॉडल को चूहों के विजुअल कॉर्टेक्स (visual cortex) के डेटा के एक विशाल संग्रह का उपयोग करके प्रशिक्षित किया, जो मस्तिष्क का वह क्षेत्र है जो जानवर द्वारा देखी जाने वाली चीजों को प्रोसेस करता है। उन्होंने चूहों को विभिन्न चित्र दिखाए, जैसे चलती हुई धारियाँ से लेकर प्राकृतिक दृश्य तक, और रिकॉर्ड किया कि हजारों व्यक्तिगत न्यूरॉन्स ने कैसे प्रतिक्रिया दी। मॉडल को पहले इन रिकॉर्डिंग के छूटे हुए हिस्सों को भरने के लिए सिखाया गया, एक ऐसी प्रक्रिया जिसने इसे यह सीखने के लिए मजबूर किया कि न्यूरॉन्स समय के साथ कैसे व्यवहार करते हैं। महत्वपूर्ण रूप से, सिस्टम को एक साथ किसी भी संख्या में न्यूरॉन्स को संभालने के लिए डिज़ाइन किया गया था। प्रत्येक न्यूरोन को एक अद्वितीय डिजिटल नाम टैग देकर, मॉडल समूह के प्रत्येक एकल सेल की विशिष्ट आदतों को सीख सकता था, चाहे कितनी भी कोशिकाओं की निगरानी की जा रही हो। यह लचीलापन एक महत्वपूर्ण प्रगति है, क्योंकि पिछले तरीके अक्सर संघर्ष करते थे जब कोशिकाओं की संख्या बदल जाती थी या कई कोशिकाओं का एक साथ विश्लेषण करने की कोशिश की जाती थी।
परीक्षण के दौरान, नया मॉडल यह भविष्यवाणी करने में उल्लेखनीय रूप से प्रभावी सिद्ध हुआ कि न्यूरॉन्स दृश्य उत्तेजनाओं (visual stimuli) के प्रति कैसे प्रतिक्रिया करेंगे। इसने तंत्रिका प्रतिक्रियाओं के समय और आकार को पकड़ने में मौजूदा तरीकों से बेहतर प्रदर्शन किया, विशेष रूप से गतिविधि के उन तीव्र, अचानक विस्फोटों को जो यह परिभाषित करते हैं कि मस्तिष्क सूचना को कैसे प्रोसेस करता है। मॉडल इन पैटर्न की भविष्यवाणी करने में सटीकता के उस स्तर के साथ सक्षम था जो यह सुझाव देता है कि इसने केवल औसत व्यवहारों को याद करने के बजाय तंत्रिका सर्किट की वास्तविक गतिशीलता को सीख लिया है। शोधकर्ताओं ने यह भी पाया कि मॉडल अच्छी तरह से सामान्यीकरण (generalize) कर सकता है, जिसका अर्थ है कि यह विभिन्न चूहों और विभिन्न प्रकार के चित्रों पर प्रभावी ढंग से काम करता है, यहाँ तक कि उन चित्रों पर भी जिन्हें उसने अपने प्रारंभिक प्रशिक्षण के दौरान नहीं देखा था। यह दर्शाता है कि सिस्टम ने तंत्रिका गतिविधि की एक मौलिक भाषा सीख ली है जो विभिन्न व्यक्तियों और स्थितियों में लागू होती है।
हालाँकि, लेखक यह स्पष्ट करने में सावधानी बरतते हैं कि उनका मॉडल क्या करता है और क्या नहीं करता है। जबकि यह न्यूरॉन्स की रासायनिक चमक की भविष्यवाणी करने में उत्कृष्ट है, यह सीधे उन इलेक्ट्रिकल स्पाइक्स (electrical spikes) की भविष्यवाणी नहीं करता है जो उस चमक का कारण बनते हैं। दोनों के बीच का संबंध जटिल है, और मॉडल को वर्तमान में दृश्य फ्लोरेसेंस संकेतों (fluorescence signals) के पूर्वानुमान के लिए एक उपकरण के रूप में समझा जाना सबसे अच्छा है, न कि अंतर्निहित विद्युत घटनाओं के रूप में। इस सीमा के बावजूद, यह कार्य तंत्रिका विज्ञान (neuroscience) के लिए एक आधारभूत उपकरण बनाने की दिशा में एक महत्वपूर्ण छलांग का प्रतिनिधित्व करता है। एक कठिन भविष्यवाणी समस्या को एक अधिक प्रबंधनीय वर्गीकरण कार्य (classification task) में सफलतापूर्वक बदलकर, शोधकर्ताओं ने भविष्य की प्रणालियों के लिए मार्ग प्रशस्त किया है जो एक दिन वैज्ञानिकों को वास्तविक समय में मस्तिष्क के साथ बातचीत करने में मदद कर सकती हैं, जिससे मन कैसे काम करता है और इसे कैसे सुधारा जा सकता है, इसकी समझ के नए द्वार खुलेंगे।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।