Information Thermodynamics of Agents: The Work Capacity of Channels with Memory
यह शोध पत्र सचेत-क्रिया लूपों (percept-action loops) के सूचना ऊष्मागतिकी (information thermodynamics) के लिए एक रूपरेखा प्रस्तुत करता है, जो "कार्य क्षमता" (work capacity) को परिभाषित करते हुए यह प्रदर्शित करता है कि ऊर्जा-कुशल एजेंटों को पूर्वानुमान और विस्मृति (forgetting) के बीच संतुलन बनाना चाहिए, जो सक्रिय प्रणालियों में भविष्य कहनेवाला सटीकता (predictive accuracy) और ऊर्जा दक्षता के बीच एक मौलिक अंतर्विरोध को प्रकट करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
एक एकल जीवाणु से लेकर एक मानव तक, हर जीवित प्राणी संवेदना और क्रिया के एक निरंतर चक्र में मौजूद है। वह दुनिया को देखता है, उस जानकारी को संसाधित करता है, और फिर दुनिया को बदलने के लिए कार्य करता है, जो बदले में उसे वह दिखाता है जो वह आगे देखेगा। यह चक्र, जिसे 'परसेप्ट-एक्शन लूप' (percept-action loop) कहा जाता है, अस्तित्व और सीखने का इंजन है। दशकों से, वैज्ञानिकों ने समझा है कि भविष्य की भविष्यवाणी करने की क्षमता इस लूप में एक शक्तिशाली उपकरण है। यदि आप अनुमान लगा सकते हैं कि आगे क्या होगा, तो आप उसके लिए तैयार हो सकते हैं, जिससे ऊर्जा की बचत होती है और खतरे से बचा जा सकता है। यह विचार जीव विज्ञान और कृत्रिम बुद्धिमत्ता (AI) के लिए इतना केंद्रीय है कि कई लोग यह मान लेते हैं कि कुशल होने का सबसे अच्छा तरीका एक पूर्ण भविष्यवक्ता बनना है, जो भविष्य की सटीक भविष्यवाणी करने के लिए अतीत के हर विवरण को याद रखता है।
हालाँकि, इनसब्रुक के भौतिकविदों के एक दल के एक नए अध्ययन ने इस लंबे समय से चली आ रही धारणा को चुनौती दी है। उन्होंने एक मौलिक प्रश्न पूछा: उस एजेंट के लिए ऊर्जा दक्षता की परम सीमा क्या है जो अपने पर्यावरण के साथ अंतःक्रिया करता है? इसका उत्तर देने के लिए, उन्होंने सूचना के ऊष्मप्रवैगिकी (thermodynamics of information) का अध्ययन किया। सरल शब्दों में, ऊष्मप्रवैगिकी इस बात का अध्ययन है कि ऊर्जा कैसे चलती है और रूप बदलती है। ऊष्मप्रवैगिकी का दूसरा नियम हमें बताता है कि ऊर्जा को बनाया या नष्ट नहीं किया जा सकता, केवल रूपांतरित किया जा सकता है, और प्रत्येक प्रक्रिया कुछ अपशिष्ट ऊष्मा उत्पन्न करती है। जब कोई एजेंट सूचना को संसाधित करता है—जैसे कि मस्तिष्क किसी पैटर्न को याद करता है या कंप्यूटर किसी चाल की गणना करता है—तो उसे एक ऊर्जा लागत चुकानी पड़ती है। शोधकर्ता जानना चाहते थे कि एक एजेंट इन सख्त भौतिक नियमों का पालन करते हुए अपने परिवेश से कितना उपयोगी कार्य निकाल सकता है।
टीम ने एजेंटों और उनके वातावरण को चैनलों के रूप में मॉडल करने के लिए एक गणितीय ढांचा विकसित किया जो सूचनाओं का आदान-प्रदान करते हैं। उन्होंने एक नई अवधारणा परिभाषित की जिसे "कार्य क्षमता" (work capacity) कहा गया, जो उस अधिकतम दर का प्रतिनिधित्व करती है जिस पर एक एजेंट अपने परिवेश से ऊर्जा निकालने की अपेक्षा कर सकता है। उनके मॉडल में, एजेंट केवल एक निष्क्रिय पर्यवेक्षक नहीं है; वह सक्रिय रूप से पर्यावरण को प्रभावित करता है, और पर्यावरण प्रतिक्रिया देता है। यह एक फीडबैक लूप बनाता है जहाँ एजेंट के कार्य उस डेटा को बदलते हैं जो वह प्राप्त करता है। विभिन्न प्रकार के एजेंटों के साथ सिमुलेशन चलाकर, उन्होंने एक आश्चर्यजनक व्यापार-संतुलन (trade-off) की खोज की। उन परिदृश्यों में जहाँ एजेंट के कार्य भविष्य के अवलोकनों को सीधे प्रभावित करते हैं, सबसे ऊर्जा-कुशल रणनीति सब कुछ याद रखना नहीं है।
अध्ययन में पाया गया कि इन संवादात्मक लूपों में, वे एजेंट जो पूर्ण भविष्यवक्ता बनने की कोशिश करते हैं, वे वास्तव में उन एजेंटों की तुलना में खराब प्रदर्शन कर सकते हैं जो भूल जाते हैं। चरम ऊर्जा दक्षता पर काम करने के लिए, एक एजेंट को भविष्यवाणी और विस्मरण (भूलने) के बीच संतुलन बनाना चाहिए। ऐसा इसलिए है क्योंकि भविष्य की सटीक भविष्यवाणी करने के लिए अतीत के हर विवरण को थामे रखने से एजेंट एक कठोर पैटर्न में फंस सकता है जो उसे ऊर्जा निकालने के लिए आवश्यक यादृच्छिकता (randomness) उत्पन्न करने से रोकता है। शोधकर्ताओं ने दिखाया कि कुछ वातावरणों के लिए, भविष्य की भविष्यवाणी करने में सर्वश्रेष्ठ एजेंटों का समूह और ऊर्जा संचय करने में सर्वश्रेष्ठ एजेंटों का समूह पूरी तरह से अलग है। वास्तव में, उन्होंने सिद्ध किया कि इन विशिष्ट स्थितियों में, एक एजेंट एक ही समय में अधिकतम भविष्यवक्ता और अधिकतम कुशल नहीं हो सकता है।
यह निष्कर्ष पिछले सिद्धांतों से एक महत्वपूर्ण विचलन है, जो अक्सर एक "टेप सेटिंग" (tape setting) पर आधारित थे जहाँ एक एजेंट केवल डेटा की एक पूर्व-मौजूद धारा को पढ़ता है बिना उसे प्रभावित किए। उस निष्क्रिय परिदृश्य में, एक पूर्ण भविष्यवक्ता होना वास्तव में सबसे कुशल मार्ग है। लेकिन वास्तविक दुनिया में, जहाँ क्रियाएं पर्यावरण को बदल देती हैं, नियम अलग हैं। अध्ययन दर्शाता है कि भविष्यवाणी करने की प्रेरणा और ऊर्जा-कुशल होने की प्रेरणा के बीच एक मौलिक तनाव है। कुशल होने के लिए, एक एजेंट को अपनी स्मृति को संतुलित करना चाहिए, यह जानते हुए कि अतीत को कब छोड़ देना है। यह सुझाव देता है कि प्रकृति या कृत्रिम बुद्धिमत्ता में दिखने वाले व्यवहार, जो शायद "भूलने" या अप्रत्याशित रूप से कार्य करने जैसे लग सकते हैं, वास्तव में ऊर्जा बचाने की एक परिष्कृत रणनीति हो सकते हैं। यह कार्य इस बात को समझने के लिए एक नया दृष्टिकोण प्रदान करता है कि कैसे जैविक प्रणालियों और भविष्य की मशीनों को हमारे ब्रह्मांड की सख्त ऊर्जा सीमाओं के भीतर संचालित होने के लिए डिज़ाइन किया जा सकता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।