Transparent Environment, Social, and Governance (ESG) Risk Score Prediction Using Machine Learning and Explainable AI
यह अध्ययन प्रदर्शित करता है कि एक व्याख्या योग्य मशीन लर्निंग पाइपलाइन, विशेष रूप से सार्वजनिक डेटा पर SHAP और LIME तकनीकों के साथ XGBoost का उपयोग करते हुए, पारदर्शी और पुनरुत्पादित पर्यावरणीय, सामाजिक और शासन (ESG) जोखिम स्कोर की प्रभावी ढंग से भविष्यवाणी कर सकती है, जो मालिकाना रेटिंग प्रणालियों के लिए एक व्यवहार्य विकल्प प्रदान करती है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
आधुनिक वित्तीय दुनिया में, किसी कंपनी के मूल्य को अब केवल उसके मुनाफे से नहीं मापा जाता है। निवेशक, नियामक और जनता तेजी से यह जानना चाहते हैं कि एक व्यवसाय ग्रह, अपने श्रमिकों और अपने स्वयं के नेतृत्व के साथ कैसा व्यवहार करता है। यह व्यापक मूल्यांकन ESG के संक्षिप्त नाम से जाना जाता है, जो एनवायर्नमेंटल (पर्यावरण), सोशल (सामाजिक) और गवर्नेंस (शासन) को दर्शाता है। पर्यावरणीय स्तंभ कंपनी के पारिस्थितिक पदचिह्न को देखता है, जैसे कि इसके कार्बन उत्सर्जन और अपशिष्ट। सामाजिक स्तंभ यह जांचता है कि संगठन समाज के साथ कैसे अंतःक्रिया करता है, जिसमें कर्मचारियों और स्थानीय समुदायों के साथ उसका व्यवहार शामिल है। गवर्नेंस स्तंभ इस बात पर ध्यान केंद्रित करता है कि कंपनी कैसे चलाई जाती है, जिसमें उसके नेतृत्व की संरचना और बोर्ड की विविधता पर विचार किया जाता है। हालांकि ये रेटिंग नैतिक निवेश के मार्गदर्शन के लिए बनाई गई हैं, लेकिन इन्हें गणना करने के तरीके अक्सर गुप्त होते हैं। प्रमुख रेटिंग एजेंसियां अपने फॉर्मूलों को निजी रखती हैं, और अपने स्कोर को मालिकाना उत्पाद के रूप में मानती हैं। पारदर्शिता की इस कमी का अर्थ है कि इन स्कोरों पर भरोसा करने वाले लोग भी आसानी से यह नहीं देख सकते कि नंबर कैसे निकाले गए थे, जिससे ये रेटिंग एक ऐसे 'ब्लैक बॉक्स' में बदल जाती हैं जिन्हें सत्यापित करना या जिन पर विश्वास करना कठिन होता है।
दक्षिण अफ्रीका के शोधकर्ताओं की एक टीम ने इन 'ब्लैक बॉक्स' को खोलने का प्रयास किया। वे देखना चाहते थे कि क्या वे केवल सार्वजनिक जानकारी का उपयोग करके इन ESG जोखिम स्कोर की भविष्यवाणी करने के लिए एक स्पष्ट, पारदर्शी प्रणाली बना सकते हैं। महंगी, निजी डेटाबेस पर निर्भर रहने के बजाय, टीम ने एक मुफ्त वित्तीय पोर्टल से डेटा एकत्र किया जो 'सस्टेनेबिलिटीटिक्स' (Sustainalytics) नामक सेवा से जानकारी एकत्रित करता है। उन्होंने बीस चार अलग-अलग देशों की हजारों कंपनियों से जानकारी एकत्र की, जिसमें प्रौद्योगिकी से लेकर खनन तक विभिन्न उद्योगों को कवर किया गया। उनका लक्ष्य दो अलग-अलग प्रकार के कंप्यूटर मॉडल का परीक्षण करना था। पहला प्रकार, जिसे 'व्हाइट-बॉक्स मॉडल' कहा जाता है, सरल और समझने में आसान है, जैसे कि नियमों की एक सीधी सूची। दूसरा प्रकार, जिसे 'ब्लैक-बॉक्स मॉडल' कहा जाता है, बहुत अधिक जटिल और शक्तिशाली है लेकिन आमतौर पर व्याख्या करने में असंभव है क्योंकि यह गणनाओं के एक उलझे हुए जाल की तरह काम करता है। शोधकर्ताओं ने इन मॉडलों को वित्तीय डेटा और कंपनी की विशेषताओं के आधार पर ESG जोखिम स्कोर का अनुमान लगाने के लिए प्रशिक्षित किया, और फिर विशेष उपकरणों का उपयोग किया ताकि जटिल मॉडलों को अपने तर्क समझाने के लिए मजबूर किया जा सके।
परिणामों ने दिखाया कि अधिक जटिल मॉडल सटीक भविष्यवाणियां करने में काफी बेहतर थे। सबसे सफल टूल एक परिष्कृत एल्गोरिदम था जिसे 'XGBoost' कहा जाता है, जिसने डेटा में उन सूक्ष्म पैटर्न को पहचानना सीखा जिन्हें सरल मॉडल छोड़ देते थे। पर्यावरणीय स्तंभ के लिए, यह मॉडल स्कोर के 92 प्रतिशत बदलावों को समझाने में सक्षम था, और गवर्नेंस स्तंभ के लिए, इसने 85 प्रतिशत की व्याख्या की। सामाजिक स्तंभ भविष्यवाणी करने के लिए सबसे कठिन साबित हुआ, जहाँ मॉडल ने 78 प्रतिशत बदलावों की व्याख्या की, जो यह सुझाव देता है कि सामाजिक जोखिमों से कारकों का एक व्यापक और अधिक अराजक सेट प्रभावित होता है। शोधकर्ताओं ने पाया कि सरल, पारदर्शी मॉडल इस स्तर की सटीकता से मेल नहीं खा सके। हालांकि वे पढ़ने में आसान थे, लेकिन वे कंपनी के वित्त और उसकी स्थिरता प्रदर्शन के बीच जटिल संबंधों को पकड़ने में विफल रहे। यह सुझाव देता है कि ESG जोखिमों को वास्तव में समझने के लिए, हमें शक्तिशाली उपकरणों का उपयोग करना चाहिए जो जटिल, गैर-रेखीय संबंधों को संभाल सकें, भले ही उन उपकरणों को समझने के लिए अतिरिक्त प्रयास की आवश्यकता हो।
इन शक्तिशाली मॉडलों के बहुत जटिल होने की समस्या को हल करने के लिए, शोधकर्ताओं ने 'एक्सप्लेनेबल एआई' (Explainable AI) नामक तकनीक का उपयोग किया। यह विधि एक स्पॉटलाइट की तरह काम करती है, जो ठीक उसी कारक पर प्रकाश डालती है जिसने एक विशिष्ट भविष्यवाणी को प्रेरित किया। जब उन्होंने अपने सर्वश्रेष्ठ प्रदर्शन करने वाले मॉडल पर यह स्पॉटलाइट जलाई, तो एक स्पष्ट तस्वीर उभर कर आई। कंपनी के जोखिम की भविष्यवाणी करने वाला सबसे प्रभावशाली कारक कोई एकल आंतरिक मीट्रिक नहीं था, बल्कि उसके उद्योग के साथियों का औसत जोखिम स्तर था। दूसरे शब्दों में, एक कंपनी का स्कोर काफी हद तक उसी क्षेत्र की अन्य कंपनियों के सामान्य व्यवहार से प्रभावित था। यदि कोई कंपनी ऐसे उद्योग में काम करती थी जहाँ उच्च पर्यावरणीय जोखिम सामान्य था, तो मॉडल ने उस कंपनी के लिए भी उच्च जोखिम की भविष्यवाणी की। वित्तीय स्वास्थ्य ने भी महत्वपूर्ण भूमिका निभाई; मजबूत लाभ और स्थिर ऋण संरचना वाली कंपनियों में गवर्नेंस और सामाजिक जोखिम स्कोर कम रहने की प्रवृत्ति थी। शोधकर्ताओं ने यह भी पाया कि विशिष्ट विवाद, जैसे कि श्रम या सुरक्षा से जुड़े घोटाले, जोखिम स्कोर को तेजी से ऊपर ले जाते हैं।
अध्ययन ने आगे खुलासा किया कि ये भविष्यवाणियां हर प्रकार के व्यवसाय के लिए समान रूप से सटीक नहीं थीं। मॉडल वित्त और उपभोक्ता क्षेत्रों की कंपनियों के लिए असाधारण रूप से अच्छा काम करते हैं, जहाँ डेटा सुसंगत और पैटर्न स्पष्ट होते हैं। हालांकि, मॉडल ऊर्जा, सामग्री और औद्योगिक परिवहन क्षेत्रों की कंपनियों के साथ अधिक संघर्ष करते हैं। इन उद्योगों में भविष्यवाणी में उच्च त्रुटियां देखी गईं, जिसका कारण संभवतः यह है कि उनका ESG डेटा अधिक जटिल, असंगत या विभिन्न देशों में मानकीकृत करने में कठिन है। शोधकर्ताओं ने यह देखने के लिए दक्षिण अफ्रीका की विशिष्ट कंपनियों का भी अध्ययन किया कि मॉडल वास्तविक दुनिया के परिदृश्यों में कैसा व्यवहार करता है। उन्होंने पाया कि एक वित्तीय कंपनी, जिसका पर्यावरणीय जोखिम स्कोर सबसे कम था, को सही ढंग से पहचाना गया क्योंकि उस क्षेत्र का प्राकृतिक भौतिक पदचिह्न छोटा होता है। इसके विपरीत, ऊर्जा क्षेत्र की एक कंपनी जिसे उच्चतम जोखिम स्कोर प्राप्त था, को भारी संसाधन-गहन संचालन के कारण चिह्नित किया गया। दिलचस्प बात यह है कि मॉडल ने एक वित्तीय कंपनी की भी पहचान की जिसमें आश्चर्यजनक रूप से उच्च गवर्नेंस जोखिम था, जो यह सुझाव देता है कि अत्यधिक विनियमित क्षेत्रों में भी, विशिष्ट आंतरिक अनियमितताएं जोखिम को बढ़ा सकती हैं।
अंततः, यह शोध प्रदर्शित करता है कि गुप्त, मालिकाना फॉर्मूलों पर निर्भर रहे बिना कॉर्पोरेट स्थिरता का आकलन करने के लिए एक पारदर्शी और पुनरुत्पादक प्रणाली बनाना संभव है। सार्वजनिक रूप से उपलब्ध डेटा और उन्नत मशीन लर्निंग का उपयोग करके, शोधकर्ताओं ने दिखाया कि वे उच्च सटीकता के साथ ESG जोखिम स्कोर की भविष्यवाणी कर सकते हैं। उन्होंने सिद्ध किया कि हालांकि कॉर्पोरेट जोखिम की पूरी तस्वीर को पकड़ने के लिए जटिल मॉडल आवश्यक हैं, फिर भी ऐसे उपकरण मौजूद हैं जो उनके निर्णयों को समझने योग्य बना सकते हैं। निष्कर्षों से पता चलता है कि एक कंपनी की ESG स्थिति उसके उद्योग के मानदंडों और उसकी अपनी वित्तीय स्थिरता से गहराई से जुड़ी हुई है। निवेशकों और नियामकों के लिए, यह कार्य कॉर्पोरेट जिम्मेदारी को देखने का एक नया तरीका प्रदान करता है, जो अपारदर्शी रेटिंग से हटकर एक ऐसी प्रणाली की ओर ले जाता है जहाँ स्कोर के पीछे के कारण स्पष्ट, तार्किक और जांच के लिए खुले हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।