Temporal Dynamics and Explainable Risk Factors of Traffic Fatalities: A Large-Scale Study Using PRF Brazil Data (2020-2024)
यह अध्ययन ब्राज़ीलियाई संघीय राजमार्ग पुलिस (2020-2024) के एक बड़े पैमाने के डेटासेट का उपयोग करके यह प्रदर्शित करता है कि एक कॉस्ट-सेंसिटिव लाइटजीबीएम (LightGBM) मॉडल, जिसे कठोर टेम्पोरल स्प्लिटिंग और SHAP-आधारित व्याख्यात्मकता के माध्यम से मान्य किया गया है, यातायात जनित मौतों की भविष्यवाणी करने में अन्य एंसेम्बल विधियों से बेहतर प्रदर्शन करता है और सक्रिय सुरक्षा नीतियों को सूचित करने के लिए प्रमुख जोखिम कारकों की पहचान करता है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
हर साल, दुनिया भर में सड़क दुर्घटनाओं में दस लाख से अधिक लोग अपनी जान गंवा देते हैं। ये केवल आँकड़े नहीं हैं; ये एक गंभीर सार्वजनिक सुरक्षा चुनौती का प्रतिनिधित्व करते हैं जो हर जगह समुदायों, अर्थव्यवस्थाओं और परिवारों को प्रभावित करती है। हालाँकि इन दुर्घटनाओं के कारण जटिल हैं, जिनमें चालक के व्यवहार और वाहन की स्थिति से लेकर मौसम और सड़क डिजाइन तक सब कुछ शामिल है, मूल समस्या वही रहती है: हम यह कैसे अनुमान लगा सकते हैं कि कौन सी दुर्घटनाएं होने से पहले ही घातक होने वाली हैं? दशकों से, शोधकर्ताओं ने ऐतिहासिक डेटा को देखकर इसका उत्तर देने का प्रयास किया है, लेकिन उस डेटा का विश्लेषण करने के लिए उपयोग की जाने वाली विधियाँ अक्सर सीमित रही हैं। पारंपरिक दृष्टिकोण कभी-कभी विभिन्न जोखिम कारकों के बीच सूक्ष्म, गैर-रेखीय (non-linear) संबंधों को पकड़ने में विफल रहते हैं, और वे अक्सर इस बात को समझने में विफल रहते हैं कि यातायात के पैटर्न समय के साथ कैसे बदलते हैं। ऐसे युग में जहाँ गतिशीलता तेजी से बदलती है—जैसे कि वैश्विक महामारी के दौरान—पुराने डेटा पर प्रशिक्षित मॉडल आज की सड़कों के खतरों को सटीक रूप से नहीं दर्शा सकते। सुरक्षा में वास्तव में सुधार करने के लिए, हमें ऐसे उपकरणों की आवश्यकता है जो सूचना की विशाल मात्रा से सीख सकें, नई स्थितियों के अनुकूल बन सकें, और यह स्पष्ट रूप से समझा सकें कि वे कुछ विशेष भविष्यवाणियां क्यों करते हैं।
यह वही चुनौती है जिसे इंडोनेशिया और ऑस्ट्रेलिया के शोधकर्ताओं की एक टीम ने स्वीकार किया, जिन्होंने अपना ध्यान ब्राजील के विस्तृत संघीय राजमार्ग नेटवर्क की ओर लगाया। उन्होंने यह समझने की कोशिश की कि कौन से विशिष्ट कारक एक यातायात घटना को त्रासदी में बदल देते हैं, जिसके लिए उन्होंने 2020 से 2024 के बीच एकत्र किए गए 2.5 मिलियन से अधिक दुर्घटना रिकॉर्ड के विशाल डेटासेट का उपयोग किया। यह अवधि विशेष रूप से महत्वपूर्ण थी क्योंकि इसने वैश्विक महामारी के दौरान और उसके बाद लोगों के आवागमन के नाटकीय बदलाव को कैद किया। संकट की शुरुआत में, सख्त लॉकडाउन के कारण यात्रा में भारी गिरावट आई, लेकिन जैसे-जैसे प्रतिबंधों में ढील दी गई, यातायात के पैटर्न उन तरीकों से सामान्य होने लगे जो तुरंत अनुमानित नहीं थे। शोधकर्ता यह जानना चाहते थे कि क्या वे एक ऐसा कंप्यूटर सिस्टम बना सकते हैं जो पिछले कुछ वर्षों की दुर्घटनाओं से सीखकर हाल के वर्ष की दुर्घटनाओं के जोखिम का सटीक अनुमान लगा सके, जो कि इस बात का परीक्षण था कि क्या मॉडल केवल पुराने डेटा को याद रखने के बजाय वास्तविक दुनिया के परिवर्तनों को संभाल सकता है।
इसे करने के लिए, टीम ने मशीन लर्निंग नामक एक परिष्कृत दृष्टिकोण का उपयोग किया, विशेष रूप से तीन शक्तिशाली प्रकार के एल्गोरिदम का उपयोग किया जो डिजिटल जासूसों की तरह कार्य करते हैं। ये एल्गोरिदम, जिन्हें रैंडम फॉरेस्ट (Random Forest), एक्सजीबूस्ट (XGBoost) और लाइटजीबीएम (LightGBM) के रूप में जाना जाता है, हजारों चरों (variables) को छानकर उन पैटर्न को खोजने के लिए डिज़ाइन किए गए हैं जिन्हें मनुष्य अनदेखा कर सकते हैं। उन्होंने इन प्रणालियों में वाहन के प्रकार और मौसम की स्थिति से लेकर दिन के विशिष्ट समय और दुर्घटना होने वाले सड़क के प्रकार तक की जानकारी डाली। महत्वपूर्ण रूप से, शोधकर्ताओं ने वर्षों को यादृच्छिक रूप से (randomly) आपस में नहीं मिलाया। इसके बजाय, उन्होंने 2020 से 2023 तक के डेटा पर मॉडलों को प्रशिक्षित किया और फिर उनसे 2024 में हुई दुर्घटनाओं के परिणामों की भविष्यवाणी करने को कहा। यह "आउट-ऑफ-टाइम" परीक्षण तरीका यह देखने का एक कठोर तरीका है कि क्या एक मॉडल वास्तव में अपने ज्ञान को एक नए भविष्य में लागू कर सकता है, न कि केवल अतीत को याद कर सकता है।
इस प्रयोग के परिणाम काफी खुलासा करने वाले थे। जबकि तीनों कंप्यूटर मॉडल चोट लगने वाली दुर्घटनाओं और बिना चोट वाली दुर्घटनाओं के बीच अंतर करने में काफी हद तक सफल रहे, एक एल्गोरिदम सबसे प्रभावी पाया गया जो सबसे खतरनाक मामलों की पहचान करने में सक्षम था। लाइटजीबीएम (LightGBM) मॉडल सबसे संवेदनशील साबित हुआ, जिसने अपने प्रतिस्पर्धियों की तुलना में घातक दुर्घटनाओं के उच्च प्रतिशत को सफलतापूर्वक पहचाना। इसने लगभग 68 प्रतिशत दुर्घटनाओं को सही ढंग से चिह्नित किया जो मृत्यु का कारण बनीं, जो अन्य मॉडलों की तुलना में एक महत्वपूर्ण सुधार है जो इन महत्वपूर्ण घटनाओं को पहचानने में चूक गए थे। हालाँकि, इस उच्च संवेदनशीलता के साथ एक समझौता भी आया: यह मॉडल गलत अलार्म उठाने के प्रति भी प्रवृत्त था, कभी-कभी ऐसी दुर्घटना की भविष्यवाणी कर देता था जहाँ मृत्यु नहीं हुई थी। इसका अर्थ यह है कि जबकि यह प्रणाली त्रासदियों को पकड़ने के लिए एक विस्तृत जाल बिछाने में उत्कृष्ट है, यह अभी तक नीति निर्धारण के लिए एकमात्र निर्णय लेने वाला बनने हेतु पर्याप्त परिष्कृत नहीं है।
शायद इस अध्ययन का सबसे मूल्यवान योगदान केवल भविष्यवाणी के आंकड़ों से परे है। क्योंकि ये उन्नत कंप्यूटर मॉडल कभी-कभी "ब्लैक बॉक्स" की तरह कार्य कर सकते हैं—अर्थात बिना यह बताए कि निर्णय कैसे लिया गया—शोधकर्ताओं ने SHAP नामक तकनीक का उपयोग करके पर्दे को हटाने का काम किया। इस पद्धति ने शोधकर्ताओं को यह देखने की अनुमति दी कि कौन से कारक भविष्यवाणियों को संचालित कर रहे थे। उन्होंने पाया कि घातक परिणाम का जोखिम किसी एक कारण से निर्धारित नहीं होता था, बल्कि कई प्रमुख तत्वों के जटिल मेल से होता था। सड़क का प्रकार सबसे प्रभावशाली कारक था; उदाहरण के लिए, बिना बाधाओं वाली दो-लेन की सड़कें अन्य विन्यासों की तुलना में काफी अधिक खतरनाक थीं। टक्कर की प्रकृति भी बहुत मायने रखती थी, जिसमें आमने-सामने की टक्कर (head-on crashes) अन्य प्रकार की टक्करों की तुलना में मृत्यु का बहुत अधिक जोखिम पैदा करती है। इसके अलावा, दिन का समय भी एक महत्वपूर्ण भूमिका निभाता था, क्योंकि कम दृश्यता या उच्च चालक थकान के घंटों के दौरान होने वाली दुर्घटनाएं अधिक गंभीर होने की संभावना रखती थीं।
अध्ययन ने यह भी उजागर किया कि ये कारक एक साथ मिलकर कैसे काम करते हैं। उदाहरण के लिए, एक विशिष्ट सड़क प्रकार का खतरा बढ़ सकता है यदि दुर्घटना रात के समय हुई हो, या यदि मोटरसाइकिल जैसे कम सुरक्षा वाले वाहन का उच्च गति वाली टक्कर में शामिल हो। ये अंतःक्रियाएं (interactions) बताती हैं कि सुरक्षा केवल एक समस्या को ठीक करने के बारे में नहीं है, बल्कि यह समझने के बारे में है कि सड़क डिजाइन, वाहन का प्रकार और मानवीय व्यवहार विशिष्ट क्षणों में कैसे टकराते हैं। शोधकर्ताओं ने इस बात पर जोर दिया कि उनके निष्कर्ष अंतिम समाधान नहीं हैं, बल्कि जोखिमों की जांच करने के लिए एक शक्तिशाली उपकरण हैं। जोखिमों को उजागर करने की मॉडल की क्षमता अधिकारियों को यह तय करने में मदद कर सकती है कि सुरक्षा अवरोध कहाँ स्थापित किए जाएं, गश्त कहाँ बढ़ाई जाए, और गति सीमा को कहाँ अधिक सख्ती से लागू किया जाए।
अंततः, यह शोध यह प्रदर्शित करता है कि बड़े पैमाने के डेटा को उन्नत, व्याख्या योग्य कृत्रिम बुद्धिमत्ता (AI) के साथ जोड़कर, हम उन अदृश्य शक्तियों की एक स्पष्ट तस्वीर प्राप्त कर सकते हैं जो यातायात संबंधी मौतों का कारण बनती हैं। यह अध्ययन पुष्टि करता है कि हालांकि कोई भी एकल मॉडल भविष्य की सटीक भविष्यवाणी नहीं कर सकता, लेकिन सही उपकरण सड़क, वाहन और समय के सबसे खतरनाक संयोजनों की पहचान कर सकते हैं। इन पैटर्न को समझकर, नीति निर्माता प्रतिक्रियात्मक उपायों से हटकर सक्रिय रणनीतियों की ओर बढ़ सकते हैं, जिससे उन विशिष्ट स्थितियों को संबोधित करके जीवन बचाना संभव हो सकता है जो एक सामान्य यात्रा को घातक घटना में बदल देती हैं। यह कार्य एक अनुस्मारक है कि सड़क सुरक्षा की जटिल दुनिया में, आगे का रास्ता केवल डेटा के विश्लेषण में नहीं, बल्कि उसे वास्तव में समझने में निहित है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।