← नवीनतम पेपर
💻 computer science

Multimodal Driver Visual Load Assessment and Prediction under Dynamic Lighting Environments Using RaceGrid-OPTICS and WA-PSRSMformer

यह अध्ययन एक मल्टीमॉडल फ्रेमवर्क प्रस्तावित करता है जो गतिशील प्रकाश व्यवस्था की स्थितियों में ड्राइवर के विजुअल लोड का सटीक आकलन और पूर्वानुमान लगाने के लिए एक नवीन RaceGrid-OPTICS क्लस्टरिंग एल्गोरिदम और WA-PSRSMformer डीप लर्निंग मॉडल के साथ आई-मूवमेंट, इल्यूमिनेशन और वाहन-गति डेटा को एकीकृत करता है, जिससे टनल वातावरण में 90.13% सटीकता प्राप्त होती है।

मूल लेखक: Noman Iqbal, Yishui Zhu, Fenjiao Wang, Luyang Wang

प्रकाशित 2026-09-25
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Noman Iqbal, Yishui Zhu, Fenjiao Wang, Luyang Wang

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। ✨ नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

ड्राइविंग मानव मस्तिष्क और सड़क के बीच निरंतर होने वाली एक बातचीत है। हम में से अधिकांश के लिए, यह बातचीत बिना किसी सचेत विचार के होती है, लेकिन यह मुख्य रूप से एक इंद्रिय पर निर्भर करती है: दृष्टि। जब प्रकाश अचानक बदल जाता है—एक धूप से भरी चमकीली हाईवे से निकलकर सुरंग के धुंधले आंतरिक भाग में प्रवेश करना, या सड़क के उस हिस्से से गुजरना जहाँ पेड़ों की छाया विंडशील्ड पर तेजी से झिलमिलाती है—तो आँखों और मस्तिष्क को तालमेल बिठाने के लिए अतिरिक्त प्रयास करना पड़ता है। सूचना की यह अचानक बढ़ती मांग एक स्थिति पैदा करती है जिसे 'विजुअल लोड' (दृश्य भार) कहा जाता है। यह वह मानसिक प्रयास है जो आँखें जो देखती हैं, उसे संसाधित करने के लिए आवश्यक होता है। जब यह भार बहुत अधिक हो जाता है, तो खतरों को पहचानने, आकृतियों को समझने और खतरों के प्रति प्रतिक्रिया देने की ड्राइवर की क्षमता कम हो सकती है, जिससे एक सामान्य यात्रा एक संभावित जोखिम में बदल सकती है। हालाँकि हम जानते हैं कि प्रकाश के ये बदलाव खतरनाक होते हैं, लेकिन वास्तविक समय में यह मापना कठिन रहा है कि वे ड्राइवर पर मानसिक तनाव का कितना भार डालते हैं।

चांगआन विश्वविद्यालय के शोधकर्ताओं की एक टीम ने इस अदृश्य मानसिक प्रयास में झाँकने का एक नया तरीका विकसित किया है। उन्होंने एक ऐसा सिस्टम बनाने का लक्ष्य रखा जो न केवल ड्राइवर के विजुअल लोड को घटित होते समय माप सके, बल्कि यह भी अनुमान लगा सके कि यह कब बढ़ने वाला है, और वह भी तब भी जब कार बदलते हुए जटिल प्रकाश के बीच चल रही हो। इसके लिए, वे ड्राइविंग सिम्युलेटर के नियंत्रित, कृत्रिम वातावरण से आगे बढ़े और अपने प्रयोग को वास्तविक सड़कों पर ले गए। उन्होंने दस ड्राइवरों को चुना और एक मानक सेडान कार को सेंसरों के एक समूह से सुसज्जित किया: ड्राइवर कहाँ देख रहा है और उसकी पुतलियाँ कैसे प्रतिक्रिया दे रही हैं, इसे ट्रैक करने के लिए एक पहनने योग्य कैमरा; सामने की सड़क को रिकॉर्ड करने के लिए एक डैशबोर्ड कैमरा; और वातावरण की सटीक चमक मापने के लिए एक लाइट मीटर। ड्राइवरों ने तीन अलग-अलग परिदृश्यों का अनुभव किया: स्थिर प्रकाश वाला एक लंबा, सीधा रास्ता; एक छायादार हिस्सा जहाँ पेड़ों के बीच से धूप झिलमिला रही थी; और एक सुरंग जहाँ प्रकाश अचानक तेज रोशनी से अंधेरे और फिर वापस उजाले में बदल गया।

शोधकर्ताओं ने भारी मात्रा में डेटा एकत्र किया, जिसमें ड्राइवरों की आँखों की गतिविधियों को बदलते प्रकाश और कार की गति के साथ तालमेल बिना जोड़ा गया। उन्होंने विशिष्ट जैविक संकेतों पर ध्यान केंद्रित किया, जैसे कि पुतलियों का आकार और उनके बदलने की गति, साथ ही यह भी कि आँखें कहाँ टिकी थीं और वे कितनी बार नए बिंदुओं पर झपकीं। ये संकेत मस्तिष्क के कार्यभार के प्रति शरीर की ईमानदार प्रतिक्रिया हैं; जब आँखें प्रकाश के अचानक परिवर्तन के अनुकूल होने के लिए संघर्ष करती हैं, तो पुतलियाँ और दृष्टि पैटर्न अनुमानित तरीकों से बदलते हैं। हालाँकि, संख्याओं की इस कच्ची धारा को "उच्च लोड" या "कम लोड" की स्पष्ट तस्वीर में बदलना एक जटिल पहेली है। टीम ने पहले एक परिष्कृत पद्धति का उपयोग करके समान पैटर्न को एक साथ समूहित किया, प्रभावी रूप से एक कंप्यूटर को यह सिखाया कि एक आरामदायक ड्राइव और एक तनावपूर्ण ड्राइव के बीच अंतर कैसे पहचाना जाए, जिसमें पहले से निर्धारित नियमों की आवश्यकता नहीं थी। उन्होंने पाया कि यह दृष्टिकोण डेटा को पांच अलग-अलग स्तरों में वर्गीकृत करने में सफल रहा, जो शांति से लेकर अत्यधिक तनाव तक विस्तृत थे।

एक बार जब सिस्टम इन अवस्थाओं की पहचान करने में सक्षम हो गया, तो शोधकर्ताओं ने अधिक कठिन कार्य यानी 'पूर्वानुमान' की ओर रुख किया। वे जानना चाहते थे कि क्या सिस्टम वर्तमान डेटा को देखकर कुछ क्षणों बाद ड्राइवर के विजुअल लोड का अनुमान लगा सकता है। उन्होंने कई अलग-अलग कंप्यूटर मॉडल का परीक्षण किया, जिनमें से कुछ छवियों में पैटर्न खोजने में कुशल हैं और अन्य जो समय के साथ घटनाओं के क्रम को याद रखने के लिए डिज़ाइन किए गए हैं। सबसे सफल दृष्टिकोण 'ट्रांसफॉर्मर' नामक एक प्रकार का आर्टिफिशियल इंटेलिजेंस मॉडल था, जो विशेष रूप से एक लंबी श्रृंखला में एक घटना से दूसरी घटना के संबंध को समझने में सक्षम है। इस मॉडल को ड्राइविंग की विशिष्ट चुनौती के लिए और भी बेहतर बनाने के लिए, टीम ने तीन प्रमुख सुधार किए। पहला, उन्होंने इसे दुर्लभ, उच्च-तनाव वाले क्षणों पर विशेष ध्यान देने के लिए प्रशिक्षित किया, जो शांत ड्राइविंग की तुलना में कम बार होते हैं लेकिन उन्हें पकड़ना सबसे महत्वपूर्ण है। दूसरा, उन्होंने इसकी आंतरिक प्रक्रिया को सुव्यवस्थित किया ताकि यह अनावश्यक गणनाओं में उलझे बिना ड्राइविंग डेटा के लंबे दौर को संभाल सके। अंत में, उन्होंने इसके मेमोरी उपयोग को अनुकूलित किया, जिससे यह उस हार्डवेयर पर कुशलतापूर्वक चल सके जो एक वास्तविक कार में मिल सकता है।

वास्तविक दुनिया के इस परीक्षण के परिणाम चौंकाने वाले थे। सबसे चुनौतीपूर्ण वातावरण में—सुरंग में, जहाँ प्रकाश अचानक बदलता है—नए सिस्टम ने ड्राइवर के विजुअल लोड की 90 प्रतिशत से अधिक सटीकता के साथ भविष्यवाणी की। यह उनके द्वारा परीक्षण किए गए अन्य मॉडलों की तुलना में काफी बेहतर था, जो तीव्र परिवर्तनों के साथ तालमेल बिठाने में संघर्ष कर रहे थे। यह सिस्टम उल्लेखनीय रूप से कुशल भी था, जिसने पुराने मॉडलों की तुलना में बहुत कम समय में डेटा को प्रोसेस किया, जो कि किसी भी ऐसी तकनीक के लिए एक महत्वपूर्ण कारक है जिसे चलते वाहन में तुरंत काम करने की आवश्यकता होती है। अध्ययन ने पुष्टि की कि आई-ट्रैकिंग डेटा, प्रकाश माप और वाहन की गति का संयोजन ड्राइवर के तनाव की एक पूर्ण तस्वीर प्रदान करता है। इसने दिखाया कि जबकि सीधी सड़कें आम तौर पर पूर्वानुमानित होती हैं, सुरंग में प्रवेश करना और बाहर निकलना सबसे जटिल दृश्य मांगें पैदा करता है, जो अक्सर ड्राइवरों को उच्च-लोड वाली स्थिति में धकेल देता है जिसे सिस्टम पहचान और अनुमान लगा सकता है।

यह कार्य न केवल तनाव को मापने का एक तरीका प्रदान करता है; यह एक सुरक्षित भविष्य का खाका भी पेश करता है। यह समझते हुए कि प्रकाश की स्थितियाँ ड्राइवर की दृष्टि पर कितना दबाव डालती हैं, इंजीनियर बेहतर चेतावनी प्रणाली डिजाइन कर सकते हैं जो ड्राइवरों को अभिभूत होने से पहले सतर्क कर सके। सिस्टम ने सिद्ध किया कि आँखों की प्राकृतिक प्रतिक्रियाओं का उपयोग करके वास्तविक समय में ड्राइविंग के अदृश्य मानसिक कार्यभार की निगरानी करना संभव है। जैसे-जैसे सड़कें अधिक जटिल हो रही हैं और स्वायत्त ड्राइविंग सिस्टम (ऑटोनॉमस ड्राइविंग सिस्टम) अधिक जिम्मेदारी संभाल रहे हैं, मानव तत्व की देखने और प्रतिक्रिया करने की क्षमता को मापने का एक विश्वसनीय तरीका होना अनिवार्य होगा। शोधकर्ताओं ने दिखाया है कि सही उपकरणों के साथ, हम सड़क के अदृश्य बोझ को देख सकते हैं और शायद, ऐसा करके, उन दुर्घटनाओं को रोक सकते हैं जो तब होती हैं जब वह बोझ ढोने के लिए बहुत भारी हो जाता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →