Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter
यह शोध पत्र एक पूर्वसूचक जोखिम-निर्देशित सुदृढीकरण शिक्षण (reinforcement learning) ढांचे का प्रस्ताव करता है जो क्लोजेस्ट पॉइंट ऑफ अप्रोच (CPA) से प्राप्त एक स्व-अनुमानित, दिशात्मक रूप से संरेखित टकराव जोखिम मानचित्र का लाभ उठाता है ताकि एक क्वाड्रोटर केवल ऑनबोर्ड डेप्थ सीक्वेंस का उपयोग करके गतिशील अव्यवस्था (dynamic clutter) के माध्यम से सुरक्षित और कुशलतापूर्वक नेविगेट कर सके, जिससे सिमुलेशन से वास्तविकता में सुदृढ़ ज़ीरो-शॉट ट्रांसफर प्राप्त होता है।