A Heuristic Approach for Performance Tuning in RL-based Quadrotor Control via Reward Design and Termination Conditions
यह शोध पत्र एक डुअल-बैंडविड्थ एक्सपोनेंशियल रिवॉर्ड स्ट्रक्चर और टर्मिनेशन कंडीशंस को डिजाइन करके RL-आधारित क्वाड्रोटर नियंत्रण के प्रदर्शन को ट्यून करने के लिए एक नवीन ह्यूरिस्टिक दृष्टिकोण प्रस्तावित करता है, जो क्रिटिकली डैम्प्ड बेसलाइन रिस्पॉन्स और कम स्टेडी-स्टेट एरर बनाए रखते हुए समायोज्य सेटलिंग टाइम (एक्रोबैटिक से लेकर निरीक्षण-जैसे तक की रेंज में) वाली पॉलिसियों के निर्माण को सक्षम बनाता है।