Differentiable Reinforcement Learning for Path Tracking by an Agile Fish-Like Robot
यह शोध पत्र एक गणनात्मक रूप से कुशल सिमुलेशन प्लेटफॉर्म और एक विभेदक (डिफरेंशिएबल) सुदृढीकरण शिक्षण दृष्टिकोण पेश करके फुर्तीले मछली जैसे रोबोटों को नियंत्रित करने की चुनौतियों का समाधान करता है जो बैकप्रोपैगेशन और पाठ्यक्रम प्रशिक्षण के माध्यम से PID गेन्स को अनुकूलित करता है, और सटीक पथ ट्रैकिंग के लिए सीखे गए नीति को सिमुलेशन से एक भौतिक रोबोट में सफलतापूर्वक स्थानांतरित करता है।