Goal-oriented safe active learning for predictive control using Bayesian recurrent neural networks
यह शोध पत्र मॉडल प्रेडिक्टिव कंट्रोल के लिए एक लक्ष्य-उन्मुख सुरक्षित सक्रिय शिक्षण ढांचे का प्रस्ताव करता है जो अन्वेषण (exploration) और लक्ष्य-प्राप्ति (goal-reaching) चरणों के बीच बारी-बारी से बदलकर बेयसियन आवर्ती तंत्रिका नेटवर्क (Bayesian recurrent neural network) के मापदंडों को पुनरावर्ती रूप से अपडेट करता है, जिससे सिस्टम डायनेमिक्स के ऑनलाइन अनुकूलन के दौरान सुरक्षा, परिमित-समय अन्वेषण समाप्ति और निकट-इष्टतम प्रदर्शन सुनिश्चित होता है।