Policy Optimization for Unknown Systems using Differentiable Model Predictive Control
यह शोध पत्र मॉडल प्रेडिक्टिव कंट्रोल के लिए एक नवीन पॉलिसी ऑप्टिमाइज़ेशन फ्रेमवर्क प्रस्तुत करता है जो तेज़ ट्रांजिएंट प्रदर्शन और मॉडल अनिश्चितता के तहत सुदृढ़ अभिसरण प्राप्त करने के लिए डिफरेंशिएबल और ज़ीरो-ऑर्डर ग्रेडिएंट एस्टीमेशन को जोड़ता है, जैसा कि एक 12-आयामी क्वाडकॉप्टर कार्य पर प्रदर्शित किया गया है।