Accelerating Visual Policy Learning with Sampling-Based Model Predictive Control
यह शोध पत्र सैंपलिंग-गाइडेड पॉलिसी सर्च (SGPS) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो जटिल रोबोटिक लोकोमोशन और मैनिपुलेशन कार्यों के लिए विजुअल पॉलिसियों को कुशलतापूर्वक प्रशिक्षित करने हेतु सैंपलिंग-आधारित मॉडल प्रेडिक्टिव कंट्रोल को फर्स्ट-ऑर्डर पॉलिसी ऑप्टिमाइज़ेशन के साथ जोड़ता है, जिससे वास्तविक दुनिया के हार्डवेयर पर ज़ीरो-शॉट ट्रांसफर प्राप्त होता है।