Efficiency of Parallel and Restart Exploration Strategies in Model Free Stochastic Simulations
यह लेख मॉडल-मुक्त स्टोकेस्टिक सिमुलेशन का विश्लेषण करता है यह दिखाने के लिए कि जबकि समानांतर अन्वेषण (पैरेलल एक्सप्लोरेशन) एक चरण संक्रमण (फेज ट्रांजिशन) प्रदर्शित करता है जिसमें सिमुलेशन की इष्टतम संख्या के बाद प्रदर्शन में गिरावट आती है, एक रीस्टार्ट रणनीति का कार्यान्वयन दुर्लभ अवस्थाओं तक पहुँचने और सुदृढीकरण शिक्षण (रीइन्फोर्समेंट लर्निंग) नीति अनुमानों को परिष्कृत करने में घातीय सुधार प्रदान कर सकता है।