Characterizing Replay Retention Under Dynamics Shift in Model-Based Reinforcement Learning
यह शोधपत्र डायनेमिक्स शिफ्ट (dynamics shifts) के तहत निरंतर मॉडल-आधारित सुदृढीकरण लर्निंग (continual model-based reinforcement learning) में रिप्ले रिटेंशन (replay retention) को कैसे अनुकूलित किया जाए, इस पर अन्वेषण करता है, जो परिवर्तन की परिमाण (change magnitude) और ट्रांज़िशन की आयु (transition age) के बीच के संतुलन को स्पष्ट करते हुए यह प्रदर्शित करता है कि एक एस्टिमेटर (estimator) इस आधार पर पुराने डेटा को रखने या हटाने का प्रभावी ढंग से मार्गदर्शन कर सकता है कि डायनेमिक्स में परिवर्तन स्थायी हैं या आवर्ती।