Adaptive Coarse-to-Fine Subgoal Refinement for Long-Horizon Offline Goal-Conditioned Reinforcement Learning
यह शोध पत्र CFHRL प्रस्तुत करता है, जो एक पूर्णतः ऑफलाइन लक्ष्य-सशर्त सुदृढीकरण शिक्षण (goal-conditioned reinforcement learning) ढांचा है जो एक मोटे-से-सूक्ष्म (coarse-to-fine) पदानुक्रमित प्रक्रिया के माध्यम से दूरस्थ लक्ष्यों को स्थानीय रूप से निष्पादनीय उप-लक्ष्यों में अनुकूल रूप से परिष्कृत करता है, जिससे बूटस्ट्रैपिंग त्रुटियों को प्रभावी ढंग से कम किया जाता है और लंबी अवधि के कार्यों पर प्रदर्शन में सुधार होता है।