Safe and Generalizable Hierarchical Multi-Agent RL via Constraint Manifold Control
यह शोध पत्र एक पदानुक्रमित बहु-एजेंट सुदृढीकरण शिक्षण ढांचा प्रस्तावित करता है जो निचले स्तर पर एक बाधा मैनिफोल्ड (constraint manifold) के माध्यम से कठोर बाधाओं को लागू करके सैद्धांतिक सुरक्षा गारंटी और स्थिर प्रशिक्षण सुनिश्चित करता है, जबकि उच्च-स्तरीय नीति शिक्षण के माध्यम से प्रभावी समन्वय सक्षम करता है, जिसके परिणामस्वरूप एक ऐसी विधि प्राप्त होती है जो लगभग पूर्ण सुरक्षा दरों और विभिन्न एजेंट एवं बाधा विन्यासों में मजबूत सामान्यीकरण के साथ प्रतिस्पर्धी प्रदर्शन प्राप्त करती है।