Learning When to Cooperate Under Heterogeneous Goals
यह शोधपत्र एक पदानुक्रमित शिक्षण ढांचे (hierarchical learning framework) को पेश करके विषम लक्ष्यों वाले एजेंटों द्वारा सहयोग करने या अकेले कार्य करने के निर्णय लेने की चुनौती को संबोधित करता है, जो अनुकरण (imitation) और सुदृढीकरण शिक्षण (reinforcement learning) को जोड़ता है, बेसलाइन की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है और यह प्रकट करता है कि साथियों का मॉडलिंग करना तब सबसे अधिक लाभकारी होता है जब उनके लक्ष्य कम दृश्यमान होते हैं।