Multi: Hierarchical Multi-Agent Decision-Making with LLM-Based Agents in Interactive Environments
यह शोधपत्र Multi प्रस्तुत करता है, जो एक पदानुक्रमित मल्टी-एजेंट फ्रेमवर्क है जो ऑब्जेक्टिव ड्रिफ्ट (उद्देश्य विचलन) को कम करने और गतिशील संवादात्मक वातावरणों में सुदृढ़, दीर्घकालिक निर्णय लेने के लिए एक सुपरवाइज्ड फाइन-ट्यून्ड हाई-लेवल प्लानर को रीइन्फोर्समेंट लर्निंग-आधारित लो-लेवल एक्जीक्यूटर के साथ जोड़ता है, जिसके साथ तीन नए बेंचमार्क डेटासेट भी जारी किए गए हैं।