RevengeBench: Reverse Engineering Code-Space Policies from Behavioral Experiments
यह शोधपत्र RevengeBench को प्रस्तुत करता है, जो एक ऐसा बेंचमार्क है जो गेम वातावरण में व्यवहार संबंधी ट्रैसेस (behavioral traces) से निष्पादन योग्य कोड नीतियों (executable code policies) को रिवर्स-इंजीनियर करने की लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है, यह प्रदर्शित करते हुए कि लक्षित प्रयोगात्मक डिज़ाइन पुनर्निर्माण सटीकता में महत्वपूर्ण सुधार करता है और डाउनस्ट्रीम टूर्नामेंटों में प्रतिस्पर्धी लाभ प्रदान करता है।