DryRUN: On the Role of Public Tests in LLM-Driven Code Generation
यह शोधपत्र DryRUN को प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो मानव-प्रदत्त सार्वजनिक परीक्षण मामलों (public test cases) पर निर्भरता को समाप्त करता है, जिससे LLMs को स्व-सुधार के लिए इनपुट उत्पन्न करने और निष्पादन ट्रेस (execution traces) को स्वायत्त रूप से सिम्युलेट करने में सक्षम बनाया जाता है, जिससे टोकन की खपत को कम करते हुए और अति-आत्मविश्वास को कम करते हुए अत्याधुनिक प्रदर्शन (state-of-the-art performance) प्राप्त किया जा सके।