SWE-Manager: Selecting and Synthesizing Golden Proposals Before Coding
यह शोध पत्र SWE-Manager को प्रस्तुत करता है, जो एक 8B सुदृढीकरण लर्निंग (reinforcement learning) मॉडल है जो तकनीकी प्रबंधकों की नकल करते हुए सॉफ्टवेयर समस्याओं के लिए सबसे अच्छे उम्मीदवार प्रस्ताव को चुनता है और कोड निष्पादित किए बिना एक "गोल्डन" समाधान संश्लेषित करता है, जिससे SWE-Lancer Manager बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।