Test-time Recursive Thinking: Self-Improvement without External Feedback
यह शोध पत्र टेस्ट-टाइम रिकर्सिव थिंकिंग (TRT) का प्रस्ताव करता है, जो एक पुनरावृत्ति स्व-सुधार ढांचा है जो विविध उम्मीदवार पीढ़ी और स्व-सत्यापन का लाभ उठाकर, बाहरी फीडबैक या अतिरिक्त प्रशिक्षण के बिना, चुनौतीपूर्ण बेंचमार्क पर लार्ज लैंग्वेज मॉडल्स की तर्क और कोडिंग क्षमता को महत्वपूर्ण रूप से बढ़ाने में सक्षम बनाता है।