TTSR: Test-Time Self-Reflection for Continual Reasoning Improvement
यह शोध पत्र TTSR का प्रस्ताव करता है, जो एक टेस्ट-टाइम सेल्फ-इवॉल्विंग फ्रेमवर्क है जहाँ एक एकल लैंग्वेज मॉडल तर्क संबंधी विफलताओं (reasoning failures) का विश्लेषण करने और लक्षित वेरिएंट प्रश्न उत्पन्न करने के लिए छात्र और शिक्षक की भूमिकाओं के बीच बारी-बारी से कार्य करता है, जिससे चुनौतीपूर्ण बेंचमार्क पर तर्क प्रदर्शन में स्थिर और निरंतर सुधार सक्षम होता है।