Self-Study Reconsidered: The Hidden Fragility of Learning from Self-Generated QA
यह शोध पत्र प्रकट करता है कि भाषा मॉडलों के लिए स्व-निर्मित प्रश्न-उत्तर पर्यवेक्षण (self-generated question-answer supervision) गैर-समान साक्ष्य चयन और निर्देश-अनुसरण पूर्वाग्रहों के कारण स्वाभाविक रूप से नाजुक है, लेकिन इन मुद्दों को निश्चित लक्ष्यों से प्रश्नों को जोड़ने और निर्देश-समान टेक्स्ट स्पैन को फ़िल्टर करके प्रभावी ढंग से कम किया जा सकता है।