How Do LLMs Encode Scientific Quality? An Empirical Study Using Monosemantic Features from Sparse Autoencoders
यह अध्ययन अनुभवजन्य रूप से प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) वैज्ञानिक गुणवत्ता की अवधारणा को विशिष्ट मोनोसेमेंटिक फीचर्स के माध्यम से एनकोड करते हैं—जिन्हें स्पार्स ऑटोएनकोडर्स के माध्यम से पहचाना गया है—जो अनुसंधान पद्धतियों, प्रकाशन प्रकारों, उच्च-प्रभाव वाले क्षेत्रों और वैज्ञानिक शब्दावली जैसे प्रमुख पहलुओं को कैप्चर करते हैं, जिससे साइटेशन काउंट और जर्नल रैंकिंग जैसे अनुसंधान मेट्रिक्स की भविष्यवाणी करना सक्षम होता है।