Toward LLM-Supported Automated Assessment of Critical Thinking Subskills
यह शोध पत्र छात्रों के तर्कपूर्ण निबंधों में आलोचनात्मक सोच के उप-कौशलों का स्वचालित रूप से मूल्यांकन करने के लिए बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के उपयोग की व्यवहार्यता की जांच करता है, जिसमें यह पाया गया है कि Llama 3.1 8B का सुपरवाइज्ड फाइन-ट्यूनिंग सबसे अच्छे परिणाम देता है, विशेष रूप से स्पष्ट दक्षता अंतर और संतुलित डेटा वाले उप-कौशलों के लिए, जबकि सूक्ष्म बारीकियों का पता लगाने और असंतुलित लेबल को संभालने में चुनौतियों को भी रेखांकित करता है।