Benchmarking Large Language Models on Reference Extraction and Parsing in the Social Sciences and Humanities
यह शोध पत्र सामाजिक विज्ञान और मानविकी के अंतर्गत यथार्थवादी, शोरयुक्त और बहुभाषी स्थितियों में संदर्भ निष्कर्षण (reference extraction) और पार्सिंग (parsing) के मूल्यांकन के लिए एक एकीकृत बेंचमार्क प्रस्तुत करता है, जो यह दर्शाता है कि जहाँ निष्कर्षण संतृप्त हो जाता है, वहीं पार्सिंग एक बाधा बनी रहती है जिसे हाइब्रिड रूटिंग के माध्यम से GROBID जैसे पारंपरिक उपकरणों को कार्य-अनुकूलित लार्ज लैंग्वेज मॉडल्स के साथ जोड़कर सर्वोत्तम रूप से संबोधित किया जा सकता है।