💬 NLP

Benchmarking Large Language Models on Reference Extraction and Parsing in the Social Sciences and Humanities

यह शोध पत्र सामाजिक विज्ञान और मानविकी के अंतर्गत यथार्थवादी, शोरयुक्त और बहुभाषी स्थितियों में संदर्भ निष्कर्षण (reference extraction) और पार्सिंग (parsing) के मूल्यांकन के लिए एक एकीकृत बेंचमार्क प्रस्तुत करता है, जो यह दर्शाता है कि जहाँ निष्कर्षण संतृप्त हो जाता है, वहीं पार्सिंग एक बाधा बनी रहती है जिसे हाइब्रिड रूटिंग के माध्यम से GROBID जैसे पारंपरिक उपकरणों को कार्य-अनुकूलित लार्ज लैंग्वेज मॉडल्स के साथ जोड़कर सर्वोत्तम रूप से संबोधित किया जा सकता है।

Yurui Zhu, Giovanni Colavizza, Matteo Romanello2026-03-17
💬 NLP

Preconditioned Test-Time Adaptation for Out-of-Distribution Debiasing in Narrative Generation

यह शोध पत्र CAP-TTA को प्रस्तुत करता है, जो एक टेस्ट-टाइम अडैप्टेशन फ्रेमवर्क है जो नैरेटिव जनरेशन में आउट-ऑफ-डिस्ट्रीब्यूशन बायस को गतिशील रूप से कम करने के लिए एक प्रीकंप्यूटेड प्रीकंडीशनर द्वारा निर्देशित कॉन्टेक्स्ट-अवेयर LoRA अपडेट्स का उपयोग करता है, साथ ही लेटेंसी को कम करता है और कैटास्ट्रोफिक फॉरगेटिंग को रोकता है।

Hanwen Shen, Ting Ying, Jiajie Lu, Shanshan Wang2026-03-17
💬 NLP

Repetition Without Exclusivity: Scale Sensitivity of Referential Mechanisms in Child-Scale Language Models

यह अध्ययन प्रदर्शित करता है कि बाल-केंद्रित वाक् (child-directed speech) पर प्रशिक्षित बाल-स्तर के भाषा मॉडल, पारस्परिक अपवर्जन (mutual exclusivity) के बजाय सुदृढ़ पुनरावृत्ति प्राइमिंग (repetition priming) प्रदर्शित करते हैं, जो यह सुझाव देता है कि पारस्परिक अपवर्जन के विकास के लिए जन्मजात पूर्वाग्रहों के बजाय संदर्भिक ग्राउंडिंग (referential grounding) और विशिष्ट इनपुट संरचनाएं आवश्यक हैं।

Jon-Paul Cacioli2026-03-17
💬 NLP

Causal Tracing of Audio-Text Fusion in Large Audio Language Models

यह शोध पत्र यह प्रकट करने के लिए कॉज़ल ट्रेसिंग (causal tracing) को अनुकूलित करता है कि बड़े ऑडियो भाषा मॉडल विविध परत-वार संलयन रणनीतियों (layer-wise fusion strategies) का उपयोग करते हैं और ध्वनिक विशेषताओं को पाठ्य संदर्भ के साथ एकीकृत करने के लिए विशिष्ट टोकन-वार तंत्रों, जैसे कि एक अंतिम-टोकन बॉटलनेक (final-token bottleneck) और मध्यवर्ती क्वेरी ट्रिगर्स (intermediate query triggers), का उपयोग करते हैं।

Wei-Chih Chen, Chien-yu Huang, Hung-yi Lee2026-03-17
💬 NLP

LiveWeb-IE: A Benchmark For Online Web Information Extraction

यह शोध पत्र लाइव, विकसित होते हुए वेबसाइटों पर वेब सूचना निष्कर्षण (वेब इंफॉर्मेशन एक्सट्रैक्शन) के मूल्यांकन के लिए एक नवीन बेंचमार्क, LiveWeb-IE पेश करता है, और विजुअल ग्राउंडिंग स्क्रैपर (VGS) का प्रस्ताव देता है, जो एक मल्टी-स्टेज एजेंटिक फ्रेमवर्क है जो गतिशील वेब पेजों से डेटा को मजबूती से निकालने के लिए मानव दृश्य संज्ञान (ह्यूमन विजुअल कॉग्निशन) की नकल करता है।

Seungbin Yang, Jihwan Kim, Jaemin Choi, Dongjin Kim, Soyoung Yang, ChaeHun Park, Jaegul Choo2026-03-17
🤖 machine learning

Greedy Information Projection for LLM Data Selection

यह शोध पत्र ग्रीडी इंफॉर्मेशन प्रोजेक्शन (GIP) को प्रस्तुत करता है, जो एक सिद्धांतपूर्ण ढांचा है जो एक तेज़ ग्रीडी ऑप्टिमाइज़ेशन प्रक्रिया के माध्यम से डेटा और कार्य-विशिष्ट क्वेरी संकेतों के बीच म्यूचुअल इंफॉर्मेशन को अधिकतम करके लार्ज लैंग्वेज मॉडल फाइन-ट्यूनिंग के लिए विविध और उच्च-गुणवत्ता वाले प्रशिक्षण उदाहरणों को कुशलतापूर्वक चुनता है।

Victor Ye Dong, Kuan-Yun Lee, Jiamei Shuai, Shengfei Liu, Yi Liu, Jian Jiao2026-03-17
💬 NLP

DeceptGuard :A Constitutional Oversight Framework For Detecting Deception in LLM Agents

यह शोधपत्र DeceptGuard को प्रस्तुत करता है, जो एक संवैधानिक निरीक्षण ढांचा (constitutional oversight framework) है जो एक सिंथेटिक धोखे वाले डेटासेट और ब्लैक-बॉक्स, चेन-ऑफ-थॉट, और एक्टिवेशन-प्रोब मॉनिटर्स के एक हाइब्रिड एन्सेम्बल का लाभ उठाता है ताकि LLM एजेंटों में सूक्ष्म भ्रामक व्यवहारों का पता लगाने में मौजूदा तरीकों से काफी बेहतर प्रदर्शन किया जा सके।

Snehasis Mukhopadhyay2026-03-17
💬 NLP

GhanaNLP Parallel Corpora: Comprehensive Multilingual Resources for Low-Resource Ghanaian Languages

घानाएनएलपी (GhanaNLP) पहल पांच स्थानीय भाषाओं और अंग्रेजी के बीच पेशेवर रूप से अनुवादित 41,513 समानांतर वाक्य युग्मों का एक क्यूरेटेड संग्रह जारी करके कम-संसाधन वाली घानाई भाषाओं के लिए डिजिटल भाषाई डेटा की कमी को संबोधित करती है ताकि मशीन अनुवाद, भाषण प्रौद्योगिकियों और भाषा संरक्षण को आगे बढ़ाया जा सके।

Lawrence Adu Gyamfi, Paul Azunre, Stephen Edward Moore, Joel Budu, Akwasi Asare, Mich-Seth Owusu, Jonathan Ofori Asiamah2026-03-17
💬 NLP

APEX-Searcher: Augmenting LLMs' Search Capabilities through Agentic Planning and Execution

यह शोध पत्र APEX-Searcher को प्रस्तुत करता है, जो एक नवीन दो-चरणीय एजेंटिक ढांचा (two-stage agentic framework) है जो जटिल मल्टी-हॉप कार्यों के लिए लार्ज लैंग्वेज मॉडल्स की खोज क्षमताओं को सुदृढ़ करने हेतु इस प्रक्रिया को सुदृढीकरण शिक्षण (reinforcement learning) के माध्यम से अनुकूलित रणनीतिक योजना और पर्यवेक्षित फाइन-ट्यूनिंग (supervised fine-tuning) के माध्यम से परिष्कृत मजबूत निष्पादन में विभाजित करता है, जिससे अस्पष्ट रिट्रीवल पथ और विरल पुरस्कारों (sparse rewards) जैसी एंड-टू-एंड प्रशिक्षण की सीमाओं को दूर किया जा सके।

Kun Chen, Qingchao Kong, Zhao Feifei, Wenji Mao2026-03-17
💬 NLP

Large Language Models Reproduce Racial Stereotypes When Used for Text Annotation

यह शोध पत्र प्रदर्शित करता है कि 19 बड़े भाषा मॉडलों और 4 मिलियन से अधिक एनोटेशन निर्णयों में, नाम और बोलियों जैसे सूक्ष्म पहचान संकेत व्यवस्थित रूप से नस्लीय रूढ़ियों को सक्रिय करते हैं, जिससे अल्पसंख्यक समूहों से जुड़े ग्रंथों को अधिक आक्रामक, कम पेशेवर और कम आत्मविश्वासी के रूप में रेट किया जाता है, जिससे अनुसंधान और निर्णय लेने में उपयोग किए जाने वाले स्वचालित डेटासेट में ये पूर्वाग्रह समाहित हो जाते हैं।

Petter Törnberg2026-03-17