💬 NLP

Citation Failure: Definition, Analysis and Efficient Mitigation

यह शोध पत्र LLM-आधारित RAG सिस्टम में साइटेशन विफलताओं (citation failures) का व्यवस्थित रूप से विश्लेषण करने के लिए CITECONTROL बेंचमार्क प्रस्तुत करता है और CITENTION का प्रस्ताव करता है, जो एक हाइब्रिड फ्रेमवर्क है जो जनरेटिव, अटेंशन-आधारित और रिट्रीवल-आधारित विधियों को एकीकृत करके इन विफलताओं को प्रभावी ढंग से कम करता है।

Jan Buchmann, Iryna Gurevych2026-03-05
🤖 AI

CareMedEval dataset: Evaluating Critical Appraisal and Reasoning in the Biomedical Field

यह शोध पत्र CareMedEval प्रस्तुत करता है, जो फ्रांसीसी चिकित्सा छात्रों की परीक्षाओं से प्राप्त एक नवीन डेटासेट है जो बायोमेडिकल साहित्य पर आलोचनात्मक मूल्यांकन और तर्क करने की लार्ज लैंग्वेज मॉडल्स (LLMs) की क्षमता का मूल्यांकन करता है, और मध्यवर्ती तर्क चरणों (intermediate reasoning steps) से सुधार के बावजूद वर्तमान मॉडल्स में महत्वपूर्ण सीमाओं को प्रकट करता है।

Doria Bonzi, Alexandre Guiggi, Frédéric Béchet, Carlos Ramisch, Benoit Favre2026-03-05
🤖 AI

Multimodal Large Language Models for Low-Resource Languages: A Case Study for Basque

यह शोध पत्र कम संसाधन वाली बास्क भाषा के लिए एक मल्टीमॉडल लार्ज लैंग्वेज मॉडल विकसित करने पर एक केस स्टडी प्रस्तुत करता है, जो यह प्रदर्शित करता है कि लगभग 20% बास्क मल्टीमॉडल डेटा के साथ उत्कृष्ट प्रदर्शन प्राप्त किया जा सकता है और एक बास्क-अनुकूलित लैंग्वेज मॉडल बैकबोन का होना अनिवार्य नहीं है।

Lukas Arana, Julen Etxaniz, Ander Salaberria, Gorka Azkune2026-03-05
💬 NLP

Dripper: Token-Efficient Main HTML Extraction with a Lightweight LM

यह शोध पत्र Dripper को प्रस्तुत करता है, जो एक हल्का ढांचा (lightweight framework) है जो वेब के मुख्य कंटेंट निष्कर्षण (web main content extraction) को स्मॉल लैंग्वेज मॉडल्स का उपयोग करते हुए एक कतिपय अनुक्रम लेबलिंग कार्य (constrained sequence labeling task) के रूप में पुनर्गठित करता है, जिससे पारंपरिक ह्यूरिस्टिक्स और विशाल जनरेटिव LLMs दोनों की तुलना में बेहतर दक्षता और सटीकता प्राप्त होती है और उच्च गुणवत्ता वाले प्रशिक्षण कॉर्पोरा के निर्माण को सक्षम बनाया जाता है।

Mengjie Liu, Jiahui Peng, Wenchang Ning, Pei Chu, Jiantao Qiu, Ren Ma, He Zhu, Rui Min, Lindong Lu, Linfeng Hou, Kaiwen (…)2026-03-05
🤖 AI

NRR-Core: Non-Resolution Reasoning as a Computational Framework for Contextual Identity and Ambiguity Preservation

यह शोध पत्र नॉन-रेज़ोल्यूशन रीजनिंग (NRR) का प्रस्ताव करता है, जो एक नवीन कम्प्यूटेशनल ढांचा है जो गैर-पहचान (non-identity) और समानांतर व्याख्या प्रतिधारण (parallel interpretation retention) के सिद्धांतों को पेश करके वर्तमान एआई में समयपूर्व अस्पष्टता पतन (ambiguity collapse) को चुनौती देता है ताकि संदर्भगत पहचान को संरक्षित किया जा सके और स्पष्ट समाधान की आवश्यकता होने तक कई वैध अर्थों को बनाए रखा जा सके।

Kei Saito2026-03-05
🤖 AI

A Systematic Analysis of Biases in Large Language Models

यह अध्ययन राजनीतिक, वैचारिक, गठबंधन, भाषाई और लैंगिक आयामों में व्यापक रूप से अपनाए गए चार बड़े भाषा मॉडलों का व्यवस्थित रूप से मूल्यांकन करता है, जो यह प्रकट करता है कि तटस्थता के लिए संरेखण प्रयासों के बावजूद, इन मॉडलों में अभी भी महत्वपूर्ण पूर्वाग्रह और आकर्षण मौजूद हैं।

Xulang Zhang, Rui Mao, Erik Cambria2026-03-05
🤖 AI

Succeeding at Scale: Automated Dataset Construction and Query-Side Adaptation for Multi-Tenant Search

यह शोध पत्र तकनीकी सहायता पुनर्प्राप्ति (technical support retrieval) के लिए एक स्वचालित बेंचमार्क, DevRev-Search पेश करता है, और एक इंडेक्स-प्रिजर्विंग अडैप्टेशन (Index-Preserving Adaptation) रणनीति का प्रस्ताव करता है जो पुन: अनुक्रमण (re-indexing) की अत्यधिक लागत के बिना स्केलेबल, उच्च-प्रदर्शन वाले मल्टी-टेनेंट सर्च प्राप्त करने के लिए केवल क्वेरी एनकोडर को फाइन-ट्यून करता है।

Prateek Jain, Shabari S Nair, Ritesh Goru, Prakhar Agarwal, Ajay Yadav, Yoga Sri Varshan Varadharajan, Constantine Caram (…)2026-03-05
🤖 AI

Knowledge Graphs are Implicit Reward Models: Path-Derived Signals Enable Compositional Reasoning

यह शोध पत्र एक पोस्ट-ट्रेनिंग प्रतिमान (पैराडाइम) प्रस्तुत करता है जो ज्ञान ग्राफों (नॉलेज ग्राफ्स) को अंतर्निहित रिवॉर्ड मॉडल के रूप में उपयोग करके बड़े भाषा मॉडलों को स्वयंसिद्ध तथ्यों से संयोजी तर्क (कंपोजिशनल रीजनिंग) सीखने में सक्षम बनाता है, जिससे पथ-व्युत्पन्न पर्यवेक्षण (पाथ-डिराइव्ड सुपरविजन) के माध्यम से एक 14B मॉडल जटिल मल्टी-हॉप मेडिकल प्रश्नों पर फ्रंटियर सिस्टम्स को पछाड़ सकता है।

Yuval Kansal, Niraj K. Jha2026-03-05✓ Author reviewed
🤖 AI

NRR-Phi: Text-to-State Mapping for Ambiguity Preservation in LLM Inference

यह शोध पत्र NRR-Phi को प्रस्तुत करता है, जो एक हाइब्रिड निष्कर्षण पाइपलाइन (hybrid extraction pipeline) का उपयोग करके अस्पष्ट पाठ को एक गैर-संकोचकारी अवस्था स्थान (non-collapsing state space) में मैप करने वाला एक औपचारिक ढांचा है, जिससे कई व्याख्याओं को संरक्षित किया जाता है और लार्ज लैंग्वेज मॉडल इन्फरेंस में समयपूर्व अर्थपूर्ण प्रतिबद्धता (premature semantic commitment) को रोका जाता है।

Kei Saito2026-03-05
🤖 machine learning

Rewards as Labels: Revisiting RLVR from a Classification Perspective

यह शोध पत्र "रिवॉर्ड्स ऐज़ लेबल्स" (REAL) का प्रस्ताव करता है, जो एक नया ढांचा है जो GRPO जैसी विधियों में ग्रेडिएंट मिसअसाइनमेंट और डोमिनेशन की समस्याओं को संबोधित करने के लिए 'रिनफोर्समेंट लर्निंग विद वेरीफिएबल रिवॉर्ड्स' को एक वर्गीकरण (classification) समस्या के रूप में पुनर्गठित करता है, जिससे अत्याधुनिक बेसलाइनों की तुलना में गणितीय तर्क संबंधी बेंचमार्क पर बेहतर प्रशिक्षण स्थिरता और प्रदर्शन प्राप्त होता है।

Zepeng Zhai, Meilin Chen, Jiaxuan Zhao, Junlang Qian, Lei Shen, Yuan Lu2026-03-05