💬 NLP

EBPO: Empirical Bayes Shrinkage for Stabilizing Group-Relative Policy Optimization

यह शोध पत्र EBPO का प्रस्ताव करता है, जो एक नवीन ढांचा है जो लार्ज लैंग्वेज मॉडल्स के लिए ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन को स्थिर करने हेतु एम्पेरिकल बेयस श्रिंकेज (Empirical Bayes shrinkage) का उपयोग करके स्थानीय बेसलाइन्स को वैश्विक सांख्यिकी के साथ नियमित करता है, जिससे अनुमानित वेरिएंस कम होता है, वैनिशिंग ग्रेडिएंट्स को रोकता है, और विविध रीजनिंग बेंचमार्क पर मौजूदा विधियों से बेहतर प्रदर्शन करता है।

Kevin Han, Yuhang Zhou, Mingze Gao, Gedi Zhou, Serena Li, Abhishek Kumar, Xiangjun Fan, Weiwei Li, Lizhu Zhang2026-02-24
💬 NLP

Transport and Merge: Cross-Architecture Merging for Large Language Models

यह शोध पत्र ऑप्टिमल ट्रांसपोर्ट पर आधारित एक क्रॉस-आर्किटेक्चर मर्जिंग फ्रेमवर्क का प्रस्ताव करता है जो विषम मॉडलों के बीच पत्राचार (correspondences) का अनुमान लगाने के लिए एक्टिवेशन्स को संरेखित करता है, जिससे सीधे वेट-स्पेस फ्यूजन के माध्यम से बड़े हाई-रिसोर्स LLMs से छोटे लो-रिसोर्स लक्ष्यों तक प्रभावी ज्ञान हस्तांतरण सक्षम होता है।

Chenhang Cui, Binyun Yang, Fei Shen, Yuxin Chen, Jingnan Zheng, Xiang Wang, An Zhang, Tat-Seng Chua2026-02-24
💬 NLP

G2CP: A Graph-Grounded Communication Protocol for Verifiable and Efficient Multi-Agent Reasoning

G2CP एक ग्राफ-आधारित संचार प्रोटोकॉल पेश करता है जो मल्टी-एजेंट सिस्टम के लिए प्राकृतिक भाषा को संरचित ग्राफ ऑपरेशन्स से बदल देता है, जिससे टोकन के उपयोग और मतिभ्रम (hallucinations) में काफी कमी आती है और जटिल औद्योगिक कार्यों में तर्क की सटीकता और सत्यापन क्षमता में सुधार होता है।

Karim Ben Khaled, Davy Monticolo2026-02-24
💬 NLP

ADAB: Arabic Dataset for Automated Politeness Benchmarking -- A Large-Scale Resource for Computational Sociopragmatics

यह शोध पत्र ADAB को प्रस्तुत करता है, जो विभिन्न ऑनलाइन प्लेटफार्मों और बोलियों से 10,000 नमूनों वाला एक बड़े पैमाने का एनोटेटेड अरबी डेटासेट है, जिसे विनम्र, अशिष्ट और तटस्थ श्रेणियों में शिष्टाचार पहचान (politeness detection) के लिए एक बेंचमार्क प्रदान करके कम्प्यूटेशनल सोशियोप्रैगमैटिक्स (computational sociopragmatics) को आगे बढ़ाने के लिए डिज़ाइन किया गया है।

Hend Al-Khalifa, Nadia Ghezaiel, Maria Bounnit, Hend Hamed Alhazmi, Noof Abdullah Alfear, Reem Fahad Alqifari, Ameera Ma (…)2026-02-24
💬 NLP

BETA-Labeling for Multilingual Dataset Construction in Low-Resource IR

यह शोध पत्र कई LLMs और मानव सत्यापन का उपयोग करके एक विश्वसनीय बांग्ला IR डेटासेट के निर्माण के लिए एक BETA-लेबलिंग ढांचे को प्रस्तुत करता है, जबकि अनुभवजन्य रूप से यह प्रदर्शित करता है कि कम-संसाधन वाले डेटासेट्स का वन-हॉप मशीन अनुवाद अक्सर भाषा-निर्भर पूर्वाग्रहों के कारण अर्थ संबंधी वैधता बनाए रखने में विफल रहता है, जिससे क्रॉस-लिंगुअल डेटासेट पुन: उपयोग के लिए महत्वपूर्ण मार्गदर्शन प्राप्त होता है।

Md. Najib Hasan, Mst. Jannatun Ferdous Rain, Fyad Mohammed, Nazmul Siddique2026-02-24
💬 NLP

RFEval: Benchmarking Reasoning Faithfulness under Counterfactual Reasoning Intervention in Large Reasoning Models

यह शोध पत्र RFEval प्रस्तुत करता है, जो काउंटरफैक्चुअल हस्तक्षेपों (counterfactual interventions) के माध्यम से लार्ज रीजनिंग मॉडल्स में रीजनिंग फेथफुलनेस (reasoning faithfulness) का आकलन करने के लिए एक बेंचमार्क और औपचारिक ढांचा है, जो यह प्रकट करता है कि स्टैंड कंसिस्टेंसी (stance inconsistencies) के कारण लगभग आधे मॉडल आउटपुट अनफेथफुल हैं और सटीकता (accuracy), रीजनिंग प्रक्रिया की संरचनात्मक अखंडता (structural integrity) के लिए एक खराब प्रॉक्सी है।

Yunseok Han, Yejoon Lee, Jaeyoung Do2026-02-24
💬 NLP

ConfSpec: Efficient Step-Level Speculative Reasoning via Confidence-Gated Verification

ConfSpec एक कॉन्फिडेंस-गेटेड कैस्केडेड वेरिफिकेशन फ्रेमवर्क पेश करता है जो स्टेप-लेवल स्पेकुलेटिव रीजनिंग में सटीकता-गति के बीच के ट्रेड-ऑफ को हल करने के लिए जनरेशन और वेरिफिकेशन के बीच की विषमता का लाभ उठाता है, जिससे लक्ष्य-मॉडल की सटीकता से समझौता किए बिना या बाहरी जज मॉडल की आवश्यकता के बिना 2.24×\times तक एंड-टू-एंड स्पीडअप प्राप्त होता है।

Siran Liu, Cyril Y. He2026-02-24
💬 NLP

Asymptotic Semantic Collapse in Hierarchical Optimization

यह शोध पत्र "एसिम्प्टोटिक सिमेंटिक कोलैप्स" (Asymptotic Semantic Collapse) के लिए एक सैद्धांतिक ढांचा प्रस्तावित करता है, जो यह प्रदर्शित करता है कि कैसे पदानुक्रमित बहु-एजेंट प्रणालियाँ अपडेट इतिहास की परवाह किए बिना एक रिमानियन मैनिफोल्ड (Riemannian manifold) पर एक समान सिमेंटिक अवस्था की ओर अभिसरित होती हैं, और RWKV-7 मॉडल पर एक डेटासेट-मुक्त बेंचमार्क के माध्यम से इन गतिकी का अनुभवजन्य सत्यापन करता है।

Faruk Alpay, Bugra Kilictas2026-02-24
💬 NLP

Exploring the Ethical Concerns in User Reviews of Mental Health Apps using Topic Modeling and Sentiment Analysis

यह अध्ययन ऐप स्टोर समीक्षाओं पर टॉपिक मॉडलिंग, ज़ीरो-शॉट क्लासिफिकेशन और सेंटीमेंट एनालिसिस को संयोजित करने वाले एक नेचुरल लैंग्वेज प्रोसेसिंग फ्रेमवर्क का उपयोग करता है ताकि एआई-संचालित मानसिक स्वास्थ्य ऐप्स में स्थापित और उभरती दोनों नैतिक चिंताओं की पहचान की जा सके, और अंततः उनकी निष्पक्षता, पारदर्शिता और विश्वसनीयता को बढ़ाने के लिए एक प्रणाली प्रस्तावित की जा सके।

Mohammad Masudur Rahman, Beenish Moalla Chaudhry2026-02-24
💬 NLP

The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models

यह शोध पत्र "एल्गोरिद्मिक अचेतन" (algorithmic unconscious) की अवधारणा प्रस्तुत करता है ताकि यह तर्क दिया जा सके कि बड़े भाषा मॉडलों में महत्वपूर्ण पूर्वाग्रह केवल डेटासेट की संरचना से ही नहीं, बल्कि टोकनाइज़ेशन, अटेंशन और एलाइनमेंट जैसी अंतर्निहित संरचनात्मक प्रणालियों से उत्पन्न होते हैं, जो अरबी भाषा के ओवर-सेगमेंटेशन के अनुभवजन्य विश्लेषण के माध्यम से यह प्रदर्शित करता है कि कैसे ये ढांचागत कारक व्यवस्थित रूप से मॉडल के प्रदर्शन को विकृत करते हैं और तकनीकी ऑडिटिंग के लिए एक नए ढांचे की आवश्यकता को अनिवार्य बनाते हैं।

Philippe Boisnard2026-02-24