💬 NLP

Dynamic Multi-Expert Projectors with Stabilized Routing for Multilingual Speech Recognition

यह शोध पत्र SMEAR-MoE को प्रस्तुत करता है, जो एक स्थिर मिक्स्चर-ऑफ-एक्सपर्ट्स प्रोजेक्टर है जो एक्सपर्ट कोलैप्स (expert collapse) को रोकता है और भाषाई रूप से सार्थक क्रॉस-लिंगुअल शेयरिंग को सक्षम बनाता है, जिससे बहुभाषी स्पीच रिकग्निशन के लिए सिंगल-प्रोजेक्टर बेसलाइनों की तुलना में 7.6% तक सापेक्ष WER कमी प्राप्त होती है।

Isha Pandey, Ashish Mittal, Vartul Bahuguna, Ganesh Ramakrishnan2026-01-28
💬 NLP

GradPruner: Gradient-Guided Layer Pruning Enabling Efficient Fine-Tuning and Inference for LLMs

GradPruner एक ग्रेडिएंट-निर्देशित लेयर प्रूनिंग विधि है जो शुरुआती फाइन-ट्यूनिंग के दौरान 'इनिशियल ग्रेडिएंट इंफॉर्मेशन एक्यूमुलेशन मैट्रिक्स' के माध्यम से लेयर के महत्व का आकलन करके लार्ज लैंग्वेज मॉडल्स के प्रशिक्षण और अनुमान (इन्फरेंस) दोनों को कुशलतापूर्वक बढ़ाता है, जिससे नगण्य सटीकता हानि के साथ 40% पैरामीटर की कमी प्राप्त होती है।

Wei Huang, Anda Cheng, Yinggui Wang2026-01-28
💬 NLP

Enhancing Academic Paper Recommendations Using Fine-Grained Knowledge Entities and Multifaceted Document Embeddings

यह शोध पत्र एक नवीन शैक्षणिक शोध पत्र अनुशंसा पद्धति प्रस्तावित करता है जो विद्वानों की विशिष्ट अनुसंधान आवश्यकताओं को बेहतर ढंग से संबोधित करने के लिए दस्तावेज़ एम्बेडिंग और उद्धरण डेटा के साथ सूक्ष्म-स्तरीय ज्ञान संस्थाओं (fine-grained knowledge entities) को एकीकृत करता है, जिससे STM-KG डेटासेट पर मौजूदा बेसलाइन मॉडल की तुलना में परिशुद्धता (precision) में 6.7% का सुधार हुआ है।

Haixu Xi, Heng Zhang, Chengzhi Zhang2026-01-28
💬 NLP

Training Tensor Attention Efficiently: From Cubic to Almost Linear Time

यह शोध पत्र यह प्रदर्शित करता है कि टेंसर अटेंशन (tensor attention) के बैकवर्ड ग्रेडिएंट को एक क्लोज्ड-फॉर्म समाधान और बहुपद सन्निकटन (polynomial approximation) एवं टेंसर बीजगणित पर आधारित एक तेज़ एल्गोरिदम प्रदान करके लगभग रैखिक समय में संगणित किया जा सकता है, जबकि यह भी सिद्ध करता है कि बाउंडेड एंट्री धारणाओं (bounded entry assumptions) के तहत यह दक्षता सटीक (tight) है।

Yang Cao, Yingyu Liang, Zhenmei Shi, Zhao Song2026-01-27
💬 NLP

Exploring LGBTQ+ Bias in Generative AI Answers across Different Country and Religious Contexts

यह अध्ययन प्रकट करता है कि चैटजीपीटी 3.5 और बार्ड जैसे जनरेटिव एआई सिस्टम सांस्कृतिक और धार्मिक संदर्भ के आधार पर समलैंगिक विरोधी बयानों के प्रति अपनी प्रतिक्रियाओं में महत्वपूर्ण परिवर्तनशीलता प्रदर्शित करते हैं, जहाँ चैटजीपीटी सांस्कृतिक सापेक्षवाद की ओर झुकता है जबकि बार्ड मानवाधिकारों को प्राथमिकता देता है, और अंततः यह तर्क देता है कि सांस्कृतिक रूप से विविध एआई आउटपुट को मौलिक मानवाधिकार सिद्धांतों पर आधारित होना चाहिए।

Lilla Vicsek, Anna Vancsó, Mike Zajko, Judit Takacs2026-01-27
💬 NLP

How to Make LMs Strong Node Classifiers?

यह शोध पत्र एक नवीन दृष्टिकोण प्रस्तावित करता है जो टोपोलॉजिकल (topological) और सिमेंटिक (semantic) रिट्रीवल के माध्यम से इनपुट्स को समृद्ध करके और एक हल्के GNN क्लासिफायर के माध्यम से भविष्यवाणियों को निर्देशित करके, बिना किसी आर्किटेक्चरल संशोधन के, ऑफ-द-शेल्फ लैंग्वेज मॉडल्स को स्टेट-ऑफ-द-आर्ट नोड क्लासिफिकेशन प्रदर्शन प्राप्त करने में सक्षम बनाता है।

Zhe Xu, Kaveh Hassani, Si Zhang, Hanqing Zeng, Michihiro Yasunaga, Limei Wang, Dongqi Fu, Ning Yao, Bo Long, Hanghang To (…)2026-01-27
💬 NLP

Debate, Deliberate, Decide (D3): A Cost-Aware Adversarial Framework for Reliable and Interpretable LLM Evaluation

यह शोध पत्र डिबेट, डेलिब्रेट, डिसाइड (D3) को प्रस्तुत करता है, जो एक लागत-सचेत (cost-aware) प्रतिकूल मल्टी-एजेंट फ्रेमवर्क है, जो कम पूर्वाग्रह और अनुकूल लागत-सटीकता व्यापार-संबंधों (cost-accuracy trade-offs) के साथ विश्वसनीय, व्याख्या योग्य और अत्याधुनिक LLM मूल्यांकन प्राप्त करने के लिए भूमिका-विशिष्ट एजेंटों के बीच संरचित बहसों और बजटयुक्त पुनरावृत्ति प्रोटोकॉल का उपयोग करता है।

Abir Harrasse, Chaithanya Bandi, Hari Bandi2026-01-27
💬 NLP

LingGen: Scalable Multi-Attribute Linguistic Control via Power-Law Masking

यह शोध पत्र LingGen प्रस्तुत करता है, जो एक स्केलेबल नियंत्रित टेक्स्ट जनरेशन मॉडल है जो एक समर्पित एट्रिब्यूट एनकोडर, BOS-आधारित इंजेक्शन और पारेटो-वितरित मास्किंग दरों का उपयोग करने वाली एक नवीन P-MASKING प्रशिक्षण रणनीति के माध्यम से उच्च प्रवाह और कम त्रुटि के साथ कई वास्तविक-मान वाले भाषाई गुणों पर सूक्ष्म नियंत्रण प्राप्त करता है।

Mohamed Elgaar, Hadi Amiri2026-01-27
💬 NLP

Discourse Features Enhance Detection of Document-Level Machine-Generated Content

यह शोध पत्र नए डेटासेट और एक नवीन मॉडल, DTransformer को पेश करके लंबे और पैराफ्रेज़ किए गए (paraphrased) टेक्स्ट को संभालने में मौजूदा मशीन-जनित सामग्री डिटेक्टरों की सीमाओं को संबोधित करता है, जो अत्याधुनिक दृष्टिकोणों की तुलना में महत्वपूर्ण प्रदर्शन सुधार प्राप्त करने के लिए विमर्श विश्लेषण (discourse analysis) का लाभ उठाता है।

Yupei Li, Manuel Milling, Lucia Specia, Björn W. Schuller2026-01-27