💬 NLP

Building Community-Centred NLP Resources for Puno Quechua

यह शोध पत्र पुनो क्वेचुआ के लिए पहले समर्पित स्वचालित भाषण पहचान संसाधनों को प्रस्तुत करता है, जिसमें 66 घंटे का सहभागी भाषण संग्रह, अत्याधुनिक मॉडलों का एक व्यवस्थित बेंचमार्क, और समुदाय-केंद्रित भाषा संरक्षण को समर्थन देने के लिए सभी डेटासेट और फाइन-ट्यून किए गए मॉडल की खुली रिलीज़ शामिल है।

Elwin Huaman, Adrian Gamarra Lafuente, Johanna Cordova, Anna Korhonen2026-05-28
🤖 AI

AI, Take the Wheel: What Drives Delegation and Trust in Human-Computer Cooperative Question Answering?

यह शोध पत्र मानव-एआई प्रश्न-उत्तर टीमों में प्रतिनिधिमंडल (delegation) और अंगीकरण (adoption) की विशिष्ट गतिशीलता की जांच करता है, जो यह प्रकट करता है कि जहाँ सहयोग व्यक्तिगत एजेंटों से बेहतर प्रदर्शन करता है, वहीं मनुष्य पुष्टिकरण पूर्वाग्रह (confirmation bias) और गलत संरेखित आत्मविश्वास के कारण उप-इष्टतम विश्वास निर्णय लेते हैं, जिससे बेहतर अंशांकन (calibration) और स्पष्टीकरण तंत्र की आवश्यकता होती है।

Maharshi Gor, Yoo Yeon Sung, Yu Hou, Eve Fleisig, Irene Ying, Tianyi Zhou, Jordan Boyd-Graber2026-05-28
💬 NLP

CIRF: Tokenizing Chain-of-Thoughts into Reusable Functional Units for Efficient Latent Reasoning in Large Language Models

यह शोध पत्र CIRF का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो स्पष्ट चेन-ऑफ-थॉट (Chain-of-Thought) तर्क को पुन: प्रयोज्य कार्यात्मक इकाइयों में टोकनाइज़ करता है ताकि बड़े भाषा मॉडलों (LLMs) में कुशल, अनुकूलन योग्य और व्याख्या योग्य लेटेंट रीजनिंग (latent reasoning) को एक अनुकूल सटीकता-विलंबता ट्रेड-ऑफ के साथ सक्षम बनाया जा सके।

Yukyung Lee, Yumeng Shen, Jinhyeong Park, Hyein Yang, Jun-Hyung Park2026-05-28
🤖 AI

Where Rollouts Begin: Low-Load, High-Leverage First-Token Diversification for RLVR

यह शोध पत्र REFT को प्रस्तुत करता है, जो एक हल्का RLVR तरीका है जो रीजनिंग मार्कर के बाद पहले टोकन के लिए पॉलिसी के शीर्ष-NN उम्मीदवारों से समान रूप से नमूना लेकर रोलआउट विविधता को बढ़ाता है और रीजनिंग प्रदर्शन में सुधार करता है, जिससे शुद्धता संकेत (correctness signal) को बदले बिना अन्वेषण का विस्तार होता है।

Soeun Kim, Albert No2026-05-28
💬 NLP

Routing-Aligned Fine-Tuning for Multilingual Downstream Tasks in Mixture-of-Experts Models

यह शोध पत्र RA-MoE का प्रस्ताव करता है, जो एक तीन-चरणीय फाइन-ट्यूनिंग फ्रेमवर्क है जो मिक्सचर-ऑफ-एक्सपर्ट्स मॉडल्स के मध्य परतों में भाषा-सार्वभौमिक संरेखण क्षेत्र (language-universal alignment zone) का लाभ उठाकर लक्ष्य-भाषा के रूटिंग पैटर्न को अंग्रेजी कार्य-विशेषज्ञ सक्रियणों (English task-expert activations) के साथ संरेखित करता है, जिससे बहुभाषी डाउनस्ट्रीम प्रदर्शन में महत्वपूर्ण सुधार होता है।

Guanzhi Deng, Kuan Wu, Haibo Wang, Shing Yin Wong, Sichun Luo, Linqi Song2026-05-28
💬 NLP

Argument Quality Assessment with Large Language Models: A Pairwise Bradley-Terry Approach

यह शोध पत्र ब्रैडली-टेरी फ्रेमवर्क के भीतर युग्मवार तुलनाओं का उपयोग करके तार्किक, अलंकारिक और द्वंद्वात्मक आयामों में तर्क की गुणवत्ता का आकलन करने की 12 बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) की क्षमता का मूल्यांकन करता है, जिसमें यह पाया गया है कि जबकि Llama-70B जैसे मॉडल मानव विशेषज्ञों के साथ मध्यम संरेखण प्रदर्शित करते हैं, वे स्वचालित तर्क मूल्यांकन के लिए एक स्थिर और आंशिक रूप से पूरक दृष्टिकोण प्रदान करते हैं।

Nicolás Benjamín Ocampo, Agnes Paullate Nyiranziza, Davide Ceolin2026-05-28
🤖 AI

Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning

यह शोध पत्र COVCAL को प्रस्तुत करता है, जो एक जोखिम-नियंत्रण ढांचा (risk-control framework) है जो प्रूफ़ कवरेज और नैदानिक संकेतों (diagnostic signals) के आधार पर उत्तरों को गतिशील रूप से चुनकर, प्राकृतिक-भाषा गणितीय समस्याओं के लिए जज के रूप में लीन (Lean) औपचारिकीकरण (formalization) के उपयोग की विश्वसनीयता को प्रमाणित करता है, यह प्रदर्शित करते हुए कि जहाँ छोटे ऑटोफॉर्मलाइज़र (autoformalizers) जोखिम-नियंत्रित स्वीकृति के लिए बहुत विरल संकेत प्रदान करते हैं, वहीं विशिष्ट फॉर्मलाइज़र सख्त जोखिम सीमाओं के तहत उच्च-सटीकता चयन को सक्षम करते हैं।

Pauline Bourigault, Xiaotong Ji, Matthieu Zimmer, Rasul Tutunov, Haitham Bou Ammar2026-05-28
💬 NLP

AdaDPO: Self-Adaptive Direct Preference Optimization with Balanced Gradient Updates

AdaDPO, डायरेक्ट प्रेफरेंस ऑप्टिमाइज़ेशन (DPO) का एक सेल्फ-अडैप्टिव वेरिएंट है जो पसंदीदा और नापसंद प्रतिक्रियाओं के अपडेट के परिमाण को संतुलित करने के लिए प्रति-जोड़ा ग्रेडिएंट गुणांक (per-pair gradient coefficients) पेश करता है, जिससे DPO के अंतर्निहित एसिमेट्रिक लर्निंग बायस को ठीक किया जाता है और न्यूनतम कार्यान्वयन परिवर्तनों के साथ बेहतर अलाइनमेंट प्रदर्शन प्राप्त किया जाता है।

Shaolong Chen, Madalina Ciobanu, Qingqing Mao, Ritankar Das2026-05-28
💬 NLP

Comonadic Morphophonology: A Compositional Framework for Context-Dependent Morphological Rules in Finnish

यह शोध पत्र फिनिश रूपात्मक ध्वनिविज्ञान (morphophonology) को कंपोजेबल स्थानीय फलनों (composable local functions) के रूप में मॉडल करने के लिए राइटर कोमोनैड (Writer comonad) का उपयोग करते हुए एक नवीन कोमोनैडिक ढांचे (comonadic framework) को प्रस्तुत करता है, जो पारंपरिक परिमित-अवस्था (finite-state) दृष्टिकोणों की तुलना में नियम जटिलता में 67-गुणा की कमी प्राप्त करते हुए उच्च सटीकता के साथ कुशल द्विदिश आकृति विज्ञान (bidirectional morphology) को सक्षम बनाता है।

Yongseok Jang2026-05-28
💬 NLP

A new semantically annotated corpus with syntactic-semantic and cross-lingual senses

यह शोध पत्र शब्द अर्थ स्पष्टीकरण (वर्ड सेंस डिस्एम्बिगुएशन) के लिए एक नया अर्थ-चिह्नित संग्रह प्रस्तुत करता है जिसमें 20 फ्रांसीसी बहुअर्थी क्रियाएं शामिल हैं, जहाँ प्रत्येक उदाहरण को इसके अंग्रेजी अनुवाद, एक लेक्सिकन-ग्रामर शब्दकोश प्रविष्टि, और इन दोनों स्रोतों को मिलाकर प्राप्त एक सूक्ष्म-स्तरीय अर्थ लेबल के साथ एनोटेट किया गया है।

Myriam Rakho, Eric Laporte, Matthieu Constant2026-05-28