💻 computer science

AutiHero: Engaging Parents in Creating Personalized, Multi-path~Social Narratives for Autistic Children

यह शोध पत्र Auti-Hero को प्रस्तुत करता है, जो एक जनरेटिव एआई (generative AI) प्रणाली है जो ऑटिस्टिक बच्चों के माता-पिता को व्यक्तिगत, बहु-मार्गी सामाजिक आख्यान (social narratives) बनाने के लिए सशक्त बनाती है, और एक दो सप्ताह के अध्ययन के माध्यम से यह प्रदर्शित करती है कि यह उपकरण प्रभावी रूप से सहयोगात्मक कहानी कहने की सुविधा प्रदान करता है और व्यवहार संबंधी मार्गदर्शन में माता-पिता के आत्मविश्वास को बढ़ाता है।

Jungeun Lee, Kyungah Lee, Inseok Hwang, SoHyun Park, Young-Ho Kim2026-04-03
🤖 machine learning

Quokka: Accelerating Program Verification with LLMs via Invariant Synthesis

यह शोध पत्र Quokka को प्रस्तुत करता है, जो एक मूल्यांकन-केंद्रित ढांचा (framework) है जो प्रोग्राम सत्यापन के लिए लूप इनवेरिएंट्स (loop invariants) को सीधे मान्य और संश्लेषित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो 866 इंस्टेंस के एक व्यापक बेंचमार्क और विभिन्न LLM कॉन्फ़िगरेशन के माध्यम से अत्याधुनिक प्रदर्शन प्रदर्शित करता है।

Anjiang Wei, Tianran Sun, Tarun Suresh, Haoze Wu, Ke Wang, Alex Aiken2026-04-03
💬 NLP

Learning to Reason in Structured In-context Environments with Reinforcement Learning

यह शोध पत्र स्ट्रक्चर्ड इन-कॉन्टेक्स्ट एनवायरनमेंट (SIE) फ्रेमवर्क पेश करता है, जो सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) के लिए स्केलेबल, सत्यापन योग्य और सामान्यीकरण योग्य वातावरण बनाने के लिए बड़े पैमाने पर संरचित डेटा का लाभ उठाता है, जिससे लार्ज लैंग्वेज मॉडल्स को इन-डोमेन और आउट-ऑफ-डोमेन दोनों कार्यों में अपने तर्क कौशल को महत्वपूर्ण रूप से सुधारने में सक्षम बनाया जा सके।

Peng Yu, Zeyuan Zhao, Shao Zhang, Luoyi Fu, Xinbing Wang, Ying Wen2026-04-03
💬 NLP

Community size rather than grammatical complexity better predicts Large Language Model accuracy in a novel Wug Test

यह अध्ययन प्रदर्शित करता है कि एक बहुभाषी वग टेस्ट (Wug Test) में बड़े भाषा मॉडल (Large Language Models) की रूपात्मक नियमों को सामान्यीकृत करने की क्षमता मुख्य रूप से किसी भाषा के वक्ता समुदाय के आकार और उसकी डिजिटल डेटा उपलब्धता द्वारा संचालित होती है न कि भाषा की व्याकरणिक जटिलता द्वारा, जो यह सुझाव देता है कि उनका प्रदर्शन वास्तविक भाषाई क्षमता के बजाय संसाधन प्रचुरता को दर्शाता है।

Nikoleta Pantelidou, Evelina Leivada, Raquel Montero, Paolo Morosi2026-04-03
💻 computer science

Support-Contra Asymmetry in LLM Explanations

यह शोध पत्र लार्ज लैंग्वेज मॉडल (Large Language Model) के स्पष्टीकरणों में एक "सपोर्ट-कॉन्ट्रा विषमता" (support-contra asymmetry) को अनुभवजन्य रूप से प्रदर्शित करता है, जो यह प्रकट करता है कि सही भविष्यवाणियों के लिए स्पष्टीकरण मुख्य रूप से सहायक शाब्दिक संकेतों (lexical cues) का संदर्भ देते हैं, जबकि गलत भविष्यवाणियों के लिए स्पष्टीकरण विरोधाभासी साक्ष्यों का उल्लेख करने की प्रवृत्ति रखते हैं।

Avinash Patil2026-04-03
💻 computer science

Penalizing Length: Uncovering Systematic Bias in Quality Estimation Metrics

यह शोध पत्र प्रकट करता है कि वर्तमान गुणवत्ता अनुमान (Quality Estimation) मेट्रिक्स विषम प्रशिक्षण डेटा वितरण के कारण व्यवस्थित रूप से लंबे अनुवादों को दंडित करते हैं, और यह प्रदर्शित करता है कि प्रशिक्षण के दौरान लंबाई सामान्यीकरण (length normalization) इस पूर्वाग्रह को प्रभावी ढंग से कम करने के लिए अधिक विश्वसनीय मूल्यांकन संकेत उत्पन्न करता है।

Yilin Zhang, Wenda Xu, Zhongtao Liu, Tetsuji Nakagawa, Markus Freitag2026-04-03
💬 NLP

WAON: Large-Scale Japanese Image-Text Pair Dataset for Improving Model Performance on Japanese Cultural Tasks

यह शोध पत्र WAON को प्रस्तुत करता है, जो लगभग 155 मिलियन उदाहरणों वाला एक बड़े पैमाने का जापानी इमेज-टेक्स्ट डेटासेट है, साथ ही एक क्यूरेटेड बेंचमार्क (WAON-Bench) भी है, जो उच्च गुणवत्ता वाले जापानी सांस्कृतिक डेटा की कमी को दूर करने के लिए है और यह प्रदर्शित करता है कि इस डेटासेट पर फाइन-ट्यूनिंग करने से जापानी सांस्कृतिक कार्यों पर विजन-लैंग्वेज मॉडल के प्रदर्शन में काफी सुधार होता है।

Issa Sugiura, Shuhei Kurita, Yusuke Oda, Daisuke Kawahara, Yasuo Okabe, Naoaki Okazaki2026-04-03
💻 computer science

Glia: A Human-Inspired AI for Automated Systems Design and Optimization

यह शोधपत्र ग्लिया (Glia) प्रस्तुत करता है, जो एक मानव-प्रेरित मल्टी-एजेंट एआई आर्किटेक्चर है जो वितरित प्रणालियों (distributed systems) के लिए व्याख्या योग्य, उच्च-प्रदर्शन वाले तंत्रों को स्वायत्त रूप से डिजाइन करने के लिए लार्ज लैंग्वेज मॉडल्स और अनुभवजन्य फीडबैक का लाभ उठाता है, जिससे काफी कम समय में मानव-विशेषज्ञ स्तर की रचनात्मकता और दक्षता प्राप्त होती है।

Pouya Hamadanian, Pantea Karimi, Arash Nasr-Esfahany, Kimia Noorbakhsh, Joseph Chandler, Ali ParandehGheibi, Mohammad Al (…)2026-04-03
💬 NLP

PETra: A Multilingual Corpus of Pragmatic Explicitation in Translation

यह शोध पत्र PragExTra को प्रस्तुत करता है, जो अनुवाद में प्रैग्मैटिक एक्सप्लिसिटेशन (pragmatic explicitation) के लिए पहला बहुभाषी कॉर्पस और डिटेक्शन फ्रेमवर्क है, जो सक्रिय शिक्षण (active learning) का लाभ उठाकर यह पहचानता है और मात्रा निर्धारित करता है कि अनुवादक सांस्कृतिक पृष्ठभूमि के विवरणों के साथ ग्रंथों को कैसे समृद्ध करते हैं, जिससे सांस्कृतिक रूप से जागरूक मशीन अनुवाद के विकास को आगे बढ़ाया जा सके।

Doreen Osmelak, Koel Dutta Chowdhury, Uliana Sentsova, Cristina España-Bonet, Josef van Genabith2026-04-03
💬 NLP

Let the Model Distribute Its Doubt: Confidence Estimation through Verbalized Probability Distribution

यह शोध पत्र मॉडल को एक एकल अनुमान के बजाय पूर्ण संभाव्यता वितरण (probability distribution) को मौखिक रूप से व्यक्त करने के लिए प्रॉम्प्ट करके लार्ज लैंग्वेज मॉडल आत्मविश्वास अनुमान में सुधार करने की एक विधि प्रस्तावित करता है, जो यह प्रदर्शित करता है कि यह दृष्टिकोण तर्क प्रभावकारिता को बढ़ाता है, विभिन्न कार्यों में बेहतर प्रदर्शन प्राप्त करता है, और मौजूदा बेसलाइन की तुलना में इन्फरेंस-टाइम स्केलिंग के दौरान कम्प्यूटेशनल लागत को महत्वपूर्ण रूप से कम करता है।

Ante Wang, Weizhi Ma, Yang Liu2026-04-03