💬 NLP

Statistical Machine Translation for Indic Languages

यह शोध पत्र अंग्रेजी और पंद्रह कम-संसाधन वाली भारतीय भाषाओं के बीच अनुवाद करने के लिए मोसेस (MOSES) टूलकिट का उपयोग करके सामानांतर (Samanantar) और ओपस (OPUS) डेटासेट का लाभ उठाते हुए, प्रशिक्षण के लिए और BLEU, METEOR एवं RIBES मेट्रिक्स द्वारा मापे गए अनुवाद की गुणवत्ता को अनुकूलित करने के लिए विभिन्न प्रीप्रोसेसिंग और पुनर्व्यवस्था (reordering) तकनीकों का उपयोग करते हुए सांख्यिकीय मशीन अनुवाद (SMT) प्रणालियों के विकास और मूल्यांकन को प्रस्तुत करता है।

Sudhansu Bala Das, Divyajoti Panda, Tapas Kumar Mishra, Bidyut Kr. Patra2026-03-04
💬 NLP

Verifying the Robustness of Automatic Credibility Assessment

यह शोध पत्र गलत सूचना का पता लगाने से बचने के लिए डिज़ाइन किए गए प्रतिकूल हमलों (adversarial attacks) के विरुद्ध टेक्स्ट क्लासिफायर की मजबूती का मूल्यांकन करता है, जिसमें BODEGA बेंचमार्क को पेश करते हुए यह प्रदर्शित किया गया है कि आधुनिक लार्ज लैंग्वेज मॉडल्स अक्सर छोटे मॉडल्स की तुलना में अर्थ-संरक्षण करने वाले टेक्स्ट संशोधनों के प्रति अधिक संवेदनशील होते हैं।

Piotr Przybyła, Alexander Shvets, Horacio Saggion2026-03-04
🤖 AI

Predictive Authoring for Brazilian Portuguese Augmentative and Alternative Communication

यह शोध पत्र ब्राज़ीलियाई पुर्तगाली ऑगमेंटेटिव एंड अल्टरनेटिव कम्युनिकेशन (AAC) प्रणालियों में पिकटोग्राम की भविष्यवाणी करने के लिए BERTimbau मॉडल का उपयोग करने का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि पिकटोग्राम को कैप्शन के माध्यम से प्रस्तुत करने से उच्चतम सटीकता प्राप्त होती है और साथ ही भविष्यवाणी के लिए छवियों के उपयोग की क्षमता का भी पता लगाता है।

Jayr Pereira, Rodrigo Nogueira, Cleber Zanchettin, Robson Fidalgo2026-03-04
💬 NLP

Safety Verification of Wait-Only Non-Blocking Broadcast Protocols

यह शोध पत्र प्रदर्शित करता है कि नॉन-ब्लॉकिंग ब्रॉडकास्ट प्रोटोकॉल को 'वेट-ओनली' (Wait-Only) प्रॉपर्टी तक सीमित करने से स्टेट और कॉन्फ़िगरेशन कवेरेबिलिटी समस्याओं की कम्प्यूटेशनल जटिलता, एकरमैन-हार्ड (Ackermann-hard) से घटकर क्रमशः पी-कम्प्लीट (P-complete) और पी-स्पेस-कम्प्लीट (PSPACE-complete) हो जाती है।

Lucie Guillou, Arnaud Sangnier, Nathalie Sznajder2026-03-04
💬 NLP

Topic-Based Watermarks for Large Language Models

यह शोध पत्र बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के लिए एक हल्का, विषय-निर्देशित वॉटरमार्किंग (वॉटरमार्किंग) तंत्र प्रस्तावित करता है जो पाठ की गुणवत्ता को बनाए रखते हुए और बिना किसी अतिरिक्त फ्रेमवर्क ओवरहेड के, मजबूत, पता लगाने योग्य हस्ताक्षरों को एम्बेड करने के लिए शब्दावली को विषय-संरेखित उपसमूहों में विभाजित करता है।

Alexander Nemecek, Yuzhou Jiang, Erman Ayday2026-03-04
💬 NLP

Automated Coding of Communications in Collaborative Problem-solving Tasks Using ChatGPT

यह अध्ययन प्रदर्शित करता है कि ChatGPT सहयोगात्मक समस्या-समाधान आकलन के लिए संचार डेटा की कोडिंग को प्रभावी ढंग से स्वचालित कर सकता है, हालांकि इसका प्रदर्शन मॉडल, फ्रेमवर्क और कार्य के आधार पर भिन्न होता है, जिसमें नए तर्क-केंद्रित मॉडल अनिवार्य रूप से दूसरों से बेहतर प्रदर्शन नहीं करते हैं और प्रॉम्प्ट शोधन (prompt refinement) असंगत सुधार प्रदान करता है।

Jiangang Hao, Wenju Cui, Patrick Kyllonen, Emily Kerzabi, Lei Liu, Michael Flor2026-03-04
🔭 astrophysics

StarWhisper Telescope: An AI framework for automating end-to-end astronomical observations

स्टारविस्पर टेलीस्कोप सिस्टम एक एआई एजेंट फ्रेमवर्क है जो बड़े भाषा मॉडलों को विशिष्ट वर्कफ़्लो के साथ एकीकृत करके एंड-टू-एंड खगोलीय अवलोकनों को स्वचालित करता है, जिससे मानव हस्तक्षेप को कम करने और भविष्य के बड़े पैमाने के टेलीस्कोप एरे के लिए स्केलेबल क्षमता प्रदर्शित करने के लिए अवलोकनों की योजना बनाने, डेटा का विश्लेषण करने और फॉलो-अप को ट्रिगर करने के कार्य स्वायत्त रूप से किए जाते हैं।

Cunshi Wang, Yu Zhang, Yuyang Li, Xinjie Hu, Yiming Mao, Xunhao Chen, Pengliang Du, Rui Wang, Ying Wu, Hang Yang, Yanson (…)2026-03-04
💬 NLP

Evaluating Spoken Language as a Biomarker for Automated Screening of Cognitive Impairment

यह अध्ययन प्रदर्शित करता है कि भाषण से भाषाई विशेषताओं का उपयोग करने वाले व्याख्यात्मक मशीन लर्निंग मॉडल अल्जाइमर रोग और संबंधित डिमेंशिया की प्रभावी ढंग से स्क्रीनिंग कर सकते हैं और संज्ञानात्मक गंभीरता की भविष्यवाणी कर सकते हैं, जो वास्तविक दुनिया के इन-रेसिडेंस डेटा के प्रति आशाजनक सामान्यीकरण प्राप्त करते हुए प्रारंभिक नैदानिक ट्राइएज के लिए एक स्केलेबल मार्ग प्रदान करते हैं।

Maria R. Lima, Alexander Capstick, Fatemeh Geranmayeh, Ramin Nilforooshan, Maja Matarić, Ravi Vaidyanathan, Payam Barnag (…)2026-03-04
🤖 AI

Hallucination, Monofacts, and Miscalibration: An Empirical Investigation

यह शोध पत्र भाषा मॉडलों में मतिभ्रम (hallucination), मोनोफैक्ट दरों (monofact rates) और मिसकैलिब्रेशन के बीच के सैद्धांतिक संबंध को अनुभवजन्य रूप से मान्य करता है और यह प्रदर्शित करता है कि प्रशिक्षण डेटा के एक छोटे अंश को चुनिंदा रूप से अपवेट (upweight) करने से सटीकता से समझौता किए बिना मतिभ्रम को महत्वपूर्ण रूप से कम किया जा सकता है, जिससे सार्वभौमिक वि-डुप्लिकेशन (deduplication) नीतियों की आवश्यकता को चुनौती मिलती है।

Miranda Muqing Miao, Michael Kearns2026-03-04
💬 NLP

Make LoRA Great Again: Boosting LoRA with Adaptive Singular Values and Mixture-of-Experts Optimization Alignment

यह शोध पत्र GOAT का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो Mixture-of-Experts आर्किटेक्चर के माध्यम से SVD-संरचित प्रायर्स (priors) को अनुकूल रूप से एकीकृत करके Low-Rank Adaptation (LoRA) को उन्नत करता है और एक सैद्धांतिक स्केलिंग कारक व्युत्पन्न करता है ताकि अनुकूलन को Full Fine-Tuning के साथ संरेखित किया जा सके, जिससे विविध कार्यों में अत्याधुनिक प्रदर्शन प्राप्त होता है।

Chenghao Fan, Zhenyi Lu, Sichen Liu, Chengfeng Gu, Xiaoye Qu, Wei Wei, Yu Cheng2026-03-04