💻 computer science

Sumi: Open Uniform Diffusion Language Model from Scratch

यह शोध पत्र सुमी (Sumi) को प्रस्तुत करता है, जो कि 1.5 ट्रिलियन टोकन पर स्क्रैच से प्रीट्रेन किया गया एक पूर्णतः ओपन 7B यूनिफॉर्म डिफ्यूजन लैंग्वेज मॉडल है, जो नेटिव यूनिफॉर्म डिफ्यूजन के अध्ययन के लिए पहला बड़े पैमाने का संदर्भ बिंदु के रूप में कार्य करता है और ज्ञान, तर्क एवं कोडिंग बेंचमार्क पर प्रतिस्पर्धी प्रदर्शन प्रदर्शित करता है।

Mengyu Ye, Keito Kudo, Wataru Ikeda, Ryosuke Matsuda, Keisuke Sakaguchi, Jun Suzuki2026-06-19
💻 computer science

Which Sections of a Research Paper Best Reveal Its Research Methods? Evidence from Library and Information Science

यह अध्ययन लाइब्रेरी और सूचना विज्ञान जर्नल्स के 1,954 पूर्ण-पाठ लेखों का विश्लेषण करता है यह प्रदर्शित करने के लिए कि विशिष्ट पूर्ण-पाठ खंडों, विशेष रूप से मध्य-से-उत्तरार्ध और अंतिम अनुभागों को, ग्रंथ सूची मेटाडेटा के साथ संयोजित करने से केवल शीर्षकों और सारांशों पर निर्भर रहने की तुलना में अनुसंधान पद्धतियों के स्वचालित बहु-लेबल वर्गीकरण में महत्वपूर्ण सुधार होता है।

Qiuyu Fang, Jiayi Hao, Chengzhi Zhang2026-06-19
💻 computer science

Written by AI, Managed by AI: Semantic Space Control and Index Sickness Elimination Across 391 Consecutive Sessions

यह शोध पत्र "इंडेक्स सिकनेस" (Index Sickness) की पहचान और समाधान करता है, जो लंबे समय तक चलने वाले LLM सहयोग में एक विफलता मोड है जहाँ अत्यधिक प्रतीकात्मक बाधाएं मॉडलों को उनके अर्थ संबंधी आधार (semantic grounding) खोने के लिए मजबूर करती हैं, और इसके लिए "बेसलाइन-लॉग फिजिकल सेपरेशन" (Baseline-Log Physical Separation) तंत्र का प्रस्ताव और सत्यापन करता है जो निर्देश मात्रा को महत्वपूर्ण रूप से कम करता है और व्यावसायिक वास्तविकता के साथ संरेखण को पुनर्स्थापित करता है।

Hui Zhang, Shuren Song2026-06-19
💻 computer science

Human-AI Coevolution Dynamics: A Formal Theory of Social Intelligence Emergence Through Long-Term Interaction

यह शोध पत्र मानव-एआई सह-विकास गतिशीलता ढांचा (HACD-H) प्रस्तुत करता है, जो एक औपचारिक मॉडल के रूप में यह प्रदर्शित करता है कि सामाजिक बुद्धिमत्ता अलग-थलग संवादात्मक क्षमताओं से नहीं, बल्कि घटती सामाजिक संज्ञानात्मक ऊर्जा और स्थिर संबंधपरक आकर्षणों (relational attractors) द्वारा चिह्नित दीर्घकालिक, स्व-संगठित मानव-एआई अंतःक्रियाओं से उत्पन्न होती है।

Jingyi Zhou, Senlin Luo, Haofan Chen2026-06-19
💻 computer science

IndicContextEval: A Benchmark for Evaluating Context Utilisation in Audio Large Language Models Across 8 Indic Languages

यह शोध पत्र IndicContextEval प्रस्तुत करता है, जो 8 भारतीय भाषाओं और 23 डोमेन में फैला एक व्यापक बहुभाषी बेंचमार्क है, जिसे एक नवीन 7-स्तरीय प्रॉम्प्टिंग ढांचे के माध्यम से यह कठोरता से मूल्यांकन करने के लिए डिज़ाइन किया गया है कि क्या ऑडियो लार्ज लैंग्वेज मॉडल्स वास्तव में स्पष्ट प्रासंगिक प्रॉम्प्ट्स का उपयोग करते हैं या प्रीट्रेनिंग ज्ञान पर निर्भर रहते हैं।

Sakshi Joshi, Dhruv Subhash Rathi, Sanskar Singh, Eldho Ittan George, R J Hari, Kaushal Bhogale, Mitesh M. Khapra2026-06-19
💻 computer science

Language Models as Interfaces, Not Oracles: A Hybrid LLM-ML System for Pediatric Appendicitis

यह शोधपत्र ClaMPAPP प्रस्तुत करता है, जो एक हाइब्रिड सिस्टम है जो एक स्थिर XGBoost क्लासिफायर के लिए क्लिनिकल नैरेटिव से संरचित विशेषताओं को निकालने हेतु एक मजबूत इंटरफेस के रूप में लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, और पीडियाट्रिक अपेंडिसाइटिस ट्राइएज में एंड-टू-एंड LLM दृष्टिकोणों की तुलना में बेहतर नैदानिक प्रदर्शन और सुरक्षा प्रदर्शित करता है।

Soheyl Bateni, Maryam Abdolali2026-06-19
💻 computer science

RECOM: A Validity Discrimination Tradeoff in Automatic Metrics for Open Ended Reddit Question Answering

यह शोध पत्र ओपन-एंडेड रेडिट प्रश्न उत्तरण (question answering) के मूल्यांकन के लिए एक संदूषण-मुक्त (contamination-free) डेटासेट, RECOM को प्रस्तुत करता है, ताकि यह प्रदर्शित किया जा सके कि वर्तमान स्वचालित मेट्रिक्स एक मौलिक वैधता-विभेदक ट्रेडऑफ़ (validity-discrimination tradeoff) का सामना करते हैं जहाँ वे या तो वास्तविक सामग्री को शोर से अलग कर सकते हैं या मॉडल के प्रदर्शन को रैंक कर सकते हैं, लेकिन अपने प्रतिनिधित्व डिज़ाइन (representation design) की अंतर्निहित सीमाओं के कारण शायद ही कभी दोनों कर पाते हैं।

Pushwitha Krishnappa, Amit Das, Vinija Jain, Aman Chadha, Tathagata Mukherjee2026-06-19
💻 computer science

Structured Inference with Large Language Gibbs

यह शोध पत्र "लार्ज लैंग्वेज गिब्स" (Large Language Gibbs) का प्रस्ताव करता है, जो एक पुनरावृत्ति संभाव्यता अनुमान विधि (iterative probabilistic inference method) है जो चरों को पुन: नमूना लेने के लिए एक LLM के सशर्त वितरणों (conditional distributions) को ट्रांज़िशन ऑपरेटरों के रूप में उपयोग करती है, जिससे सुसंगत संरचित तर्क प्राप्त करने के लिए सिंगल-पास ऑटोरेग्रेसिव जनरेशन के क्रम-निर्भर पूर्वाग्रहों (order-dependent biases) पर विजय प्राप्त की जा सके।

Sanghyeok Choi, Henry Gouk, Esmeralda S. Whitammer2026-06-19
💻 computer science

Rethinking Reward Supervision: Rubric-Conditioned Self-Distillation

यह शोध पत्र रूब्रिक-कंडीशन्ड सेल्फ-डिस्टिलेशन (Rubric-Conditioned Self-Distillation) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो ऑन-पॉलिसी सेल्फ-डिस्टिलेशन को निर्देशित करने के लिए संरचित, सूक्ष्म-स्तरीय रूब्रिक्स का लाभ उठाता है, जिससे शोर वाले चेन-ऑफ-थॉट एनोटेशन और स्केलर रिवार्ड्स की सीमाओं को पार करते हुए GRPO और OPSD की तुलना में विज्ञान तर्क बेंचमार्क पर बेहतर प्रदर्शन प्राप्त किया जा सके।

Siyi Gu, Jialin Chen, Sophia Zhou, Arman Cohan, Rex Ying2026-06-19
💻 computer science

Freeing the Law with LOCUS: A Local Ordinance Corpus for the United States

यह शोध पत्र LOCUS को प्रस्तुत करता है, जो खंडित स्रोतों से OCR के माध्यम से प्राप्त लगभग सभी सार्वजनिक रूप से उपलब्ध अमेरिकी नगरपालिका और काउंटी अध्यादेशों का एक व्यापक, मशीन-पठनीय संग्रह है, जिसके साथ स्थानीय कानूनों के बड़े पैमाने पर कानूनी अनुसंधान और विश्लेषण को सक्षम करने के लिए सुसंगत एक्सेस लेयर्स और विशिष्ट AI मॉडल दिए गए हैं।

Denis Peskoff, Joe Barrow, Christopher Vu, Diag Davenport2026-06-19