💬 NLP

Learning from the Self-future: On-policy Self-distillation for dLLMs

यह शोध पत्र d-OPSD प्रस्तुत करता है, जो डिफ्यूजन लार्ज लैंग्वेज मॉडल्स (dLLMs) के लिए विशेष रूप से तैयार किया गया पहला ऑन-पॉलिसी सेल्फ-डिस्टिलेशन फ्रेमवर्क है, जो मौजूदा बेसलाइन्स की तुलना में बेहतर प्रदर्शन और सैंपल दक्षता प्राप्त करने के लिए स्व-जनित सफिक्स कंडीशनिंग और स्टेप-लेवल सुपरविजन का लाभ उठाता है।

Yifu Luo, Zeyu Chen, Haoyu Wang, Xinhao Hu, Yuxuan Zhang, Zhizhou Sha, Shiwei Liu2026-06-17
💬 NLP

RubricsTree: Scalable and Evolving Open-Ended Evaluation of Personal Health Agents across Health Memory and Medical Skills

यह शोध पत्र RubricsTree को प्रस्तुत करता है, जो व्यक्तिगत स्वास्थ्य एजेंटों के लिए एक स्केलेबल और विकसित होने वाला मूल्यांकन ढांचा है, जो नैदानिक रूप से सत्यापन योग्य रूब्रिक्स (rubrics) के एक पदानुक्रमित वर्गीकरण और एक अनुकूली राउटर का उपयोग करता है ताकि महंगी मानव एनोटेशन और असंगत LLM जजों की सीमाओं को दूर किया जा सके, जिससे विशेषज्ञ-संरेखित, उच्च-थ्रूपुट मूल्यांकन और स्वास्थ्य सेवा एआई मॉडलों के लिए महत्वपूर्ण प्रदर्शन लाभ सक्षम हो सके।

Weizhi Zhang, Zechen Li, Hamid Palangi, Ben Graef, A. Ali Heydari, Simon A. Lee, Salman Rahman, Ray Luo, Zeinab Esmaeilp (…)2026-06-17
💬 NLP

Looped World Models

यह शोध पत्र लूप्ड वर्ल्ड मॉडल्स (LoopWM) को प्रस्तुत करता है, जो एक नवीन आर्किटेक्चर है जो एक पैरामीटर-साझा ट्रांसफार्मर के माध्यम से लेटेंट स्टेट्स को पुनरावृत्ति से परिष्कृत करके, निष्ठावान लॉन्ग-होरिज़न सिमुलेशन और कम्प्यूटेशनल लागत के बीच के तनाव को हल करता है, जिससे 100 गुना तक पैरामीटर दक्षता प्राप्त होती है और इटरेटिव लेटेंट डेप्थ को वर्ल्ड मॉडलिंग के लिए एक नए स्केलिंग एक्सिस के रूप में स्थापित करता है।

Hongyuan Adam Lu, Z. L. Victor Wei, Qun Zhang, Jinrui Zeng, Bowen Cao, Lingwei Meng, Mocheng Li, Zezhong Wang, Haonan Yi (…)2026-06-17
💬 NLP

Darshana Graph: A Parallel Commentary Corpus for Comparative Indian Philosophy, with Stylometric and Exploratory Graph Analyses

यह शोध पत्र दर्शन ग्राफ (Darshana Graph) का परिचय देता है, जो हिंदू, बौद्ध और जैन परंपराओं के 1,25,000 से अधिक अभिलेखों का एक अद्वितीय समानांतर टीका संग्रह है जो प्रत्यक्ष अंतर-टीका तुलना को सक्षम बनाता है, और तर्कपूर्ण शैलियों के शैलीमितीय (stylometric) विश्लेषण तथा दार्शनिक संबंधों को निकालने और सत्यापित करने के लिए एक नियंत्रित एलएलएम (LLM) पाइपलाइन के माध्यम से इसकी उपयोगिता को प्रदर्शित करता है।

Joy Bose2026-06-17
💬 NLP

ReproRepo: Scaling Reproducibility Audits with GitHub Repository Issues

यह शोध पत्र ReproRepo को प्रस्तुत करता है, जो 1,149 मशीन लर्निंग शोध पत्रों से प्राप्त मानव-रिपोर्ट किए गए GitHub इश्यूज़ का लाभ उठाकर वास्तविक दुनिया के पुनरुत्पादकता अवरोधकों (reproducibility blockers) की पहचान करने की LLM एजेंटों की क्षमता का मूल्यांकन करने के लिए एक स्केलेबल फ्रेमवर्क है, जो यह प्रदर्शित करता है कि गैर-निष्पादित (non-executing) एजेंट भी लगभग 90% मामलों में सिमेंटिक समस्याओं का पता लगा सकते हैं।

Shanda Li, Qiuhong Anna Wei, Jingwu Tang, Valerie Chen, Nihar B Shah, Tim Dettmers, Yiming Yang, Ameet Talwalkar2026-06-17
💬 NLP

HK-LegiCoST: Leveraging Non-Verbatim Transcripts for Speech Translation

यह शोध पत्र HK-LegiCoST को प्रस्तुत करता है, जो कैंटोनीज़ ऑडियो, गैर-मौखिक पारंपरिक चीनी लिप्यंतरण और अंग्रेजी अनुवादों का एक बड़े पैमाने पर तीन-तरफा समानांतर संग्रह है, जिसे उन भाषाओं के लिए स्पीच ट्रांसलेशन अनुसंधान को आगे बढ़ाने के लिए डिज़ाइन किया गया है जहाँ मौखिक और लिखित रूपों में महत्वपूर्ण अंतर होता है।

Cihan Xiao, Henry Li Xinyuan, Jinyi Yang, Dongji Gao, Matthew Wiesner, Kevin Duh, Sanjeev Khudanpur2026-06-16
💬 NLP

Attention, not scale, drives human-AI alignment in multimodal language prediction

यह अध्ययन प्रदर्शित करता है कि मॉडल के पैमाने के बजाय सूचनात्मक दृश्य संकेतों (visual cues) पर चयनात्मक ध्यान देना ही वह प्राथमिक कारक है जो ट्रांसफार्मर-आधारित विजन-लैंग्वेज मॉडलों को मल्टीमॉडल संदर्भों के भीतर आगामी शब्दों की भविष्यवाणी करने में मानव व्यवहार के साथ संरेखित होने में सक्षम बनाता है।

Viktor Kewenig, Andrew Lampinen, Samuel A. Nastase, Christopher Edwards, Quitterie Lacome D'Elascombe, Akilles Rechardt (…)2026-06-16
💬 NLP

It's About Time: Temporal References in Emergent Communication

यह शोध पत्र यह प्रदर्शित करता है कि लॉस फंक्शन (loss function) को बदलने के बजाय, एजेंट आर्किटेक्चर में बैचिंग पद्धति को संशोधित करना, उभरते संचार प्रणालियों (emergent communication systems) में टेम्पोरल संदर्भों (temporal references) के उद्भव को सक्षम करने के लिए पर्याप्त है, जो अधिक इष्टतम कोडिंग दक्षता प्राप्त करने के लिए एक आवश्यक क्षमता है।

Olaf Lipinski, Adam J. Sobey, Federico Cerutti, Timothy J. Norman2026-06-16
🤖 AI

Speaking Your Language: Spatial Relationships in Interpretable Emergent Communication

यह शोध पत्र प्रदर्शित करता है कि एजेंट एक व्याख्या योग्य उभरती भाषा विकसित कर सकते हैं जो उच्च सटीकता के साथ स्थानिक संबंधों को व्यक्त करने में सक्षम है, जिसमें संरचनात्मक (compositional) और गैर-संरचनात्मक (non-compositional) संदेशों का मिश्रण उपयोग किया गया है जिसे कृत्रिम प्राप्तकर्ताओं और मनुष्यों दोनों द्वारा सफलतापूर्वक समझा जाता है।

Olaf Lipinski, Adam J. Sobey, Federico Cerutti, Timothy J. Norman2026-06-16
📊 statistics

Metacognitive Myopia in Large Language Models

यह शोध पत्र "मेटाकॉग्निटिव मायोपिया" (metacognitive myopia) को एक संज्ञानात्मक-पारिस्थितिक ढांचे के रूप में प्रस्तावित करता है ताकि यह स्पष्ट किया जा सके कि कैसे पक्षपाती प्रशिक्षण डेटा लार्ज लैंग्वेज मॉडल्स (Large Language Models) को दोषपूर्ण तर्क के पांच विशिष्ट लक्षणों को प्रदर्शित करने के लिए प्रेरित करता है, और यह तर्क देता है कि उच्च-जोखिम वाले अनुप्रयोगों में इन पूर्वाग्रहों को कम करने के लिए मेटाकॉग्निटिव मॉनिटरिंग और कंट्रोल के तकनीकी अनुमान आवश्यक हैं।

Florian Scholten, Tobias R. Rebholz, Mandy Hütter2026-06-16