💬 NLP

Darshana Graph: A Parallel Commentary Corpus for Comparative Indian Philosophy, with Stylometric and Exploratory Graph Analyses

यह शोध पत्र दर्शन ग्राफ (Darshana Graph) का परिचय देता है, जो हिंदू, बौद्ध और जैन परंपराओं के 1,25,000 से अधिक अभिलेखों का एक अद्वितीय समानांतर टीका संग्रह है जो प्रत्यक्ष अंतर-टीका तुलना को सक्षम बनाता है, और तर्कपूर्ण शैलियों के शैलीमितीय (stylometric) विश्लेषण तथा दार्शनिक संबंधों को निकालने और सत्यापित करने के लिए एक नियंत्रित एलएलएम (LLM) पाइपलाइन के माध्यम से इसकी उपयोगिता को प्रदर्शित करता है।

Joy Bose2026-06-17
💬 NLP

ReproRepo: Scaling Reproducibility Audits with GitHub Repository Issues

यह शोध पत्र ReproRepo को प्रस्तुत करता है, जो 1,149 मशीन लर्निंग शोध पत्रों से प्राप्त मानव-रिपोर्ट किए गए GitHub इश्यूज़ का लाभ उठाकर वास्तविक दुनिया के पुनरुत्पादकता अवरोधकों (reproducibility blockers) की पहचान करने की LLM एजेंटों की क्षमता का मूल्यांकन करने के लिए एक स्केलेबल फ्रेमवर्क है, जो यह प्रदर्शित करता है कि गैर-निष्पादित (non-executing) एजेंट भी लगभग 90% मामलों में सिमेंटिक समस्याओं का पता लगा सकते हैं।

Shanda Li, Qiuhong Anna Wei, Jingwu Tang, Valerie Chen, Nihar B Shah, Tim Dettmers, Yiming Yang, Ameet Talwalkar2026-06-17
💬 NLP

HK-LegiCoST: Leveraging Non-Verbatim Transcripts for Speech Translation

यह शोध पत्र HK-LegiCoST को प्रस्तुत करता है, जो कैंटोनीज़ ऑडियो, गैर-मौखिक पारंपरिक चीनी लिप्यंतरण और अंग्रेजी अनुवादों का एक बड़े पैमाने पर तीन-तरफा समानांतर संग्रह है, जिसे उन भाषाओं के लिए स्पीच ट्रांसलेशन अनुसंधान को आगे बढ़ाने के लिए डिज़ाइन किया गया है जहाँ मौखिक और लिखित रूपों में महत्वपूर्ण अंतर होता है।

Cihan Xiao, Henry Li Xinyuan, Jinyi Yang, Dongji Gao, Matthew Wiesner, Kevin Duh, Sanjeev Khudanpur2026-06-16
💬 NLP

Attention, not scale, drives human-AI alignment in multimodal language prediction

यह अध्ययन प्रदर्शित करता है कि मॉडल के पैमाने के बजाय सूचनात्मक दृश्य संकेतों (visual cues) पर चयनात्मक ध्यान देना ही वह प्राथमिक कारक है जो ट्रांसफार्मर-आधारित विजन-लैंग्वेज मॉडलों को मल्टीमॉडल संदर्भों के भीतर आगामी शब्दों की भविष्यवाणी करने में मानव व्यवहार के साथ संरेखित होने में सक्षम बनाता है।

Viktor Kewenig, Andrew Lampinen, Samuel A. Nastase, Christopher Edwards, Quitterie Lacome D'Elascombe, Akilles Rechardt (…)2026-06-16
💬 NLP

It's About Time: Temporal References in Emergent Communication

यह शोध पत्र यह प्रदर्शित करता है कि लॉस फंक्शन (loss function) को बदलने के बजाय, एजेंट आर्किटेक्चर में बैचिंग पद्धति को संशोधित करना, उभरते संचार प्रणालियों (emergent communication systems) में टेम्पोरल संदर्भों (temporal references) के उद्भव को सक्षम करने के लिए पर्याप्त है, जो अधिक इष्टतम कोडिंग दक्षता प्राप्त करने के लिए एक आवश्यक क्षमता है।

Olaf Lipinski, Adam J. Sobey, Federico Cerutti, Timothy J. Norman2026-06-16
🤖 AI

Speaking Your Language: Spatial Relationships in Interpretable Emergent Communication

यह शोध पत्र प्रदर्शित करता है कि एजेंट एक व्याख्या योग्य उभरती भाषा विकसित कर सकते हैं जो उच्च सटीकता के साथ स्थानिक संबंधों को व्यक्त करने में सक्षम है, जिसमें संरचनात्मक (compositional) और गैर-संरचनात्मक (non-compositional) संदेशों का मिश्रण उपयोग किया गया है जिसे कृत्रिम प्राप्तकर्ताओं और मनुष्यों दोनों द्वारा सफलतापूर्वक समझा जाता है।

Olaf Lipinski, Adam J. Sobey, Federico Cerutti, Timothy J. Norman2026-06-16
📊 statistics

Metacognitive Myopia in Large Language Models

यह शोध पत्र "मेटाकॉग्निटिव मायोपिया" (metacognitive myopia) को एक संज्ञानात्मक-पारिस्थितिक ढांचे के रूप में प्रस्तावित करता है ताकि यह स्पष्ट किया जा सके कि कैसे पक्षपाती प्रशिक्षण डेटा लार्ज लैंग्वेज मॉडल्स (Large Language Models) को दोषपूर्ण तर्क के पांच विशिष्ट लक्षणों को प्रदर्शित करने के लिए प्रेरित करता है, और यह तर्क देता है कि उच्च-जोखिम वाले अनुप्रयोगों में इन पूर्वाग्रहों को कम करने के लिए मेटाकॉग्निटिव मॉनिटरिंग और कंट्रोल के तकनीकी अनुमान आवश्यक हैं।

Florian Scholten, Tobias R. Rebholz, Mandy Hütter2026-06-16
⚡ electrical engineering

A Functional Trade-off between Prosodic and Semantic Cues in Conveying Sarcasm

यह अध्ययन टेलीविजन शो से व्यंग्यात्मक कथनों का विश्लेषण करता है ताकि एक कार्यात्मक व्यापार-बंद (फंक्शनल ट्रेड-ऑफ) को प्रदर्शित किया जा सके जहाँ वाक्यांश के भीतर अर्थ संबंधी संकेत अधिक प्रमुख होने पर व्यंग्य व्यक्त करने के लिए ध्वन्यात्मक संकेत कम महत्वपूर्ण हो जाते हैं।

Zhu Li, Xiyuan Gao, Yuqing Zhang, Shekhar Nayak, Matt Coler2026-06-16
🧬 biology

Generative causal testing to bridge data-driven models and scientific theories in language neuroscience

यह शोध पत्र जेनेरेटिव कॉज़ल टेस्टिंग (GCT) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो मस्तिष्क में भाषा चयनशीलता के लिए संक्षिप्त स्पष्टीकरण उत्पन्न करने और प्रयोगात्मक रूप से उन्हें मान्य करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे भाषा तंत्रिका विज्ञान (लैंग्वेज न्यूरोसाइंस) में अपारदर्शी डेटा-संचालित मॉडलों और औपचारिक वैज्ञानिक सिद्धांतों के बीच के अंतर को पाटा जा सके।

Richard Antonello, Chandan Singh, Shailee Jain, Aliyah Hsu, Sihang Guo, Jianfeng Gao, Bin Yu, Alexander Huth2026-06-16
💬 NLP

Anything Goes? A Crosslinguistic Study of (Im)possible Language Learning in LMs

यह क्रॉसलिंग्विस्टिक अध्ययन यह प्रदर्शित करता है कि हालांकि GPT-2 small प्रमाणित भाषाओं को टाइपोलॉजिकल रूप से असंभव भाषाओं से अलग करके कुछ मानव-समान इंडक्टिव बायस (inductive biases) प्रदर्शित करता है, लेकिन ये बायस अपूर्ण हैं और मानव शिक्षार्थियों में पाए जाने वाले बायस की तुलना में कमजोर हैं।

Xiulin Yang, Tatsuya Aoyama, Yuekun Yao, Ethan Gotlieb Wilcox2026-06-16