💬 NLP

Gender Differences in Research Topic and Method Convergence among Collaborating Scholars in Library and Information Science

यह अध्ययन Top2Vec और CogFT मॉडलों का उपयोग करके 1990 से 2022 तक के 25,204 लाइब्रेरी एंड इंफॉर्मेशन साइंस शोध पत्रों का विश्लेषण करता है, जिससे यह पता चलता है कि महिला सहयोगी विद्वान अपने पुरुष समकक्षों की तुलना में अनुसंधान विषयों और कार्यप्रणालियों में कम अभिसरण (convergence) प्रदर्शित करती हैं।

Chengzhi Zhang, Linlei Xie, Siqi Wei2026-06-23
💬 NLP

Pre-Generation Hallucination Detection in Large Language Models via Soft-Target Attention Probing

यह शोध पत्र एक प्री-जनरेशन हॉलुसिनेशन डिटेक्शन फ्रेमवर्क प्रस्तुत करता है जो जोखिम अनुमान को अनुभवजन्य त्रुटि दरों पर आधारित सॉफ्ट-टारगेट सुपरविजन के माध्यम से हल की जाने वाली समस्या के रूप में और प्रॉम्प्ट रिप्रेजेंटेशन को चुनिंदा रूप से एकत्रित करने के लिए अनुकूलित अटेंशन प्रोबिंग के माध्यम से स्वरूपित करके मौजूदा विधियों में सुधार करता है, जिससे कई बेंचमार्क और मॉडलों में श्रेष्ठ डिटेक्शन गुणवत्ता प्राप्त होती है।

Amina Miftakhova, Alexey Zaytsev2026-06-23
💻 computer science

MindTailor: Personalized Emotional Support via Post History-Grounded Case Formulation and Collaborative Refinement

यह शोधपत्र माइंडटेलर (MindTailor) का परिचय देता है, जो एक ऐसा ढांचा है जो केस फॉर्मूलेशन के लिए खोजकर्ता (seeker) के पोस्ट इतिहास का लाभ उठाकर और सहयोगात्मक एजेंट परिशोधन (collaborative agent refinement) को नियोजित करके व्यक्तिगत भावनात्मक सहायता को बढ़ाता है, जिसे नए रेडडीसप (ReddiSupp) डेटासेट के माध्यम से मान्य किया गया है और बेसलाइन की तुलना में सहानुभूति, वैयक्तिकरण और उपयोगकर्ता प्राथमिकता में बेहतर प्रदर्शन के माध्यम से सिद्ध किया गया है।

Suhyun Han, Kyunghyun Cho, JinYeong Bak2026-06-23✓ Author reviewed
💻 computer science

Latent Confidence Alignment for LLM Self-Assessment

यह शोध पत्र लेटेंट कॉन्फिडेंस अलाइनमेंट एरर (LCAE) का प्रस्ताव करता है, जो एक राश मॉडल-आधारित ढांचा है जो आइटम कठिनाई और लेटेंट क्षमता को ध्यान में रखते हुए LLM स्व-आकलन का मूल्यांकन करता है, जो चिकित्सा-डोमेन कार्यों में बेहतर अंशांकन गुणवत्ता और विश्वसनीयता एवं अनुमान लागत के बीच एक संबंध प्रदर्शित करता है।

Ting-Yu Chen, Tingting Yu, Pei-Cing Huang, Chan Hsu, Ming-Yen Lin, Yihuang Kang2026-06-23
💻 computer science

Are Multilingual Models Actually Improving? Isolating True Cross-Lingual Transfer

यह शोध पत्र हार्डनेस एडजस्टेड ट्रांसफर (HAT) स्कोर को पेश करता है ताकि सामान्य स्रोत-भाषा सुधारों से वास्तविक क्रॉस-लिंगुअल ट्रांसफर को अलग किया जा सके, जिससे यह पता चलता है कि जहाँ छोटे मॉडल प्रभावी ढंग से ट्रांसफर करते हैं और समय के साथ प्रगति हुई है, वहीं मॉडलों को स्केल करने से ट्रांसफर स्ट्रेंथ में अपेक्षा से धीमी बढ़त मिलती है।

Prasoon Bajpai, Eleftheria Briakou, Colin Cherry, Preethi Jyothi, Vihari Piratla2026-06-23
💻 computer science

OpenBioRQ: Unsolved Biomedical Research Questions for Agents

यह शोध पत्र OpenBioRQ को प्रस्तुत करता है, जो 12,553 अनसुलझे बायोमेडिकल अनुसंधान प्रश्नों से युक्त एक नवीन रिट्रीवल-ग्राउंडेड एजेंटिक बेंचमार्क है, जो वर्तमान मॉडलों में साइटेशन हलुसिनेशन (citation hallucination) और टूल कोलैप्स (tool collapse) जैसे महत्वपूर्ण विफलता मोडों को उजागर करता है, साथ ही यह भी प्रदर्शित करता है कि अत्याधुनिक एजेंट भी इन ओपन-एंडेड, नॉन-सैचुरेटिंग कार्यों के एक महत्वपूर्ण हिस्से को हल करने में संघर्ष करते हैं।

Minbyul Jeong2026-06-23
💻 computer science

Adding Robust Code-Switching Capabilities to High Performance Multilingual ASR

यह शोध पत्र एक बेयसियन फैक्टराइज्ड एडाप्टेशन पद्धति का प्रस्ताव करता है जो न्यूनतम सिंथेटिक डेटा का उपयोग करके उच्च-प्रदर्शन वाले बहुभाषी एएसआर (ASR) मॉडल में कोड-स्विचिंग ज्ञान को प्रभावी ढंग से एकीकृत करता है, जिससे कोड-स्विच्ड शब्दों के लिए ट्रांसक्रिप्शन त्रुटियों में काफी कमी आती है और मोनोलिंगुअल क्षमताओं को कम किए बिना समग्र प्रदर्शन में सुधार होता है।

Enes Yavuz Ugan, Alexander Waibel2026-06-23
💻 computer science

Benchmarking Large Language Models for Grapheme-to-Phoneme Conversion: A Japanese Case Study

यह शोध पत्र जापानी ग्राफीम-टू-फोनम रूपांतरण के लिए 30 से अधिक बड़े भाषा मॉडलों का बेंचमार्किंग करता है, जो यह प्रदर्शित करता है कि नियम-आधारित पोस्ट-प्रोसेसिंग वाले पार्स मोड का उपयोग करने वाले विशिष्ट मॉडल उच्चारण सटीकता में पारंपरिक उपकरणों और एंड-टू-एंड टेक्स्ट-टू-स्पीच सिस्टम की तुलना में काफी बेहतर प्रदर्शन करते हैं।

Tomoki Koriyama2026-06-23
💻 computer science

Nous: A Predictive World Model for Long-Term Agent Memory

Nous एक नवीन एजेंट मेमोरी आर्किटेक्चर पेश करता है जो पारंपरिक तथ्य भंडारण को श्रेणीगत संभाव्यता वितरणों (categorical probability distributions) के एक भविष्य कहने वाले विश्व मॉडल से बदल देता है, जहाँ सूचना को विश्वास अपडेट (डेल्टा) के रूप में बनाए रखा जाता है और विस्मरण स्वाभाविक रूप से एंट्रॉपी क्षय (entropy decay) के माध्यम से होता है, जिससे बिना किसी बाहरी वेक्टर डेटाबेस या ग्राफ इंजन की आवश्यकता के दीर्घकालिक संवादात्मक बेंचमार्क पर प्रतिस्पर्धी प्रदर्शन प्राप्त होता है।

Pranav Singh2026-06-23
💻 computer science

NL2Scratch: An Executable Benchmark and Evaluation for Block-Based Programming

यह शोध पत्र NL2Scratch, एक बड़े पैमाने के निष्पादन योग्य बेंचमार्क और सिमेंटिक अलाइनमेंट कंसिस्टेंसी (SAC) मेट्रिक को प्रस्तुत करता है ताकि ब्लॉक-आधारित प्रोग्रामिंग में पारंपरिक NL2Code मूल्यांकन की सीमाओं को संबोधित किया जा सके, जो यह प्रकट करता है कि वर्तमान LLMs अक्सर उच्च लेक्सिकल समानता प्राप्त करते हैं जबकि सही स्क्रैच प्रोग्राम उत्पन्न करने के लिए आवश्यक सिमेंटिक अलाइनमेंट को पकड़ने में विफल रहते हैं।

Heejin Do, Alexandre Ballenghien, Yang Wu, April Yi Wang2026-06-23