💬 NLP

Retrieval Augmented Generation Framework for the Nepali Legal Domain Question Answering

यह अध्ययन नेपाली कानूनी प्रश्नोत्तर के लिए पहले रिट्रीवल ऑगमेंटेड जनरेशन (Retrieval Augmented Generation) फ्रेमवर्क को प्रस्तुत करता है, जो उच्च परिशुद्धता और सत्यता स्कोर प्राप्त करने के लिए नेपाल कानून पत्रिका संग्रह का लाभ उठाता है, जिससे कम-संसाधन वाले कानूनी डोमेन में डेटा की कमी की चुनौतियों का समाधान होता है।

Samir Wagle, Abiral Adhikari, Reewaj Khanal, Batsal Bhandari, Prashant Manandhar, Praveen Acharya, Bal Krishna Bal2026-06-09
💬 NLP

ABLE: Representing and Mapping LLMs via Attribution-Based Large-model Embedding

यह शोध पत्र ABLE को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त (training-free) ढांचा है जो इनपुट-संवेदनशीलता पैटर्न को पकड़ने के लिए टोकेनाइज़र-अज्ञेय (tokenizer-agnostic) ग्रेडिएंट-आधारित फीचर एट्रिब्यूशन को एकत्रित करके विषम (heterogeneous) लार्ज लैंग्वेज मॉडल्स को निरूपित और मैप करता है, जिससे मॉडल तुलना, रूटिंग और प्रोवेनेंस ऑडिटिंग जैसे कार्यों के लिए स्थिर और स्केलेबल एम्बेडिंग्स प्राप्त होती हैं।

Zirui Wang, Yusen Hou, Shaofeng Liang, Bowen Tian, Yanlin Zhang, Wenshuo Chen, Yutao Yue2026-06-09
💬 NLP

CAPruner: Conceptual-Adjacent Scene Graph Pruner for Enhancing 3D Spatial Reasoning of Large Language Models

यह शोध पत्र CAPruner प्रस्तुत करता है, जो एक नवीन सीन ग्राफ प्रनर (scene graph pruner) है जो 3D विजन-लैंग्वेज कार्यों के लिए कार्य-महत्वपूर्ण संबंधों को कुशलतापूर्वक चुनने के लिए फजी सिमेंटिक प्रासंगिकता (fuzzy semantic relevance) को स्थानिक निकटता (spatial proximity) के साथ जोड़ता है, जिससे बड़े भाषा मॉडलों की स्थानिक तर्क क्षमताओं को बढ़ाते हुए कम्प्यूटेशनल लागत को कम किया जा सके।

Shengli Zhou, Xiangchen Wang, Guanhua Chen, Feng Zheng2026-06-09
💬 NLP

Finding New Connections between Concepts from Medline Database Incorporating Domain Knowledge

यह शोध पत्र मेडलाइन डेटाबेस में विजातीय चिकित्सा अवधारणाओं के बीच छिपे हुए संबंधों को साझा मध्यवर्ती विषयों की पहचान करके उजागर करने के लिए डॉन आर. स्वानसन के ABC ढांचे से व्युत्पन्न एक अनुकूली साहित्य-आधारित खोज मॉडल प्रस्तावित करता है।

Yang Weikang, Chowdhury S. M. Mazharul Hoque, Jin Wei2026-06-09
💬 NLP

PulseBench-Tab: A Multilingual Benchmark for Table Extraction with Graph-Based Evaluation

यह शोधपत्र PulseBench-Tab प्रस्तुत करता है, जो नौ भाषाओं और चार लिपियों में 1,820 मानव-एनोटेटेड तालिकाओं से युक्त एक बहुभाषी बेंचमार्क है, साथ ही इसमें जटिल, वास्तविक दुनिया की दस्तावेज़ छवियों पर विभिन्न तालिका निष्कर्षण प्रणालियों के प्रदर्शन का आकलन करने के लिए T-LAG नामक एक नवीन ग्राफ-आधारित मूल्यांकन मीट्रिक भी शामिल है।

Ritvik Pandey, Sid Manchkanti, Mohammed Wazir Adain, Mohammed Hadi, Dushyanth Sekhar2026-06-09
💬 NLP

Multilingual Refusal Alignment for Safer Large Language Models

यह शोध पत्र 12 यूरोपीय भाषाओं के लिए एक बहुभाषी रिफ्यूज़ल (refusal) डेटासेट, RefusEU, प्रस्तुत करता है, और डायरेक्ट प्रेफरेंस ऑप्टिमाइज़ेशन (Direct Preference Optimization) प्रयोगों के माध्यम से यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स को विशेष रूप से केवल अंग्रेजी में संरेखित (align) करना क्रॉस-लिंगुअल सुरक्षा सुनिश्चित करने में विफल रहता है, जबकि बहुभाषी प्रशिक्षण सामान्य ज्ञान क्षमताओं से समझौता किए बिना विभिन्न भाषाओं में सुरक्षा को प्रभावी ढंग से बढ़ाता है।

Aleksandra Krasnodębska, Wojciech Kusa, Aldo Lipani2026-06-09
💬 NLP

From Architecture to Output: Structural Origins of Hallucination in Large Language Models and the Amplifying Role of Data

यह शोध पत्र यह तर्क देता है कि लार्ज लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) तीन मुख्य वास्तुशिल्प निर्णयों—सेल्फ-अटेंशन, मैक्सिमम लाइकलीहुड एस्टीमेशन और ऑटोरेग्रेसिव डिकोडिंग—के संरचनात्मक परिणाम हैं, जो एक संयुक्त विफलता प्रणाली का निर्माण करते हैं जिसे डेटासेट की विकृतियाँ उत्पन्न करने के बजाय केवल बढ़ा देती हैं, जिससे आउटपुट-आधारित वर्गीकरण से हटकर तंत्र-विशिष्ट नैदानिक और शमन रणनीतियों की ओर बदलाव आवश्यक हो जाता है।

Md. Rejaul Korim Sadi, Toufiqur Rahman Tasin, Golam Mostofa Naeem2026-06-09
💬 NLP

Finding Hidden Relationships Between Medical Concepts by Leveraging Metamap and Text Mining Techniques

यह शोध पत्र एक नवीन मॉडल प्रस्तुत करता है जो मेटामैप (MetaMap) और टेक्स्ट माइनिंग तकनीकों का लाभ उठाकर एक व्यापक इंडेक्स संरचना का निर्माण करता है, जो चिकित्सा अवधारणाओं के बीच उन छिपे हुए, क्रॉस-डॉक्यूमेंट संबंधों को प्रभावी ढंग से खोजता है जिन्हें मौजूदा दृष्टिकोणों द्वारा अक्सर अनदेखा कर दिया जाता है।

Weikang Yang, S M Mazharul Hoque Chowdhury, Wei Jin2026-06-09
💬 NLP

Liberating LLM Capabilities in Full-Duplex Speech Models

यह शोध पत्र Listen-Write-Speak (LWS) को प्रस्तुत करता है, जो एक नवीन टेक्स्ट-फर्स्ट ट्राई-चैनल प्रतिमान (paradigm) है जो बिना किसी संरचनात्मक परिवर्तन के एक साझा ऑटोरेग्रेसिव LLM का उपयोग करके फुल-डुप्लेक्स स्पीच मॉडल्स को वास्तविक समय में सुनने, दृश्यमान संरचित टेक्स्ट लिखने और बोलने में सक्षम बनाता है, जिससे संवादात्मक उत्तरदायित्व बनाए रखते हुए कोड जनरेशन और संरचित तर्क जैसी टेक्स्ट-नेटिव क्षमताओं के द्वार खुलते हैं।

Luoyuan Zhang, Bokai Xu, Junbo Cui, Weiyue Sun, Yingjing Xu, Hanyu Liu, Yuan Yao2026-06-09
🤖 AI

Evaluating Advanced Prompting on Gemini Flash for Multi-Hop Biomedical QA

यह शोध पत्र प्रदर्शित करता है कि कुशल जेमिनी 2.0 फ्लैश मॉडल पर परिष्कृत, बहु-घटक प्रॉम्प्ट इंजीनियरिंग का उपयोग करने से इसकी मल्टी-हॉप बायोमेडिकल रीजनिंग क्षमताओं में महत्वपूर्ण वृद्धि होती है, जिससे 0.720 का कॉन्सेप्ट लेवल स्कोर प्राप्त होता है जो अगली पीढ़ी के मॉडलों के समकक्ष है और बेसलाइन दृष्टिकोणों से कहीं अधिक बेहतर है।

Ahmed Bajaber, Mohammed Alliheedi2026-06-09