💬 NLP

DAVIS: Planning Agent with Knowledge Graph-Powered Inner Monologue

यह शोध पत्र DAVIS को प्रस्तुत करता है, जो एक नवीन वैज्ञानिक नियोजन एजेंट है जो मौजूदा रिट्रीवल-ऑगमेंटेड जनरेशन दृष्टिकोणों की तुलना में जटिल प्रयोगशाला कार्यों और मल्टी-हॉप प्रश्न उत्तर देने में श्रेष्ठ प्रदर्शन प्राप्त करने के लिए नॉलेज ग्राफ-संचालित इनर मोनोलॉग और स्ट्रक्चर्ड टेम्पोरल मेमोरी का लाभ उठाता है।

Minh Pham Dinh, Munira Syed, Michael G Yankoski, Trenton W. Ford2026-03-20
💬 NLP

LLMs Faithfully and Iteratively Compute Answers During CoT: A Systematic Analysis With Multi-step Arithmetics

यह अध्ययन प्रदर्शित करता है कि बड़े भाषा मॉडल चेन-ऑफ-थॉट रीजनिंग के दौरान उत्तरों को पहले से निर्धारित करने के बजाय उन्हें पुनरावृत्ति (iteratively) के माध्यम से निष्ठापूर्वक गणना करते हैं, जो इस बात की पुष्टि करता है कि उनके द्वारा उत्पन्न रीजनिंग चेन उनकी आंतरिक कम्प्यूटेशनल प्रक्रिया को सटीक रूप से दर्शाती है।

Keito Kudo, Yoichi Aoki, Tatsuki Kuribayashi, Shusaku Sone, Masaya Taniguchi, Ana Brassard, Keisuke Sakaguchi, Kentaro I (…)2026-03-20
💬 NLP

Enhancing Lexicon-Based Text Embeddings with Large Language Models

यह शोध पत्र LENS को प्रस्तुत करता है, जो एक नवीन लेक्सिकन-आधारित एम्बेडिंग विधि है जो प्रतिस्पर्धी, संक्षिप्त टेक्स्ट रिप्रेजेंटेशन प्राप्त करने के लिए लार्ज लैंग्वेज मॉडल्स और टोकन क्लस्टरिंग का लाभ उठाती है, जो MTEB बेंचमार्क पर डेंस एम्बेडिंग्स से बेहतर प्रदर्शन करती है और उनके साथ संयोजन में अत्याधुनिक परिणाम प्राप्त करती है।

Yibin Lei, Tao Shen, Yu Cao, Andrew Yates2026-03-20
💬 NLP

HiFi-KPI: A Dataset for Hierarchical KPI Extraction from Earnings Filings

यह शोध पत्र HiFi-KPI प्रस्तुत करता है, जो एक बड़े पैमाने का डेटासेट है जिसमें 1.65 मिलियन पैराग्राफ और iXBRL टैक्सोनॉमी से जुड़े 198,000 पदानुक्रमित रूप से व्यवस्थित लेबल शामिल हैं ताकि अर्निंग फाइलिंग से मुख्य प्रदर्शन संकेतकों (Key Performance Indicators) के निष्कर्षण और वर्गीकरण को सुगम बनाया जा सके, साथ ही इसमें तीव्र मूल्यांकन के लिए एक क्यूरेटेड Lite सबसेट और ओपन-सोर्स कोड भी दिया गया है।

Rasmus Aavang, Giovanni Rizzi, Rasmus Bøggild, Alexandre Iolov, Mike Zhang, Johannes Bjerva2026-03-20
💬 NLP

PlainQAFact: Retrieval-augmented Factual Consistency Evaluation Metric for Biomedical Plain Language Summarization

यह शोधपत्र PlainQAFact को प्रस्तुत करता है, जो एक रिट्रीवल-ऑगमेंटेड, सेंटेंस-अवेयर इवैल्यूएशन मेट्रिक है जिसे एक नए मानव-एनोटेटेड डेटासेट (PlainFact) पर प्रशिक्षित किया गया है, जो विस्तृत स्पष्टीकरणों वाले बायोमेडिकल प्लेन लैंग्वेज सारांशों के लिए तथ्यात्मक निरंतरता का आकलन करने में मौजूदा विधियों की सीमाओं को प्रभावी ढंग से संबोधित करता है।

Zhiwen You, Yue Guo2026-03-20
💬 NLP

Enhancing Multi-Label Emotion Analysis and Corresponding Intensities for Ethiopian Languages

यह शोध पत्र इथियोपियाई भाषाओं के लिए बहुभाषी EthioEmo डेटासेट में भावना तीव्रता (emotion intensity) एनोटेशन जोड़कर इसे उन्नत करता है और यह प्रदर्शित करता है कि जब इन तीव्रता विशेषताओं का उपयोग किया जाता है, तो अफ्रीकी-केंद्रित एनकोडर-ओनली मॉडल मल्टी-लेबल इमोशन क्लासिफिकेशन में लार्ज लैंग्वेज मॉडल्स की तुलना में बेहतर प्रदर्शन करते हैं।

Tadesse Destaw Belay, Dawit Ketema Gete, Abinew Ali Ayele, Olga Kolesnikova, Iqra Ameer, Grigori Sidorov, Seid Muhie Yim (…)2026-03-20
💬 NLP

ELM: A Hybrid Ensemble of Language Models for Automated Tumor Group Classification in Population-Based Cancer Registries

ELM एक नवीन हाइब्रिड एन्सेम्बल सिस्टम है जो फाइन-ट्यून्ड एनकोडर-ओनली मॉडल्स और एक लार्ज लैंग्वेज मॉडल आर्बिट्रेटर को जोड़ता है जो जनसंख्या-आधारित कैंसर रजिस्ट्रियों में स्वचालित ट्यूमर समूह वर्गीकरण सटीकता में महत्वपूर्ण सुधार करता है, जिससे उच्च डेटा गुणवत्ता मानकों को बनाए रखते हुए मैन्युअल समीक्षा आवश्यकताओं को 60-70% तक कम किया जाता है।

Lovedeep Gondara, Jonathan Simkin, Shebnum Devji, Gregory Arbour, Raymond Ng2026-03-20
💬 NLP

Auditing Black-Box LLM APIs with a Rank-Based Uniformity Test

यह शोध पत्र एक रैंक-आधारित एकरूपता परीक्षण प्रस्तावित करता है जो उपयोगकर्ताओं को स्थानीय प्रामाणिक मॉडल के साथ व्यवहार संबंधी निरंतरता को सत्यापित करके, डिटेक्शन पैटर्न को प्रकट किए बिना, अनधिकृत मॉडल प्रतिस्थापन, जैसे कि क्वांटाइजेशन या हानिकारक फाइन-ट्यूनिंग, के लिए ब्लैक-बॉक्स एलएलएम (LLM) एपीआई का सटीक और कुशलतापूर्वक ऑडिट करने में सक्षम बनाता है।

Xiaoyuan Zhu, Yaowen Ye, Tianyi Qiu, Hanlin Zhu, Sijun Tan, Ajraf Mannan, Jonathan Michala, Raluca Ada Popa, Willie Neis (…)2026-03-20
💬 NLP

RAISE: Enhancing Scientific Reasoning in LLMs via Step-by-Step Retrieval

यह शोधपत्र RAISE को प्रस्तुत करता है, जो एक चरण-दर-चरण रिट्रीवल-ऑगमेंटेड फ्रेमवर्क है जो समस्याओं को विघटित करके और इन-द-वाइल्ड कॉर्पोरा से डोमेन-विशिष्ट, तार्किक रूप से प्रासंगिक दस्तावेज़ों को खोजने के लिए तार्किक क्वेरी उत्पन्न करके लार्ज लैंग्वेज मॉडल्स में वैज्ञानिक तर्क क्षमता को बढ़ाता है, जिससे यह वैज्ञानिक तर्क बेंचमार्क पर मौजूदा बेसलाइन की तुलना में बेहतर प्रदर्शन करता है।

Minhae Oh, Jeonghye Kim, Nakyung Lee, Donggeon Seo, Taeuk Kim, Jungwoo Lee2026-03-20
⚡ electrical engineering

DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment

यह शोध पत्र DeSTA2.5-Audio को प्रस्तुत करता है, जो एक सामान्य-उद्देश्य वाला लार्ज ऑडियो लैंग्वेज मॉडल है जो एक स्व-जनित क्रॉस-मोडल अलाइनमेंट रणनीति और 5 मिलियन नमूनों के एक विशाल, टास्क-अग्नोस्टिक डेटासेट का उपयोग करके कैटास्ट्रोफिक फॉरगेटिंग को कम करता है और अत्याधुनिक प्रदर्शन प्राप्त करता है।

Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, Chao-Han Huck Yang, Sung-Feng Huang, Chih-Kai Yang, Chee-En Yu, Chun-Wei Chen, Wei- (…)2026-03-20