💬 NLP

POTSA: A Cross-Lingual Speech Alignment Framework for Speech-to-Text Translation

यह शोधपत्र POTSA को प्रस्तुत करता है, जो एक नवीन ढांचा है जो उच्च और निम्न-संसाधन वाले स्पीच-टू-टेक्स्ट ट्रांसलेशन के अंतर को पाटने के लिए समानांतर स्पीच पेयर्स (parallel speech pairs) और बायस कंपनसेशन (bias compensation) एवं लेयर शेड्यूलिंग (layer scheduling) के साथ ऑप्टिमल ट्रांसपोर्ट (Optimal Transport) का लाभ उठाता है, जिससे न्यूनतम समानांतर डेटा के साथ FLEURS बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Xuanchen Li, Chenrui Cui, Tianrui Wang, Meng Ge, Zikang Huang, Jin Li, Yizhou Peng, Yuheng Lu, Nyima Tashi, Longbiao Wan (…)2026-03-31
💬 NLP

Beyond Elicitation: Provision-based Prompt Optimization for Knowledge-Intensive Tasks

यह शोध पत्र नॉलेज-प्रोविजन-आधारित प्रॉम्प्ट ऑप्टिमाइज़ेशन (KPPO) को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो इलिसिटेशन-आधारित रणनीतियों से व्यवस्थित ज्ञान एकीकरण की ओर स्थानांतरित होता है, और नॉलेज गैप फिलिंग, बैच-वाइज इवैल्यूएशन और एडेप्टिव प्रूनिंग जैसे तंत्रों के माध्यम से टोकन खपत को महत्वपूर्ण रूप से कम करते हुए ज्ञान-गहन कार्यों पर श्रेष्ठ प्रदर्शन प्राप्त करता है।

Yunzhe Xu, Zhuosheng Zhang, Zhe Liu2026-03-31
💬 NLP

π\pi-Attention: Periodic Sparse Transformers for Efficient Long-Context Modeling

यह शोध पत्र π\pi-Attention को प्रस्तुत करता है, जो एक आवधिक विरल (periodic sparse) ट्रांसफॉर्मर आर्किटेक्चर है जो स्थानीय पड़ोस (local neighborhoods), नियत स्ट्राइड स्किप्स (deterministic stride skips) और अनुकूलन योग्य संलयन (adaptive fusion) को संयोजित करता है ताकि मौजूदा तरीकों जैसे कि RingAttention की तुलना में काफी कम कंप्यूटेशनल संसाधनों के साथ रैखिक जटिलता और उत्कृष्ट दीर्घ-संदर्भ मॉडलिंग प्रदर्शन प्राप्त किया जा सके।

Dong Liu, Yanxuan Yu2026-03-31
💬 NLP

AISAC: An Integrated multi-agent System for Transparent, Retrieval-Grounded Scientific Assistance

आर्गोन नेशनल लेबोरेटरी द्वारा विकसित, AISAC एक पारदर्शी, मॉड्यूलर मल्टी-एजेंट रनटाइम है जो भूमिका अर्थशास्त्र (role semantics), बजटयुक्त ऑर्केस्ट्रेशन, संरेखित मेमोरी एक्सेस और ट्रेस-संचालित पारदर्शिता के लिए संरचनात्मक गारंटियों को लागू करता है ताकि दहन और सामग्री अनुसंधान जैसे विविध डोमेन में साक्ष्य-आधारित वैज्ञानिक तर्क का समर्थन किया जा सके।

Chandrachur Bhattacharya, Sibendu Som2026-03-31
💬 NLP

OEMA: Ontology-Enhanced Multi-Agent Collaboration Framework for Zero-Shot Clinical Named Entity Recognition

यह शोध पत्र OEMA का प्रस्ताव करता है, जो एक नवीन ऑन्टोलॉजी-संवर्धित मल्टी-एजेंट सहयोग ढांचा है, जो पारंपरिक पर्यवेक्षित मॉडलों और मौजूदा LLM-आधारित दृष्टिकोणों की सीमाओं को दूर करने के लिए एक सेल्फ-एनोटेटर, एक SNOMED CT-आधारित डिस्क्रिमिनेटर और एक एंटिटी-टाइप-अवेयर प्रेडिक्टर को एकीकृत करके स्टेट-ऑफ-द-आर्ट ज़ीरो-शॉट क्लिनिकल नेम्ड एंटिटी रिकग्निशन प्रदर्शन प्राप्त करता है।

Xinli Tao, Xin Dong, Xuezhong Zhou2026-03-31
💬 NLP

HEAD-QA v2: Expanding a Healthcare Benchmark for Reasoning

यह शोध पत्र HEAD-QA v2 प्रस्तुत करता है, जो 12,000 से अधिक स्पेनिश स्वास्थ्य देखभाल परीक्षा प्रश्नों का एक विस्तारित बहुभाषी डेटासेट है, और यह प्रदर्शित करता है कि बेंचमार्किंग परिणाम मुख्य रूप से जटिल अनुमान रणनीतियों के बजाय मॉडल के पैमाने और अंतर्निहित तर्क क्षमताओं द्वारा संचालित होते हैं।

Alexis Correa-Guillén, Carlos Gómez-Rodríguez, David Vilares2026-03-31
💬 NLP

Towards Hyper-Efficient RAG Systems in VecDBs: Distributed Parallel Multi-Resolution Vector Search

यह शोध पत्र सिमेंटिक पिरामिड इंडेक्सिंग (SPI) को प्रस्तुत करता है, जो एक नवीन मल्टी-रेज़ोल्यूशन वेक्टर इंडेक्सिंग फ्रेमवर्क है जो उपयोगकर्ता के प्रश्नों के अनुसार रिट्रीवल ग्रैनुलैरिटी को गतिशील रूप से अनुकूलित करता है, जिससे मौजूदा वेक्टर डेटाबेस बैकएंड के साथ संगत रहते हुए RAG सिस्टम के लिए खोज गति, मेमोरी दक्षता और QA सटीकता में महत्वपूर्ण सुधार प्राप्त होता है।

Dong Liu, Yanxuan Yu2026-03-31
💬 NLP

Estonian WinoGrande Dataset: Comparative Analysis of LLM Performance on Human and Machine Translation

यह शोध पत्र विनोग्रैंडे (WinoGrande) बेंचमार्क के एक सांस्कृतिक रूप से अनुकूलित एस्टोनियाई अनुवाद को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि मानव-अनुवादित डेटासेट मशीन-अनुवादित डेटासेट की तुलना में बड़े भाषा मॉडल (large language model) के तर्क का अधिक विश्वसनीय मूल्यांकन प्रदान करते हैं, साथ ही अनुवाद संबंधी चुनौतियों को दूर करने में प्रॉम्प्ट इंजीनियरिंग की सीमित प्रभावशीलता पर प्रकाश डालते हैं।

Marii Ojastu, Hele-Andra Kuulmets, Aleksei Dorkin, Marika Borovikova, Dage Särg, Kairit Sirts2026-03-31
💬 NLP

VideoARM: Agentic Reasoning over Hierarchical Memory for Long-Form Video Understanding

VideoARM एक पदानुक्रमित मल्टीमॉडल मेमोरी (hierarchical multimodal memory) के साथ एक एजेंटिक रीजनिंग प्रतिमान (agentic reasoning paradigm) पेश करता है जो अनुकूलन योग्य, ऑन-द-फ्लाई कोर्स-टू-फाइन (coarse-to-fine) वीडियो विश्लेषण को सक्षम बनाता है, जिससे मौजूदा विधियों की तुलना में टोकन खपत को काफी कम करते हुए लंबी अवधि के वीडियो को समझने में अत्याधुनिक प्रदर्शन प्राप्त होता है।

Yufei Yin, Qianke Meng, Minghao Chen, Jiajun Ding, Zhenwei Shao, Zhou Yu2026-03-31
💬 NLP

RadImageNet-VQA: A Large-Scale CT and MRI Dataset for Radiologic Visual Question Answering

यह शोध पत्र RadImageNet-VQA को प्रस्तुत करता है, जो 750K CT और MRI छवियों के साथ 7.5M प्रश्न-उत्तर युग्मों वाला एक बड़े पैमाने का, विशेषज्ञ-क्यूरेटेड डेटासेट है, जिसे रेडियोलॉजिक विजुअल क्वेश्चन अनस्वर्सिंग को आगे बढ़ाने के लिए डिज़ाइन किया गया है और साथ ही भाषाई शॉर्टकट्स के विरुद्ध इसकी मजबूती और सूक्ष्म पैथोलॉजी पहचान में वर्तमान अत्याधुनिक मॉडलों की सीमाओं को प्रदर्शित करने के लिए बनाया गया है।

Léo Butsanets, Charles Corbière, Julien Khlaut, Pierre Manceron, Corentin Dancette2026-03-31