💬 NLP

SciPaths: Forecasting Pathways to Scientific Discovery

यह शोध पत्र SciPaths प्रस्तुत करता है, जो वैज्ञानिक खोज पथों के पूर्वानुमान के लिए एक नया बेंचमार्क और कार्य है जिसके लिए मॉडलों को एक लक्षित वैज्ञानिक योगदान के लिए सक्षम योगदानों और पूर्व कार्य को पहचानने और उन्हें स्थापित करने की आवश्यकता होती है, जिससे यह पता चलता है कि वर्तमान भाषा मॉडल इस जटिल तर्क क्षमता के साथ काफी संघर्ष करते हैं।

Eric Chamoun, Yizhou Chi, Yulong Chen, Rui Cao, Zifeng Ding, Michalis Korakakis, Andreas Vlachos2026-05-15
💬 NLP

Do We Really Need External Tools to Mitigate Hallucinations? SIRA: Shared-Prefix Internal Reconstruction of Attribution

SIRA एक प्रशिक्षण-मुक्त (training-free), आंतरिक कंट्रास्टिविव डिकोडिंग फ्रेमवर्क है जो बाद की परतों में मास्क्ड अटेंशन के माध्यम से उसी ट्रांसफार्मर के भीतर भाषा-प्राथमिकता-प्रधान काउंटरफैक्चुअल संदर्भ उत्पन्न करके बड़े विजन-लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) को कम करता है, जिससे बाहरी उपकरणों और अतिरिक्त फॉरवर्ड पासेज पर निर्भरता कम होती है और वर्णनात्मक कवरेज भी सुरक्षित रहता है।

Tian Qin, Junzhe Chen, Yuqing Shi, Tianshu Zhang, Qiang Ju, Lijie Wen2026-05-15
💬 NLP

Falkor-IRAC: Graph-Constrained Generation for Verified Legal Reasoning in Indian Judicial AI

यह शोध पत्र Falkor-IRAC को प्रस्तुत करता है, जो भारतीय कानूनी एआई के लिए एक ग्राफ-प्रतिबंधित जनरेशन फ्रेमवर्क है जो एलएलएम (LLM) आउटपुट को संरचित IRAC ज्ञान ग्राफ़ में ग्राउंड करके और उद्धरणों को मान्य करने तथा सैद्धांतिक संघर्षों का पता लगाने के लिए एक सत्यापनकर्ता एजेंट (Verifier Agent) का उपयोग करके सत्यापित तर्क सुनिश्चित करता है, जिससे पारंपरिक वेक्टर-आधारित रिट्रीवल सिस्टम की मतिभ्रम (hallucination) और सटीकता संबंधी सीमाओं को संबोधित किया जा सके।

Joy Bose2026-05-15
💬 NLP

Agentifying Patient Dynamics within LLMs through Interacting with Clinical World Model

यह शोध पत्र SepsisAgent को प्रस्तुत करता है, जो एक वर्ल्ड मॉडल-संवर्धित (world model-augmented) LLM है जिसे रोगी की प्रतिक्रियाओं को सिम्युलेट करने और उपचार संबंधी निर्णयों को पुनरावृत्ति से परिष्कृत करने के लिए एक तीन-चरणीय पाठ्यक्रम (three-stage curriculum) के माध्यम से प्रशिक्षित किया गया है, जो पारंपरिक RL और LLM बेसलाइन की तुलना में सेप्सिस प्रबंधन में बेहतर सुरक्षा और प्रदर्शन प्रदर्शित करता है।

Minghao Wu, Yuting Yan, Zhenyang Cai, Ke Ji, Chuangsen Fang, Ziying Sheng, Xidong Wang, Rongsheng Wang, Hejia Zhang, Shu (…)2026-05-15
💬 NLP

Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining

यह शोध पत्र Video2GUI को प्रस्तुत करता है, जो एक स्वचालित ढांचा (framework) है जो डेटा की कमी को दूर करने और मल्टीमॉडल GUI एजेंटों के सामान्यीकरण प्रदर्शन (generalization performance) को महत्वपूर्ण रूप से बढ़ाने के लिए अनलेबल इंटरनेट वीडियो से 12 मिलियन GUI इंटरेक्शन प्रक्षेपवक्रों (trajectories) का एक बड़े पैमाने पर डेटासेट संश्लेषित करता है।

Weimin Xiong, Shuhao Gu, Bowen Ye, Zihao Yue, Lei Li, Feifan Song, Sujian Li, Hao Tian2026-05-15
⚡ electrical engineering

Streaming Speech-to-Text Translation with a SpeechLLM

यह शोध पत्र एक SpeechLLM पर आधारित एक रियल-टाइम स्ट्रीमिंग स्पीच-टू-टेक्स्ट ट्रांसलेशन सिस्टम का प्रस्ताव करता है जो ऑडियो इनपुट के आधार पर गतिशील रूप से यह निर्णय लेता है कि आउटपुट टोकन कब जारी करने हैं, जिससे बेसलाइन ट्रांसलेशन गुणवत्ता के करीब पहुँचते हुए 1-2 सेकंड की काफी कम लेटेंसी प्राप्त होती है।

Titouan Parcollet, Shucong Zhang, Xianrui Zheng, Rogier C. van Dalen2026-05-15
💬 NLP

Do Composed Image Retrieval Benchmarks Require Multimodal Composition?

यह शोध पत्र प्रकट करता है कि वर्तमान कंपोज्ड इमेज रिट्रीवल (CIR) बेंचमार्क मल्टीमॉडल कंपोजिशन क्षमताओं को बढ़ा-चढ़ाकर दिखाते हैं क्योंकि प्रश्नों का एक महत्वपूर्ण हिस्सा यूनिमोडल शॉर्टकट के माध्यम से हल किया जा सकता है या खराब तरीके से निर्मित होता है, जिसके लिए यह सुनिश्चित करने हेतु एक सत्यापित उपसमूह की आवश्यकता है कि मॉडल वास्तव में इमेज और टेक्स्ट इनपुट को संयोजित करते हैं।

Matteo Attimonelli, Alessandro De Bellis, Aryo Pradipta Gema, Rohit Saxena, Monica Sekoyan, Wai-Chung Kwan, Claudio Pomo (…)2026-05-15
💬 NLP

Graphs of Research: Citation Evolution Graphs as Supervision for Research Idea Generation

यह शोध पत्र "ग्राफ्स ऑफ रिसर्च" (GoR) का प्रस्ताव करता है, जो एक सुपरवाइज्ड फाइन-ट्यूनिंग विधि है जो संदर्भ पड़ोस (reference neighborhoods) से प्राप्त संरचित उद्धरण-विकास ग्राफों (citation-evolution graphs) का लाभ उठाकर बड़े भाषा मॉडलों की नवीन अनुसंधान विचार उत्पन्न करने की क्षमता में महत्वपूर्ण सुधार करती है, और मौजूदा बेसलाइनों पर अत्याधुनिक प्रदर्शन प्राप्त करती है।

Songyang Gao, Yinghui Xia, Siyi Liu, Hui Xiong2026-05-15
💬 NLP

Holistic Evaluation and Failure Diagnosis of AI Agents

यह शोध पत्र एक समग्र मूल्यांकन ढांचे को प्रस्तुत करता है जो AI एजेंटों में विफलताओं को प्रभावी ढंग से स्थानीयकृत और वर्गीकृत करने के लिए टॉप-डाउन निदान (top-down diagnosis) को बॉटम-अप स्पैन-स्तरीय मूल्यांकन (bottom-up span-level assessment) के साथ जोड़ता है, जो TRAIL बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है और यह प्रदर्शित करता है कि एजेंट निदान में मॉडल क्षमता के बजाय मूल्यांकन पद्धति ही प्राथमिक बाधा है।

Netta Madvil, Gilad Dym, Alon Mecilati, Edo Dekel, Jonatan Liberman, Rotem Brazilay, Liron Schliesser, Max Svidlo, Shai (…)2026-05-15
💬 NLP

Tokenizer Fertility and Zero-Shot Performance of Foundation Models on Ukrainian Legal Text: A Comparative Study

यह अध्ययन यूक्रेनी कानूनी पाठ पर सात फाउंडेशन मॉडलों का बेंचमार्किंग करता है, जिससे पता चलता है कि टोकेनाइज़र दक्षता API लागत को महत्वपूर्ण रूप से प्रभावित करती है, 120B-पैरामीटर वाला NVIDIA Nemotron Super 3, बहुत कम लागत में बड़े Mistral Large 3 से बेहतर प्रदर्शन करता है, और इस रूपात्मक रूप से समृद्ध भाषा के लिए ज़ीरो-शॉट प्रॉम्प्टिंग, फ्यू-शॉट प्रॉम्प्टिंग से श्रेष्ठ है।

Volodymyr Ovcharov2026-05-15