💬 NLP

The Detection--Extraction Gap: Models Know the Answer Before They Can Say It

यह शोध पत्र आधुनिक रीजनिंग मॉडल्स में एक "डिटेक्शन-एक्सट्रैक्शन गैप" (पहचान-निष्कर्षण अंतराल) की पहचान करता है जहाँ सही उत्तर को स्पष्ट रूप से उत्पन्न होने से बहुत पहले ही आंतरिक अवस्था (इंटरनल स्टेट) से पुनः प्राप्त किया जा सकता है, और एक ब्लैक-बॉक्स अडैप्टिव अर्ली एग्जिट विधि का प्रस्ताव करता है जो इस विषमता का लाभ उठाकर जनरेशन लागत को काफी कम करने के साथ-साथ सटीकता में सुधार करता है।

Hanyang Wang, Mingxuan Zhu2026-04-09
💬 NLP

Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection

यह शोध पत्र Argus को प्रस्तुत करता है, जो एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो आपूर्ति श्रृंखला विश्लेषण (सप्लाई चेन एनालिसिस), सहयोगी एजेंटों और RAG एवं ReAct जैसी उन्नत तकनीकों को एकीकृत करके स्टेटिक एनालिसिस वर्कफ़्लो को पुनर्गठित करता है ताकि वास्तविक कमजोरियों का पता लगाने में मौजूदा LLM-आधारित तरीकों से काफी बेहतर प्रदर्शन करते हुए फॉल्स पॉजिटिव्स और परिचालन लागत को कम किया जा सके।

Zi Liang, Qipeng Xie, Jun He, Bohuan Xue, Weizheng Wang, Yuandao Cai, Fei Luo, Boxian Zhang, Haibo Hu, Kaishun Wu2026-04-09
💬 NLP

Feedback Adaptation for Retrieval-Augmented Generation

यह शोध पत्र "फीडबैक अनुकूलन" (feedback adaptation) को रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) प्रणालियों के लिए एक महत्वपूर्ण मूल्यांकन आयाम के रूप में प्रस्तुत करता है, जिसमें सुधार अंतराल (correction lag) और फीडबैक-पश्चात प्रदर्शन (post-feedback performance) जैसे मेट्रिक्स का प्रस्ताव दिया गया है ताकि स्थिर मूल्यांकनों की सीमाओं को उजागर किया जा सके और यह प्रदर्शित किया जा सके कि प्रस्तावित इन्फरेंस-टाइम विधि, PatchRAG, बिना पुन: प्रशिक्षण (retraining) के तत्काल सुधार और सुदृढ़ सामान्यीकरण प्राप्त करती है।

Jihwan Bang, Seunghan Yang, Kyuhong Shim, Simyung Chang, Juntae Lee, Sungha Choi2026-04-09
💬 NLP

A Parameter-Efficient Transfer Learning Approach through Multitask Prompt Distillation and Decomposition for Clinical NLP

यह शोध पत्र एक पैरामीटर-कुशल ट्रांसफर लर्निंग फ्रेमवर्क पेश करता है जो 21 विविध नैदानिक कार्यों से एक एकल साझा मेटाप्रॉम्ट को डिस्टिल करता है, जिससे 0.05% से कम प्रशिक्षण योग्य पैरामीटर्स के साथ नए नैदानिक एनएलपी (NLP) कार्यों के अनुकूलन में सक्षम बनाया जाता है और यह कई बैकबोन मॉडल्स और कार्य प्रकारों में लोरा (LoRA) और सिंगल-टास्क प्रॉम्ट ट्यूनिंग दोनों से बेहतर प्रदर्शन करता है।

Cheng Peng, Mengxian Lyu, Ziyi Chen, Yonghui Wu2026-04-09
💬 NLP

Between Century and Poet: Graph-Based Lexical Semantic Change in Persian Poetry

यह शोधपत्र सदियों और कवियों के बीच संरेखित (aligned) Word2Vec स्पेस के भीतर स्थानीय अर्थगत ग्राफों (local semantic graphs) के पुनर्गठन (rewiring) के रूप में मॉडलिंग करके फारसी कविता में शाब्दिक अर्थगत परिवर्तन की जांच करता है, जो यह प्रकट करता है कि पड़ोस संबंधी संरचनात्मक बदलाव (neighborhood structural shifts), सरल वेक्टर विस्थापन (simple vector displacement) की तुलना में ऐतिहासिक और संबंधपरक अर्थ को बेहतर ढंग से पकड़ते हैं।

Kourosh Shahnazari, Seyed Moein Ayyoubzadeh, Mohammadali Keshtparvar2026-04-09
💬 NLP

ChemVLR: Prioritizing Reasoning in Perception for Chemical Vision-Language Understanding

ChemVLR एक नवीन रासायनिक विजन-लैंग्वेज मॉडल है जो उत्तर देने से पहले स्पष्ट रूप से रासायनिक विवरणों (descriptors) की पहचान करके सूक्ष्म तर्क (fine-grained reasoning) को प्राथमिकता देता है, जो व्याख्यात्मक रासायनिक दृश्य समझ में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए एक बड़े पैमाने पर क्यूरेटेड डेटासेट और एक तीन-चरणीय प्रशिक्षण ढांचे का लाभ उठाता है।

Xuanle Zhao, Xinyuan Cai, Xiang Cheng, Xiuyi Chen, Bo Xu2026-04-09
💬 NLP

Specializing Large Models for Oracle Bone Script Interpretation via Component-Grounded Multimodal Knowledge Augmentation

यह शोध पत्र एक एजेंट-संचालित विजन-लैंग्वेज मॉडल फ्रेमवर्क प्रस्तावित करता है जिसे OB-Radix नामक एक नए विशेषज्ञ-एनोटेटेड डेटासेट द्वारा संवर्धित किया गया है ताकि बार-बार आने वाले चित्रात्मक घटकों के हस्तांतरणीय अर्थों का लाभ उठाकर अधिक सटीक और भाषाई रूप से सटीक परिणामों के माध्यम से ओरेकल बोन स्क्रिप्ट (Oracle Bone Script) के डिकोडिंग में व्याख्या अंतराल को पाटा जा सके।

Jianing Zhang, Runan Li, Honglin Pang, Ding Xia, Zhou Zhu, Qian Zhang, Chuntao Li, Xi Yang2026-04-09
💬 NLP

Luwen Technical Report

यह शोध पत्र लुवेन (Luwen) का परिचय देता है, जो बायचुआन (Baichuan) की नींव पर निर्मित एक ओपन-सोर्स चीनी कानूनी भाषा मॉडल है, जो निरंतर पूर्व-प्रशिक्षण (continual pre-training), पर्यवेक्षित सूक्ष्म-समायोजन (supervised fine-tuning) और पुनर्प्राप्ति-संवर्धित पीढ़ी (retrieval-augmented generation) का लाभ उठाकर पांच प्रमुख कानूनी कार्यों में मौजूदा बेसलाइन से बेहतर प्रदर्शन करता है।

Yiquan Wu, Yuhang Liu, Yifei Liu, Ang Li, Siying Zhou, Kun Kuang2026-04-09
💬 NLP

StructKV: Preserving the Structural Skeleton for Scalable Long-Context Inference

StructKV एक नवीन KV कैश संपीड़न ढांचा (framework) है जो वैश्विक इन-डिग्री सेंट्रैलिटीिटी (global in-degree centrality), गतिशील पिवट डिटेक्शन (dynamic pivot detection) और संरचनात्मक प्रसार (structural propagation) को पेश करके स्थानीय सैलिएंसी-आधारित विधियों की सीमाओं को दूर करता है ताकि लंबी-दूरी की निर्भरताओं को संरक्षित किया जा सके और स्केलेबल लॉन्ग-कॉन्टेक्स्ट LLM इन्फरेंस के लिए मेमोरी दक्षता में सुधार किया जा सके।

Zhirui Chen, Peiyang Liu, Ling Shao2026-04-09
💬 NLP

Select-then-Solve: Paradigm Routing as Inference-Time Optimization for LLM Agents

यह शोध पत्र प्रदर्शित करता है कि LLM एजेंटों के लिए सभी कार्यों में कोई एक एकल तर्क प्रतिमान (reasoning paradigm) प्रभावी नहीं है और एक "सेलेक्ट-देन-सॉल्व" (Select-then-Solve) दृष्टिकोण प्रस्तावित करता है, जहाँ एक हल्का सीखा हुआ राउटर गतिशील रूप से प्रति कार्य इष्टतम प्रतिमान का चयन करता है ताकि निश्चित रणनीतियों की तुलना में काफी बेहतर प्रदर्शन किया जा सके और एक ओरकल सिलेक्टर (oracle selector) के प्रदर्शन अंतराल के एक बड़े हिस्से को पुनः प्राप्त किया जा सके।

Heng Zhou, Zelin Tan, Zhemeng Zhang, Yutao Fan, Yibing Lin, Li Kang, Xiufeng Song, Rui Li, Songtao Huang, Ao Yu, Yuchen (…)2026-04-09