💬 NLP

Embodied Task Planning via Graph-Informed Action Generation with Large Language Model

यह शोध पत्र GiG का प्रस्ताव करता है, जो एक नवीन एम्बोडीड टास्क प्लानिंग फ्रेमवर्क है जो अनुभव स्मृति को संरचित करने के लिए ग्राफ न्यूरल नेटवर्क्स को एक बाउंडेड लुकअहेड मॉड्यूल के साथ जोड़ता है ताकि दीर्घकालिक तर्क (लॉन्ग-होराइजन रीजनिंग) को बढ़ाया जा सके और कई बेंचमार्क पर अत्याधुनिक बेसलाइनों से काफी बेहतर प्रदर्शन किया जा सके।

Xiang Li, Ning Yan, Masood Mortazavi2026-02-26
💬 NLP

Small Reward Models via Backward Inference

यह शोध पत्र FLIP को प्रस्तुत करता है, जो एक संदर्भ-मुक्त (reference-free) रिवॉर्ड मॉडलिंग दृष्टिकोण है जो प्रतिक्रियाओं से निर्देशों को पुनर्गठित करने के लिए बैकवर्ड इन्फरेंस (backward inference) का लाभ उठाता है, जो LLM-as-a-Judge बेसलाइन की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है और छोटे भाषा मॉडलों के साथ डाउनस्ट्रीम कार्यों को महत्वपूर्ण रूप से बढ़ाता है।

Yike Wang, Faeze Brahman, Shangbin Feng, Teng Xiao, Hannaneh Hajishirzi, Yulia Tsvetkov2026-02-26
💬 NLP

SELAUR: Self Evolving LLM Agent via Uncertainty-aware Rewards

SELAUR एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो अन्वेषण दक्षता और सीखने की स्थिरता में सुधार के लिए रिवॉर्ड डिज़ाइन में आंतरिक अनिश्चितता मेट्रिक्स को एकीकृत करके LLM एजेंटों में बहु-चरणीय निर्णय लेने की क्षमता को बढ़ाता है, जिसके परिणामस्वरूप ALFWorld और WebShop जैसे बेंचमार्क पर उच्च सफलता दर प्राप्त होती है।

Dengjia Zhang, Xiaoou Liu, Lu Cheng, Yaqing Wang, Kenton Murray, Hua Wei2026-02-26
💬 NLP

Inference-time Alignment via Sparse Junction Steering

यह शोध पत्र स्पार्स इन्फरेंस-टाइम अलाइनमेंट (SIA) का प्रस्ताव करता है, जो एक ऐसी विधि है जो प्रत्येक टोकन के बजाय केवल उच्च-एन्ट्रॉपी निर्णय बिंदुओं पर हस्तक्षेप करके अलाइनमेंट दक्षता और जनरेशन गुणवत्ता में सुधार करती है, जिससे 6 गुना तक कम कम्प्यूटेशनल लागत के साथ बेहतर परिणाम प्राप्त होते हैं।

Runyi Hu, Jie Zhang, Shiqian Zhao, Jiale Meng, Jiwei Li, Jason Zeng, Ming Wu, Michael Heinrich, Yonggang Wen, Tianwei Zh (…)2026-02-26
💬 NLP

Applied Sociolinguistic AI for Community Development (ASA-CD): A New Scientific Paradigm for Linguistically-Grounded Social Intervention

यह शोध पत्र 'एप्लाइड सोशियोलिंग्विस्टिक एआई फॉर कम्युनिटी डेवलपमेंट' (ASA-CD) को एक नए वैज्ञानिक प्रतिमान के रूप में प्रस्तावित करता है जो भाषाई बायोमार्कर, विकास-संरेखित एनएलपी (NLP), और एक मानकीकृत हस्तक्षेप प्रोटोकॉल का उपयोग करके भाषाई रूप से सुदृढ़, स्केलेबल सामुदायिक सशक्तिकरण के लिए एआई का लाभ उठाता है।

S M Ruhul Alam, Rifa Ferzana2026-02-26
💬 NLP

EPSVec: Efficient and Private Synthetic Data Generation via Dataset Vectors

यह शोध पत्र EPSVec को प्रस्तुत करता है, जो एक डिफरेंशियल-प्राइवेट फ्रेमवर्क है जो LLMs को निर्देशित करने के लिए डेटासेट वेक्टर्स को निकालने और उन्हें सैनिटाइज करने के माध्यम से उच्च-गुणवत्ता वाला सिंथेटिक डेटा कुशलतापूर्वक उत्पन्न करता है, जिससे गोपनीयता लागत को जनरेशन वॉल्यूम से अलग किया जाता है और कम डेटा वाले परिदृश्यों में काफी कम कम्प्यूटेशनल ओवरहेड के साथ मौजूदा तरीकों से बेहतर प्रदर्शन किया जाता है।

Amin Banayeeanzade, Qingchuan Yang, Deqing Fu, Spencer Hong, Erin Babinsky, Alfy Samuel, Anoop Kumar, Robin Jia, Sai Pra (…)2026-02-26
💬 NLP

Latent Context Compilation: Distilling Long Context into Compact Portable Memory

यह शोध पत्र लेटेंट कॉन्टेक्स्ट कंपाइलेशन (Latent Context Compilation) का प्रस्ताव करता है, जो एक डिस्पोजेबल लोरा (LoRA) मॉड्यूल और एक सेल्फ-अलाइन्ड ऑप्टिमाइज़ेशन स्ट्रैटेजी का उपयोग करके लंबे कॉन्टेक्स्ट को कॉम्पैक्ट, स्टेटलेस बफ़र टोकन्स में संकुचित करने वाला एक फ्रेमवर्क है, जो सिंथेटिक डेटा या वेट मॉडिफिकेशन की आवश्यकता के बिना फ्रोजन एलएलएम (LLM) के साथ कुशल, प्लग-एंड-प्ले लॉन्ग-कॉन्टेक्स्ट प्रोसेसिंग को सक्षम बनाता है।

Zeju Li, Yizhou Zhou, Qiang Xu2026-02-26
💬 NLP

Task-Aware LoRA Adapter Composition via Similarity Retrieval in Vector Databases

यह शोध पत्र डायनेमिक LoRA एडेप्टर कंपोजिशन के लिए एक नवीन ढांचे का प्रस्ताव करता है जो कार्य समानता के आधार पर कई विशिष्ट एडेप्टरों को मर्ज करने के लिए वेक्टर डेटाबेस में समानता रिट्रीवल का लाभ उठाता है, जिससे अतिरिक्त रिट्राइवर प्रशिक्षण की आवश्यकता के बिना ज़ीरो-शॉट सामान्यीकरण प्राप्त होता है और सिंगल-टास्क बेसलाइन से बेहतर प्रदर्शन होता है।

Riya Adsul, Balachandra Devarangadi Sunil, Isha Nalawade, Sudharshan Govindan2026-02-26
💬 NLP

Measuring Pragmatic Influence in Large Language Model Instructions

यह शोध पत्र "प्रैग्मैटिक फ्रेमिंग" (pragmatic framing)—जो कि तात्कालिकता या अधिकार जैसे प्रासंगिक संकेतों के बड़े भाषा मॉडलों (large language models) की निर्देशात्मक प्राथमिकता पर प्रभाव को दर्शाता है—को व्यवस्थित रूप से मापने और परिमाणित करने के लिए एक नवीन ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि ऐसी फ्रेमिंग विविध आर्किटेक्चर में मॉडल के व्यवहार को निरंतर परिवर्तित करती है।

Yilin Geng, Omri Abend, Eduard Hovy, Lea Frermann2026-02-26
💬 NLP

IslamicLegalBench: Evaluating LLMs Knowledge and Reasoning of Islamic Law Across 1,200 Years of Islamic Pluralist Legal Traditions

यह शोध पत्र इस्लामिकलीगलबेंच (IslamicLegalBench) को प्रस्तुत करता है, जो 1,200 वर्षों की बहुलवादी परंपराओं में इस्लामी कानूनी तर्क पर एलएलएम (LLMs) का मूल्यांकन करने वाला पहला बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान मॉडल महत्वपूर्ण ज्ञान अंतराल, उच्च मतिभ्रम दर और खतरनाक चाटुकारिता से ग्रस्त हैं जिसे प्रॉम्प्ट इंजीनियरिंग पर्याप्त रूप से हल नहीं कर सकती है।

Ezieddin Elmahjub, Junaid Qadir, Abdullah Mushtaq, Rafay Naeem, Ibrahim Ghaznavi, Waleed Iqbal2026-02-26