💬 NLP

Mimicking How Humans Interpret Out-of-Context Sentences Through Controlled Toxicity Decoding

यह शोध पत्र एक नियंत्रित विषाक्तता डिकोडिंग रणनीति प्रस्तावित करता है जो मानवीय धारणा के विभिन्न विषाक्तता स्तरों का अनुकरण करने के लिए संदर्भ-रहित वाक्यों की विविध व्याख्याएँ उत्पन्न करती है, जिससे मानव-लिखित व्याख्याओं के साथ संरेखण में सुधार होता है और मॉडल अनिश्चितता कम होती है।

Maria Mihaela Trusca, Liesbeth Allein2026-04-17
💬 NLP

VisRet: Visualization Improves Knowledge-Intensive Text-to-Image Retrieval

यह शोधपत्र VisRet का प्रस्ताव करता है, जो एक नवीन रिट्रीवल प्रतिमान (retrieval paradigm) है जो टेक्स्ट-टू-इमेज रिट्रीवल में सुधार करने के लिए पहले टेक्स्टुअल क्वेरीज़ से इमेज जेनरेट करता है ताकि संरचित दृश्य संबंधों (structured visual relationships) को पकड़ने में क्रॉस-मोडल एम्बेडिंग्स की सीमाओं को दरकिनार किया जा सके, जिससे यह कई बेंचमार्क पर मौजूदा बेसलाइन्स से काफी बेहतर प्रदर्शन करता है और डाउनस्ट्रीम विजुअल क्वेश्चन अनस्वर्सिंग सटीकता को बढ़ाता है।

Di Wu, Yixin Wan, Kai-Wei Chang2026-04-17
💬 NLP

Towards Bridging the Reward-Generation Gap in Direct Alignment Algorithms

यह शोध पत्र डायरेक्ट अलाइनमेंट एल्गोरिदम (DAAs) में "रिवॉर्ड-जेनरेशन गैप" को प्रशिक्षण उद्देश्यों और ऑटोरेग्रेसिव डिकोडिंग डायनेमिक्स के बीच एक बेमेल के रूप में पहचानता है, और एक सरल प्रीफिक्स-ओरिएंटेड इक्वल-लेंथ ट्रेनिंग (POET) पद्धति का प्रस्ताव करता है जो प्रतिक्रियाओं को समान लंबाई में छोटा (ट्रंकेट) करती है ताकि AlpacaEval 2 जैसे बेंचमार्क पर प्रदर्शन में उल्लेखनीय सुधार किया जा सके।

Zeguan Xiao, Yun Chen, Guanhua Chen, Ke Tang2026-04-17
💬 NLP

Theory of Mind in Action: The Instruction Inference Task in Dynamic Human-Agent Collaboration

यह शोध पत्र 'इंस्ट्रक्शन इन्फरेंस टास्क' और 'टॉमकेट' (Tomcat) का परिचय देता है, जो एक LLM-आधारित एजेंट है जिसे अस्पष्ट निर्देशों से अनकही मंशाओं का अनुमान लगाकर 'थ्योरी ऑफ माइंड' का अभ्यास करने के लिए डिज़ाइन किया गया है, जो यह प्रदर्शित करता है कि 'फ्यू-शॉट चेन-ऑफ-थॉट रीजनिंग' का उपयोग करने वाले वेरिएंट गतिशील मानव-एजेंट सहयोग में मानव-तुलनीय प्रदर्शन प्राप्त करते हैं।

Fardin Saad, Pradeep K. Murukannaiah, Munindar P. Singh2026-04-17
💬 NLP

Attribution, Citation, and Quotation: A Survey of Evidence-based Text Generation with Large Language Models

यह शोध पत्र बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के साथ साक्ष्य-आधारित टेक्स्ट जनरेशन के लिए एक एकीकृत वर्गीकरण स्थापित करने हेतु 134 अध्ययनों और 300 मूल्यांकन मेट्रिक्स का एक व्यापक सर्वेक्षण प्रस्तुत करता है, जो शब्दावली और बेंचमार्क में वर्तमान विखंडन को संबोधित करता है और भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Tobias Schreieder, Tim Schopf, Michael Färber2026-04-17
💬 NLP

Hierarchical Semantic Retrieval with Cobweb

यह शोध पत्र कोबवेब (Cobweb) का परिचय देता है, जो एक पदानुक्रमित अर्थपूर्ण पुनर्प्राप्ति ढांचा (hierarchical semantic retrieval framework) है जो वाक्य एम्बेडिंग को एक प्रोटोटाइप ट्री में व्यवस्थित करता है ताकि मोटे-से-सूक्ष्म (coarse-to-fine) दस्तावेज़ रैंकिंग को सक्षम किया जा सके, जो पारंपरिक फ्लैट वेक्टर खोज की तुलना में प्रतिस्पर्धी प्रभावशीलता, एम्बेडिंग गुणवत्ता में गिरावट के प्रति बेहतर मजबूती और व्याख्या योग्य पुनर्प्राप्ति पथ प्रदान करता है।

Anant Gupta, Karthik Singaravadivelan, Zekun Wang2026-04-17
💬 NLP

Your LLM Agents are Temporally Blind: The Misalignment Between Tool Use Decisions and Human Time Perception

यह शोध पत्र "टेम्पोरल ब्लाइंडनेस" (सामयिक अंधापन) को एलएलएम (LLM) एजेंटों में एक महत्वपूर्ण सीमा के रूप में पहचानता है, जहाँ वास्तविक दुनिया में बीते हुए समय का लेखा-जोखा न रख पाने के कारण उनके टूल-उपयोग संबंधी निर्णय गलत हो जाते हैं, और 'टिकटॉक' (TicToc) डेटासेट तथा उन निष्कर्षों को प्रस्तुत करता है जो दर्शाते हैं कि जबकि प्रॉम्प्ट-आधारित सुधार सीमित हैं, पोस्ट-ट्रेनिंग अलाइनमेंट एजेंटों की सामयिक जागरूकता को मानव धारणा के अनुरूप प्रभावी ढंग से सुधार सकता है।

Yize Cheng, Arshia Soltani Moakhar, Chenrui Fan, Parsa Hosseini, Kazem Faghih, Zahra Sodagar, Wenxiao Wang, Soheil Feizi2026-04-17
💬 NLP

Dark & Stormy: Modeling Humor in Sentences from the Bulwer-Lytton Fiction Contest

यह शोध पत्र बुल्वर-लिटन फिक्शन कॉन्टेस्ट (Bulwer-Lytton Fiction Contest) से "बुरे" हास्य के एक नवीन संग्रह को प्रस्तुत करता है, जो यह प्रकट करता है कि मानक हास्य पहचान मॉडल इसके अद्वितीय साहित्यिक युक्तियों के मिश्रण को पकड़ने में विफल रहते हैं और बड़े भाषा मॉडल (large language models), हालांकि इस रूप की नकल करने में सक्षम हैं, इन विशेषताओं को बढ़ा-चढ़ाकर पेश करते हैं और मानव लेखकों की तुलना में अधिक नवीन विशेषण-संज्ञा संयोजनों को उत्पन्न करते हैं।

Venkata S Govindarajan, Laura Biester2026-04-17
💬 NLP

Graph-Based Alternatives to LLMs for Human Simulation

यह शोध पत्र ग्राफ-आधारित मॉडल्स फॉर ह्यूमन सिमुलेशन (GEMS) को प्रस्तुत करता है, जो एक ग्राफ न्यूरल नेटवर्क दृष्टिकोण है जो क्लोज-एंडेड ह्यूमन सिमुलेशन कार्यों को लिंक प्रेडिक्शन के रूप में सूत्रबद्ध करता है ताकि बड़े लैंग्वेज मॉडल्स के प्रदर्शन के बराबर या उससे बेहतर प्रदर्शन करते हुए उनके मुकाबले तीन गुना कम पैरामीटर्स का उपयोग किया जा सके।

Joseph Suh, Suhong Moon, Serina Chang2026-04-17
💬 NLP

AccelOpt: A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization

AccelOpt एक स्व-सुधार करने वाला (self-improving) LLM एजेंटिक सिस्टम है जो अनुभव-आधारित मेमोरी का लाभ उठाकर AI एक्सेलेरेटर कर्नेल को स्वायत्त रूप से अनुकूलित करता है, जिससे AWS Trainium हार्डवेयर पर महत्वपूर्ण थ्रूपुट लाभ प्राप्त होता है और साथ ही महंगे प्रोप्रायटरी मॉडल्स के प्रदर्शन की बराबरी बहुत कम लागत पर की जा सकती है।

Genghan Zhang, Shaowei Zhu, Anjiang Wei, Zhenyu Song, Allen Nie, Zhen Jia, Nandita Vijaykumar, Yida Wang, Kunle Olukotun2026-04-17