💬 NLP

Can Interpretation Predict Behavior on Unseen Data?

यह शोध पत्र यह प्रदर्शित करता है कि इन-डिस्ट्रीब्यूशन प्रशिक्षण के दौरान देखे गए अटेंशन पैटर्न एक ट्रांसफॉर्मर मॉडल के आउट-ऑफ-डिस्ट्रीब्यूशन व्यवहार की सफलतापूर्वक भविष्यवाणी कर सकते हैं, जो एक नए व्याख्यात्मकता उद्देश्य (interpretability objective) को स्थापित करता है जहाँ प्रेक्षण संबंधी विश्लेषण वितरण बदलाव (distribution shift) के तहत विश्वसनीयता का पूर्वानुमान लगा सकता है, भले ही कारण संबंधी यांत्रिक लिंक (causal mechanistic links) अनुपस्थित हों।

Victoria R. Li, Jenny Kaufmann, Tian Qin, Martin Wattenberg, David Alvarez-Melis, Naomi Saphra2026-07-21
💬 NLP

LogicIF: Towards Complex Logic Instruction Following

यह शोध पत्र LogicIFGen को पेश करता है, जो कोड से सत्यापन योग्य तर्क-समृद्ध (logic-rich) निर्देश उत्पन्न करने के लिए एक स्वचालित ढांचा है, और LogicIFEval को, जो 426 ऐसे कार्यों का एक बेंचमार्क है, यह प्रकट करने के लिए कि वर्तमान अत्याधुनिक LLMs जटिल तार्किक निर्देशों का पालन करने में काफी संघर्ष करते हैं।

Mian Zhang, Shujian Liu, Sixun Dong, Ming Yin, Yebowen Hu, Xun Wang, Simin Ma, Song Wang, Sathish Reddy Indurthi, Haoyun (…)2026-07-21
💬 NLP

"Not in My Backyard": LLMs Uncover Online and Offline Social Biases Against Homelessness

यह शोध पत्र ऑनलाइन और ऑफलाइन विमर्श में बेघर होने के विरुद्ध सामाजिक पूर्वाग्रहों को ट्रैक करने के लिए एक नवीन बहु-डोमेन कॉर्पस और ऑडिट प्रोटोकॉल प्रस्तुत करता है, जो यह प्रकट करता है कि हालांकि लार्ज लैंग्वेज मॉडल्स ऐसे पूर्वाग्रहों की पहचान कर सकते हैं, लेकिन वे महत्वपूर्ण मिसकैलिब्रेशन (असंतुलन) से ग्रस्त हैं जो व्यवस्थित रूप से "NIMBY" भावनाओं को अत्यधिक फ्लैग करता है और तथ्यात्मक दावों का पता लगाने में कम रह जाता है।

Jonathan A. Karr, Benjamin F. Herbst, Matthew L. Sisk, Xueyun Li, Ting Hua, Matthew Hauenstein, Georgina Curto, Nitesh V (…)2026-07-21
💬 NLP

From Evidence to Trajectory: Abductive Reasoning Path Synthesis for Retrieval-Augmented Generation Agents Development

यह शोध पत्र EviPath प्रस्तुत करता है, जो एक एबडक्टिव रीजनिंग फ्रेमवर्क है जो रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) एजेंट विकास में डेटा की कमी को दूर करने के लिए प्रश्न-उत्तर-साक्ष्य ट्रिपल्स से निष्पादन योग्य एजेंट-पर्यावरण इंटरेक्शन ट्राजेक्टरीज को संश्लेषित करता है, जिससे छोटे मॉडल ओपन-डोमेन प्रश्न उत्तर देने में अत्याधुनिक प्रदर्शन प्राप्त करने में सक्षम होते हैं।

Muzhi Li, Jinhu Qi, Yihong Wu, Minghao Zhao, Liheng Ma, Yifan Li, Xinyu Wang, Zhenghan Tai, Zixing Song, Yingxue Zhang (…)2026-07-21
💬 NLP

Self-Explaining Hate Speech Detection with Moral Rationales

यह शोध पत्र सुपरवाइज्ड मोरल रैशनले अटेंशन (SMRA) प्रस्तुत करता है, जो एक नवीन स्व-व्याख्यात्मक ढांचा है जो ब्राज़ीलियाई पुर्तगाली में नए जारी किए गए HateBRMoralXplain डेटासेट द्वारा समर्थित, नैतिक आधारों के सिद्धांत (Moral Foundations Theory) पर आधारित विशेषज्ञ-एनोटेटेड नैतिक तर्कों के साथ मॉडल अटेंशन को संरेखित करता है ताकि घृणा भाषण (hate speech) का पता लगाने की मजबूती और व्याख्यात्मकता में सुधार किया जा सके।

Francielle Vargas, Jackson Trager, Diego Alves, Surendrabikram Thapa, Matteo Guida, Berk Atil, Daryna Dementieva, Andrew (…)2026-07-21
💬 NLP

GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning

यह शोधपत्र GradAlign को प्रस्तुत करता है, जो एक ग्रेडिएंट-अलाइन्ड डेटा चयन पद्धति है जो एक विश्वसनीय वैलिडेशन सेट का लाभ उठाकर उन प्रशिक्षण समस्याओं को प्राथमिकता देती है जिनके पॉलिसी ग्रेडिएंट्स संरेखित (aligned) हैं, जिससे एक अनुकूली पाठ्यक्रम (adaptive curriculum) स्थापित होता है जो चुनौतीपूर्ण डेटा व्यवस्थाओं में एलएलएम (LLM) सुदृढीकरण शिक्षण की स्थिरता और प्रदर्शन में महत्वपूर्ण सुधार करता है।

Ningyuan Yang, Weihua Du, Weiwei Sun, Sean Welleck, Yiming Yang2026-07-21
💰 quantitative finance

FOI-O: A global ontology and verification framework for Freedom of Information process modelling

यह शोध पत्र FOI-O को प्रस्तुत करता है, जो एक वैश्विक ऑन्टोलॉजी और सत्यापन ढांचा है जिसे न्यूज़ीलैंड और ऑस्ट्रेलिया जैसे क्षेत्राधिकारों में सूचना के अधिकार (Freedom of Information) की प्रक्रियाओं को मॉडल और विश्लेषित करने के लिए डिज़ाइन किया गया है, साथ ही कानूनी सलाह या आधिकारिक प्रमाणन के स्रोत के बजाय एक अनुसंधान उपकरण के रूप में इसकी भूमिका को स्पष्ट करता है।

Dylan A Mordaunt2026-07-21
💬 NLP

Beyond Multilingual Averages: MTEB-PT, a Benchmark for Portuguese Sentence Encoders

यह शोध पत्र MTEB-PT को प्रस्तुत करता है, जो एक व्यापक पुर्तगाली बेंचमार्क है जो यह प्रदर्शित करता है कि बहुभाषी रैंकिंग विविध कार्यों में पुर्तगाली-विशिष्ट प्रदर्शन की भविष्यवाणी करने में विफल रहती है, जबकि यह दर्शाता है कि मैट्रोस्का प्रतिनिधित्व शिक्षण (Matryoshka Representation Learning) के साथ भाषा-विशिष्ट फाइन-ट्यूनिंग मॉडल की प्रभावशीलता को महत्वपूर्ण रूप से बढ़ाती है, विशेष रूप से सिमेंटिक समानता और लॉन्ग-कॉन्टेक्स्ट रिट्रीवल के लिए।

Lucas Hideki Takeuchi Okamura, Alexandre Alcoforado, Anna Helena Reali Costa2026-07-21
🤖 AI

ColGraphRAG: Late-Interaction Evidence Retrieval for Multimodal GraphRAG

यह शोधपत्र ColGraphRAG का प्रस्ताव करता है, जो एक मल्टीमॉडल GraphRAG फ्रेमवर्क है जो सिंगल-वेक्टर विजुअल रिट्रीवल को लेट-इंटरेक्शन मल्टी-वेक्टर स्कोरिंग (ColBERT/ColPali शैली) से बदलकर प्रश्नोत्तर सटीकता को बढ़ाता है ताकि ग्राफ-लिंक्ड छवियों में फाइन-ग्रैन्ड पैच और टोकन-स्तरीय संरचनाओं को बेहतर ढंग से संरक्षित किया जा सके, जो मूल ग्राफ निर्माण और रीजनिंग पाइपलाइन को बनाए रखते हुए विजुअल-हैवी क्वेरीज पर महत्वपूर्ण सुधार प्रदर्शित करता है।

Seonok Kim2026-07-21
🤖 AI

RAIL Guard: Closing the Evaluation-to-Remediation Gap in Responsible AI for LLM Agents

यह शोध पत्र RAIL Guard को प्रस्तुत करता है, जो एक क्लोज्ड-लूप जिम्मेदार एआई पाइपलाइन है जो आठ आयामों में एलएलएम (LLM) एजेंट आउटपुट का पुनरावृत्ति रूप से मूल्यांकन और उपचार करती है, यह प्रदर्शित करते हुए कि फीडबैक-संचालित स्व-मरम्मत न्यूनतम उपयोगिता हानि के साथ उच्च अभिसरण प्राप्त करती है जबकि यह पहचानती है कि पारदर्शिता और जवाबदेही जैसे संरचनात्मक मुद्दों के लिए एल्गोरिदम के बजाय आर्किटेक्चरल समाधानों की आवश्यकता होती है।

Sumit Verma, Pritam Prasun, Pritish Kumar2026-07-21