💬 NLP

SGR: A Stepwise Reasoning Framework for LLMs with External Subgraph Generation

यह शोध पत्र SGR को प्रस्तुत करता है, जो एक चरणबद्ध तर्क ढांचा (stepwise reasoning framework) है जो बाहरी ज्ञान भंडारों से क्वेरी-विशिष्ट उपग्राफ (query-specific subgraphs) का निर्माण करके बहु-चरणीय अनुमान को संरचित, तथ्यात्मक साक्ष्यों पर आधारित करता है, जिससे जटिल कार्यों में लार्ज लैंग्वेज मॉडल्स के प्रदर्शन को बढ़ाया जा सके।

Xin Zhang, Yang Cao, Baoxing Wu, Kai Song, Siying Li2026-05-18
🤖 AI

Fully Open Meditron: An Auditable Pipeline for Clinical LLMs

यह शोध पत्र फुली ओपन मेडिट्रॉन (Fully Open Meditron) को प्रस्तुत करता है, जो क्लिनिकल एलएलएम (LLMs) के लिए पहला एंड-टू-एंड ऑडिट करने योग्य पाइपलाइन है, जो मेडिकल बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करने के लिए एक क्लिनिशियन-सत्यापित प्रशिक्षण कॉर्पस और पुनरुत्पादक फ्रेमवर्क को जोड़ता है, जबकि पूर्ण पारदर्शिता और पुनरुत्पादकता बनाए रखता है।

Xavier Theimer-Lienhard, Mushtaha El-Amin, Fay Elhassan, Sahaj Vaidya, Victor Cartier-Negadi, David Sasu, Lars Klein, Ma (…)2026-05-18
💬 NLP

Artificial Aphasias in Lesioned Language Models

यह शोध पत्र भाषा मॉडल के मापदंडों (पैरामीटर्स) को एफ़ेज़िया (aphasia) से प्रेरित तकनीक के माध्यम से क्षतिग्रस्त करने की एक विधि प्रस्तुत करता है, जिससे यह प्रकट होता है कि यद्यपि ये मॉडल भाषा के लक्षणों के पूर्ण स्पेक्ट्रम को प्रदर्शित करते हैं, फिर भी उनकी परिणामी अक्षमता प्रोफाइल मानव एफ़ेज़िया से गुणात्मक रूप से भिन्न होती हैं और वास्तुशिल्प घटकों (आर्किटेक्चरल कंपोनेंट्स) एवं नेटवर्क की गहराई में व्यवस्थित रूप से भिन्न होती हैं, जो यह सुझाव देता है कि भाषा के टूटने के पैटर्न विशिष्ट शिक्षण और प्रसंस्करण तंत्रों द्वारा आकार लेते हैं न कि डोमेन-अपरिवर्तनीय (domain-invariant) होते हैं।

Nathan Roll, Jill Kries, Laura Gwilliams, Cory Shain2026-05-18
💬 NLP

AI-Mediated Communication Can Steer Collective Opinion

यह शोध पत्र अनुभवजन्य विश्लेषण और गणितीय मॉडलिंग के माध्यम से यह प्रदर्शित करता है कि मानव-से-मानव संचार की मध्यस्थता करने वाली जनरेटिव एआई प्रणालियाँ दिशात्मक पूर्वाग्रहों को पेश और प्रवर्धित कर सकती हैं, जिससे सामूहिक राय में महत्वपूर्ण बदलाव आ सकता है, साथ ही यह भी रेखांकित करता है कि कैसे विशिष्ट प्लेटफॉर्म डिजाइन विकल्प और संभावित नियामक ढांचे इन परिणामों को प्रभावित करते हैं।

Stratis Tsirtsis, Kai Rawal, Chris Russell, Brent Mittelstadt, Sandra Wachter2026-05-18
💬 NLP

Autofocus Retrieval: An Effective Pipeline for Multi-Hop Question Answering With Semi-Structured Knowledge

यह शोध पत्र ऑटोफोकस-रिट्रीवर (AF-Retriever) को प्रस्तुत करता है, जो एक मॉड्यूलर फ्रेमवर्क है जो एक नवीन हाइब्रिड रिट्रीवल और रीरैंकिंग पाइपलाइन के माध्यम से संरचित और असंरचित ज्ञान को प्रभावी ढंग से जोड़ता है, और लार्ज लैंग्वेज मॉडल्स तथा इंक्रीमेंटल स्कोप एक्सपेंशन का लाभ उठाकर मल्टी-हॉप क्वेश्चन आंसरिंग बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Derian Boer, Stephen Roth, Stefan Kramer2026-05-15
💬 NLP

Decomposing Representation Space into Interpretable Subspaces with Unsupervised Learning

यह शोध पत्र 'नेबर डिस्टेंस मिनिमाइजेशन' (NDM) नामक एक अनसुपरवाइज्ड विधि प्रस्तुत करता है जो न्यूरल मॉडल रिप्रेजेंटेशन स्पेस को स्पष्ट रूप से व्याख्या योग्य, गैर-बेसिस-अलाइन्ड सबस्पेस में सफलतापूर्वक विघटित करती है, जो विशिष्ट अमूर्त अवधारणाओं और सर्किट वेरिएबल्स के अनुरूप हैं, जैसा कि GPT-2 और 2B-स्केल मॉडल्स पर गुणात्मक विश्लेषण और मात्रात्मक प्रयोगों के माध्यम से प्रदर्शित किया गया है।

Xinting Huang, Michael Hahn2026-05-15
💬 NLP

Beyond the Final Answer: Evaluating the Reasoning Trajectories of Tool-Augmented Agents

यह शोध पत्र TRACE प्रस्तुत करता है, जो एक संदर्भ-मुक्त (reference-free) ढांचा है जो टूल-ऑगमेंटेड LLMs के बहु-आयामी तर्क पथों (reasoning trajectories) को कुशलतापूर्वक और सटीक रूप से मूल्यांकन करने के लिए एक साक्ष्य बैंक (evidence bank) का लाभ उठाता है, जो पारंपरिक उत्तर-मिलान मेट्रिक्स और ग्राउंड-ट्रुथ एनोटेशन की उच्च लागत की सीमाओं को संबोधित करता है।

Wonjoong Kim, Sangwu Park, Yeonjun In, Sein Kim, Dongha Lee, Chanyoung Park2026-05-15
💬 NLP

Does Local News Stay Local?: Online Content Shifts in Sinclair-Acquired Stations

यह अध्ययन कम्प्यूटेशनल विधियों का उपयोग करके यह प्रदर्शित करता है कि सिनक्लेयर ब्रॉडकास्ट ग्रुप द्वारा अधिग्रहित किए जाने के बाद, स्थानीय समाचार स्टेशन स्थानीय मुद्दों की कीमत पर अधिक ध्रुवीकरण वाले राष्ट्रीय विषयों को कवर करने के लिए अपनी ऑनलाइन सामग्री को बदलते हैं।

Miriam Wanner, Sophia Hager, Anjalie Field2026-05-15
💬 NLP

TRIM: Token-wise Attention-Derived Saliency for Data-Efficient Instruction Tuning

TRIM एक गणनात्मक रूप से कुशल, फॉरवर्ड-ओनली फ्रेमवर्क है जो प्रतिनिधि नमूनों की पहचान करने के लिए टोकन-वाइज अटेंशन फिंगरप्रिंट्स का लाभ उठाकर उच्च-गुणवत्ता वाले इंस्ट्रक्शन-ट्यूनिंग कोरेसेट्स (coresets) का निर्माण करता है, जो मौजूदा ग्रेडिएंट-आधारित विधियों और पूर्ण-डेटा फाइन-ट्यूनिंग से बेहतर प्रदर्शन करते हुए कम्प्यूटेशनल लागतों को महत्वपूर्ण रूप से कम करता है।

Manish Nagaraj, Sakshi Choudhary, Utkarsh Saxena, Deepak Ravikumar, Kaushik Roy2026-05-15