💬 NLP

Agenda-based Narrative Extraction: Steering Pathfinding Algorithms with Large Language Models

यह शोध पत्र एजेंडा-आधारित नैरेटिव निष्कर्षण (agenda-based narrative extraction) प्रस्तुत करता है, जो एक ऐसी विधि है जो उच्च कथा सुसंगतता बनाए रखते हुए और कई कथा-धाराओं का समर्थन करते हुए, उपयोगकर्ता द्वारा निर्दिष्ट दृष्टिकोणों की ओर कहानी निर्माण को निर्देशित करने के लिए पाथफाइंडिंग एल्गोरिदम में लार्ज लैंग्वेज मॉडल्स को एकीकृत करती है।

Brian Felipe Keith-Norambuena, Carolina Inés Rojas-Córdova, Claudio Juvenal Meneses-Villegas, Elizabeth Johanna Lam-Esqu (…)2026-04-01
💬 NLP

A Comprehensive Information-Decomposition Analysis of Large Vision-Language Models

यह शोधपत्र आंशिक सूचना अपघटन (पार्शियल इंफॉर्मेशन डिकंपोजिशन) का उपयोग करने वाले एक नवीन ढांचे को प्रस्तुत करता है जो 26 बड़े विजन-लैंग्वेज मॉडलों की आंतरिक निर्णय लेने की प्रक्रियाओं का मात्रात्मक विश्लेषण करता है, जो विशिष्ट कार्य व्यवस्थाओं (टास्क रेजीम्स), विपरीत परिवार-स्तरीय रणनीतियों और वास्तविक मल्टीमॉडल फ्यूजन प्राप्त करने में विजुअल इंस्ट्रक्शन ट्यूनिंग की महत्वपूर्ण भूमिका को प्रकट करता है।

Lixin Xiu, Xufang Luo, Hideki Nakayama2026-04-01
💬 NLP

Training-Free Dynamic Upcycling of Expert Language Models

यह शोध पत्र डायनेमिक अपसाइकिलिंग MoE (DUME) को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त विधि है जो एक क्लोज्ड-फॉर्म रिज रिग्रेशन समाधान के माध्यम से पूर्व-प्रशिक्षित डेंस एक्सपर्ट्स का पुन: उपयोग करके कुशलतापूर्वक एक एकीकृत, स्केलेबल मिक्स्चर ऑफ एक्सपर्ट्स मॉडल का निर्माण करती है, जिससे बिना किसी अतिरिक्त फाइनट्यूनिंग के और बिना कैटास्ट्रोफिक फॉरगेटिंग (catastrophic forgetting) के झेले, मूल डोमेन-विशिष्ट क्षमताओं को संरक्षित किया जाता है और अक्सर उनसे बेहतर बनाया जाता है।

Eros Fanì, Oğuzhan Ersoy2026-04-01
💬 NLP

SNEAK: Evaluating Strategic Communication and Information Leakage in Large Language Models

यह शोधपत्र SNEK का परिचय देता है, जो सहयोगियों को गुप्त जानकारी रणनीतिक रूप से संप्रेषित करने और विरोधियों तक रिसाव को न्यूनतम करने की बड़े भाषा मॉडलों (LLMs) की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया एक बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान मॉडल उपयोगिता और गोपनीयता के बीच संतुलन बनाने में मनुष्यों की तुलना में काफी कम प्रदर्शन करते हैं।

Adar Avsian, Larry Heck2026-04-01
💬 NLP

Towards Empowering Consumers through Sentence-level Readability Scoring in German ESG Reports

यह शोध पत्र वाक्य-स्तरीय पठनीयता एनोटेशन को क्राउडसोर्सिंग करके और यह प्रदर्शित करके जर्मन ESG रिपोर्ट विश्लेषण को उन्नत करता है कि जबकि LLM प्रॉम्प्टिंग आशाजनक दिखती है, एक छोटा फाइनट्यून्ड ट्रांसफॉर्मर मानव पठनीयता धारणाओं की भविष्यवाणी करने में उच्चतम सटीकता प्राप्त करता है।

Benjamin Josef Schüßler, Jakob Prange2026-04-01
💬 NLP

UnWeaving the knots of GraphRAG -- turns out VectorRAG is almost enough

यह शोध पत्र UnWeaver को प्रस्तुत करता है, जो एक नवीन RAG फ्रेमवर्क है जो दस्तावेज़ों को रिट्रीवल के लिए क्रॉस-चंक संस्थाओं (cross-chunk entities) में विघटित करने के लिए LLMs का उपयोग करके GraphRAG को सरल बनाता है, जिससे पारंपरिक ग्राफ-आधारित दृष्टिकोणों की उच्च जटिलता और ह्यूरिस्टिक निर्भरता से बचते हुए स्रोत की निष्ठा (source fidelity) को संरक्षित किया जाता है और शोर को कम किया जाता है।

Ryszard Tuora, Mateusz Galiński, Michał Godziszewski, Michał Karpowicz, Mateusz Czyżnikiewicz, Adam Kozakiewicz, Tomasz (…)2026-04-01
💬 NLP

FLEURS-Kobani: Extending the FLEURS Dataset for Northern Kurdish

यह शोध पत्र FLEURS-Kobani को प्रस्तुत करता है, जो 31 मूल भाषियों द्वारा रिकॉर्ड किए गए 5,162 सत्यापित कथनों से बना पहला सार्वजनिक उत्तरी कुर्दिश बेंचमार्क है, जो इस अल्प-संसाधन वाली भाषा के लिए स्वचालित भाषण पहचान और भाषण अनुवाद कार्यों के मूल्यांकन को सक्षम करने हेतु FLEURS डेटासेट का विस्तार करता है।

Daban Q. Jaff, Mohammad Mohammadamini2026-04-01
💬 NLP

Rewrite the News: Tracing Editorial Reuse Across News Agencies

यह शोध पत्र पूर्ण अनुवाद के बिना बहुभाषी पत्रकारिता में वाक्य-स्तरीय पाठ पुन: उपयोग का पता लगाने के लिए एक दुर्बल रूप से पर्यवेक्षित (weakly supervised), क्रॉस-लिंगुअल पद्धति प्रस्तुत करता है, जो यह प्रकट करता है कि संपादकीय पुन: उपयोग व्यापक है, मुख्य रूप से गैर-शाब्दिक है, और लीड (leads) के बजाय लेखों के मध्य और अंत में केंद्रित है।

Soveatin Kuntur, Nina Smirnova, Anna Wroblewska, Philipp Mayr, Sebastijan Razboršek Maček2026-04-01
💬 NLP

Enhancing Structural Mapping with LLM-derived Abstractions for Analogical Reasoning in Narratives

यह शोध पत्र YARN को प्रस्तुत करता है, जो एक मॉड्यूलर फ्रेमवर्क है जो नैरेटिव एब्स्ट्रैक्शन (कथा अमूर्तता) उत्पन्न करने के लिए LLMs का लाभ उठाता है, यह प्रदर्शित करते हुए कि यह दृष्टिकोण एंड-टू-एंड LLM बेसलाइन की तुलना में स्ट्रक्चरल मैपिंग और एनालॉजिकल रीजनिंग प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है।

Mohammadhossein Khojasteh, Yifan Jiang, Stefano De Giorgis, Frank van Harmelen, Filip Ilievski2026-04-01
💬 NLP

Tracking Equivalent Mechanistic Interpretations Across Neural Networks

यह शोध पत्र मॉडलों के बीच व्याख्यात्मक तुल्यता (interpretive equivalence) की अवधारणा को परिभाषित और औपचारिक रूप देकर, प्रतिनिधित्व समानता (representation similarity) पर आधारित इसे अनुमानित करने के लिए एक एल्गोरिदम प्रस्तावित करके, और अधिक कठोर मूल्यांकन तथा स्वचालित खोज को सक्षम करने के लिए एल्गोरिद्मिक व्याख्याओं, सर्किटों और प्रस्तुतियों को जोड़ने वाले सैद्धांतिक गारंटियों को स्थापित करके, मैकेनिस्टिक इंटरप्रिटेबिलिटी (mechanistic interpretability) में स्केलेबिलिटी और सामान्यीकरण की चुनौतियों का समाधान करता है।

Alan Sun, Mariya Toneva2026-04-01