💬 NLP

LuxMT Technical Report

यह शोध पत्र LuxMT को प्रस्तुत करता है, जो LuxAlign और Luci के डेटा का उपयोग करके लक्समबर्गिश-से-फ्रेंच और अंग्रेजी अनुवाद के लिए Gemma 3 27B पर फाइन-ट्यून किया गया एक मशीन अनुवाद सिस्टम है, जो बेसलाइन की तुलना में महत्वपूर्ण प्रदर्शन सुधार प्रदर्शित करता है और गुणवत्ता अनुमान मीट्रिक के रूप में LuxEmbedder की क्षमता का अन्वेषण करता है।

Nils Rehlinger2026-02-18
💬 NLP

ExpertWeaver: Unlocking the Inherent MoE in Dense LLMs with GLU Activation Patterns

ExpertWeaver एक प्रशिक्षण-मुक्त (training-free) फ्रेमवर्क है जो GLU सक्रियण पैटर्न का विश्लेषण करके न्यूरॉन्स को सार्वभौमिक और विशिष्ट समूहों में विभाजित करके प्रीट्रेंड डेंस LLMs के भीतर अंतर्निहित मिक्स्चर-ऑफ-एक्सपर्ट्स संरचना को अनलॉक करता है, जिससे यह डायनेमिक स्ट्रक्चरल प्रूनिंग और MoE इनिशियलाइजेशन दोनों के लिए मौजूदा तरीकों से बेहतर प्रदर्शन करता है।

Ziyu Zhao, Tong Zhu, Zhi Zhang, Tiantian Fan, Jinluan Yang, Kun Kuang, Zhongyu Wei, Fei Wu, Yu Cheng2026-02-18
💬 NLP

RUVA: Personalized Transparent On-Device Graph Reasoning

रुवा एक "ग्लास बॉक्स" व्यक्तिगत एआई आर्किटेक्चर है जो मानव-इन-द-लूप मेमोरी क्यूरेशन, सटीक तथ्य रेडैक्शन और वास्तविक गोपनीयता अनुपालन को सक्षम करने के लिए अपारदर्शी वेक्टर-आधारित रिट्रीवल को एक पारदर्शी, ऑन-डिवाइस पर्सनल नॉलेज ग्राफ से बदल देता है।

Gabriele Conte, Alessio Mattiace, Gianni Carmosino, Potito Aghilar, Giovanni Servedio, Francesco Musicco, Vito Walter An (…)2026-02-18
💬 NLP

Beyond Static Pipelines: Learning Dynamic Workflows for Text-to-SQL

यह शोधपत्र SquRL प्रस्तुत करता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो LLMs को इन्फरेंस के समय गतिशील रूप से इष्टतम Text-to-SQL वर्कफ़्लो बनाने में सक्षम बनाता है, जिससे यह उम्मीदवार वर्कफ़्लो की विषमता का अनुकूल रूप से लाभ उठाकर स्थिर विधियों की तुलना में—विशेष रूप से जटिल और आउट-ऑफ-डिस्ट्रीब्यूशन प्रश्नों पर—बेहतर प्रदर्शन करता है।

Yihan Wang, Peiyu Liu, Runyu Chen, Wei Xu2026-02-18
💬 NLP

Revisiting Northrop Frye's Four Myths Theory with Large Language Models

यह शोध पत्र एक नया चरित्र फलन ढांचा (character function framework) प्रस्तावित करता है जो जुंगियन आर्केटाइप्स (Jungian archetypes) को नॉर्थ्रॉप फ्राई के चार कथात्मक विधाओं (narrative genres) से जोड़ता है, और एक बहु-मॉडल एलएलएम (multi-model LLM) अध्ययन के माध्यम से इसकी प्रभावकारिता को प्रमाणित करता है जो विभिन्न कथा कृतियों में विधा-विशिष्ट आर्केटाइप भूमिकाओं को व्यवस्थित रूप से पहचानने और अंतर करने की मॉडलों की क्षमता को प्रदर्शित करता है।

Edirlei Soares de Lima, Marco A. Casanova, Antonio L. Furtado2026-02-18
💬 NLP

Rethinking Metrics for Lexical Semantic Change Detection

यह शोध पत्र लेक्सिकल सिमेंटिक चेंज (lexical semantic change) का पता लगाने के लिए APD और PRT जैसे पारंपरिक मेट्रिक्स के मजबूत विकल्पों के रूप में एवरेज मिनिमम डिस्टेंस (AMD) और सिमेट्रिक एवरेज मिनिमम डिस्टेंस (SAMD) को प्रस्तुत करता है, जो विभिन्न भाषाओं, मॉडलों और रिप्रेजेंटेशन स्पेस में उनके बेहतर प्रदर्शन को प्रदर्शित करता है।

Roksana Goworek, Haim Dubossarsky2026-02-18
💬 NLP

Recursive Concept Evolution for Compositional Reasoning in Large Language Models

यह शोध पत्र रिकर्सिव कॉन्सेप्ट इवोल्यूशन (RCE) का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो फिक्स्ड लेटेंट रिप्रेजेंटेशन स्पेस की सीमाओं को दूर करने के लिए इन्फरेंस के दौरान नए कॉन्सेप्ट सबस्पेस को गतिशील रूप से उत्पन्न और अनुकूलित करके लार्ज लैंग्वेज मॉडल्स में कंपोजिशनल रीजनिंग को बढ़ाता है, जिसके परिणामस्वरूप ARC-AGI-2 और GPQA जैसे चुनौतीपूर्ण बेंचमार्क्स पर महत्वपूर्ण प्रदर्शन लाभ प्राप्त होते हैं।

Sarim Chaudhry2026-02-18
📈 economics

Causal Effect Estimation with Latent Textual Treatments

यह शोध पत्र एक एंड-टू-एंड पाइपलाइन प्रस्तुत करता है जो लेटेंट टेक्स्ट इंटरवेंशन को स्टीयर करने के लिए स्पार्स ऑटोएनकोडर्स को कोवेरिएट रेसिडुअलाइजेशन के साथ जोड़ता है ताकि अनुमान संबंधी पूर्वाग्रह (एस्टिमेशन बायस) को कम किया जा सके, जिससे डाउनस्ट्रीम परिणामों पर टेक्स्ट के कारण होने वाले प्रभाव का सुदृढ़ कॉज़ल इफेक्ट एस्टिमेशन सक्षम हो सके।

Omri Feldman, Amar Venugopal, Jann Spiess, Amir Feder2026-02-18
💬 NLP

Beyond Binary Classification: Detecting Fine-Grained Sexism in Social Media Videos

यह शोधपत्र FineMuSe प्रस्तुत करता है, जो एक नया स्पेनिश मल्टीमॉडल डेटासेट है जिसमें सूक्ष्म-स्तरीय एनोटेशन और एक पदानुक्रमित वर्गीकरण है, ताकि बाइनरी क्लासिफिकेशन से आगे बढ़कर सेक्सिज्म डिटेक्शन को उन्नत किया जा सके और उन मल्टीमॉडल एलएलएम (LLMs) का मूल्यांकन किया जा सके जो सूक्ष्म सेक्सिज्म की पहचान करने में मनुष्यों के साथ प्रतिस्पर्धी प्रदर्शन दिखाते हैं, साथ ही दृश्य संकेतों के माध्यम से व्यक्त होने वाले सह-घटित होने वाले प्रकारों का पता लगाने में आने वाली चुनौतियों को भी उजागर करते हैं।

Laura De Grazia, Danae Sánchez Villegas, Desmond Elliott, Mireia Farrús, Mariona Taulé2026-02-18
💬 NLP

ChartEditBench: Evaluating Grounded Multi-Turn Chart Editing in Multimodal Language Models

यह शोध पत्र ChartEditBench प्रस्तुत करता है, जो एक व्यापक बेंचमार्क और मूल्यांकन ढांचा है जिसे मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की ग्राउंडेड, मल्टी-टर्न चार्ट एडिटिंग करने की क्षमताओं का आकलन करने के लिए डिज़ाइन किया गया है, जो सिंगल-टर्न जनरेशन की तुलना में निरंतर इंटरैक्टिव परिदृश्यों में महत्वपूर्ण प्रदर्शन गिरावट को प्रकट करता है।

Manav Nitin Kapadnis, Lawanya Baghel, Atharva Naik, Carolyn Rosé2026-02-18