💬 NLP

Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset

यह शोध पत्र एक व्यापक पाइपलाइन प्रस्तुत करता है जो मौजूदा गलत सूचना संसाधनों की सीमाओं को दूर करने के लिए क्लेमरिव्यू (ClaimReview) फीड्स को एकत्रित करने, साक्ष्य निकालने और औचित्य उत्पन्न करने के माध्यम से फ्रांसीसी और जर्मन में संरचित, बहुभाषी और बहुविध तथ्य-जांच डेटासेट बनाने के लिए बड़े भाषा मॉडल का लाभ उठाता है।

Z. Melce Hüsünbeyi, Virginie Mouilleron, Leonie Uhling, Daniel Foppe, Tatjana Scheffler, Djamé Seddah2026-03-16
💬 NLP

A Longitudinal, Multinational, and Multilingual Corpus of News Coverage of the Russo-Ukrainian War

यह शोध पत्र DNIPRO को प्रस्तुत करता है, जो रूस-यूक्रेन युद्ध को कवर करने वाले पांच राष्ट्रों के 246,000 समाचार लेखों का एक बहुभाषी संग्रह है, जिसमें विविध भू-राजनीतिक आख्यानों और सूचना युद्ध के अनुभवजन्य अध्ययन को सक्षम करने के लिए रुख (stance), भावना (sentiment) और फ्रेमिंग (framing) पर मानव-एनोटेटेड मेटाडेटा शामिल है।

Dikshya Mohanty, Taisiia Sabadyn, Jelwin Rodrigues, Chenlu Wang, Abhishek Kalugade, Ritwik Banerjee2026-03-16
💬 NLP

A Decision-Theoretic Formalisation of Steganography With Applications to LLM Monitoring

यह शोध पत्र "सामान्यीकृत V\mathcal{V}-सूचना" (generalised V\mathcal{V}-information) और "स्टेग्नोग्राफिक अंतराल" (steganographic gap) को पेश करके एजेंटों के बीच सूचना विषमता को मापने के लिए, ज्ञात संदर्भ वितरणों की आवश्यकता वाले शास्त्रीय तरीकों की सीमाओं को दूर करते हुए, बड़े भाषा मॉडलों में स्टेग्नोग्राफी का पता लगाने और उसे मापने के लिए एक निर्णय-सैद्धांतिक ढांचे का प्रस्ताव करता है।

Usman Anwar, Julianna Piskorz, David D. Baek, David Africa, Jim Weatherall, Max Tegmark, Christian Schroeder de Witt, Mi (…)2026-03-16
💬 NLP

Task-Specific Knowledge Distillation via Intermediate Probes

यह शोध पत्र \method{} को प्रस्तुत करता है, जो एक ज्ञान आसवन (knowledge distillation) ढांचा है जो फ्रोजन टीचर हिडन स्टेट्स पर लाइटवेट प्रोब्स को प्रशिक्षित करके छात्र मॉडल के तर्क कार्यों (reasoning tasks) पर प्रदर्शन में सुधार करता है ताकि स्वच्छर सुपरविजन सिग्नल उत्पन्न किए जा सकें, जिससे टीचर आउटपुट लॉजिट्स में निहित शोर और सूचना हानि को दरकिनार किया जा सके।

Ryan Brown, Chris Russell2026-03-16
💬 NLP

Aligning Language Models from User Interactions

यह शोध पत्र एक स्केलेबल सेल्फ-डिस्टिलेशन विधि प्रस्तावित करता है जो भाषा मॉडलों की उपयोगकर्ता के फॉलो-अप के आधार पर अपनी प्रतिक्रियाओं को संशोधित करने की अंतर्निहित क्षमता का लाभ उठाकर उन्हें संरेखित और व्यक्तिगत बनाती है, यह प्रदर्शित करते हुए कि वास्तविक दुनिया के डिप्लॉयमेंट से प्राप्त रॉ मल्टी-टर्न इंटरेक्शन डेटा बिना किसी स्पष्ट फीडबैक या क्षमता प्रतिगमन के इंस्ट्रक्शन-फॉलोइंग और अनुकूलन में सुधार कर सकता है।

Thomas Kleine Buening, Jonas Hübotter, Barna Pásztor, Idan Shenfeld, Giorgia Ramponi, Andreas Krause2026-03-16
🤖 AI

Context-Enriched Natural Language Descriptions of Vessel Trajectories

यह शोधपत्र एक संदर्भ-जागरूक (context-aware) ढांचे का प्रस्ताव करता है जो कच्चे AIS जहाज प्रक्षेपवक्र डेटा को बहु-स्रोत प्रासंगिक सूचनाओं के साथ एनोटेट किए गए संरचित, अर्थपूर्ण रूप से समृद्ध निरूपणों में परिवर्तित करता है, जिससे उच्च-स्तरीय समुद्री तर्क और विश्लेषण को सुगम बनाने के लिए LLMs द्वारा नियंत्रित प्राकृतिक भाषा विवरणों के निर्माण को सक्षम बनाया जा सके।

Kostas Patroumpas, Alexandros Troupiotis-Kapeliaris, Giannis Spiliopoulos, Panagiotis Betchavas, Dimitrios Skoutas, Dimi (…)2026-03-16
💻 computer science

Multi-Step Semantic Reasoning in Generative Retrieval

यह शोध पत्र ReasonGR प्रस्तुत करता है, जो एक ऐसा ढांचा है जो संरचित प्रॉम्प्टिंग और एक तर्क-केंद्रित अनुकूलन मॉड्यूल का उपयोग करके जनरेटिव रिट्रीवल मॉडल्स की जटिल संख्यात्मक और अर्थ संबंधी तर्क कार्यों, जैसे कि वित्तीय प्रश्नों, को संभालने की क्षमता को बढ़ाता है ताकि रिट्रीवल सटीकता में महत्वपूर्ण सुधार किया जा सके।

Steven Dong, Yubao Tang, Maarten de Rijke2026-03-16
🤖 machine learning

NeuroLoRA: Context-Aware Neuromodulation for Parameter-Efficient Multi-Task Adaptation

NeuroLoRA एक पैरामीटर-कुशल मल्टी-टास्क एडेप्टेशन फ्रेमवर्क है जो एक कॉन्टेक्स्ट-अवेयर न्यूरोमॉड्यूलेशन गेट और एक कॉन्ट्रास्टिव ऑर्थोगोनैलिटी लॉस को पेश करके लो-रैंक एडेप्टेशन (LoRA) को उन्नत करता है ताकि स्पार्स रैंडम प्रोजेक्शन्स को गतिशील रूप से विनियमित किया जा सके, जिससे यह कंप्यूटेशनल दक्षता बनाए रखते हुए सिंगल-टास्क, मल्टी-टास्क और कॉन्टिनुअल लर्निंग परिदृश्यों में FlyLoRA जैसे मौजूदा तरीकों से बेहतर प्रदर्शन करता है।

Yuxin Yang, Haoran Zhang, Mingxuan Li, Jiachen Xu, Ruoxi Shen, Zhenyu Wang, Tianhao Liu, Siqi Chen, Weilin Huang2026-03-16
💬 NLP

CSE-UOI at SemEval-2026 Task 6: A Two-Stage Heterogeneous Ensemble with Deliberative Complexity Gating for Political Evasion Detection

CSE-UOI टीम ने एक नवीन डेलिब्रेटिव कॉम्प्लेक्सिटी गेटिंग मैकेनिज्म का उपयोग करते हुए, जो राजनीतिक टालमटोल (पॉलिटिकल इवेजन) का पता लगाने के लिए रिस्पॉन्स-लेंथ प्रॉक्सीज़ और क्रॉस-मॉडल सिग्नल्स का लाभ उठाता है, एक हेट्रोजेनियस डुअल-LLM एन्सेम्बल के माध्यम से 0.85 के मैक्रो-F1 स्कोर के साथ SemEval-2026 टास्क 6 में तीसरा स्थान प्राप्त किया।

Christos Tzouvaras, Konstantinos Skianis, Athanasios Voulodimos2026-03-16
💬 NLP

Marked Pedagogies: Examining Linguistic Biases in Personalized Automated Writing Feedback

यह अध्ययन प्रकट करता है कि चार व्यापक रूप से उपयोग किए जाने वाले लार्ज लैंग्वेज मॉडल्स व्यवस्थित रूप से पक्षपाती, रूढ़िवादी-संरेखित लेखन फीडबैक उत्पन्न करते हैं—जो नस्ल, भाषा या विकलांगता के रूप में चिह्नित छात्रों के लिए अत्यधिक प्रशंसा और आलोचना को रोकने की विशेषता रखता है—यह प्रदर्शित करते हुए कि स्वचालित "वैयक्तिकरण" अक्सर हानिकारक निर्देशात्मक ओरिएंटेशन को पुनरुत्पादित करता है जिन्हें "मार्क्ड पेडागॉजीज़" कहा जाता है।

Mei Tan, Lena Phalen, Dorottya Demszky2026-03-16