💬 NLP

SCOPE: Tree-based Self-Correcting Online Log Parsing via Syntactic-Semantic Collaboration

SCOPE एक नवीन स्व-सुधारात्मक ऑनलाइन लॉग पार्सिंग विधि है जो उच्च सटीकता और दक्षता प्राप्त करने के लिए एक द्वि-दिशीय वृक्ष संरचना को दो-चरणीय वाक्यात्मक-अर्थगत सहयोग ढांचे के साथ जोड़ती है, जिसमें प्रारंभिक मिलान के लिए हल्के एनएलपी (NLP) मॉडल का उपयोग किया जाता है और केवल जटिल मामलों के लिए ही एलएलएम (LLM) को चुनिंदा रूप से बुलाया जाता है।

Dongyi Fan, Suqiong Zhang, Lili He, Ming Liu, Yifan Huo2026-03-31
💬 NLP

SACRED: A Faithful Annotated Multimedia Multimodal Multilingual Dataset for Classifying Connectedness Types in Online Spirituality

यह शोध पत्र SACRED को प्रस्तुत करता है, जो ऑनलाइन आध्यात्मिकता में जुड़ाव के प्रकारों को वर्गीकृत करने के लिए पहला एनोटेटेड मल्टीमीडिया मल्टीमॉडल मल्टीलिंगुअल डेटासेट है, जिसका उपयोग विभिन्न एआई मॉडलों को बेंचमार्क करने के लिए किया गया था और जिसके परिणामस्वरूप संचार विज्ञान के लिए मूल्यवान एक नए जुड़ाव प्रकार की खोज हुई।

Qinghao Guan, Yuchen Pan, Donghao Li, Zishi Zhang, Yiyang Chen, Lu Li, Flaminia Canu, Emilia Volkart, Gerold Schneider2026-03-31
💬 NLP

Inference-Time Structural Reasoning for Compositional Vision-Language Understanding

यह शोध पत्र सीन ग्राफ्स के माध्यम से संरचनात्मक तर्क (structural reasoning) के साथ विजन-लैंग्वेज मॉडल्स के मूल्यांकन और संवर्धन के लिए एक एकीकृत ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि Qwen3-VL-8B-Thinking मॉडल मल्टी-टर्न सीन ग्राफ फ़िल्टरिंग रणनीति के साथ बेहतर होने पर, विशेष रूप से विनोग्रउंड (Winoground) बेंचमार्क पर अन्य आर्किटेक्चर की तुलना में काफी बेहतर प्रदर्शन करता है।

Amartya Bhattacharya2026-03-31
💬 NLP

Not Worth Mentioning? A Pilot Study on Salient Proposition Annotation

यह शोध पत्र एक पायलट अध्ययन प्रस्तुत करता है जो एक एनोटेशन कार्य को परिभाषित करके, इसे एक बहु-विधा (multi-genre) डेटासेट पर लागू करके, और रिटोरिकल स्ट्रक्चर थ्योरी (Rhetorical Structure Theory) में डिस्कोर्स यूनिट सेंट्रैलिटी के साथ इसके संबंध का प्रारंभिक मूल्यांकन करके श्रेणीबद्ध प्रपोजिशन सैलिएंस (graded proposition salience) को परिचालन रूप (operationalize) देता है।

Amir Zeldes, Katherine Conhaim, Lauren Levine2026-03-31
🤖 AI

Heterogeneous Debate Engine: Identity-Grounded Cognitive Architecture for Resilient LLM-Based Ethical Tutoring

यह शोध पत्र हेट्रोजेनियस डिबेट इंजन (HDE) को प्रस्तुत करता है, जो एक ऐसा संज्ञानात्मक आर्किटेक्चर है जो मल्टी-एजेंट एलएलएम (LLM) प्रणालियों में सिमेंटिक ड्रिफ्ट और लॉजिकल डैटीरियोरेशन को रोकने के लिए आइडेंटिटी-ग्राउंडेड रिट्रीवल-ऑगमेंटेड जनरेशन और ह्यूरिस्टिक थ्योरी ऑफ माइंड को संयोजित करता है, जिससे रणनीतिक रूप से प्रतिकूल द्वंद्वात्मक अंतःक्रियाओं के माध्यम से लचीली और उच्च-निष्ठा वाली नैतिक ट्यूटरिंग सक्षम होती है।

Jakub Masłowski, Jarosław A. Chudziak2026-03-31
🤖 machine learning

The Geometry of Harmful Intent: Training-Free Anomaly Detection via Angular Deviation in LLM Residual Streams

LatentBiopsy एक प्रशिक्षण-मुक्त विसंगति पहचान (anomaly detection) विधि है जो LLM रेसिडुअल स्ट्रीम्स में एक मानक संदर्भ दिशा से उनके कोणीय विचलन को मापकर हानिकारक प्रॉम्प्ट्स की पहचान करती है, और यह विभिन्न मॉडल वेरिएंट्स—जिनमें वे भी शामिल हैं जिनसे रिफ्यूज़ल मैकेनिज्म को सर्जिकल रूप से हटाया गया है—के बीच हानिकारक इरादे और संरेखण व्यवहारों के बीच ज्यामितीय पृथक्करण का लाभ उठाते हुए उच्च सटीकता प्राप्त करती है।

Isaac Llorente-Saguer2026-03-31
💬 NLP

Improving Attributed Long-form Question Answering with Intent Awareness

यह शोध पत्र एक इरादा-जागरूक (intent-aware) ढांचे का प्रस्ताव करता है जो अंतर्निहित लेखक के इरादों को निकालने के लिए संरचित टैग-आधारित योजनाओं का उपयोग करता है, जिससे बड़े और छोटे दोनों प्रकार के भाषा मॉडलों द्वारा उत्पन्न लंबे वैज्ञानिक रिपोर्टों की गुणवत्ता, उद्धरण सटीकता और पठनीयता में महत्वपूर्ण सुधार होता है।

Xinran Zhao, Aakanksha Naik, Jay DeYoung, Joseph Chee Chang, Jena D. Hwang, Tongshuang Wu, Varsha Kishore2026-03-31
💬 NLP

Multi-Agent Dialectical Refinement for Enhanced Argument Classification

यह शोध पत्र MAD-ACC प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त बहु-एजेंट फ्रेमवर्क है जो तर्क खनन (argument mining) में संरचनात्मक अस्पष्टताओं को हल करने के लिए एक समर्थक-विरोधी-न्यायाधीश (Proponent-Opponent-Judge) द्वंद्वात्मक बहस का उपयोग करता है, जो UKP स्टूडेंट एसेज कॉर्पस पर एकल-एजेंट बेसलाइन की तुलना में बेहतर वर्गीकरण सटीकता और व्याख्यात्मकता प्राप्त करता है।

Jakub Bąba, Jarosław A. Chudziak2026-03-31
💬 NLP

AgentSwing: Adaptive Parallel Context Management Routing for Long-Horizon Web Agents

यह शोध पत्र AgentSwing को प्रस्तुत करता है, जो एक स्टेट-अवेयर (state-aware) एडेप्टिव फ्रेमवर्क है जो लॉन्ग-होराइजन वेब एजेंट प्रदर्शन को गतिशील रूप से अनुकूलित करने के लिए पैरेलल कॉन्टेक्स्ट मैनेजमेंट और लुकअहेड राउटिंग का उपयोग करता है, जो स्टैटिक कॉन्टेक्स्ट मैनेजमेंट रणनीतियों से बेहतर प्रदर्शन करते हुए इंटरैक्शन टर्न्स को महत्वपूर्ण रूप से कम करता है।

Zhaopeng Feng, Liangcai Su, Zhen Zhang, Xinyu Wang, Xiaotian Zhang, Xiaobin Wang, Runnan Fang, Qi Zhang, Baixuan Li, Shi (…)2026-03-31
💬 NLP

Over-Refusal and Representation Subspaces: A Mechanistic Analysis of Task-Conditioned Refusal in Aligned LLMs

यह शोध पत्र एक यांत्रिक विश्लेषण प्रदान करता है जो यह प्रकट करता है कि जबकि हानिकारक इनकार (harmful refusal) एक एकल वैश्विक वेक्टर द्वारा नियंत्रित होता है, अति-इनकार (over-refusal) सौहार्दपूर्ण कार्य समूहों (benign task clusters) के भीतर कार्य-निर्भर, उच्च-आयामी उप-स्थानों (higher-dimensional subspaces) से उत्पन्न होता है, जो यह स्पष्ट करता है कि वैश्विक एब्लेशन (global ablation) क्यों विफल रहता है और कार्य-विशिष्ट ज्यामितिक हस्तक्षेपों (task-specific geometric interventions) को क्यों आवश्यक बनाता है।

Utsav Maskey, Mark Dras, Usman Naseem2026-03-31