💬 NLP

Detecting RAG Extraction Attack via Dual-Path Runtime Integrity Game

यह शोधपत्र CanaryRAG को प्रस्तुत करता है, जो एक प्लग-एंड-प्ले रनटाइम रक्षा तंत्र है जो रिट्रीव किए गए चंक्स (chunks) में कैनरी टोकन को एम्बेड करता है और बिना मॉडल रिट्रेनिंग की आवश्यकता के या प्रदर्शन को प्रभावित किए बिना, रीयल टाइम में RAG एक्सट्रैक्शन हमलों का पता लगाने और उन्हें कम करने के लिए एक ड्यूल-पाथ इंटीग्रिटी गेम का उपयोग करता है।

Yuanbo Xie, Yingjie Zhang, Yulin Li, Shouyou Song, Xiaokun Chen, Zhihan Liu, Liya Su, Tingwen Liu2026-04-14
🤖 AI

Teaching Language Models How to Code Like Learners: Conversational Serialization for Student Simulation

यह शोध पत्र टेम्पोरल प्रोसेस लॉग्स को संवादात्मक संवादों में बदलकर और एक सुपरवाइज्ड फाइन-ट्यूनिंग प्लस प्रेफरेंस ऑप्टिमाइजेशन पाइपलाइन लागू करके, ओपन-वेट लैंग्वेज मॉडल्स को छात्र प्रोग्रामिंग व्यवहार का अनुकरण करने के लिए प्रशिक्षित करने की एक विधि प्रस्तावित करता है, जो कोड-ओनली दृष्टिकोणों और प्रॉम्प्टेड बेसलाइन्स की तुलना में मॉडल्स की प्रामाणिक डिबगिंग पैटर्न को दोहराने की क्षमता में महत्वपूर्ण सुधार करता है।

Charles Koutcheme, Arto Hellas, Juho Leinonen2026-04-14
💬 NLP

Expect the Unexpected? Testing the Surprisal of Salient Entities

यह शोध पत्र यह प्रदर्शित करके 'यूनिफॉर्म इन्फॉर्मेशन डेंसिटी' (Uniform Information Density) परिकल्पना को चुनौती देता है कि विमर्श (discourse) में वैश्विक रूप से प्रमुख संस्थाएं (globally salient entities) गैर-प्रमुख संस्थाओं की तुलना में काफी अधिक सर्प्राइज़ल (surprisal) प्रदर्शित करती हैं, जबकि साथ ही वे आसपास की सामग्री के सर्प्राइज़ल को कम भी करती हैं, जिससे यह स्पष्ट होता है कि वैश्विक संस्थागत प्रमुखता (global entity salience) विभिन्न शैलियों में सूचना वितरण को आकार देने वाला एक प्रमुख तंत्र है।

Jessica Lin, Amir Zeldes2026-04-14
💬 NLP

Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models

यह शोध पत्र व्यवस्थित रूप से प्रदर्शित करता है कि रोल-प्लेइंग भाषा मॉडलों में, उच्च व्यक्तित्व अनुकूलता (persona agreeableness) महत्वपूर्ण रूप से बढ़े हुए चाटुकारिता व्यवहार (sycophantic behavior) की भविष्यवाणी करती है, जो व्यक्तित्व लक्षणों और तथ्यात्मक सटीकता के बजाय उपयोगकर्ता के सत्यापन को प्राथमिकता देने की प्रवृत्ति के बीच एक महत्वपूर्ण संबंध को उजागर करती है।

Arya Shah, Deepali Mishra, Chaklam Silpasuwanchai2026-04-14
💬 NLP

Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS

यह शोध पत्र सेल्फ-करेक्टिंग RAG का प्रस्ताव करता है, जो एक एकीकृत ढांचा है जो संदर्भ चयन को एक बहु-आयामी मल्टीपल-चॉइस नैपसैक समस्या के रूप में पुनर्गठित करके और जनरेट किए गए उत्तरों को गतिशील रूप से मान्य करने के लिए NLI-निर्देशित मोंटे कार्लो ट्री सर्च का उपयोग करके जटिल तर्क कार्यों में निष्ठा (faithfulness) को बढ़ाता है, जिससे सटीकता में उल्लेखनीय सुधार होता है और मतिभ्रम (hallucinations) कम होता है।

Shijia Xu, Zhou Wu, Xiaolong Jia, Yu Wang, Kai Liu, April Xiaowen Dong2026-04-14
💬 NLP

BlasBench: An Open Benchmark for Irish Speech Recognition

यह शोध पत्र BlasBench को प्रस्तुत करता है, जो आयरिश भाषण पहचान के लिए पहला खुला बेंचमार्क है जो एक आयरिश-जागरूक मूल्यांकन प्रोटोकॉल का उपयोग करता है ताकि 12 ASR प्रणालियों के बीच महत्वपूर्ण सामान्यीकरण अंतराल और प्रदर्शन असमानताओं को प्रकट किया जा सके, जिसमें यह निष्कर्ष भी शामिल है कि सभी Whisper वेरिएंट 100% से अधिक शब्द त्रुटि दर (Word Error Rate) को पार कर जाते हैं।

Jyoutir Raj, John Conway2026-04-14
💬 NLP

RCBSF: A Multi-Agent Framework for Automated Contract Revision via Stackelberg Game

यह शोध पत्र रिस्क-कंस्ट्रेंड बाइलेवल स्टैकेलबर्ग फ्रेमवर्क (RCBSF) का प्रस्ताव करता है, जो एक मल्टी-एजेंट सिस्टम है जो सुरक्षा बाधाओं को लागू करने और 84.21% की रिस्क रेजोल्यूशन रेट के साथ अत्याधुनिक प्रदर्शन प्राप्त करने के लिए स्वचालित अनुबंध संशोधन को एक गैर-सहकारी स्टैकेलबर्ग गेम के रूप में मॉडल करता है।

Shijia Xu, Yu Wang, Xiaolong Jia, Zhou Wu, Kai Liu, April Xiaowen Dong2026-04-14
💬 NLP

Do BERT Embeddings Encode Narrative Dimensions? A Token-Level Probing Analysis of Time, Space, Causality, and Character in Fiction

यह अध्ययन प्रदर्शित करता है कि BERT एम्बेडिंग्स फिक्शन (कथा साहित्य) में समय, स्थान, कार्य-कारणता और पात्रों के संबंध में अर्थपूर्ण टोकन-स्तरीय जानकारी को एनकोड करती हैं, जैसा कि एक उच्च-सटीकता वाले लीनियर प्रोब द्वारा प्रमाणित होता है जो रैंडम बेसलाइन से काफी बेहतर प्रदर्शन करता है, हालांकि आयाम विविक्त रूप से विभाज्य नहीं हैं और "बाउंड्री लीकेज" से ग्रस्त हैं जहाँ दुर्लभ श्रेणियों को अक्सर "अन्य" के रूप में गलत वर्गीकृत किया जाता है।

Beicheng Bei, Hannah Hyesun Chun, Chen Guo, Arwa Saghiri2026-04-14
💬 NLP

When Meaning Isn't Literal: Exploring Idiomatic Meaning Across Languages and Modalities

यह शोध पत्र "Mediom" नामक 3,533 मुहावरों के एक बहुभाषी बहुविध (multilingual multimodal) संग्रह और "HIDE" नामक एक संकेत-आधारित ढांचे को प्रस्तुत करता है, जो टेक्स्ट और इमेज मोडैलिटीज के माध्यम से सांस्कृतिक रूप से निहित, गैर-शाब्दिक मुहावरेदार तर्क को समझने में वर्तमान एआई मॉडलों की व्यवस्थित विफलताओं को संबोधित करने और सुधारने के लिए है।

Sarmistha Das, Shreyas Guha, Suvrayan Bandyopadhyay, Salisa Phosit, Kitsuchart Pasupa, Sriparna Saha2026-04-14
💬 NLP

Position-Agnostic Pre-Projection for Transformer Attention: Nonlinear Feature Construction and Content Skip Before Q/K/V

यह शोध पत्र एक पोजीशन-अग्नोस्टिक (position-agnostic) नॉनलीनियर प्री-प्रोजेक्शन और एक कंटेंट स्किप कनेक्शन पेश करता है जो अटेंशन मैकेनिज्म को बायपास करता है, जिससे K/V कैश ओवरहेड बढ़ाए बिना पायथिया (Pythia) मॉडल्स पर फ्रोजन-प्रोब प्रयोगों में महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Chirag Shinde2026-04-14