💬 NLP

Using Machine Learning to Enhance the Detection of Obfuscated Abusive Words in Swahili: A Focus on Child Safety

यह अध्ययन बाल सुरक्षा के लिए अस्पष्ट (obfuscated) स्वाहिली भाषा के अपमानजनक शब्दों का पता लगाने हेतु SMOTE जैसी तकनीकों से अनुकूलित मशीन लर्निंग मॉडलों के अनुप्रयोग की जांच करता है, जबकि यह स्वीकार करता है कि वर्तमान निष्कर्ष डेटासेट के आकार और असंतुलन द्वारा सीमित हैं और बड़े डेटासेट तथा उन्नत तकनीकों से जुड़े भविष्य के कार्य का आह्वान करता है।

Phyllis Nabangi, Abdul-Jalil Zakaria, Jema David Ndibwile2026-02-17
💬 NLP

From Perceptions To Evidence: Detecting AI-Generated Content In Turkish News Media With A Fine-Tuned Bert Classifier

यह अध्ययन LLM द्वारा पुनर्गठित (rewriting) सामग्री का पता लगाने के लिए 3,600 लेखों पर एक BERT क्लासिफायर को फाइन-ट्यून करके, टर्किश समाचार मीडिया में AI-जनित सामग्री की पहली अनुभवजन्य जांच प्रस्तुत करता है, जो यह प्रकट करता है कि लगभग 2.5% परीक्षित सामग्री AI-संशोधित है और साथ ही मॉडल की उच्च सटीकता और सामयिक स्थिरता को प्रदर्शित करता है।

Ozancan Ozdemir2026-02-17
💬 NLP

DistillLens: Symmetric Knowledge Distillation Through Logit Lens

डिस्टिलल लेंस (DistillLens) एक सममित ज्ञान आसवन (knowledge distillation) ढांचे को पेश करता है जो 'लॉगिट लेंस' (Logit Lens) के माध्यम से हिडन स्टेट्स को वोकैबुलरी स्पेस में प्रोजेक्ट करके छात्र और शिक्षक मॉडलों की मध्यवर्ती विचार प्रक्रियाओं को संरेखित करता है, जिससे यह आवश्यक उच्च-एन्ट्रॉपी जानकारी को संरक्षित करते हुए निर्देश-अनुसरण बेंचमार्क पर मानक विधियों से बेहतर प्रदर्शन करता है।

Manish Dhakal, Uthman Jinadu, Anjila Budathoki, Rajshekhar Sunderraman, Yi Ding2026-02-17
💬 NLP

Rubrics as an Attack Surface: Stealthy Preference Drift in LLM Judges

यह शोध पत्र "रूब्रिक-इंड्यूस्ड प्रेफरेंस ड्रिफ्ट" (RIPD) की पहचान और प्रदर्शन करता है, जो एक गुप्त भेद्यता है जहाँ प्राकृतिक-भाषा मूल्यांकन रूब्रिक्स में स्पष्ट रूप से हानिरहित संपादन व्यवस्थित रूप से LLM जजों को लक्षित-डोमेन सटीकता को कम करने और डाउनस्ट्रीम अलाइनमेंट पाइपलाइनों के माध्यम से हानिकारक पूर्वाग्रहों को प्रसारित करने के लिए हेरफेर कर सकते हैं, भले ही वे संपादन मानक बेंचमार्क सत्यापन पास कर लें।

Ruomeng Ding, Yifei Pang, He Sun, Yizhong Wang, Zhiwei Steven Wu, Zhun Deng2026-02-17
💬 NLP

Building Autonomous GUI Navigation via Agentic-Q Estimation and Step-Wise Policy Optimization

यह शोध पत्र स्वायत्त GUI एजेंटों के लिए एक नवीन MLLM-केंद्रित ढांचे को प्रस्तुत करता है जो कुशल, स्व-जनित डेटा संग्रह और स्थिर सुदृढीकरण शिक्षण (reinforcement learning) को सक्षम करने के लिए एजेंटिक-Q अनुमान (agentic-Q estimation) और चरण-वार नीति अनुकूलन (step-wise policy optimization) को संयोजित करता है, जिससे Ovis2.5-9B मॉडल ने नेविगेशन और ग्राउंडिंग बेंचमार्क पर बड़े पैमाने के प्रतिस्पर्धियों को पछाड़ दिया है।

Yibo Wang, Guangda Huzhang, Yuwei Hu, Yu Xia, Shiyin Lu, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Lijun Zhang2026-02-17
💬 NLP

Metaphors' journeys across time and genre: tracking the evolution of literary metaphors with temporal embeddings

यह अध्ययन इतालवी कॉर्पोरा पर कालानुक्रमिक वितरण संबंधी अर्थविज्ञान (diachronic distributional semantics) का उपयोग करता है यह प्रकट करने के लिए कि जहाँ साहित्यिक रूपकों की प्रसंस्करण संबंधी मांगें समय के साथ स्थिर रही हैं, वहीं विधा (genre) रूपक की कठिनाई को महत्वपूर्ण रूप से प्रभावित करती है, जिसमें आधुनिक साहित्य उच्च प्रसंस्करण लागत प्रस्तुत करता है और समकालीन वेब भाषा अपने 19वीं शताब्दी के समकक्षों की तुलना में अधिक सुलभता प्रदान करती है।

Veronica Mangiaterra, Chiara Barattieri di San Pietro, Paolo Canal, Valentina Bambini2026-02-17
💬 NLP

Beyond Words: Evaluating and Bridging Epistemic Divergence in User-Agent Interaction via Theory of Mind

यह शोध पत्र LLM इंटरैक्शन में उपयोगकर्ता के विश्वासों और पर्यावरणीय अवस्थाओं के बीच के अंतर को संबोधित करने के लिए 'थ्योरी ऑफ माइंड' को एपिस्टेमिक डाइवर्जेंस रेजोल्यूशन (ज्ञान संबंधी विचलन समाधान) के एक तंत्र के रूप में औपचारिक रूप देता है, एक नया बेंचमार्क पेश करता है और एक सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) द्वारा प्रशिक्षित मॉडल प्रस्तुत करता है जो बेहतर विश्वास ट्रैकिंग और तर्क के माध्यम से कार्य प्रदर्शन में महत्वपूर्ण सुधार करता है।

Minyuan Ruan, Ziyue Wang, Kaiming Liu, Yunghwei Lai, Peng Li, Yang Liu2026-02-17
💬 NLP

Evaluating Prompt Engineering Techniques for RAG in Small Language Models: A Multi-Hop QA Approach

यह शोध पत्र एक बड़े पैमाने पर अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि प्रॉम्प्ट इंजीनियरिंग तकनीकों को अनुकूलित करना रिट्रीवल ऑगमेंटेड जनरेशन प्रणालियों में स्मॉल लैंग्वेज मॉडल्स के मल्टी-हॉप रीजनिंग प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है, जो मानक दृष्टिकोणों की तुलना में HotpotQA डेटासेट पर 84.5% तक की वृद्धि प्राप्त करता है।

Amir Hossein Mohammadi, Ali Moeinian, Zahra Razavizade, Afsaneh Fatemi, Reza Ramezani2026-02-17
💬 NLP

Pre-Editorial Normalization for Automatically Transcribed Medieval Manuscripts in Old French and Latin

यह शोध पत्र ओल्ड फ्रेंच और लैटिन पांडुलिपियों के पुरालेखीय रूप से सटीक और सामान्यीकृत डिजिटल संस्करणों के बीच के अंतर को पाटने के लिए प्री-एडिटोरियल नॉर्मलाइजेशन (PEN) के कार्य को प्रस्तुत करता है, जो एक नया डेटासेट और एक ByT5-आधारित मॉडल पेश करता है जो कच्चे ऑटोमैटिक टेक्स्ट रिकग्निशन आउटपुट को उपयोगी, सामान्यीकृत टेक्स्ट में बदलने में अत्याधुनिक प्रदर्शन प्राप्त करता है।

Thibault Clérice, Rachel Bawden, Anthony Glaise, Ariane Pinche, David Smith2026-02-17
💬 NLP

MarsRetrieval: Benchmarking Vision-Language Models for Planetary-Scale Geospatial Retrieval on Mars

यह शोध पत्र MarsRetrieval प्रस्तुत करता है, जो मंगल ग्रह पर टेक्स्ट-निर्देशित भू-स्थानिक खोज (geospatial discovery) के लिए विजन-लैंग्वेज मॉडल्स का मूल्यांकन करने और उन्हें सुधारने के लिए डिज़ाइन किया गया एक व्यापक बेंचमार्क और एकीकृत प्रोटोकॉल है, जो मंगल की भू-आकृतिक विशिष्टताओं (geomorphic distinctions) को पकड़ने में वर्तमान फाउंडेशन मॉडल्स की सीमाओं को दूर करने के लिए डोमेन-विशिष्ट फाइन-ट्यूनिंग की महत्वपूर्ण आवश्यकता पर प्रकाश डालता है।

Shuoyuan Wang, Yiran Wang, Hongxin Wei2026-02-17