💬 NLP

Scripts Through Time: A Survey of the Evolving Role of Transliteration in NLP

यह शोध पत्र क्रॉस-लिंगुअल एनएलपी (NLP) के लिए लिपि बाधाओं को दूर करने में लिप्यंतरण (ट्रांसलिटेरेशन) की भूमिका पर एक व्यापक सर्वेक्षण प्रस्तुत करता है, जो प्रेरणाओं का एक वर्गीकरण, विकसित होते तरीकों और समझौतों (ट्रेड-ऑफ) का विश्लेषण, और विभिन्न कार्यों एवं संसाधन सीमाओं के तहत लिप्यंतरण रणनीतियों को लागू करने के लिए शोधकर्ताओं हेतु व्यावहारिक सिफारिशें प्रदान करता है।

Thanmay Jayakumar, Deepon Halder, Raj Dabre2026-04-22
💬 NLP

Investigating Counterfactual Unfairness in LLMs towards Identities through Humor

यह शोध पत्र इस बात का विश्लेषण करके बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) में प्रतितथ्यात्मक अनैतिकता (काउंटरफैक्चुअल अनफेयरनेस) की जांच करता है कि कैसे वक्ता और लक्ष्य की पहचान बदलने पर हास्य प्रतिक्रियाएं बदल जाती हैं, जो यह प्रकट करता है कि मॉडल हाशिए पर मौजूद समूहों की तुलना में विशेषाधिकार प्राप्त वक्ताओं द्वारा सुनाए गए चुटकुलों को व्यवस्थित रूप से अस्वीकार करते हैं, उन्हें दुर्भावनापूर्ण मानते हैं और उन्हें अधिक हानिकारक के रूप में रेट करते हैं।

Shubin Kim, Yejin Son, Junyeong Park, Keummin Ka, Seungbeen Lee, Jaeyoung Lee, Hyeju Jang, Alice Oh, Youngjae Yu2026-04-22
🤖 machine learning

Towards Understanding the Robustness of Sparse Autoencoders

यह शोध पत्र प्रदर्शित करता है कि अनुमान के समय (inference time) ट्रांसफॉर्मर रेसिडुअल स्ट्रीम्स में प्रीट्रेंड स्पार्स ऑटोएनकोडर्स (Sparse Autoencoders) को एकीकृत करना, ऑप्टिमाइज़ेशन ज्योमेट्री को पुनर्गठित करके व्हाइट-बॉक्स और ब्लैक-बॉक्स दोनों प्रकार के जेलब्रेक हमलों के विरुद्ध LLM की मजबूती को महत्वपूर्ण रूप से बढ़ाता है, जिससे हमले की सफलता दर में 5 गुना तक की कमी आती है और स्पर्सिटी (sparsity) एवं रक्षा प्रभावकारिता के बीच एक मोनोटोनिक संबंध प्रकट होता है।

Ahson Saiyed, Sabrina Sadiekh, Chirag Agarwal2026-04-22
💬 NLP

Syntax as a Rosetta Stone: Universal Dependencies for In-Context Coptic Translation

यह शोध पत्र कम-संसाधन वाले कॉप्टिक-से-अंग्रेजी अनुवाद के लिए एक नवीन इन-कॉन्टेक्स्ट लर्निंग दृष्टिकोण प्रस्तावित करता है जो यूनिवर्सल डिपेंडेंसीज़ पार्स से प्राप्त वाक्यात्मक जानकारी के साथ रिट्रीव्ड द्विभाषी डिक्शनरी ग्लॉस (glosses) को जोड़ता है, और यह प्रदर्शित करते हुए नए स्टेट-ऑफ-द-आर्ट परिणाम प्राप्त करता है कि यह हाइब्रिड विधि किसी भी अकेले संसाधन का उपयोग करने की तुलना में बेहतर प्रदर्शन करती है।

Abhishek Purushothama, Emma Thronson, Alexia Guo, Amir Zeldes2026-04-22
💬 NLP

An Empirical Study of Multi-Generation Sampling for Jailbreak Detection in Large Language Models

यह शोध पत्र अनुभवजन्य रूप से प्रदर्शित करता है कि मध्यम बहु-पीढ़ी नमूनाकरण (multi-generation sampling) बड़े भाषा मॉडलों में जेलब्रेक डिटेक्शन में महत्वपूर्ण सुधार करता है क्योंकि यह उन छिपी हुई कमजोरियों को प्रकट करता है जिन्हें एकल-आउटपुट मूल्यांकन चूक जाते हैं, साथ ही यह भी दर्शाता है कि डिटेक्शन संकेत मॉडलों के बीच आंशिक रूप से सामान्यीकृत होते हैं और लेक्सिकल डिटेक्टर व्यवहार संबंधी और विषय-विशिष्ट संकेतों दोनों को कैप्चर करते हैं।

Hanrui Luo, Shreyank N Gowda2026-04-22
💬 NLP

Mango: Multi-Agent Web Navigation via Global-View Optimization

मैंगो (Mango) एक मल्टी-एजेंट वेब नेविगेशन फ्रेमवर्क है जो मल्टी-आर्म्ड बैंडिट दृष्टिकोण के माध्यम से इष्टतम शुरुआती यूआरएल (URLs) को गतिशील रूप से चुनकर और एपिसोडिक मेमोरी का लाभ उठाकर अन्वेषण दक्षता को अनुकूलित करता है, जिससे वेबवॉयेजर (WebVoyager) और वेबवॉकरक्यूए (WebWalkerQA) बेंचमार्क पर अत्याधुनिक सफलता दर प्राप्त होती है।

Weixi Tong, Yifeng Di, Tianyi Zhang2026-04-22
💬 NLP

Experiments or Outcomes? Probing Scientific Feasibility in Large Language Models

यह शोध पत्र वैज्ञानिक व्यवहार्यता मूल्यांकन पर बड़े भाषा मॉडलों का मूल्यांकन करता है, जिसमें यह पाया गया है कि प्रयोगात्मक विवरण प्रदान करने की तुलना में प्रयोगात्मक परिणाम साक्ष्य प्रदान करना सामान्य रूप से सटीकता और मजबूती को अधिक प्रभावी ढंग से सुधारता है, जो अधूरा संदर्भ होने पर प्रदर्शन को कम कर सकता है।

Seyedali Mohammadi, Manas Gaur, Francis Ferraro2026-04-22
🤖 AI

Human-Guided Harm Recovery for Computer Use Agents

यह शोध पत्र एक मानव-निर्देशित हानि रिकवरी फ्रेमवर्क पेश करके कंप्यूटर का उपयोग करने वाले एजेंटों में होने वाली क्षति के उपचार की महत्वपूर्ण चुनौती को संबोधित करता है, जो एजेंटों को हानिकारक अवस्थाओं से वापस सुरक्षित अवस्थाओं की ओर प्रभावी ढंग से मोड़ने के लिए एक प्राथमिकता-संरेखित रिवॉर्ड मॉडल और बैकबेंच (BackBench) बेंचमार्क का उपयोग करता है।

Christy Li, Sky CH-Wang, Andi Peng, Andreea Bobu2026-04-22
💬 NLP

LegalBench-BR: A Benchmark for Evaluating Large Language Models on Brazilian Legal Decision Classification

यह शोध पत्र लीगलबेंच-बीआर (LegalBench-BR) को प्रस्तुत करता है, जो 3,105 एनोटेटेड अपीलीय कार्यवाहियों का उपयोग करके ब्राज़ीलियाई कानूनी निर्णय वर्गीकरण के लिए पहला सार्वजनिक बेंचमार्क है, जो यह प्रदर्शित करता है कि एक LoRA-फाइन-ट्यून किया गया BERT मॉडल सटीकता और डोमेन-विशिष्ट भेदभाव में अग्रणी वाणिज्यिक लार्ज लैंग्वेज मॉडल्स की तुलना में काफी बेहतर प्रदर्शन करता है और साथ ही सिविल लॉ के प्रति व्यवस्थित पूर्वाग्रहों को समाप्त करता है।

Pedro Barbosa de Carvalho Neto2026-04-22
💬 NLP

Less Is More: Cognitive Load and the Single-Prompt Ceiling in LLM Mathematical Reasoning

यह शोध पत्र SAIR इक्वेशनल थ्योरीज प्रतियोगिता में औपचारिक गणितीय तर्क के लिए प्रॉम्प्ट इंजीनियरिंग का एक व्यवस्थित अध्ययन प्रस्तुत करता है, जो एक "सिंगल-प्रॉम्ट सीलिंग" को प्रकट करता है जहाँ गणितीय अनिश्चितता और मॉडल-विशिष्ट सीमाओं के कारण सटीकता लगभग 60-79% पर स्थिर हो जाती है, बावजूद इसके कि एक अनुकूलित 2,252-बाइट प्रॉम्प्ट के माध्यम से बेसलाइन की तुलना में 19.5 प्रतिशत अंक का सुधार प्राप्त किया गया है।

Manuel Israel Cazares2026-04-22