💬 NLP

LaViSA: A Language and Vision Structural Ambiguity Benchmark

यह शोध पत्र LaViSA को प्रस्तुत करता है, जो सात श्रेणियों में अस्पष्ट वाक्यों और उनके संगत स्पष्टीकरण देने वाले चित्रों से बना एक बेंचमार्क है, ताकि संरचनात्मक अस्पष्टता को हल करने की विजन-लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन किया जा सके, जिससे यह पता चलता है कि हालांकि वर्तमान मॉडल कुछ क्षमता प्रदर्शित करते हैं, फिर भी वे विशिष्ट अस्पष्टता प्रकारों और सूक्ष्म दृश्य अंतरों के साथ संघर्ष करते हैं।

Lee Sangmyeong, Shun Inadumi, Koichiro Yoshino2026-06-19
🤖 AI

Uncertainty Decomposition for Clarification Seeking in LLM Agents

यह शोध पत्र इंटरैक्टिव LLM एजेंटों के लिए शास्त्रीय अनिश्चितता ढांचों की सीमाओं को संबोधित करते हुए एक प्रॉम्प्ट-आधारित अपघटन प्रस्तावित करता है जो सक्रिय स्पष्टीकरण चाहने में सक्षम करने के लिए क्रिया आत्मविश्वास (action confidence) को अनुरोध अनिश्चितता (request uncertainty) से अलग करता है, जो कई मॉडल बैकबोन पर जानबूझकर कम-निर्दिष्ट कार्यों वाले बेंचमार्क पर मौजूदा विधियों से काफी बेहतर प्रदर्शन करता है।

Gregory Matsnev2026-06-19
🤖 AI

Toten: Knowledge-Based Ontological Tokenization Of Physical Quantities And Technical Notation In Brazilian Portuguese

यह शोध पत्र TOTEN को प्रस्तुत करता है, जो ब्राज़ीलियाई पुर्तगाली के लिए एक ज्ञान-आधारित ऑन्टोलॉजिकल टोकनाइज़ेशन ढांचा है, जो भौतिक मात्राओं और तकनीकी संकेतन की अर्थ संबंधी और संरचनात्मक अखंडता को बनाए रखने के लिए सांख्यिकीय रूप से व्युत्पन्न उपशब्दों (subwords) को एक घोषणात्मक, ऑन्टोलॉजी-संचालित दृष्टिकोण से प्रतिस्थापित करता है, जो यूनिट परमाणुता (unit atomicity) और संख्यात्मक पुनर्निर्माण में अत्याधुनिक बेसलाइन की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Antonio de Sousa Leitão Filho; Allan Kardec Duailibe Barros Filho; Fabrício Saul Lima; Selby Mykael Lima dos Santos; Rej (…)2026-06-19
💬 NLP

Before the Labels: How Dataset Construction Shapes Suicidality Detection in Clinical Text

यह शोध पत्र तर्क देता है कि नैदानिक (क्लिनिकल) एनएलपी मॉडल आत्महत्या की प्रवृत्ति का पता लगाने के लिए अक्सर डेटासेट लेबल को ही सत्य (ग्राउंड ट्रुथ) मानकर गलत व्याख्या करते हैं, और इस बात की अनदेखी करते हैं कि ScAN जैसे डेटासेट्स में निर्माण संबंधी विकल्प कैसे आत्महत्या की विशिष्ट और सीमित परिचालन परिभाषाओं (ऑपरेशनलाइजेशन) को समाहित करते हैं जो नैदानिक अस्पष्टता और विषमता को ओझल कर देते हैं।

Priyanshi Garg, Ishita Rao, Jieqiong Ding, Amandalynne Paullada2026-06-19
💬 NLP

MiqraBERT: Regression-Based Sentence-BERT Finetuning for Biblical Hebrew Parallel Detection

यह शोधपत्र MiqraBERT प्रस्तुत करता है, जो बाइबिलल हिब्रू (Biblical Hebrew) पर फाइनट्यून किया गया एक Sentence-BERT मॉडल है, जो सिमेंटिक समानता के माध्यम से नैरेटिव टेक्स्ट के पुनरावृत्ति का पता लगाने में महत्वपूर्ण सुधार करता है, हालांकि यह काव्य समानांतरता (poetic parallels) की पहचान करने के लिए कम प्रभावी बना रहता है।

David M. Smiley2026-06-19
💬 NLP

Creating Multilingual Mental Health Dialogue Datasets: Limits of Persona-Based Localization via Nationality and Language

यह शोध पत्र यह प्रदर्शित करता है कि अंग्रेजी-केंद्रित व्यक्तित्वों (पर्सोना) में केवल राष्ट्रीयता और भाषा के मापदंडों को संशोधित करना नैदानिक रूप से सुसंगत बहुभाषी मानसिक स्वास्थ्य डेटासेट उत्पन्न करने में विफल रहता है, जो विभिन्न भाषाओं में अवसाद की गंभीरता का सटीक आकलन करने में वर्तमान एलएलएम (LLM) की क्षमता की महत्वपूर्ण सीमाओं को उजागर करता है और सांस्कृतिक रूप से उत्तरदायी डेटा पीढ़ी विधियों की तत्काल आवश्यकता को रेखांकित करता है।

Yunkai Xu, Saeed Abdullah2026-06-19
💬 NLP

From 50K to 8.2 Million in 24 Hours: Vozinha's Algorithmic Consecration and the Multilingual Making of World Cup Visibility

यह शोध पत्र 2026 के विश्व कप के बाद के केप वर्डी के गोलकीपर वोज़िन्हा के एल्गोरिद्मिक पवित्रीकरण के निर्माण को भाषा द्वारा कैसे निर्मित किया गया, इसका एक बहुभाषी कम्प्यूटेशनल विमर्श विश्लेषण प्रस्तुत करता है, जिसमें उनके अनुयायी संख्या के 50 हज़ार से 8.2 मिलियन तक बढ़ने के इर्द-गिर्द वैश्विक दृश्यता को जुटाने वाले विशिष्ट भाषाई ढांचों को प्रदर्शित करने के लिए एक नए संग्रह (कोरस) और नैरेटिव वर्गीकरण का उपयोग किया गया है।

Vinicius Covas2026-06-19
💬 NLP

SAGE-OPD: Selective Agent-Guided Intervention for Multi-Turn On-Policy Distillation

यह शोध पत्र SAGE-OPD का प्रस्ताव करता है, जो मल्टी-टर्न ऑन-पॉलिसी डिस्टिलेशन के लिए एक वर्िफायर-फ्री फ्रेमवर्क है, जो एनवायरनमेंट फीडबैक और टीचर कॉन्फिडेंस के आधार पर स्टूडेंट रिस्पॉन्स में चुनिंदा रूप से हस्तक्षेप करता है और लॉस नॉर्मलाइजेशन लागू करता है, जिससे एरर कंपाउंडिंग को कम किया जा सके और मानक विधियों की तुलना में महत्वपूर्ण प्रदर्शन लाभ प्राप्त किया जा सके।

Yuhang Zhou, Lizhu Zhang, Yifan Wu, Mingyi Wang, Bo Peng, Jiayi Liu, Xiangjun Fan, Zhuokai Zhao2026-06-19
💬 NLP

A Layered Security Framework Against Prompt Injection in RAG-Based Chatbots

यह शोध पत्र एक मॉडल-अज्ञेय (model-agnostic), तीन-स्तरीय सुरक्षा ढांचे का प्रस्ताव करता है जो इनपुट की स्क्रीनिंग करने, उत्पत्ति-आधारित निर्देश पदानुक्रमों (provenance-based instruction hierarchies) को लागू करने और आउटपुट का ऑडिट करने के माध्यम से RAG-आधारित चैटबॉट्स में प्रत्यक्ष और अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन हमलों को प्रभावी ढंग से कम करता है, जिससे कम विलंबता (latency) और कम फाल्स पॉजिटिव दरों को बनाए रखते हुए हमले की सफलता दर को 71.4% से घटाकर 11.3% कर दिया गया है।

Gulshan Saleem, Nisar Ahmed, Muhammad Imran Zaman, Ali Hassan2026-06-19
🤖 machine learning

Efficiently Representing Algorithms With Chain-of-Thought Transformers

यह शोध पत्र प्रदर्शित करता है कि चेन-ऑफ-थॉट ट्रांसफॉर्मर केवल पॉली-लॉगैरिद्मिक ओवरहेड के साथ वर्ड रैम एल्गोरिदम का कुशलतापूर्वक अनुकरण कर सकते हैं, जो ट्यूरिंग मशीन सिमुलेशन के लिए आवश्यक द्विघात (क्वाड्रेटिक) ओवरहेड से काफी बेहतर प्रदर्शन करता है।

Yanhong Li, Anej Svete, Ashish Sabharwal, William Merrill2026-06-19