💬 NLP

BlasBench: An Open Benchmark for Irish Speech Recognition

यह शोध पत्र BlasBench को प्रस्तुत करता है, जो आयरिश भाषण पहचान के लिए पहला खुला बेंचमार्क है जो एक आयरिश-जागरूक मूल्यांकन प्रोटोकॉल का उपयोग करता है ताकि 12 ASR प्रणालियों के बीच महत्वपूर्ण सामान्यीकरण अंतराल और प्रदर्शन असमानताओं को प्रकट किया जा सके, जिसमें यह निष्कर्ष भी शामिल है कि सभी Whisper वेरिएंट 100% से अधिक शब्द त्रुटि दर (Word Error Rate) को पार कर जाते हैं।

Jyoutir Raj, John Conway2026-04-14
💬 NLP

RCBSF: A Multi-Agent Framework for Automated Contract Revision via Stackelberg Game

यह शोध पत्र रिस्क-कंस्ट्रेंड बाइलेवल स्टैकेलबर्ग फ्रेमवर्क (RCBSF) का प्रस्ताव करता है, जो एक मल्टी-एजेंट सिस्टम है जो सुरक्षा बाधाओं को लागू करने और 84.21% की रिस्क रेजोल्यूशन रेट के साथ अत्याधुनिक प्रदर्शन प्राप्त करने के लिए स्वचालित अनुबंध संशोधन को एक गैर-सहकारी स्टैकेलबर्ग गेम के रूप में मॉडल करता है।

Shijia Xu, Yu Wang, Xiaolong Jia, Zhou Wu, Kai Liu, April Xiaowen Dong2026-04-14
💬 NLP

Do BERT Embeddings Encode Narrative Dimensions? A Token-Level Probing Analysis of Time, Space, Causality, and Character in Fiction

यह अध्ययन प्रदर्शित करता है कि BERT एम्बेडिंग्स फिक्शन (कथा साहित्य) में समय, स्थान, कार्य-कारणता और पात्रों के संबंध में अर्थपूर्ण टोकन-स्तरीय जानकारी को एनकोड करती हैं, जैसा कि एक उच्च-सटीकता वाले लीनियर प्रोब द्वारा प्रमाणित होता है जो रैंडम बेसलाइन से काफी बेहतर प्रदर्शन करता है, हालांकि आयाम विविक्त रूप से विभाज्य नहीं हैं और "बाउंड्री लीकेज" से ग्रस्त हैं जहाँ दुर्लभ श्रेणियों को अक्सर "अन्य" के रूप में गलत वर्गीकृत किया जाता है।

Beicheng Bei, Hannah Hyesun Chun, Chen Guo, Arwa Saghiri2026-04-14
💬 NLP

When Meaning Isn't Literal: Exploring Idiomatic Meaning Across Languages and Modalities

यह शोध पत्र "Mediom" नामक 3,533 मुहावरों के एक बहुभाषी बहुविध (multilingual multimodal) संग्रह और "HIDE" नामक एक संकेत-आधारित ढांचे को प्रस्तुत करता है, जो टेक्स्ट और इमेज मोडैलिटीज के माध्यम से सांस्कृतिक रूप से निहित, गैर-शाब्दिक मुहावरेदार तर्क को समझने में वर्तमान एआई मॉडलों की व्यवस्थित विफलताओं को संबोधित करने और सुधारने के लिए है।

Sarmistha Das, Shreyas Guha, Suvrayan Bandyopadhyay, Salisa Phosit, Kitsuchart Pasupa, Sriparna Saha2026-04-14
💬 NLP

Position-Agnostic Pre-Projection for Transformer Attention: Nonlinear Feature Construction and Content Skip Before Q/K/V

यह शोध पत्र एक पोजीशन-अग्नोस्टिक (position-agnostic) नॉनलीनियर प्री-प्रोजेक्शन और एक कंटेंट स्किप कनेक्शन पेश करता है जो अटेंशन मैकेनिज्म को बायपास करता है, जिससे K/V कैश ओवरहेड बढ़ाए बिना पायथिया (Pythia) मॉडल्स पर फ्रोजन-प्रोब प्रयोगों में महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Chirag Shinde2026-04-14
💬 NLP

Advancing Polish Language Modeling through Tokenizer Optimization in the Bielik v3 7B and 11B Series

यह शोध पत्र Bielik v3 7B और 11B मॉडलों को प्रस्तुत करता है, जो यूनिवर्सल टोकनाइज़र के स्थान पर एक समर्पित, अनुकूलित शब्दावली का उपयोग करके और FOCUS-आधारित इनिशियलाइज़ेशन, बहु-चरणीय प्रीट्रेनिंग और उन्नत अलाइनमेंट तकनीकों सहित एक व्यापक प्रशिक्षण पाइपलाइन को नियोजित करके पोलिश भाषा के लिए महत्वपूर्ण प्रदर्शन सुधार प्राप्त करते हैं।

Krzysztof Ociepa, Łukasz Flis, Remigiusz Kinas, Krzysztof Wróbel, Adrian Gwoździej2026-04-14
💬 NLP

Speaking to No One: Ontological Dissonance and the Double Bind of Conversational AI

यह शोधपत्र तर्क देता है कि संवादात्मक एआई (conversational AI) के कुछ उपयोगकर्ताओं में भ्रमित करने वाले अनुभवों का जोखिम न केवल व्यक्तिगत भेद्यता या इंजीनियरिंग की खामियों से उपजा है, बल्कि उस अंतर्निहित "सत्तामीमांसीय विसंगति" (ontological dissonance) और "संवादात्मक दोहरी दुविधा" (communicative double bind) से उत्पन्न होता है जो एक ऐसे मानव और एक ऐसी एआई के बीच की अंतःक्रिया से निर्मित होती है जो संबंधपरक उपस्थिति की खोज कर रहा है और एक ऐसी एआई जो बिना किसी सक्षम विषय (subject) के उसका अनुकरण करती है जो इसे बनाए रखने में सक्षम हो।

Hugh Brosnahan, Izabela Lipinska2026-04-14
💬 NLP

OccuBench: Evaluating AI Agents on Real-World Professional Tasks via Language World Models

यह शोध पत्र OccuBench प्रस्तुत करता है, जो 65 विशिष्ट डोमेन में 100 वास्तविक-विश्व पेशेवर कार्यों के माध्यम से AI एजेंटों का मूल्यांकन करने के लिए लैंग्वेज वर्ल्ड मॉडल्स (Language World Models) का उपयोग करने वाला एक व्यापक बेंचमार्क है, जो यह प्रकट करता है कि कोई भी एकल मॉडल सभी उद्योगों पर हावी नहीं है, स्पष्ट त्रुटियों की तुलना में निहित डेटा दोष अधिक चुनौतियाँ पेश करते हैं, और प्रदर्शन मॉडल के आकार और तर्क संबंधी प्रयास के साथ बढ़ता है।

Xiaomeng Hu, Yinger Zhang, Fei Huang, Jianhong Tu, Yang Su, Lianghao Deng, Yuxuan Liu, Yantao Liu, Dayiheng Liu, Tsung-Y (…)2026-04-14
💬 NLP

AOP-Smart: A RAG-Enhanced Large Language Model Framework for Adverse Outcome Pathway Analysis

यह शोध पत्र AOP-Smart को प्रस्तुत करता है, जो एक रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) फ्रेमवर्क है जो आधिकारिक AOP-Wiki डेटा का लाभ उठाकर कई लार्ज लैंग्वेज मॉडल्स में एडवर्स आउटकम पाथवे (Adverse Outcome Pathway) विश्लेषण कार्यों के दौरान मतिभ्रम (hallucinations) को महत्वपूर्ण रूप से कम करता है और उत्तर की सटीकता को बढ़ाता है।

Qinjiang Niu, Lu Yan2026-04-14
⚡ electrical engineering

Audio Flamingo Next: Next-Generation Open Audio-Language Models for Speech, Sound, and Music

यह शोध पत्र ऑडियो फ्लेमिंगो नेक्स्ट (AF-Next) को प्रस्तुत करता है, जो एक अगली पीढ़ी का ओपन ऑडियो-लैंग्वेज मॉडल है जो एक मजबूत आधार, दस लाख घंटों से अधिक के क्यूरेटेड डेटा और एक नवीन टेम्पोरल ऑडियो चेन-ऑफ-थॉट प्रतिमान का लाभ उठाता है ताकि स्पीच, साउंड और म्यूजिक के बीच समझ और तर्क करने में अत्याधुनिक प्रदर्शन प्राप्त किया जा सके, जिसमें 30 मिनट तक के जटिल इनपुट शामिल हैं।

Sreyan Ghosh, Arushi Goel, Kaousheik Jayakumar, Lasha Koroshinadze, Nishit Anand, Zhifeng Kong, Siddharth Gururani, Sang (…)2026-04-14