💬 NLP

KazByte: Adapting Qwen models to Kazakh via Byte-level Adapter

KazByte ने Qwen2.5-7B के लिए एक दो-चरणीय अनुकूलन विधि का प्रस्ताव दिया है जो टोकनाइज़र को बायपास करने के लिए कच्चे कज़ाख टेक्स्ट के साथ इंटरफेस करने हेतु एक बाइट-स्तरीय एडेप्टर का उपयोग करती है, जिसका लक्ष्य टोकनाइज़ेशन की अक्षमताओं को दूर करना और कज़ाख बेंचमार्क पर प्रदर्शन में सुधार करना है।

Rauan Akylzhanov2026-03-31
💬 NLP

HumMusQA: A Human-written Music Understanding QA Benchmark Dataset

यह शोध पत्र HumMusQA प्रस्तुत करता है, जो 320 मानव-लिखित प्रश्नों का एक कठोरता से क्यूरेट किया गया बेंचमार्क डेटासेट है जिसे लार्ज ऑडियो-लैंग्वेज मॉडल्स की संगीत समझ क्षमताओं का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो छह अत्याधुनिक मॉडलों पर प्रयोगों के माध्यम से यह प्रदर्शित करता है कि जटिल ऑडियो समझ की जांच करने और यूनि-मोडल शॉर्टकट्स से बचने के लिए संगीत विशेषज्ञों द्वारा मैन्युअल क्यूरेशन आवश्यक है।

Benno Weck, Pablo Puentes, Andrea Poltronieri, Satyajeet Prabhu, Dmitry Bogdanov2026-03-31
💬 NLP

EnsemJudge: Enhancing Reliability in Chinese LLM-Generated Text Detection through Diverse Model Ensembles

यह शोध पत्र EnsemJudge प्रस्तुत करता है, जो विविध मॉडल एन्सेम्बल्स और अनुकूलित रणनीतियों का उपयोग करने वाला एक सुदृढ़ ढांचा है, जिसने चीनी LLM-जनित टेक्स्ट का पता लगाने में सभी बेसलाइन्स को पछाड़कर NLPCC2025 शेयर्ड टास्क 1 में प्रथम स्थान प्राप्त किया।

Zhuoshang Wang, Yubing Ren, Guoyu Zhao, Xiaowei Zhu, Hao Li, Yanan Cao2026-03-31
🤖 machine learning

Efficient Inference of Large Vision Language Models

यह शोध पत्र लार्ज विजन लैंग्वेज मॉडल (LVLM) इन्फरेंस को त्वरित करने वाली अत्याधुनिक तकनीकों का एक व्यापक सर्वेक्षण प्रस्तुत करता है, जो चार आयामों—विजुअल टोकन कम्प्रेशन, मेमोरी मैनेजमेंट, एफिशिएंट आर्किटेक्चर और डिकोडिंग रणनीतियों—में एक व्यवस्थित वर्गीकरण पेश करता है, साथ ही वर्तमान सीमाओं का आलोचनात्मक परीक्षण करता है और भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Surendra Pathak2026-03-31
💬 NLP

Rethinking Atomic Decomposition for LLM Judges: A Prompt-Controlled Study of Reference-Grounded QA Evaluation

यह अध्ययन एक प्रॉम्प्ट-नियंत्रित समग्र जज (holistic judge) और विस्तृत रूब्रिक के माध्यम से, यह प्रदर्शित करके LLM-आधारित संदर्भ-आधारित (reference-grounded) QA मूल्यांकन के लिए परमाणु अपघटन (atomic decomposition) की मानी जाने वाली श्रेष्ठता को चुनौती देता है कि वह अक्सर एकल-प्रॉम्प्ट स्व-अपघटित (self-decomposing) जजों के बराबर या उनसे बेहतर प्रदर्शन करता है, विशेष रूप से कई बेंचमार्क और मॉडल परिवारों में आंशिक समर्थन (partial support) का पता लगाने के मामले में।

Xinran Zhang2026-03-31
💬 NLP

Transfer Learning for an Endangered Slavic Variety: Dependency Parsing in Pomak Across Contact-Shaped Dialects

यह शोध पत्र एक ग्रीक-प्रकार के ट्रीबैंक से तुर्की-प्रकार में ज़ीरो-शॉट ट्रांसफर का मूल्यांकन करके और क्रॉस-वेरिटी ट्रांसफर लर्निंग को एक नए, छोटे हस्तलिखित तुर्की-प्रकार के कॉर्पस के साथ जोड़कर पार्सिंग सटीकता में महत्वपूर्ण सुधार प्रदर्शित करके लुप्तप्राय पोमक भाषा के लिए डिपेंडेंसी पार्सिंग को संबोधित करता है।

Sercan Karakaş2026-03-31
💬 NLP

Who Wrote the Book? Detecting and Attributing LLM Ghostwriters

यह शोध पत्र GhostWriteBench प्रस्तुत करता है, जो लेखकत्व एट्रिब्यूशन (authorship attribution) के परीक्षण के लिए फ्रंटियर LLMs द्वारा जनरेट किए गए लंबे टेक्स्ट का एक डेटासेट है, और TRACE प्रस्तावित करता है, जो एक व्याख्यात्मक (interpretable) और हल्का (lightweight) फिंगरप्रिंटिंग तरीका है जो विविध और आउट-ऑफ-डिस्ट्रीब्यूशन परिदृश्यों में LLM घोस्टराइटरों का पता लगाने और उनका एट्रिब्यूशन करने में अत्याधुनिक प्रदर्शन प्राप्त करता है।

Anudeex Shetty, Qiongkai Xu, Olga Ohrimenko, Jey Han Lau2026-03-31
💬 NLP

\textit{Versteasch du mi?} Computational and Socio-Linguistic Perspectives on GenAI, LLMs, and Non-Standard Language

यह अंतर्विषयी शोधपत्र महत्वपूर्ण समाजभाषाविज्ञान और संगणकीय भाषाविज्ञान को संयोजित करता है ताकि यह परीक्षण किया जा सके कि दक्षिण टायरियोल (South Tyrolean) बोलियों और कुर्दिश जैसी गैर-मानक भाषाई विविधताओं को संभालने के लिए लार्ज लैंग्वेज मॉडल्स को तकनीकी रूप से कैसे अनुकूलित किया जा सकता है, जिसका लक्ष्य डिजिटल भाषाई अंतराल को दूर करना और वि-औपनिवेशिक (decolonial) एआई रणनीतियों को आगे बढ़ाना है।

Verena Platzgummer, John McCrae, Sina Ahmadi2026-03-31
💬 NLP

Categorical Perception in Large Language Model Hidden States: Structural Warping at Digit-Count Boundaries

यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडल (large language models) अंक-गणना सीमाओं (जैसे, 10 और 100) पर अपने हिडन स्टेट्स (hidden states) में कैटेगोरिकल परसेप्शन जैसी ज्यामितीय विकृति (geometric warping) प्रदर्शित करते हैं, जो एक ऐसी घटना है जो अर्थ संबंधी ज्ञान के बजाय संरचनात्मक टोकनाइज़ेशन विच्छेदन (structural tokenization discontinuities) द्वारा संचालित होती है, और यह मॉडल आर्किटेक्चर के आधार पर या तो स्पष्ट वर्गीकरण या विशुद्ध रूप से ज्यामितीय विरूपण के रूप में प्रकट होती है।

Jon-Paul Cacioli2026-03-31
💬 NLP

Coconstructions in spoken data: UD annotation guidelines and first results

यह शोध पत्र यूनिवर्सल डिपेंडेंसीज़ (Universal Dependencies) एनोटेशन दिशानिर्देश और दो विशिष्ट प्रतिनिधित्व मॉडल प्रस्तावित करता है जो बोले गए भाषा में वक्ता के फेरबदल (speaker turns) के बीच फैले हुए सिंटैक्टिक डिपेंडेंसीज़ को संभालने के लिए हैं, जो विशेष रूप से सहयोगात्मक को-कंस्ट्रक्शन (collaborative coconstructions), बैकचैनल (backchannels), पुनर्गठन (reformulations) और अधूरे वाक्यांशों (unfinished phrases) को संबोधित करते हैं।

Ludovica Pannitto, Sylvain Kahane, Kaja Dobrovoljc, Elena Battaglia, Bruno Guillaume, Caterina Mauri, Eleonora Zucchini2026-03-31