💬 NLP

A Simple Method to Enhance Pre-trained Language Models with Speech Tokens for Classification

यह शोध पत्र लंबे स्पीच टोकन अनुक्रमों को एक संक्षिप्त मल्टीमॉडल बैग-ऑफ-वर्ड्स (Bag-of-Words) प्रतिनिधित्व में कम करने के लिए लासो-आधारित (lasso-based) फीचर चयन को लागू करके, वर्गीकरण कार्यों के लिए प्री-ट्रेंड लैंग्वेज मॉडल्स को उन्नत करने हेतु एक सरल और लागत प्रभावी विधि प्रस्तावित करता है, जिसे फिर फॉलसी डिटेक्शन (fallacy detection) और अफेक्टिव कंप्यूटिंग कार्यों पर प्रदर्शन में सुधार करने के लिए सेल्फ-सुपरवाइज्ड लर्निंग के माध्यम से एकीकृत किया जाता है।

Nicolas Calbucura, Jose Guillen, Valentin Barriere2026-04-07
💬 NLP

BLASST: Dynamic BLocked Attention Sparsity via Softmax Thresholding

BLASST एक ट्रेनिंग-फ्री, डायनेमिक स्पार्स अटेंशन मैकेनिज्म है जो नगण्य अटेंशन ब्लॉक्स को छोड़ने के लिए एक फिक्स्ड स्केलर थ्रेशोल्ड का उपयोग करके विभिन्न आर्किटेक्चर पर LLM इन्फरेंस को तेज़ करता है, जिससे नगण्य सटीकता हानि के साथ 1.52x तक की स्पीडअप प्राप्त होती है।

Jiayi Yuan, Cameron Shinn, Kai Xu, Jingze Cui, George Klimiashvili, Guangxuan Xiao, Perkz Zheng, Bo Li, Yuxin Zhou, Zhou (…)2026-04-07
💬 NLP

The Drill-Down and Fabricate Test (DDFT): A Protocol for Measuring Epistemic Robustness in Language Models

यह शोध पत्र ड्रिल-डाउन एंड फैब्रिकेट टेस्ट (DDFT) का परिचय देता है, जो एक प्रोटोकॉल है जो यह प्रदर्शित करता है कि एक भाषा मॉडल की एपिस्टेमिक मजबूती (epistemic robustness)—सिमेंटिक संपीड़न (semantic compression) और प्रतिकूल दबाव के तहत तथ्यात्मक सटीकता बनाए रखने की उसकी क्षमता—मॉडल के आकार या आर्किटेक्चर पर स्वतंत्र है और इसके बजाय महत्वपूर्ण रूप से त्रुटि पहचान क्षमताओं पर निर्भर करती है।

Rahul Baxi2026-04-07
💬 NLP

Parallel Universes, Parallel Languages: A Comprehensive Study on LLM-based Multilingual Counterfactual Example Generation

यह शोध पत्र व्यापक रूप से LLM-आधारित बहुभाषी काउंटरफैक्चुअल जनरेशन का मूल्यांकन करता है, जिसमें यह पाया गया है कि हालांकि अनुवाद-आधारित विधियाँ प्रत्यक्ष जनरेशन से बेहतर प्रदर्शन करती हैं और भाषाओं के बीच सामान्य संपादन पैटर्न साझा करती हैं, फिर भी अंतर्निहित त्रुटि प्रकार और गुणवत्ता संबंधी सीमाएँ बहुभाषी काउंटरफैक्चुअल डेटा ऑग्मेंटेशन के माध्यम से प्राप्त होने वाले प्रदर्शन लाभों को प्रतिबंधित करती हैं।

Qianli Wang, Van Bach Nguyen, Yihong Liu, Fedor Splitt, Nils Feldhus, Christin Seifert, Hinrich Schütze, Sebastian Mölle (…)2026-04-07
🤖 machine learning

Scaling DPPs for RAG: Density Meets Diversity

यह शोध पत्र ScalDPP प्रस्तुत करता है, जो एक स्केलेबल रिट्रीवल मैकेनिज्म है जिसे RAG के लिए बनाया गया है और जो संदर्भ घनत्व (context density) और विविधता (diversity) को संयुक्त रूप से अनुकूलित करने के लिए डिटर्मिनेंटल पॉइंट प्रोसेसेज (Determinantal Point Processes) और एक नवीन डाइवर्स मार्जिन लॉस (Diverse Margin Loss) का लाभ उठाता है, जिससे LLM जनरेशन में रेडंडेंसी को कम किया जा सके और साक्ष्य कवरेज (evidence coverage) में सुधार किया जा सके।

Xun Sun, Baiheng Xie, Li Huang, Qiang Gao2026-04-07
💬 NLP

Robust LLM Performance Certification via Constrained Maximum Likelihood Estimation

यह शोध पत्र एक छोटे मानव-लेबल वाले कैलिब्रेशन सेट, बड़े पैमाने पर LLM-जज एनोटेशन और एक सीमित अधिकतम-संभावना अनुमान (maximum-likelihood estimation) ढांचे के भीतर डोमेन-विशिष्ट बाधाओं को संयोजित करके LLM विफलता दरों का अनुमान लगाने के लिए एक सुदृढ़ और कुशल विधि प्रस्तावित करता है, जो प्रेडिक्शन-पावर्ड इन्फरेंस (Prediction-Powered Inference) जैसे मौजूदा बेसलाइन की तुलना में बेहतर सटीकता और कम विचरण प्राप्त करता है।

Minghe Shen, Ananth Balashankar, Adam Fisch, David Madras, Miguel Rodrigues2026-04-07
💬 NLP

VIGIL: An Extensible System for Real-Time Detection and Mitigation of Cognitive Bias Triggers

यह शोध पत्र VIGIL को प्रस्तुत करता है, जो इन-सीटू (in-situ) विश्लेषण, प्रतिवर्ती (reversible) LLM-संचालित पुनर्गठन और गोपनीयता-लचीले अनुमान (privacy-flexible inference) जैसी विशेषताओं के माध्यम से ऑनलाइन सूचनाओं में संज्ञानात्मक पूर्वाग्रह ट्रिगर्स (cognitive bias triggers) का वास्तविक समय में पता लगाने और उन्हें कम करने के लिए डिज़ाइन किया गया पहला ओपन-सोर्स ब्राउज़र एक्सटेंशन है।

Bo Kang, Sander Noels, Tijl De Bie2026-04-07
💬 NLP

On the First Computer Science Research Paper in an Indian Language and the Future of Science in Indian Languages

यह शोधपत्र लेखक के पूर्णतः तेलुगु में लिखे गए पहले मौलिक कंप्यूटर विज्ञान अनुसंधान पत्र लिखने के अनुभव का विवरण देता है, जिसमें भाषाई और टाइपसेटिंग बाधाओं को दूर करने के लिए एक संस्कृत-आधारित तकनीकी शब्दावली और एक कस्टम XeLaTeX टेम्पलेट के निर्माण का विस्तृत विवरण दिया गया है, साथ ही सभी भारतीय भाषाओं में वैज्ञानिक लेखन को आगे बढ़ाने के लिए एक दृष्टिकोण प्रस्तावित किया गया है।

Siddhartha Visveswara Jayanti2026-04-07
💬 NLP

Knowledge Packs: Zero-Token Knowledge Delivery via KV Cache Injection

यह शोध पत्र नॉलेज पैक्स (Knowledge Packs) को प्रस्तुत करता है, जो एक ऐसी विधि है जो प्री-कंप्यूटेड KV कैश (pre-computed KV caches) को इंजेक्ट करके कॉज़ल ट्रांसफॉर्मर्स (causal transformers) में ज़ीरो-टोकन ज्ञान वितरण और व्यवहार संबंधी स्टीयरिंग (behavioral steering) प्राप्त करती है, बशर्ते मानक RAG के साथ सटीक समानता सुनिश्चित करने के लिए सख्त चैट टेम्पलेट फॉर्मेटिंग बनाए रखी जाए, जबकि यह 95% तक टोकन की बचत सक्षम करती है।

Andrey Pustovit2026-04-07
🔬 physics

Generative Chemical Language Models for Energetic Materials Discovery

यह शोध पत्र एक ट्रांसफर-लर्निंग फ्रेमवर्क प्रस्तुत करता है जो व्यापक रासायनिक डेटा पर प्री-ट्रेन और क्यूरेटेड ऊर्जावान सामग्रियों (energetic materials) के डेटासेट के साथ फाइन-ट्यून किए गए जनरेटिव मॉलिक्यूलर लैंग्वेज मॉडल्स का उपयोग करता है, ताकि फ्रैगमेंट-आधारित एनकोडिंग्स के माध्यम से डेटा की कमी को दूर किया जा सके और अगली पीढ़ी की ऊर्जावान सामग्रियों की खोज में तेजी लाई जा सके।

Andrew Salij, R. Seaton Ullberg, Megan C. Davis, Marc J. Cawkwell, Christopher J. Snyder, Cristina Garcia Cardona, Ivana (…)2026-04-07