⚡ electrical engineering

Pisets: A Robust Speech Recognition System for Lectures and Interviews

यह शोध पत्र "Pisets" को प्रस्तुत करता है, जो व्याख्यानों और साक्षात्कारों के लिए डिज़ाइन किया गया एक सुदृढ़ रूसी स्पीच-टू-टेक्स्ट सिस्टम है, जो करिकुलम लर्निंग और उन्नत अनिश्चितता मॉडलिंग के साथ Wav2Vec2, ऑडियो स्पेक्ट्रोग्राम ट्रांसफॉर्मर और व्हिस्पर (Whisper) को संयोजित करने वाले तीन-घटक आर्किटेक्चर का उपयोग करके मानक व्हिस्पर मॉडलों की तुलना में ट्रांसक्रिप्शन सटीकता को बढ़ाता है और मतिभ्रम (hallucinations) को कम करता है।

Ivan Bondarenko, Daniil Grebenkin, Oleg Sedukhin, Mikhail Klementev, Roman Derunets, Lyudmila Budneva2026-01-27
💬 NLP

Latent Knowledge as a Predictor of Fact Acquisition in Fine-Tuned Large Language Models

यह अध्ययन प्रदर्शित करता है कि सुप्त ज्ञान—जो मॉडल के भार (weights) में संग्रहीत बायोमेडिकल तथ्य हैं लेकिन प्रारंभ में अप्राप्य होते हैं—इस बात का सबसे मजबूत भविष्यवक्ता है कि लार्ज लैंग्वेज मॉडल्स फाइन-ट्यूनिंग के दौरान कितनी तेज़ी से नए तथ्यों को प्राप्त करते हैं और अनदेखे ऑन्टोलॉजी मैपिंग्स (ontology mappings) पर सामान्यीकरण करने में उनकी कितनी क्षमता है, साथ ही यह भी प्रकट करता है कि प्रशिक्षण के दौरान सुदृढ़ न किए जाने पर पहले से सही मैपिंग्स के क्षरण की संभावना अधिक होती है।

Daniel B. Hier, Tayo Obafemi-Ajayi2026-01-27
💬 NLP

Funny or Persuasive, but Not Both: Evaluating Fine-Grained Multi-Concept Control in LLMs

यह शोध पत्र एक मूल्यांकन ढांचा प्रस्तुत करता है जो यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) हास्य और प्रभावशीलता जैसे भाषाई रूप से भिन्न अवधारणाओं को एक साथ नियंत्रित करने में संघर्ष करते हैं, जो इन गुणों की सहज स्वतंत्रता के बावजूद संरचनात्मक बहु-अवधारणा नियंत्रण में एक मौलिक सीमा को प्रकट करता है।

Arya Labroo, Ivaxi Sheth, Vyas Raina, Amaani Ahmed, Mario Fritz2026-01-27
💬 NLP

Unknown Unknowns: Why Hidden Intentions in LLMs Evade Detection

यह शोध पत्र एलएलएम (LLMs) में छिपे हुए इरादों की दस श्रेणियों का एक व्यापक वर्गीकरण प्रस्तुत करता है, अत्याधुनिक मॉडलों में उनके आसानी से प्रेरण और प्रकटीकरण को प्रदर्शित करता है, और यह प्रकट करता है कि वर्तमान पहचान विधियाँ उच्च फॉल्स पॉजिटिव दरों और कम-प्रचलन स्थितियों के तहत परिशुद्धता (precision) के पतन के कारण वास्तविक ओपन-वर्ल्ड परिवेश में विफल हो जाती हैं।

Devansh Srivastav, David Pape, Lea Schönherr2026-01-27
💬 NLP

From Classification to Ranking: Enhancing LLM Reasoning Capabilities for MBTI Personality Detection

यह शोध पत्र एक नवीन सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) ढांचे का प्रस्ताव करता है जो MBTI व्यक्तित्व पहचान को वर्गीकरण के बजाय एक रैंकिंग कार्य के रूप में पुनर्गठित करता है, जिसमें मौजूदा प्रॉम्प्ट-आधारित विधियों की सीमाओं को दूर करने और अत्याधुनिक प्रदर्शन प्राप्त करने के लिए सुपरवाइज्ड फाइन-ट्यूनिंग और एक विशेष रिवॉर्ड फंक्शन के साथ ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन (GRPO) का उपयोग किया गया है।

Yuan Cao, Feixiang Liu, Xinyue Wang, Yihan Zhu, Hui Xu, Zheng Wang, Qiang Qiu2026-01-27
💬 NLP

Comparing Specialised Small and General Large Language Models on Text Classification: 100 Labelled Samples to Achieve Break-Even Performance

यह अध्ययन प्रदर्शित करता है कि विशेषीकृत छोटे भाषा मॉडल (small language models) औसतन केवल 100 लेबल वाले नमूनों का उपयोग करके टेक्स्ट वर्गीकरण कार्यों पर सामान्य बड़े भाषा मॉडलों के साथ प्रदर्शन समानता या श्रेष्ठता प्राप्त कर सकते हैं, हालांकि आवश्यक नमूना आकार कार्य की विशेषताओं के आधार पर काफी भिन्न होता है और प्रदर्शन भिन्नता को ध्यान में रखने पर काफी बढ़ जाता है।

Branislav Pecher, Ivan Srba, Maria Bielikova2026-01-26
💬 NLP

Linguistic traces of stochastic empathy in language models

पाँच अध्ययनों के माध्यम से, यह शोध पत्र प्रदर्शित करता है कि हालांकि मानव जैसा दिखने के निर्देश LLM-जनित पाठ की अविभेद्यता में सुधार करते हैं, लेकिन अंतर्निहित तंत्र में मॉडल वास्तविक मानव-समान सहानुभूति रखने के बजाय "स्टोकेस्टिक सहानुभूति" (stochastic empathy) की नकल करना शामिल है।

Bennett Kleinberg, Jari Zegers, Jonas Festor, Stefana Vida, Julian Präsent, Riccardo Loconte, Sanne Peereboom2026-01-26
💬 NLP

On Fine-Grained I/O Complexity of Attention Backward Passes

यह शोध पत्र रेड-ब्लू पेबल गेम फ्रेमवर्क का उपयोग करके सभी कैश आकारों के लिए अटेंशन बैकवर्ड पासेज के लिए सटीक I/O जटिलता सीमाएं स्थापित करता है, बड़े-कैश परिदृश्यों में फ्लैशअटेंशन (FlashAttention) की इष्टतमता को मान्य करता है, और एक नवीन एल्गोरिदम प्रस्तावित करता है जो छोटे-कैश वातावरण के लिए सैद्धांतिक इष्टतमता प्राप्त करता है और इन परिणामों को स्पार्स अटेंशन (sparse attention) तक विस्तारित करता है।

Xiaoyu Li, Yingyu Liang, Zhenmei Shi, Zhao Song, Song Yue, Jiahao Zhang2026-01-26
💬 NLP

PRACTIQ: A Practical Conversational Text-to-SQL dataset with Ambiguous and Unanswerable Queries

यह शोधपत्र PRACTIQ प्रस्तुत करता है, जो वास्तविक दुनिया की अंतःक्रियाओं से प्रेरित अस्पष्ट और अनुत्तरित प्रश्नों वाला एक नया संवादात्मक टेक्स्ट-टू-SQL डेटासेट है, और LLM-आधारित बेसलाइन्स के माध्यम से यह प्रदर्शित करता है कि वर्तमान अत्याधुनिक प्रणालियाँ इन व्यावहारिक चुनौतियों को प्रभावी ढंग से संभालने में संघर्ष करती हैं।

Mingwen Dong, Nischal Ashok Kumar, Yiqun Hu, Anuj Chauhan, Chung-Wei Hang, Shuaichen Chang, Lin Pan, Wuwei Lan, Henghui (…)2026-01-26
💬 NLP

Modern Hopfield Networks Require Chain-of-Thought to Solve NC1\mathsf{NC}^1-Hard Problems

यह शोध पत्र स्थापित करता है कि मानक मॉडर्न हॉपफील्ड नेटवर्क सैद्धांतिक रूप से TC0\mathsf{TC}^0 जटिलता वर्ग तक सीमित हैं और NC1\mathsf{NC}^1-कठिन समस्याओं को हल नहीं कर सकते हैं, लेकिन यह प्रदर्शित करता है कि उन्हें चेन-ऑफ-थॉट तंत्र से सुसज्जित करने से वे इन सीमाओं को पार करने और स्वाभाविक रूप से क्रमिक कार्यों को हल करने में सक्षम होते हैं।

Yang Cao, Xiaoyu Li, Yuanpeng Li, Yingyu Liang, Zhenmei Shi, Zhao Song2026-01-26