💬 NLP

Revealing the Truth with ConLLM for Detecting Multi-Modal Deepfakes

यह शोध पत्र ConLLM प्रस्तुत करता है, जो एक हाइब्रिड फ्रेमवर्क है जो मोडैलिटी विखंडन (modality fragmentation) और उथले अंतर-मोडल तर्क (shallow inter-modal reasoning) को दूर करने के लिए प्री-ट्रेन्ड मॉडल एम्बेडिंग्स को कंट्रास्टिव लर्निंग और लार्ज लैंग्वेज मॉडल रीजनिंग के साथ जोड़ता है, जिससे ऑडियो, वीडियो और ऑडियो-विजुअल डीपफेक में डिटेक्शन सटीकता में महत्वपूर्ण सुधार होता है।

Gautam Siddharth Kashyap, Harsh Joshi, Niharika Jain, Ebad Shabbir, Jiechao Gao, Nipun Joshi, Usman Naseem2026-01-27
💬 NLP

Improving User Privacy in Personalized Generation: Client-Side Retrieval-Augmented Modification of Server-Side Generated Speculations

यह शोध पत्र P3P^3 को प्रस्तुत करता है, जो एक गोपनीयता-संरक्षण फ्रेमवर्क है जो उच्च-गुणवत्ता वाले व्यक्तिगत LLM आउटपुट प्राप्त करने के लिए सर्वर-साइड मॉडल के ड्राफ्ट जनरेशन को क्लाइंट-साइड मॉडल के रिट्रीवल-ऑगमेंटेड रिफाइनमेंट के साथ जोड़ता है, ताकि सर्वर को निजी उपयोगकर्ता प्रोफाइल को उजागर किए बिना यह संभव हो सके।

Alireza Salemi, Hamed Zamani2026-01-27
💬 NLP

Status Hierarchies in Language Models

यह शोध प्रबंध यह प्रदर्शित करता है कि मानव पाठ पर प्रशिक्षित भाषा मॉडल मल्टी-एजेंट परिवेश में स्वतः ही स्थिति पदानुक्रम (स्टेटस हायरार्की) बना लेते हैं और क्षमता समान होने पर भी उच्च-स्थिति के संकेतों के प्रति समर्पण दिखाते हैं, हालांकि वास्तविक क्षमता अंतर अंततः इन स्थिति संकेतों को निष्प्रभावी कर देते हैं, जो उभरते हुए भ्रामक व्यवहारों और प्रवर्धित पूर्वाग्रहों के संबंध में एआई सुरक्षा के लिए महत्वपूर्ण चिंताएं उत्पन्न करता है।

Emilio Barkett2026-01-27
💬 NLP

Sequence Repetition Enhances Token Embeddings and Improves Sequence Labeling with Decoder-only Language Models

यह शोध पत्र प्रदर्शित करता है कि अनुक्रम पुनरावृत्ति (sequence repetition), जो कॉज़ल मास्क हटाने का एक कम आक्रामक विकल्प है, प्रभावी रूप से डिकोडर-ओनली लैंग्वेज मॉडल्स को सीक्वेंस लेबलिंग कार्यों के लिए द्विदिश संदर्भ (bidirectional context) का लाभ उठाने में सक्षम बनाती है, जिससे एनकोडर-ओनली मॉडल्स और अनमास्क्ड डिकोडर्स दोनों की तुलना में बेहतर टोकन एम्बेडिंग्स और प्रदर्शन प्राप्त होता है, जबकि मध्यवर्ती परत के निरूपण (intermediate layer representations) के उपयोग के माध्यम से यह कुशल बनी रहती है।

Matija Luka Kukić, Marko Čuljak, David Dukić, Martin Tutek, Jan Šnajder2026-01-27
💬 NLP

Intelligence Requires Grounding But Not Embodiment

यह शोध पत्र तर्क देता है कि यद्यपि बुद्धिमत्ता के लिए मौलिक रूप से ग्राउंडिंग (आधारभूतता) की आवश्यकता होती है, लेकिन इसके लिए भौतिक अवतार (एम्बॉडमेंट) अनिवार्य नहीं है, यह प्रदर्शित करते हुए कि गैर-अवतारित एजेंट डिजिटल वातावरण के भीतर प्रेरणा, पूर्वानुमान, कारण संबंधी समझ और अनुभवात्मक शिक्षण के माध्यम से बुद्धिमत्ता प्राप्त कर सकते हैं।

Marcus Ma, Shrikanth Narayanan2026-01-27
💬 NLP

Learning to Ideate for Machine Learning Engineering Agents

यह शोध पत्र MLE-Ideator को प्रस्तुत करता है, जो एक दोहरा-एजेंट ढांचा है जो रणनीतिक विचारोन्मेष (ideation) को कार्यान्वयन से अलग करता है ताकि मशीन लर्निंग इंजीनियरिंग प्रदर्शन को महत्वपूर्ण रूप से बढ़ाया जा सके, यह प्रदर्शित करते हुए कि सुदृढीकरण शिक्षण (reinforcement learning) द्वारा प्रशिक्षित Ideator, अपरिष्कृत बेसलाइन और क्लॉड सोनेट 3.5 (Claude Sonnet 3.5) जैसे अग्रणी वाणिज्यिक मॉडलों दोनों से बेहतर प्रदर्शन कर सकता है।

Yunxiang Zhang, Kang Zhou, Zhichao Xu, Kiran Ramnath, Yun Zhou, Sangmin Woo, Haibo Ding, Lin Lee Cheong2026-01-27
⚡ electrical engineering

BanglaRobustNet: A Hybrid Denoising-Attention Architecture for Robust Bangla Speech Recognition

यह शोध पत्र BanglaRobustNet को प्रस्तुत करता है, जो एक हाइब्रिड Wav2Vec-BERT आर्किटेक्चर है जो शोर वाले और विविध वक्ता परिवेशों में बांग्ला स्पीच रिकग्निशन की सटीकता में महत्वपूर्ण सुधार करने के लिए डिफ्यूजन-आधारित डिनोइजिंग और स्पीकर-कंडीशन्ड क्रॉस-अटेंशन को संयोजित करता है।

Md Sazzadul Islam Ridoy, Mubaswira Ibnat Zidney, Sumi Akter, Md. Aminur Rahman2026-01-27
💬 NLP

\infty-MoE: Generalizing Mixture of Experts to Infinite Experts

यह शोध पत्र \infty-MoE का प्रस्ताव करता है, जो एक नवीन आर्किटेक्चर है जो प्रत्येक टोकन के लिए बड़े फीड-फॉरवर्ड नेटवर्क मापदंडों के निरंतर अंशों का चयन करके 'मिक्सचर ऑफ एक्सपर्ट्स' को एक अनंत स्थान तक सामान्यीकृत करता है, जिससे विशेषज्ञों की एक विशाल संख्या के साथ प्रभावी प्रशिक्षण सक्षम होता है और बहुत बड़े डेंस मॉडल्स के तुलनीय प्रदर्शन प्राप्त करने के साथ-साथ एक लचीला सटीकता-गति ट्रेड-ऑफ भी प्रदान करता है।

Shota Takashiro, Takeshi Kojima, Shohei Taniguchi, Yusuke Iwasawa, Yutaka Matsuo2026-01-27
💬 NLP

Unsupervised Elicitation of Moral Values from Language Models

यह शोध पत्र प्रदर्शित करता है कि इंटरनल कोहेरेंस मैक्सिमाइजेशन (ICM) एल्गोरिदम अनसुपरवाइज्ड, प्रीट्रेन्ड लैंग्वेज मॉडल्स से सुप्त नैतिक तर्क क्षमताओं को सफलतापूर्वक प्राप्त कर सकता है, जो विविध नैतिक ढांचों में सामाजिक पूर्वाग्रहों को महत्वपूर्ण रूप से कम करते हुए मानक बेसलाइन्स और मानव-लेबल वाले फाइन-ट्यूनिंग दोनों से बेहतर प्रदर्शन करता है।

Meysam Alizadeh, Fabrizio Gilardi, Zeynab Samei2026-01-27
💬 NLP

Cross-Lingual Probing and Community-Grounded Analysis of Gender Bias in Low-Resource Bengali

यह शोध पत्र कंप्यूटेशनल प्रोबिंग विधियों को समुदाय-आधारित क्षेत्रीय अध्ययनों के साथ जोड़कर कम-संसाधन वाले बंगाली में लैंगिक पूर्वाग्रह की जांच करता है, जो यह प्रकट करता है कि अंग्रेजी-केंद्रित ढांचे अपर्याप्त हैं और निष्पक्ष एनएलपी (NLP) सिस्टम विकसित करने के लिए स्थानीयकृत, सांस्कृतिक रूप से संवेदनशील दृष्टिकोणों की आवश्यकता पर बल देता है।

Md Asgor Hossain Reaj, Rajan Das Gupta, Jui Saha Pritha, Abdullah Al Noman, Abir Ahmed, Golam Md Mohiuddin, Tze Hui Liew2026-01-27