💬 NLP

fMRI-LM: Towards a Universal Foundation Model for Language-Aligned fMRI Understanding

यह शोध पत्र fMRI-LM को प्रस्तुत करता है, जो एक सार्वभौमिक फाउंडेशन मॉडल है जो न्यूरल टोकेनाइजेशन, संयुक्त LLM अनुकूलन और मल्टी-टास्क इंस्ट्रक्शन ट्यूनिंग से जुड़े एक तीन-चरणीय ढांचे के माध्यम से कार्यात्मक MRI और भाषा को जोड़ता है ताकि मस्तिष्क की गतिविधि की स्केलेबल, भाषा-संरेखित अर्थपूर्ण समझ को सक्षम बनाया जा सके।

Yuxiang Wei, Yanteng Zhang, Xi Xiao, Chengxuan Qian, Tianyang Wang, Vince D. Calhoun2026-04-16
💬 NLP

Reducing Hallucinations in LLMs via Factuality-Aware Preference Learning

यह शोध पत्र F-DPO को प्रस्तुत करता है, जो डायरेक्ट प्रिफरेंस ऑप्टिमाइजेशन का एक सरल विस्तार है जो बाइनरी फैक्टुअलिटी लेबल का लाभ उठाकर प्रिफरेंस पेयर ऑर्डरिंग को ठीक करता है और फैक्टुअलिटी-अवेयर मार्जिन लागू करता है, जो बिना किसी सहायक रिवॉर्ड मॉडल या जटिल ट्रेनिंग पाइपलाइन के विभिन्न LLMs में मतिभ्रम (hallucinations) को प्रभावी रूप से कम करता है और तथ्यात्मक सटीकता में सुधार करता है।

Sindhuja Chaduvula, Ahmed Y. Radwan, Azib Farooq, Yani Ioannou, Shaina Raza2026-04-16
💬 NLP

Exposía: Teaching and Assessment of Academic Writing Skills for Research Project Proposals and Peer Feedback

यह शोध पत्र Expos'ia को प्रस्तुत करता है, जो छात्र अनुसंधान प्रस्तावों को बहु-चरणीय सहकर्मी और प्रशिक्षक फीडबैक के साथ जोड़ने वाला पहला सार्वजनिक डेटासेट है, ताकि स्वचालित स्कोरिंग कार्यों पर लार्ज लैंग्वेज मॉडल्स का बेंचमार्क बनाया जा सके और शैक्षिक मूल्यांकन के लिए प्रभावी प्रॉम्प्टिंग रणनीतियों की पहचान की जा सके।

Dennis Zyska, Alla Rozovskaya, Ilia Kuznetsov, Iryna Gurevych2026-04-16
💬 NLP

TRIM: Hybrid Inference via Targeted Stepwise Routing in Multi-Step Reasoning Tasks

यह शोध पत्र TRIM को प्रस्तुत करता है, जो एक हाइब्रिड इन्फरेंस फ्रेमवर्क है जो प्रोसेस रिवॉर्ड मॉडल्स का उपयोग करके केवल महत्वपूर्ण, त्रुटि-प्रवण चरणों को बड़े मॉडल्स के पास गतिशील रूप से रूट करता है और छोटे मॉडल्स को नियमित चरणों को संभालने की अनुमति देता है, जिससे बहु-चरणीय तर्क कार्यों में गणनात्मक लागत को काफी कम करते हुए कैस्केडिंग विफलताओं को रोका जा सकता है और लागत दक्षता में सुधार किया जा सकता है।

Vansh Kapoor, Aman Gupta, Hao Chen, Anurag Beniwal, Jing Huang, Aviral Kumar2026-04-16
💬 NLP

Common to Whom? Regional Cultural Commonsense and LLM Bias in India

यह शोध पत्र इंडिका (Indica) को प्रस्तुत करता है, जो पहला ऐसा बेंचमार्क है जो यह प्रकट करता है कि भारत में सांस्कृतिक सामान्य ज्ञान मुख्य रूप से राष्ट्रीय होने के बजाय क्षेत्रीय है, और यह प्रदर्शित करता है कि वर्तमान बड़े भाषा मॉडल इस विविधता के साथ संघर्ष करते हैं जबकि मध्य और उत्तर भारत के प्रति महत्वपूर्ण भौगोलिक पूर्वाग्रह प्रदर्शित करते हैं।

Sangmitra Madhusudan, Trush Shashank More, Steph Buongiorno, Renata Dividino, Jad Kabbara, Ali Emami2026-04-16
💬 NLP

Sparse or Dense? A Mechanistic Estimation of Computation Density in Transformer-based LLMs

यह शोधपत्र ट्रांसफॉर्मर-आधारित एलएलएम (LLMs) में कंप्यूटेशन डेंसिटी (गणना घनत्व) को मापने के लिए एक मैकेनिस्टिक एस्टिमेटर पेश करता है, जो यह प्रकट करता है कि प्रोसेसिंग आम तौर पर सघन और गतिशील है, जिसमें डेंसिटी स्तर मॉडलों के बीच सह-संबंधित हैं और टोकन की दुर्लभता एवं संदर्भ लंबाई के आधार पर भिन्न होते हैं।

Corentin Kervadec, Iuliia Lysova, Marco Baroni, Gemma Boleda2026-04-16
💻 computer science

A Domain-Specific Language for LLM-Driven Trigger Generation in Multimodal Data Collection

यह शोध पत्र एक डिक्लेरेटिव फ्रेमवर्क का प्रस्ताव करता है जो प्राकृतिक भाषा के उपयोगकर्ता अनुरोधों को सत्यापन योग्य डोमेन-विशिष्ट भाषा कार्यक्रमों में अनुवादित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे पैसिव लॉगिंग की तुलना में स्टोरेज लागत और निष्पादन विलंबता (एग्जीक्यूशन लेटेंसी) को कम करते हुए मल्टीमॉडल सेंसर डेटा के कुशल, इरादा-संचालित और चयनात्मक ऑन-डिवाइस संग्रह को सक्षम बनाया जा सके।

Philipp Reis, Philipp Rigoll, Martin Zehetner, Jacqueline Henle, Stefan Otten, Eric Sax2026-04-16
💻 computer science

Form Without Function: Agent Social Behavior in the Moltbook Network

यह शोध पत्र मोल्टबुक (Moltbook) नेटवर्क का विश्लेषण करता है, जो पूरी तरह से एआई एजेंटों से बना एक सामाजिक मंच है, यह प्रदर्शित करने के लिए कि जबकि इसका तकनीकी बुनियादी ढांचा कार्य करता है और निर्देशों का जवाब देता है, इसका सामाजिक स्तर उभरने में विफल रहता है, जिसके परिणामस्वरूप एक ऐसी प्रणाली बनती है जो सोशल मीडिया के रूप की नकल तो करती है लेकिन उसके आवश्यक मानव-समान कार्य को नहीं।

Saber Zerhoudi, Kanishka Ghosh Dastidar, Felix Klement, Artur Romazanov, Andreas Einwiller, Dang H. Dang, Michael Dinzin (…)2026-04-16
💬 NLP

Caption First, VQA Second: Knowledge Density, Not Task Format, Drives Multimodal Scaling

यह शोध पत्र यह तर्क देता है कि मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स को स्केल करने में प्राथमिक बाधा कार्य प्रारूप की विविधता नहीं बल्कि प्रशिक्षण डेटा का ज्ञान घनत्व (knowledge density) है, जो यह प्रदर्शित करता है कि इमेज कैप्शन को संरचित ज्ञान के साथ समृद्ध करना विजुअल क्वेश्चन अनसरिंग जैसे कार्य-विशिष्ट पर्यवेक्षण जोड़ने की तुलना में अधिक सुसंगत प्रदर्शन सुधार प्रदान करता है।

Hongjian Zou, Yue Ge, Qi Ding, Yixuan Liao, Xiaoxin Chen2026-04-16
💬 NLP

A Multi-Model Approach to English-Bangla Sentiment Classification of Government Mobile Banking App Reviews

यह अध्ययन एक हाइब्रिड लेबलिंग दृष्टिकोण और कई मॉडलों का उपयोग करके चार बांग्लादेशी सरकारी मोबाइल बैंकिंग ऐप्स की 5,652 अंग्रेजी और बांग्ला समीक्षाओं का विश्लेषण करता है, जो यह प्रकट करता है कि पारंपरिक मशीन लर्निंग एल्गोरिदम सेंटीमेंट वर्गीकरण में ट्रांसफॉर्मर-आधारित मॉडलों से बेहतर रहे, साथ ही लेनदेन की गति और इंटरफ़ेस डिज़ाइन को प्राथमिक उपयोगकर्ता समस्याओं के रूप में पहचाना और अंग्रेजी और बांग्ला प्रसंस्करण के बीच एक महत्वपूर्ण प्रदर्शन अंतर को उजागर किया।

Md. Naim Molla, Md Muhtasim Munif Fahim, Md. Binyamin, Md Jahid Hasan Imran, Tonmoy Shil, Nura Rayhan, Md Rezaul Karim2026-04-16