💬 NLP

Bangla Key2Text: Text Generation from Keywords for a Low Resource Language

यह शोध पत्र बांग्ला कीवर्ड-टेक्स्ट के 2.6 मिलियन युग्मों का एक विशाल डेटासेट 'बांग्ला की-टू-टेक्स्ट' (Bangla Key2Text) प्रस्तुत करता है जिसे एक BERT-आधारित पाइपलाइन के माध्यम से बनाया गया है, और यह प्रदर्शित करता है कि mT5 और BanglaT5 जैसे सीक्वेंस-टू-सीक्वेंस मॉडलों को फाइन-ट्यून करना इस कम-संसाधन वाली भाषा में कीवर्ड-संचालित टेक्स्ट जनरेशन के लिए ज़ीरो-शॉट लार्ज लैंग्वेज मॉडल्स की तुलना में काफी बेहतर प्रदर्शन करता है।

Tonmoy Talukder, G M Shahariar2026-04-22
💬 NLP

Diagnosable ColBERT: Debugging Late-Interaction Retrieval Models Using a Learned Latent Space as Reference

यह पोजीशन पेपर 'डायग्नोसेबल कोलबर्ट' (Diagnosable ColBERT) का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो कोलबर्ट टोकन एम्बेडिंग्स को क्लिनिकल नॉलेज-ग्राउंडेड लेटेंट स्पेस के साथ संरेखित करता है ताकि उथले इंटरैक्शन स्कोर्स को बायोमेडिकल रिट्रीवल में व्यवस्थित मॉडल विफलताओं के निदान के लिए निरीक्षण योग्य साक्ष्य में बदला जा सके और सिद्धांत-आधारित डेटा क्यूरेशन का मार्गदर्शन किया जा सके।

François Remy2026-04-22
💬 NLP

Impact of large language models on peer review opinions from a fine-grained perspective: Evidence from top conference proceedings in AI

यह अध्ययन प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स के उद्भव ने शीर्ष एआई सम्मेलनों में पीयर रिव्यू को रिपोर्टों को लंबा, अधिक सुसंगत और मानकीकृत बनाकर बदल दिया है, जबकि साथ ही मौलिकता और पुनरुत्पादकता (रेप्लिकेबिलिटी) के संबंध में गहन आलोचनात्मक मूल्यांकन के बजाय सतही स्पष्टता और सारांशों की ओर ध्यान केंद्रित कर दिया है।

Wenqing Wu, Chengzhi Zhang, Yi Zhao, Tong Bao2026-04-22
💬 NLP

RoLegalGEC: Legal Domain Grammatical Error Detection and Correction Dataset for Romanian

यह शोध पत्र RoLegalGEC को प्रस्तुत करता है, जो कानूनी ग्रंथों में 350,000 एनोटेटेड व्याकरण संबंधी त्रुटियों वाला पहला रोमानियाई-भाषा का समानांतर डेटासेट है, और कानूनी डोमेन के लिए विशेष रूप से तैयार किए गए व्याकरण संबंधी त्रुटि पहचान और सुधार उपकरणों के प्रशिक्षण के लिए इसकी प्रभावशीलता को प्रदर्शित करने हेतु विभिन्न न्यूरल नेटवर्क मॉडलों का मूल्यांकन करता है।

Mircea Timpuriu, Dumitru-Clementin Cercel2026-04-22
💬 NLP

The "Small World of Words" German Free-Association Norms

यह शोध पत्र SWOW-DE को प्रस्तुत करता है, जो जर्मन मुक्त-संबद्ध मानदंडों (free-association norms) का अब तक का सबसे बड़ा संग्रह है, जो 5,877 संकेत शब्दों (cue words) को प्रदान करके एक महत्वपूर्ण संसाधन अंतराल को भरता है जो मनोभाषाई कार्यों (psycholinguistic tasks) में प्रदर्शन की मजबूती से भविष्यवाणी करता है और मौजूदा डेटा के साथ क्रॉस-लिंग्विस्टिक तुलना को सक्षम बनाता है।

Samuel Aeschbach, Rui Mata, Kaidi Lõo, Simon De Deyne, Dirk U. Wulff2026-04-22
🤖 AI

SafetyALFRED: Evaluating Safety-Conscious Planning of Multimodal Large Language Models

यह शोध पत्र SafetyALFRED को प्रस्तुत करता है, जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए वास्तविक दुनिया के किचन खतरों के साथ ALFRED वातावरण का विस्तार करने वाला एक नया बेंचमार्क है, जो स्थिर प्रश्न-उत्तर सेटिंग्स में सुरक्षा जोखिमों को पहचानने की उनकी क्षमता और एम्बॉडीड प्लानिंग (embodied planning) के माध्यम से उन जोखिमों को सक्रिय रूप से कम करने की उनकी क्षमता के बीच एक महत्वपूर्ण अंतर को प्रकट करता है।

Josue Torres-Fonseca, Naihao Deng, Yinpei Dai, Shane Storks, Yichi Zhang, Rada Mihalcea, Casey Kennington, Joyce Chai2026-04-22
💬 NLP

Micro Language Models Enable Instant Responses

यह शोध पत्र माइक्रो लैंग्वेज मॉडल्स (μ\muLMs) को प्रस्तुत करता है, जो अत्यंत लघु ऑन-डिवाइस मॉडल (8M–30M पैरामीटर्स) हैं जो क्लाउड लेटेंसी (latency) को छिपाने के लिए प्रतिक्रिया की शुरुआत को तुरंत उत्पन्न करते हैं, जबकि एक बड़ा क्लाउड मॉडल एक सहयोगात्मक ढांचे के माध्यम से वाक्य को निर्बाध रूप से पूरा करता है जो संसाधन-सीमित एज डिवाइसेस (edge devices) के लिए जवाबदेही सुनिश्चित करता है।

Wen Cheng, Tuochao Chen, Karim Helwani, Sriram Srinivasan, Luke Zettlemoyer, Shyamnath Gollakota2026-04-22
💬 NLP

The signal is the ceiling: Measurement limits of LLM-predicted experience ratings from open-ended survey text

यह शोध पत्र यह प्रदर्शित करता है कि जबकि प्रॉम्प्ट अनुकूलन (prompt customization) सर्वेक्षण पाठ से प्रशंसक अनुभव रेटिंग की भविष्यवाणी करने में एलएलएम (LLM) की सटीकता में मामूली सुधार कर सकता है, लेकिन प्रदर्शन की मौलिक सीमा मॉडल चयन या व्यापक इंजीनियरिंग के बजाय इनपुट की अंतर्निहित भाषाई सामग्री और लिखित फीडबैक एवं वास्तविक निर्णयों के बीच के अंतर द्वारा निर्धारित होती है।

Andrew Hong, Jason Potteiger, Luis E. Zapata2026-04-22
💬 NLP

Pause or Fabricate? Training Language Models for Grounded Reasoning

यह शोध पत्र ग्राउंडेड रीजनिंग वाया इंटरैक्टिव रीइन्फोर्समेंट लर्निंग (GRIL) को प्रस्तुत करता है, जो एक मल्टी-टर्न फ्रेमवर्क है जो भाषा मॉडलों को सूचना अंतराल पहचानने और काल्पनिक आधार बनाने के बजाय स्पष्टीकरण के लिए रुकने के लिए प्रशिक्षित करता है, जिससे अधूरी जानकारी वाले कार्यों पर तर्क की सटीकता और दक्षता में उल्लेखनीय सुधार होता है।

Yiwen Qiu, Linjuan Wu, Yizhou Liu, Yuchen Yan, Jin Ma, Xu Tan, Yao Hu, Daoxin Zhang, Wenqi Zhang, Weiming Lu, Jun Xiao (…)2026-04-22
💬 NLP

Exploring Language-Agnosticity in Function Vectors: A Case Study in Machine Translation

यह शोधपत्र प्रदर्शित करता है कि बहुभाषी लार्ज लैंग्वेज मॉडल्स से निकाले गए फंक्शन वेक्टर्स भाषा-निरपेक्ष गुण प्रदर्शित करते हैं, क्योंकि अंग्रेजी-से-लक्ष्य कार्यों से प्राप्त ट्रांसलेशन वेक्टर्स अनदेखी लक्ष्य भाषाओं में प्रदर्शन सुधारने के लिए सफलतापूर्वक सामान्यीकृत होते हैं और इंस्ट्रक्शन-ट्यून्ड वेरिएंट्स में प्रभावी ढंग से स्थानांतरित होते हैं।

Nurkhan Laiyk, Gerard I. Gállego, Javier Ferrando, Fajri Koto2026-04-22