💬 NLP

Surpassing Scale by Efficiency: A Compact 135M Parameter Foundational LLM Natively Adapted for the Bangla Language

यह शोध पत्र bangla-smollm-135m को प्रस्तुत करता है, जो एक विशेष टोकन मर्ज़िंग रणनीति का उपयोग करके मूल रूप से बंगाली भाषा के लिए अनुकूलित एक अत्यधिक कुशल 135-मिलियन पैरामीटर वाला फाउंडेशनल मॉडल है, जो काफी बड़े मॉडलों के साथ प्रदर्शन समानता प्राप्त करता है और संसाधन-सीमित एज और मोबाइल परिनियोजन के लिए उपयुक्त बना रहता है।

Rabindra Nath Nandi2026-06-16
💬 NLP

PathRouter: Aligning Rewards with Retrieval Quality in Agentic Graph Retrieval-Augmented Generation

PathRouter एक पाथ-अवेयर (path-aware) ट्रेनिंग फ्रेमवर्क है जो एजेंटिक GraphRAG के लिए बनाया गया है, जो रिवॉर्ड एलियासिंग (reward aliasing) और सर्च-अपडेट अस्पष्टता (search-update ambiguity) को कम करने के लिए उत्तर की शुद्धता और साक्ष्य-पथ ओवरलैप (evidence-path overlap) का संयुक्त रूप से मूल्यांकन करके सुदृढीकरण शिक्षण (reinforcement learning) संकेतों को परिष्कृत करता है, जिससे विभिन्न मॉडल आकारों में उत्तर की सटीकता और साक्ष्य पुनर्प्राप्ति गुणवत्ता दोनों में महत्वपूर्ण सुधार होता है।

Bo Wang, Heyan Huang, Yaolin Li, Wei Tang, Yuan Zhang, Wenbo Li, Mingze Gao, Ge Shi, Chong Feng2026-06-16
🤖 machine learning

Taylor-Calibrate: Principled Initialization for Hybrid Linear Attention Distillation

यह शोध पत्र Taylor-Calibrate का प्रस्ताव करता है, जो एक सिद्धांत-आधारित इनिशियलाइज़ेशन विधि है जो प्रीट्रेन किए गए ट्रांसफॉर्मर से परिवर्तित हाइब्रिड लीनियर अटेंशन मॉडल्स के ज़ीरो-शॉट प्रदर्शन और प्रशिक्षण दक्षता को महत्वपूर्ण रूप से सुधारने के लिए टेलर-निर्देशित शिक्षक सांख्यिकी (Taylor-guided teacher statistics) और प्रति-परत संरेखण (per-layer alignment) का लाभ उठाता है।

Zhongzhu Zhou, Qingyang Wu, Junxiong Wang, Mayank Mishra, Shuaiwen Leon Song, Ben Athiwaratkun, Chenfeng Xu2026-06-16
💬 NLP

From Awareness to Adherence: Bridging the Context Gap in Spoken Dialogue Systems via Context-Aware Decoding

यह शोध पत्र एक ऑडियो-अनुकूलित कॉन्टेक्स्ट-अवेयर डिकोडिंग (CAD) पद्धति प्रस्तावित करता है जो आउटपुट डिस्ट्रीब्यूशन के बीच विषमता उत्पन्न करके मल्टीमॉडल कॉन्टेक्स्ट संकेतों को प्रवर्धित करती है, जिससे स्पोकन डायलॉग सिस्टम में लेटेंट कॉन्टेक्स्ट अवेयरनेस और एक्टिव एडहेरेंस के बीच के अंतर को पाटकर मेमोरी और कोहेरेंस बेंचमार्क पर प्रदर्शन में महत्वपूर्ण सुधार किया जाता है।

Che Hyun Lee, Heeseung Kim, Sungroh Yoon2026-06-16
💬 NLP

Lost at the End: Primacy Bias in Multimodal Retrieval-Augmented Question Answering

यह शोध पत्र प्रकट करता है कि मल्टीमॉडल नॉलेज-बेस्ड विजुअल क्वेश्चन अनस्वर्सिंग सिस्टम्स "लॉस्ट एट द एंड" (अंत में खो जाना) नामक एक घटना से ग्रस्त हैं, जहाँ सही रिट्रीव किए गए पैसेज को संदर्भ के आरंभ में रखने से उसे अंत में रखने की तुलना में काफी बेहतर प्रदर्शन होता है, जो कि रिट्रीवल की गुणवत्ता के बजाय रीडर मॉडल के प्रॉम्प्ट स्लॉट 0 द्वारा संचालित एक पूर्वाग्रह है, जिससे रिकॉल@k की प्रदर्शन मेट्रिक के रूप में पर्याप्तता को चुनौती मिलती है।

Jieyuan Liu, Jianyang Gu, Shijie Chen, Jefferson Chen, Zhen Wang2026-06-16
💬 NLP

SkillWiki: A Living Knowledge Infrastructure for Agent Skills

SkillWiki एक नवीन बुनियादी ढांचा है जिसे एजेंट कौशल के बड़े पैमाने पर उत्पादन और शासन की कमी को दूर करने के लिए डिज़ाइन किया गया है, जो विषम ज्ञान को पुन: प्रयोज्य, उत्पत्ति-जागरूक संपत्तियों में परिवर्तित करता है जो ज्ञान, कौशल और निष्पादन अनुभव के निरंतर सह-विकास को सक्षम बनाती हैं।

Dingcheng Huang, Yuda Ding, Bingshuo Liu, Qingbin Liu, Xi Chen, Jiang Bian, Hongliang Sun, Zhiying Tu, Dianhui Chu, Xiao (…)2026-06-16
💬 NLP

Uncertainty Is Not a Safety Net for Clinical VQA, but Can It Anticipate Model Failure?

यह शोध पत्र यह प्रदर्शित करता है कि जबकि क्लिनिकल विजन-लैंग्वेज मॉडल्स में वर्तमान अनिश्चितता अनुमान विधियाँ अपनी मॉडल सटीकता पर निर्भरता के कारण विश्वसनीय सुरक्षा जाल के रूप में कार्य करने में विफल रहती हैं, वे प्रभावी रूप से नैदानिक उपकरणों के रूप में कार्य करती हैं जो व्यवधान (perturbation) के तहत विशिष्ट भविष्यवाणात्मक विफलताओं का पूर्वानुमान लगा सकते हैं।

Arnisa Fazla, Alberto Testoni, Ameen Abu-Hanna, Barbara Plank, Iacer Calixto2026-06-16
💬 NLP

FraudSMSWalker: Benchmarking Agentic Large Language Models for SMS-to-Webpage Fraud Detection

यह शोधपत्र FraudSMSWalker प्रस्तुत करता है, जो एक नियंत्रित बेंचमार्क है जिसे URL मास्किंग के माध्यम से साक्ष्य-आधारित निर्णयों को अनिवार्य करके और स्कैम फ्लो की नकल करने वाले चुनौतीपूर्ण निर्दोष मामलों को शामिल करके, एजेंटिक लार्ज लैंग्वेज मॉडल्स की SMS-टू-वेबपेज धोखाधड़ी का पता लगाने की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है।

Y. H. Zhou, Z. M. Ma, Y. J. Zhou, Y. T. Li, H. X. Xiang, Y. M. Cheng, T. L. Chen, K. J. Zhang, Z. H. Nan, J. H. Ni, Z. W (…)2026-06-16
💬 NLP

SCAR: Semantic Continuity-Aware Retrieval for Efficient Context Expansion in RAG

यह शोध पत्र SCAR का प्रस्ताव करता है, जो एक अनुकूली रिट्रीवल पॉलिसी (adaptive retrieval policy) है जो एक सापेक्ष प्रासंगिकता थ्रेशोल्ड (relative relevance threshold) के आधार पर पड़ोसी चंक्स को चुनिंदा रूप से विस्तारित करके RAG में बाउंड्री फ्रैगमेंटेशन (boundary fragmentation) को कम करता है, जिससे कम टोकन के साथ काफी अधिक रिकॉल प्राप्त होता है और बिना पुन: अंशांकन (recalibration) के विभिन्न एम्बेडिंग मॉडल्स के बीच मजबूत स्थानांतरणीयता (transferability) प्रदर्शित करता है।

Nathanaël Langlois2026-06-16
💬 NLP

Multimodal Evaluator Preference Collapse: Cross-Modal Contagion in Self-Evolving Agents

यह शोध पत्र मल्टीमॉडल सेल्फ-इवॉल्विंग एजेंट्स में 'इवैल्यूएटर प्रेफरेंस कोलैप्स' (मूल्यांकक प्राथमिकता पतन) की पहचान और मात्रा निर्धारित करता है, जो यह प्रदर्शित करता है कि क्रॉस-मॉडल मूल्यांकन महत्वपूर्ण क्रॉस-मोडल कपलिंग को प्रेरित करता है जो रणनीति चयन को दूषित करता है, जबकि सेल्फ-इवैल्यूएशन इस पूर्वाग्रह के प्रति लगभग पूर्ण प्रतिरक्षा प्रदान करता है।

Zewen Liu2026-06-16