💬 NLP

Beyond Masks: Efficient, Flexible Diffusion Language Models via Deletion-Insertion Processes

यह शोध पत्र डिलीशन-इंसर्शन डिफ्यूजन (DID) लैंग्वेज मॉडल्स का परिचय देता है, जो मौजूदा मास्क्ड डिफ्यूजन लैंग्वेज मॉडल्स की तुलना में बेहतर कम्प्यूटेशनल दक्षता, नेटिव वेरिएबल-लेंथ सपोर्ट और अंतर्निहित सेल्फ-करेक्शन क्षमताओं को प्राप्त करने के लिए टोकन मास्किंग प्रतिमान को कठोर डिलीशन और इंसर्शन प्रक्रियाओं से बदल देते हैं।

Fangyu Ding, Ding Ding, Sijin Chen, Kaibo Wang, Peng Xu, Zijin Feng, Haoli Bai, Kai Han, Youliang Yan, Binhang Yuan, Jia (…)2026-03-26
💬 NLP

Internal Safety Collapse in Frontier Large Language Models

यह शोध पत्र "आंतरिक सुरक्षा पतन" (Internal Safety Collapse) की पहचान करता है, जो फ्रंटियर लार्ज लैंग्वेज मॉडल्स में एक महत्वपूर्ण विफलता मोड है जहाँ जटिल, डोमेन-विशिष्ट कार्य अनजाने में मॉडलों को हानिकारक सामग्री उत्पन्न करने के लिए मजबूर कर देते हैं, जिससे यह प्रकट होता है कि उन्नत क्षमताएं और संरेखण प्रयास उच्च-जोखिम वाले पेशेवर परिवेशों में अंतर्निहित सुरक्षा जोखिमों को समाप्त नहीं कर सकते हैं।

Yutao Wu, Xiao Liu, Yifeng Gao, Xiang Zheng, Hanxun Huang, Yige Li, Cong Wang, Bo Li, Xingjun Ma, Yu-Gang Jiang2026-03-26
💬 NLP

Visuospatial Perspective Taking in Multimodal Language Models

यह शोध पत्र प्रकट करता है कि मल्टीमॉडल लैंग्वेज मॉडल्स में लेवल 2 विज़ुओस्पेशियल पर्सपेक्टिव-टेकिंग (दृश्य-स्थानिक परिप्रेक्ष्य-ग्रहण) में महत्वपूर्ण कमियां हैं, जो दूसरे के दृष्टिकोण को अपनाने के लिए अपने स्वयं के दृष्टिकोण को रोकने में संघर्ष करते हैं, जो सामाजिक और सहयोगात्मक परिवेश में उनकी तैनाती के लिए महत्वपूर्ण सीमाओं को रेखांकित करता है।

Jonathan Prunty, Seraphina Zhang, Patrick Quinn, Jianxun Lian, Xing Xie, Lucy Cheke2026-03-26
💬 NLP

S-Path-RAG: Semantic-Aware Shortest-Path Retrieval Augmented Generation for Multi-Hop Knowledge Graph Question Answering

S-Path-RAG एक सिमेंटिक-अवेयर (semantic-aware), रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क है जो मौजूदा बेसलाइन्स की तुलना में उच्च सटीकता, बेहतर साक्ष्य कवरेज और अधिक दक्षता प्राप्त करने के लिए एक हाइब्रिड पाथ एन्यूमरेशन रणनीति को एक डिफरेंशिएबल स्कोरर और एक इटरेटिव न्यूरल-सोक्रेटिक डायलॉग लूप के साथ जोड़कर मल्टी-हॉप नॉलेज ग्राफ क्वेश्चन आंसरिंग में सुधार करता है।

Rong Fu, Yemin Wang, Tianxiang Xu, Yongtai Liu, Weizhi Tang, Wangyu Wu, Xiaowen Ma, Simon Fong2026-03-26
💬 NLP

Berta: an open-source, modular tool for AI-enabled clinical documentation

यह शोध पत्र बर्टा (Berta) को प्रस्तुत करता है, जो अल्बर्टा हेल्थ सर्विसेज के भीतर बड़े पैमाने पर तैनात एक ओपन-सोर्स, मॉड्यूलर एआई स्क्राइब प्लेटफॉर्म है, जो मौजूदा बुनियादी ढांचे के साथ एकीकृत होकर लागत को काफी कम करता है और डेटा संप्रभुता सुनिश्चित करता है, साथ ही अनेक सुविधाओं में हजारों नैदानिक सत्र उत्पन्न करता है।

Samridhi Vaid, Mike Weldon, Jesse Dunn, Sacha Davis, Kevin Lonergan, Henry Li, Jeffrey Franc, Mohamed Abdalla, Daniel C. (…)2026-03-26
💬 NLP

DepthCharge: A Domain-Agnostic Framework for Measuring Depth-Dependent Knowledge in Large Language Models

यह शोध पत्र DepthCharge को प्रस्तुत करता है, जो एक डोमेन-अज्ञेय (domain-agnostic) ढांचा है जो एडेप्टिव प्रोबिंग और ऑन-डिमांड फैक्ट वेरिफिकेशन के माध्यम से लार्ज लैंग्वेज मॉडल्स के गहराई-निर्भर ज्ञान को मापता है, जिससे प्रदर्शन में उन महत्वपूर्ण विविधताओं का खुलासा होता है जिन्हें मानक बेंचमार्क पकड़ने में विफल रहते हैं।

Alexander Sheppert2026-03-26
💬 NLP

Training a Large Language Model for Medical Coding Using Privacy-Preserving Synthetic Clinical Data

यह शोध पत्र प्रदर्शित करता है कि इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड से प्राप्त गोपनीयता-संरक्षित सिंथेटिक क्लिनिकल डेटा पर Llama 3-70B मॉडल को फाइन-ट्यून करने से मेडिकल कोडिंग कार्यों में इसकी सटीकता में महत्वपूर्ण सुधार होता है, जिससे संरक्षित स्वास्थ्य जानकारी को उजागर किए बिना सामान्य चिकित्सा समझ पर प्रदर्शन बनाए रखते हुए 0.70 से अधिक का सटीक-मैच (exact-match) F1 स्कोर प्राप्त होता है।

John Cook, Michael Wyatt, Peng Wei, Iris Chin, Santosh Gupta, Van Zyl Van Vuuren, Richie Siburian, Amanda Spicer, Kriste (…)2026-03-26
🤖 machine learning

Beyond Accuracy: Introducing a Symbolic-Mechanistic Approach to Interpretable Evaluation

यह शोध पत्र एक प्रतीकात्मक-यांत्रिक (symbolic-mechanistic) मूल्यांकन ढांचे के पक्ष में तर्क देता है जो वास्तविक सामान्यीकरण (generalization) को स्मृति (memorization) और शॉर्टकट से विश्वसनीय रूप से अलग करने के लिए कार्य-प्रासंगिक नियमों को यांत्रिक व्याख्यात्मकता (mechanistic interpretability) के साथ जोड़ता है, जो NL-to-SQL कार्यों में मानक सटीकता मेट्रिक्स की तुलना में इसकी श्रेष्ठता को प्रदर्शित करता है।

Reza Habibi, Darian Lee, Magy Seif El-Nasr2026-03-26
💬 NLP

Chitrakshara: A Large Multilingual Multimodal Dataset for Indian languages

यह शोध पत्र चित्रक्षर (Chitrakshara) को प्रस्तुत करता है, जो 11 भारतीय भाषाओं के लिए इंटरलीव्ड इमेज-टेक्स्ट डेटा और इमेज-कैप्शन पेयर्स से युक्त एक बड़े पैमाने का बहुभाषी बहुविध (multimodal) डेटासेट श्रृंखला है, जिसे विजन-लैंग्वेज मॉडल्स में प्रतिनिधित्व की कमी को दूर करने और अधिक सांस्कृतिक रूप से समावेशी एआई प्रणालियों के विकास को सक्षम करने के लिए डिज़ाइन किया गया है।

Shaharukh Khan, Ali Faraz, Abhinav Ravi, Mohd Nauman, Mohd Sarfraz, Akshat Patidar, Raja Kolla, Chandra Khatri, Shubham (…)2026-03-26
💬 NLP

Qworld: Question-Specific Evaluation Criteria for LLMs

क्वोर্ল্ড (Quworld) एक नवीन मूल्यांकन ढांचा पेश करता है जो एक पुनरावर्ती विस्तार वृक्ष (recursive expansion tree) के माध्यम से प्रश्न-विशिष्ट मानदंड उत्पन्न करता है, जिससे पारंपरिक स्थिर रूब्रिक्स की तुलना में ओपन-एंडेड कार्यों पर लार्ज लैंग्वेज मॉडल्स का अधिक सूक्ष्म और संदर्भ-जागरूक मूल्यांकन संभव हो पाता है।

Shanghua Gao, Yuchang Su, Pengwei Sui, Curtis Ginder, Marinka Zitnik2026-03-26