💬 NLP

Know You Before You Speak: User-State Modeling for LLM Personalization in Multi-Turn Conversation

यह शोध पत्र PUMA को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो फ्री एनर्जी प्रिंसिपल (Free Energy Principle) पर आधारित है और जो लेटेंट यूजर स्टेट्स (latent user states) को मॉडल करके और आंशिक दृश्यता (partial observability) के तहत निर्णय लेने के माध्यम से संवाद क्रियाओं का चयन करके LLM वैयक्तिकरण को बढ़ाता है, जिससे यह निष्क्रिय मेमोरी रिट्रीवल (passive memory retrieval) से हटकर बहु-चरण वार्तालापों में उपयोगकर्ता के विकास के सक्रिय प्रबंधन की ओर स्थानांतरित हो जाता है।

Jiani Luo, Xiaoyan Zhao, Yang Zhang, Shuyi Miao, Bingbing Xu, Stefan Konigorski, Tat-Seng Chua2026-05-26
🤖 AI

Measuring Reasoning Quality in LLMs: A Multi-Dimensional Behavioral Framework

यह शोध पत्र एक एकीकृत बहु-आयामी व्यवहारिक ढांचे (behavioral framework) को प्रस्तुत करता है जो LLM तर्क क्षमता का छह विशिष्ट आयामों—सत्यता (Correctness), निरंतरता (Consistency), सुदृढ़ता (Robustness), तार्किक सुसंगतता (Logical Coherence), दक्षता (Efficiency), और स्थिरता (Stability)—के माध्यम से मूल्यांकन करता है, ताकि महत्वपूर्ण अंतर्दृष्टि प्राप्त की जा सके और उन रैंकिंग त्रुटियों को रोका जा सके जिन्हें पारंपरिक केवल-सटीकता (accuracy-only) वाले मेट्रिक्स अनदेखा कर देते हैं।

Ali Şenol, Garima Agrawal, Huan Liu2026-05-26✓ Author reviewed
🤖 AI

Exploration of Perceptual Speech Features for Clinical Decision-Support in Mental Health Care

यह शोध पत्र एक पारदर्शी, विशेषता-आधारित ढांचे को प्रस्तुत करता है जो नियंत्रित बेंचमार्क और वास्तविक दुनिया के नैदानिक डेटा, दोनों में अवसाद, चिंता और ADHD की गंभीरता के बीच स्वर और भाषाई पैटर्न के बीच स्थिर संबंधों की पहचान करने के लिए संवेदी भाषण विशेषताओं और व्याख्या योग्य मशीन लर्निंग का लाभ उठाता है।

Vassilis Lyberatos, Edmund G. Dervakos, Eleni Adamidi, Athanasios Voulodimos, Giorgos Stamou2026-05-26
💬 NLP

Mix-MoE: Improving Multilingual Machine Translation of Large Language Models through Mixed MoEs

यह शोध पत्र Mix-MoE का प्रस्ताव करता है, जो एक दो-चरणीय मिक्सचर-ऑफ-एक्सपर्ट्स (Mixture-of-Experts) ढांचा है जो लैंग्वेज मॉडल और मशीन ट्रांसलेशन विशेषज्ञों को अलग करता है और पैरामीटर इंटरफेरेंस को प्रभावी ढंग से कम करने तथा लार्ज लैंग्वेज मॉडल्स में बहुभाषी मशीन ट्रांसलेशन प्रदर्शन को महत्वपूर्ण रूप से सुधारने के लिए फूरियर ट्रांसफॉर्म-उन्नत रूटिंग का उपयोग करता है।

Bo Li, Tianyu Dong, Shaolin Zhu, Deyi Xiong2026-05-26
💬 NLP

The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models

यह शोधपत्र TraceLock प्रस्तुत करता है, जो एक हल्का, स्व-पर्यवेक्षित (self-supervised) नियंत्रक है जो भविष्य की स्थिरता का लाभ उठाकर फ्रोजन डिफ्यूजन लैंग्वेज मॉडल्स के लिए एक पुन: प्रयोज्य टोकन-कमिटमेंट पॉलिसी सीखता है, जिससे बिना पुन: प्रशिक्षण के विभिन्न सेटिंग्स में जनरेशन की गुणवत्ता और अनुकूलन क्षमता में सुधार होता है।

Bohang Sun, Max Zhu, Francesco Caso, Jindong Gu, Junchi Yu, Philip Torr, Pietro Liò, Jialin Yu2026-05-26
💬 NLP

The Tokenizer Tax Across 25 European Languages: Domain Invariance, Cross-Lingual Few-Shot Effects, and the Ukrainian Penalty

यह शोध पत्र 25 यूरोपीय भाषाओं में एक "टोकेनाइज़र टैक्स" (tokenizer tax) को परिमाणित करता है, जो यह प्रकट करता है कि गैर-अंग्रेजी भाषाएं, विशेष रूप से यूक्रेनी और जटिल रूपविज्ञान वाली भाषाएं, प्री-ट्रेनिंग डेटा में कम प्रतिनिधित्व के कारण काफी उच्च टोकन-टू-वर्ड अनुपात से ग्रस्त हैं, जबकि यह भी दर्शाता है कि ये फर्टिलिटी रैंकिंग विभिन्न डोमेन में सुसंगत बनी रहती हैं और फ्यू-शॉट प्रभाव भाषा-निर्भर होने के बजाय मॉडल-अंतर्निहित हैं।

Volodymyr Ovcharov2026-05-26
💬 NLP

ROC Analysis for Evaluating Translation Quality Estimation Systems

यह शोध पत्र अनुवाद गुणवत्ता अनुमान प्रणालियों के मूल्यांकन के लिए एक व्यावहारिक, निर्णय-उन्मुख पद्धति के रूप में रिसीवर ऑपरेटिंग कैरेक्टरिस्टिक (ROC) विश्लेषण का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि यह मौजूदा मूल्यांकन मेट्रिक्स के साथ संरेखित है और व्यावसायिक निर्णय लेने के लिए कार्रवाई योग्य अंतर्दृष्टि प्रदान करता है।

Evelyn Y. Garland (Acta-Transphere), Carola F. Berger (CFB Scientific Translations LLC)2026-05-26
💬 NLP

StepGap: A Hybrid NLI-LLM Checker for Step-Level Evidence-Gap Detectionin Multi-Hop Question Answering

यह शोध पत्र StepGap को प्रस्तुत करता है, जो एक हाइब्रिड NLI-LLM निर्णय वृक्ष (decision tree) है जो LLM-मात्र बेसलाइनों की तुलना में अधिक संरचनात्मक पारदर्शिता के साथ मल्टी-हॉप प्रश्न उत्तर देने में विशिष्ट चरण-स्तरीय साक्ष्य अंतराल (step-level evidence gaps) का पता लगाता है, और एक टाइप किए गए प्रोसेस रिवॉर्ड के रूप में इसकी प्रभावशीलता को प्रदर्शित करता है जो Qwen2.5-7B-Instruct के सटीक मिलान (exact match) प्रदर्शन में महत्वपूर्ण सुधार करता है।

Yuelyu Ji, Zhuochun Li, Hui Ji, Daqing He2026-05-26
💬 NLP

Who judges the judges? Governance from metrics: a runtime framework for continuous LLM compliance monitoring

यह शोध पत्र "govllm" को प्रस्तुत करता है, जो एक ओपन-सोर्स फ्रेमवर्क है जो यूरोपीय संघ के एआई अधिनियम (EU AI Act) के तहत निरंतर एलएलएम (LLM) अनुपालन निगरानी को सक्षम करने के लिए "मैट्रिक्स से शासन" (governance from metrics) को लागू करता है, जिसमें वास्तविक समय के अनुपालन संकेत उत्पन्न करने और मानवीय मध्यस्थता के लिए अनिश्चितता को चिह्नित करने हेतु नियामक न्यायाधीशों के रूप में विशिष्ट लघु भाषा मॉडलों (small language models) के एक पैनल का उपयोग किया जाता है।

Jehanne Dussert2026-05-26
💬 NLP

Beyond the Target: From Imitation to Collaboration in Speculative Decoding

यह शोध पत्र कोलबोरेटिव स्पेकुलेटिव डिकोडिंग (CoSpec) प्रस्तुत करता है, जो एक नवीन फ्रेमवर्क है जो पारंपरिक इमिटेशन-आधारित दृष्टिकोण को सुदृढीकरण लर्निंग-संचालित मध्यस्थता नीति (reinforcement learning-driven arbitration policy) से बदल देता है, जिससे एक छोटा ड्राफ्ट मॉडल तब भी चुनिंदा रूप से टोकन में योगदान दे पाता है जब वे बड़े टार्गेट मॉडल से मेल नहीं खाते हैं, जिससे महत्वपूर्ण अनुमान गति (inference speedup) और बेहतर अंतिम सटीकता दोनों प्राप्त होते हैं।

Jinze Li, Yixing Xu, Guanchen Li, Jinfeng Xu, Shuo Yang, Yang Zhang, Xuanwu Yin, Dong Li, Edith C. H. Ngai, Emad Barsoum2026-05-26