💬 NLP

QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents

यह शोध पत्र QUACK को प्रस्तुत करता है, जो एक ओपन-सोर्स मल्टीमॉडल सोशल डिटेक्शन फ्रेमवर्क है जो ग्राउंड-ट्रुथ ट्रेजेक्टरीज (ground-truth trajectories) को पुनर्गठित करके लार्ज लैंग्वेज मॉडल एजेंटों का ऑडिट करता है ताकि मतिभ्रम (hallucinations), निराधार आरोपों और भाषा एवं कार्यों के बीच विसंगतियों का स्वतः पता लगाया जा सके और उन्हें मापा जा सके।

Ye Yuan, Rui Song, Weien Li, Zeyu Li, Haochen Liu, Xiangyu Kong, Changjiang Han, Yonghan Yang, Zichen Zhao, Zixuan Dong (…)2026-05-27
🧬 biology

Beyond Binary: Speech Representations Across the Cognitive Score Hierarchy

यह अध्ययन 5,754 जर्मन भाषण रिकॉर्डिंग का विश्लेषण करता है यह प्रकट करने के लिए कि जबकि कम संज्ञानात्मक स्तरों पर स्व-पर्यवेक्षित शिक्षण एम्बेडिंग (self-supervised learning embeddings) हस्तनिर्मित विशेषताओं (hand-crafted features) से बेहतर प्रदर्शन करते हैं, वहीं हस्तनिर्मित विशेषताएँ MCI वर्गीकरण में उत्कृष्ट होती हैं, जिसमें कार्य-विशिष्ट बाधाएं यह निर्धारित करती हैं कि संज्ञानात्मक स्कोर पदानुक्रम में प्रतिनिधित्व "विशेषज्ञों" (specialists) या "सामान्यज्ञों" (generalists) के रूप में व्यवहार करते हैं।

Serli Kopar, Roshan Prakash Rane, Christian Mychajliw, Lydia Federmann, Gerhard Eschweiler, Daniela Berg, Sam Gijsen, Pa (…)2026-05-27
💬 NLP

EpiCurveBench: Evaluating VLMs on Epidemic Curve Digitization

यह शोध पत्र EpiCurveBench का परिचय देता है, जो 1,000 वास्तविक दुनिया के महामारी वक्र (epidemic curve) चित्रों का एक बेंचमार्क है, और EpiCurveSimilarity (ECS) को, जो एक नवीन मूल्यांकन मीट्रिक है जो टेम्पोरल संरचना और स्थानीय बदलावों को ध्यान में रखता है, यह प्रदर्शित करने के लिए कि वर्तमान विजन-लैंग्वेज मॉडल महामारी वक्र के डिजिटलीकरण में संघर्ष करते हैं और ECS मौजूदा की-वैल्यू मीट्रिक्स की तुलना में अधिक भेदभावपूर्ण और महामारी विज्ञान संबंधी रूप से प्रासंगिक मूल्यांकन प्रदान करता है।

Thomas Berkane, Maimuna S. Majumder2026-05-27
💬 NLP

GraphReview: Scientific Paper Evaluation via LLM-Based Graph Message Passing

GraphReview एक नवीन ग्राफ-आधारित LLM फ्रेमवर्क है जो एक सिमेंटिक ग्राफ पर मैसेज पासिंग के माध्यम से आंतरिक गुणवत्ता और अंतर-पेपर संबंधों को मॉडल करके वैज्ञानिक शोध पत्रों के मूल्यांकन को बढ़ाता है, जिससे मौजूदा बेसलाइन्स की तुलना में निर्णय सटीकता, रैंकिंग और समीक्षा पीढ़ी में महत्वपूर्ण सुधार प्राप्त होता है।

Pujun Zheng, Wanying Ren, Jiacheng Yao, Guoxiu He, Star X. Zhao2026-05-27
💬 NLP

Temporal Simultaneity Predicts Annotation Quality in Sentiment Corpora

यह शोध पत्र एक सेत्स्वाना सेंटिमेंट डेटासेट प्रस्तुत करता है और यह प्रदर्शित करता है कि टेम्पोरल सिमुल्टेनियटी (टेम्पोरल समवर्तीता)—यानी एनोटेशन के बीच का समय अंतराल—इंटर-एनोटेटर एग्रीमेंट का प्राथमिक भविष्यवक्ता है, जिसमें लेबल एक मिनट के भीतर दिए जाने पर लगभग पूर्ण निरंतरता देखी जाती है जबकि लंबे समय की अवधि में महत्वपूर्ण विचलन होता है, साथ ही उन बहुभाषी मॉडलों का बेंचमार्किंग भी करता है जो फाइन-ट्यूनिंग के बाद उत्कृष्ट प्रदर्शन प्राप्त करते हैं।

Idris Abdulmumin, Mokgadi Penelope Matloga, Tadesse Destaw Belay, Botshelo Kondowe, Letlhogonolo Mohleleng, Hareaipha Nk (…)2026-05-27
💬 NLP

ENPMR-Bench: Benchmarking Proactive Memory Retrieval for Emotional Support Agents

यह शोध पत्र ENPMR-Bench प्रस्तुत करता है, जो इमोशनल नीड-अवेयर प्रोएक्टिव मेमोरी रिट्रीवल (Emotional Need-aware Proactive Memory Retrieval) का मूल्यांकन करने के लिए मास्लो के आवश्यकताओं के पदानुक्रम (Maslow's hierarchy of needs) पर आधारित 1,800 से अधिक संवादों वाला एक बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान रिट्रीवल प्रतिमान (retrieval paradigms) अंतर्निहित भावनात्मक आवश्यकताओं का अनुमान लगाने और सहानुभूतिपूर्ण बातचीत के लिए सहायक स्मृतियों को सक्रिय रूप से पुनः प्राप्त करने में काफी संघर्ष करते हैं।

Xing Fu, Yulin Hu, Mengtong Ji, Haozhen Li, Yixin Sun, Weixiang Zhao, Yanyan Zhao, Bing Qin2026-05-27
🤖 AI

Gumbel Machine: Counterfactual Student Writing Generation via Gumbel Noise Steering

यह शोध पत्र गंबेल मशीन (Gumbel Machine) का परिचय देता है, जो एक नवीन β\beta-हिंडसाइट (Hindsight) नियंत्रित डिकोडिंग एल्गोरिदम का उपयोग करने वाला एक मॉड्यूलर ढांचा है, जो मूल कार्य के साथ समानता और गुणवत्ता सुधार के बीच प्रभावी ढंग से संतुलन बनाए रखते हुए रूब्रिक-संगत प्रतितथ्यात्मक (counterfactual) छात्र लेखन उत्पन्न करने के लिए गंबेल शोर (Gumbel noise) का उपयोग करता है।

Hunter McNichols, Alexander Scarlatos, Mihai Dascalu, Danielle McNamara, Andrew Lan2026-05-27
💬 NLP

Pair-In, Pair-Out: Latent Multi-Token Prediction for Efficient LLMs

यह शोध पत्र 'पेयर-इन, पेयर-आउट' (PIPO) का प्रस्ताव करता है, जो एक एकीकृत ढांचा है जो लेटेंसी में महत्वपूर्ण तेजी लाने और एक अलग सत्यापनकर्ता पास (verifier pass) के बिना बड़े भाषा मॉडलों में बेहतर तर्क प्रदर्शन प्राप्त करने के लिए लेटेंट इनपुट संपीड़न (latent input compression) को मल्टी-टोकन आउटपुट प्रेडिक्शन और एक हल्के आत्मविश्वास-आधारित स्वीकृति तंत्र (confidence-based acceptance mechanism) के साथ जोड़ता है।

Wenhui Tan, Minghao Li, Xiaoqian Ma, Siqi Fan, Xiusheng Huang, Liujie Zhang, Ruihua Song, Weihang Chen2026-05-27
💬 NLP

Lost in Sampling: Assessing Lexical Reachability in LLMs via the Word Coverage Score (WCS)

यह शोध पत्र वर्ड कवरेज स्कोर (WCS) प्रस्तुत करता है, जो एक ऐसा मीट्रिक है जो यह दर्शाता है कि लार्ज लैंग्वेज मॉडल्स में मानक डिकोडिंग सैंपलिंग फिल्टर्स व्यवस्थित रूप से संदर्भ के अनुकूल, कम-आवृत्ति वाले मानवीय शब्दावली को हटा देते हैं, जिससे वे अनपेक्षित सेंसरशिप तंत्र के रूप में कार्य करते हैं जो लेक्सिकल विविधता को दबाते हैं और उत्पन्न टेक्स्ट को समरूप बनाते हैं।

Samer Awad, Javier Conde, Carlos Arriaga, Tairan Fu, Javier Coronado-Blázquez, Pedro Reviriego2026-05-27
💬 NLP

It's Not Always Sycophancy: Measuring LLM Conformity as a Function of Epistemic Uncertainty

यह शोध पत्र MUSE प्रस्तुत करता है, जो एक ऐसा ढांचा है जो यह प्रदर्शित करता है कि उपयोगकर्ता के प्रतिरोध के प्रति LLM की अनुरूपता न केवल चापलूसी (sycophancy) से प्रेरित है, बल्कि एपिस्टेमिक अनिश्चितता (epistemic uncertainty) से भी संचालित है, और ये दोनों कारक उपयोगकर्ता की कथित विशेषज्ञता और उनके सुझावों की संभाव्यता के आधार पर बढ़ते हैं।

Kevin H. Guo, Chao Yan, Avinash Baidya, Katherine Brown, Xiang Gao, Juming Xiong, Zhijun Yin, Bradley A. Malin2026-05-27