💬 NLP

Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization

यह शोधपत्र FaithMate को प्रस्तुत करता है, जो एक एकीकृत ढांचा है जो प्रासंगिक (contextual) और पैरामीट्रिक (parametric) चेन-ऑफ-थॉट निष्ठा (faithfulness) के बीच एक विषम सकारात्मक युग्मन (asymmetric positive coupling) को प्रकट करता है, जो यह प्रदर्शित करता है कि पैरामीट्रिक निष्ठा के लिए अनुकूलन विभिन्न प्रतिमानों (paradigms) में अधिक सुसंगत रूप से सामान्यीकृत होता है, जबकि साथ ही अंतर्निहित समझौतों (trade-offs) और निष्ठा मेट्रिक्स की गैर-एकात्मक प्रकृति को भी उजागर करता है।

Jingyi Sun, Qianli Wang, Pepa Atanasova, Nils Feldhus, Isabelle Augenstein2026-05-26
💬 NLP

Universal Boosts, Specific Suppressors: Sparse Autoencoder Steering of Medical Vision-Language Models

यह शोध पत्र यूनिवर्सल बूस्ट दिशाओं और मॉडल-विशिष्ट सप्रेशन दिशाओं को लागू करके, यूनिवर्सल बूस्ट दिशाओं और मॉडल-विशिष्ट सप्रेशन दिशाओं को लागू करके, स्पार्स ऑटोएन्कोडर-आधारित रेसिडुअल स्टीयरिंग का उपयोग करने वाले एक इन्फरेंस-ओनली विधि को प्रस्तुत करता है जो बिना पुनप्रशिक्षण के कई आर्किटेक्चर और डेटासेट में प्रभावशीलता प्रदर्शित करते हुए मेडिकल विजन-लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) को महत्वपूर्ण रूप से कम करता है और रिपोर्ट की गुणवत्ता में सुधार करता है।

Farhad Nooralahzadeh, Benjamin Gundersen, Nicolas Deperrois, Hidetoshi Matsuom, Mizuho Nishio, Thomas Frauenfelder, Ahme (…)2026-05-26
💬 NLP

Large Language Model Selection with Limited Annotations

यह शोध पत्र SELECT-LLM प्रस्तुत करता है, जो एक नवीन ढांचा है जो एनोटेशन के लिए प्रश्नों के एक न्यूनतम सेट को सक्रिय रूप से चुनने के लिए युग्मवार (pairwise) मॉडल आउटपुट समानताओं से प्राप्त अपेक्षित सूचना लाभ (expected information gain) का लाभ उठाता है, जिससे मॉडल वेट्स (weights) तक पहुंच की आवश्यकता के बिना, किसी दिए गए कार्य के लिए सर्वश्रेष्ठ लार्ज लैंग्वेज मॉडल की प्रभावी ढंग से पहचान करते हुए मूल्यांकन लागत को काफी कम किया जा सकता है।

Yavuz Durmazkeser, Patrik Okanovic, Andreas Kirsch, Torsten Hoefler, Nezihe Merve Gürel2026-05-26
💬 NLP

Exploring Profiles of Cognitive Distortions Associated with Mental Health Disorders

यह अध्ययन एक बड़े रेडिट (Reddit) डेटासेट पर n-ग्राम और ट्रांसफॉर्मर-आधारित विधियों का उपयोग करके यह प्रदर्शित करता है कि नौ स्व-रिपोर्ट किए गए मानसिक स्वास्थ्य समूहों के व्यक्तियों में एक नियंत्रण समूह की तुलना में संज्ञानात्मक विकृतियों (cognitive distortions) का उच्च प्रसार होता है, जो विभिन्न स्थितियों में भिन्न तीव्रता स्तरों के साथ काफी समान विकृति प्रोफाइल को प्रकट करता है।

Alina Anikejeva, Kairit Sirts2026-05-26
💬 NLP

Better, Faster: Harnessing Self-Improvement in Large Reasoning Models

यह शोध पत्र HSIR का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो 'वेरिफाई-देन-एग्जिट' सैंपलिंग रणनीति और एक 'इंट्रिन्सिक डायवर्सिटी' स्कोर के माध्यम से डेटा असंतुलन और ओवरथिंकिंगिंग को संबोधित करके लार्ज रीजनिंग मॉडल्स को बेहतर बनाता है, जिससे तर्क प्रदर्शन और अनुमान दक्षता दोनों में महत्वपूर्ण सुधार होता है।

Qihuang Zhong, Liang Ding, Juhua Liu, Bo Du, Leszek Rutkowski, Dacheng Tao2026-05-26
🤖 AI

Privacy-Preserving Local Language Models for Longitudinal Data Retrieval in Chronic Dermatologic Disease: Implementation in Pemphigus Patients

यह अध्ययन प्रदर्शित करता है कि एक स्थानीय रूप से तैनात, गोपनीयता-संरक्षण वाला लघु भाषा मॉडल (Qwen3 4B), व्यापक पेम्फिगस रोगी रिकॉर्ड से नैदानिक विशेषताओं को सटीक रूप से निकाल सकता है और उच्च गुणवत्ता वाले अनुदैर्ध्य सारांश उत्पन्न कर सकता है, जो डेटा सुरक्षा बनाए रखते हुए दक्षता और विश्वसनीयता में संभावित रूप से मानव विशेषज्ञों से बेहतर प्रदर्शन कर सकता है।

Abdurrahim Yilmaz, Ayşe Esra Koku Aksu, Duygu Yamen, Vefa Asli Erdemir, Mehmet Salih Gurel, Gulsum Gencoglan, Joram M. P (…)2026-05-26
💬 NLP

Language Bias in LVLMs: From In-Depth Analysis to Simple and Effective Mitigation

यह शोध पत्र प्रशिक्षण के दौरान मोडैलिटी मिसअलाइनमेंट (modality misalignment) को लार्ज विजन-लैंग्वेज मॉडल्स में भाषाई पूर्वाग्रह के मूल कारण के रूप में पहचानता है और दो प्रभावी, डेटा-मुक्त न्यूनीकरण विधियों, लैंग्वेज बायस रेगुलराइजेशन (LBR) और लैंग्वेज बायस पेनल्टी (LBP) का प्रस्ताव करता है, जो मतिभ्रम (hallucinations) को महत्वपूर्ण रूप से कम करने और मल्टीमॉडल संरेखण (multimodal alignment) में सुधार करने के लिए हैं।

Yangneng Chen, Jing Li2026-05-26
💬 NLP

TRACE: A taxonomy-grounded synthetic dataset for teaching-program generation and session interpretation in Applied Behavior Analysis

यह शोध पत्र TRACE को प्रस्तुत करता है, जो 2,999 उदाहरणों का एक वर्गीकरण-आधारित (taxonomy-grounded) सिंथेटिक डेटासेट है, जिसे HIPAA प्रतिबंधों को दूर करने के लिए डिज़ाइन किया गया है ताकि शिक्षण-कार्यक्रम पीढ़ी (teaching-program generation) और बहु-सत्र व्यवहार संबंधी व्याख्या (multi-session behavioral interpretation) जैसे एप्लाइड बिहेवियरल एनालिसिस (ABA) कार्यों के लिए AI मॉडल को प्रशिक्षित किया जा सके।

Festus Kahunla2026-05-26
💬 NLP

Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground Truth

यह शोधपत्र BonaFide को एक नए बेंचमार्क के रूप में प्रस्तुत करता है जिसमें ग्राउंड-ट्रुथ फिडेलिटी (सत्यता) लेबल हैं, ताकि यह प्रदर्शित किया जा सके कि चेन-ऑफ-थॉट (CoT) रीजनिंग के मूल्यांकन के लिए मौजूदा मेट्रिक्स काफी हद तक अप्रभावी हैं, जो लगभग संयोग (near-chance) प्रदर्शन प्रदर्शित करते हैं और विश्वसनीय रूप से यह मापने में विफल रहते हैं कि मॉडल के ट्रेस वास्तव में उनकी आंतरिक गणनाओं को दर्शाते हैं या नहीं।

Yoav Gur-Arieh, Ana Marasović, Mor Geva2026-05-26
💬 NLP

AgentIR: A Workload-Adaptive Cascade Retrieval Substrate for Long-Term Conversational Memory

AgentIR दीर्घकालिक संवादात्मक स्मृति के लिए एक वर्कलोड-अनुकूलित कैस्केड रिट्रीवल सबस्ट्रेट पेश करता है जो आत्मविश्वास थ्रेशोल्ड के आधार पर महंगे डेंस रिट्रीवल को गतिशील रूप से स्किप करता है और विविध बेंचमार्क में रिट्रीवल सटीकता को बनाए रखते हुए या सुधारते हुए सब-10ms लेटेंसी और 132x तक की स्पीडअप प्राप्त करने के लिए एक टाइम-पार्टीशन इंडेक्स का उपयोग करता है।

Aojie Yuan, Haiyue Zhang, Shahin Nazarian2026-05-26