💻 computer science

Mitigating Hallucination in Large Vision-Language Models via Adaptive Attention Calibration

यह शोध पत्र कॉन्फिडेंस-अवेयर अटेंशन कैलिब्रेशन (CAAC) फ्रेमवर्क प्रस्तुत करता है, जो एक ट्रेनिंग-मुक्त विधि है जो विजुअल-टोकन कैलिब्रेशन और एडेप्टिव अटेंशन री-स्केलिंग के माध्यम से स्थानिक धारणा और मोडैलिटी पूर्वाग्रहों को सुधारकर लार्ज विजन-लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) को कम करती है, जिससे लॉन्ग-फॉर्म जनरेशन कार्यों में सटीकता में उल्लेखनीय सुधार होता है।

Mehrdad Fazli, Bowen Wei, Ahmet Sari, Ziwei Zhu2026-04-13
💬 NLP

Bayesian Social Deduction with Graph-Informed Language Models

यह शोध पत्र एक हाइब्रिड फ्रेमवर्क पेश करता है जो विश्वास अनुमान (belief inference) के लिए एक संरचित संभाव्य मॉडल को भाषा संवाद के लिए एक LLM के साथ जोड़ता है, जिससे एक सोशल डिटेक्शन एजेंट 'अवलॉन' के खेल में बड़े लैंग्वेज मॉडल्स और मानव खिलाड़ियों दोनों को पछाड़ने में सक्षम होता है और मनुष्यों के विरुद्ध 67% जीत दर प्राप्त करता है।

Shahab Rahimirad, Guven Gergerli, Lucia Romero, Angela Qian, Matthew Lyle Olson, Simon Stepputtis, Joseph Campbell2026-04-13
💬 NLP

BEDTime: A Unified Benchmark for Automatically Describing Time Series

यह शोध पत्र BEDTime प्रस्तुत करता है, जो एक एकीकृत बेंचमार्क है जिसमें पांच डेटासेट और तीन मोडैलिटीज शामिल हैं, जो यह मूल्यांकन करने के लिए है कि अत्याधुनिक मॉडल यूनिवेरिएट टाइम सीरीज़ (एकचर समय श्रृंखला) के विवरण को कितनी अच्छी तरह पहचानते, अंतर करते और उत्पन्न करते हैं, जिससे यह पता चलता है कि समर्पित टाइम-सीरीज-लैंग्वेज मॉडल विजन-लैंग्वेज मॉडल्स की तुलना में कम प्रदर्शन करते हैं जबकि सभी दृष्टिकोण वास्तविक दुनिया की मजबूती (रोबस्टनेस) के साथ संघर्ष करते हैं।

Medhasweta Sen, Zachary Gottesman, Jiaxing Qiu, C. Bayan Bruss, Nam Nguyen, Tom Hartvigsen2026-04-13
💬 NLP

Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis

यह शोध पत्र टास्क सबस्पेस लॉजिट एट्रिब्यूशन (TSLA) फ्रेमवर्क को इन-कॉन्टेक्स्ट लर्निंग को विशिष्ट टास्क रिकग्निशन और टास्क लर्निंग घटकों में यांत्रिक रूप से स्थानीयकृत करने के लिए प्रस्तुत करता है, जो उन विशेष अटेंशन हेड्स की पहचान करता है जो हिडन स्टेट्स को क्रमशः टास्क सबस्पेस के साथ संरेखित करते हैं और उन्हें सही भविष्यवाणियों की ओर घुमाते हैं।

Haolin Yang, Hakaze Cho, Naoya Inoue2026-04-13
💬 NLP

Task Vectors, Learned Not Extracted: Performance Gains and Mechanistic Insight

यह शोध पत्र इन-कॉन्टेक्स्ट लर्निंग के लिए एक्सट्रैक्टेड टास्क वेक्टर्स के एक बेहतर, सीधे प्रशिक्षित विकल्प के रूप में लर्नड टास्क वेक्टर्स (LTVs) को प्रस्तुत करता है, जबकि यह इस बात की यांत्रिक अंतर्दृष्टि भी प्रदान करता है कि ये वेक्टर्स ट्रांसफॉर्मर मॉडल्स के भीतर विशिष्ट अटेंशन सर्किट्स और लीनियर प्रोपेगेशन पैटर्न के माध्यम से भविष्यवाणियों को कैसे निर्देशित करते हैं।

Haolin Yang, Hakaze Cho, Kaize Ding, Naoya Inoue2026-04-13
💬 NLP

Exploiting Web Search Tools of AI Agents for Data Exfiltration

यह शोध पत्र वेब सर्च टूल्स के माध्यम से अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन हमलों के प्रति लार्ज लैंग्वेज मॉडल्स की संवेदनशीलता का व्यवस्थित रूप से मूल्यांकन करता है, जो विविध मॉडल्स में निरंतर बनी रहने वाली कमजोरियों को प्रकट करता है और सुरक्षा को कोर एआई डिज़ाइन में एकीकृत करने के लिए उन्नत प्रशिक्षण, केंद्रीकृत थ्रेट डेटाबेस और एकीकृत परीक्षण ढांचे की वकालत करता है।

Dennis Rall, Bernhard Bauer, Mohit Mittal, Thomas Fraunholz2026-04-13
💬 NLP

LLM4Delay: Flight Delay Prediction via Cross-Modality Adaptation of Large Language Models and Aircraft Trajectory Representation

यह शोध पत्र LLM4Delay का प्रस्ताव करता है, जो एक नवीन ढांचा है जो टेक्स्टुअल एयरोनॉटिकल डेटा को एयरक्राफ्ट ट्रेजेक्टरी रिप्रजेंटेशन के साथ एक क्रॉस-मोडैलिटी अडैप्टेशन रणनीति के माध्यम से एकीकृत करके उड़ान विलंब की भविष्यवाणी को बढ़ाता है, जिससे यह मौजूदा एयर ट्रैफिक मैनेजमेंट सिस्टम से बेहतर प्रदर्शन करता है।

Thaweerath Phisannupawong, Joshua Julian Damanik, Han-Lim Choi2026-04-13
💬 NLP

A Method for Characterizing Disease Progression from Acute Kidney Injury to Chronic Kidney Disease

यह अध्ययन इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड डेटा और मल्टी-स्टेट मॉडलिंग का उपयोग करके पंद्रह विशिष्ट पोस्ट-एक्यूट किडनी इंजरी क्लिनिकल अवस्थाओं की पहचान करता है, जो यह प्रकट करता है कि कैसे स्थापित और नवीन दोनों जोखिम कारक इन प्रक्षेप पथों (ट्रैजेक्टरीज) में क्रोनिक किडनी डिजीज की प्रगति को अलग-अलग तरह से प्रभावित करते हैं।

Yilu Fang, Jordan G. Nestor, Casey N. Ta, Jerard Z. Kneifati-Hayek, Chunhua Weng2026-04-13
💬 NLP

SkillFactory: Self-Distillation For Learning Cognitive Behaviors

SkillFactory एक सेल्फ-डिस्टिलेशन (self-distillation) विधि पेश करता है जो एक मॉडल के अपने ही अपूर्ण रीजनिंग ट्रेसेस (reasoning traces) को सुपरवाइज्ड फाइन-ट्यूनिंग डेटा में पुनर्व्यवस्थित करता है ताकि उसे बाद के सुदृढीकरण लर्निंग (reinforcement learning) के दौरान वेरिफिकेशन (verification) और बैकट्रैकिंग (backtracking) जैसे मजबूत संज्ञानात्मक कौशल प्राप्त करने के लिए तैयार किया जा सके, जो अंततः मानक दृष्टिकोणों की तुलना में सामान्यीकरण (generalization) और आउट-ऑफ-डोमेन मजबूती (out-of-domain robustness) में सुधार करता है।

Zayne Sprague, Jack Lu, Manya Wadhwa, Sedrick Keh, Mengye Ren, Greg Durrett2026-04-13
💬 NLP

Overstating Attitudes, Ignoring Networks: LLM Biases in Simulating Misinformation Susceptibility

यह शोध पत्र पाता है कि जहाँ बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) दुष्प्रचार के प्रति संवेदनशीलता के मानवीय पैटर्न की व्यापक रूप से नकल कर सकते हैं, वहीं वे विश्वास और साझा करने के बीच के संबंध को व्यवस्थित रूप से बढ़ा-चढ़ाकर बताते हैं और नेटवर्क विशेषताओं की तुलना में अभिवृत्ति संबंधी कारकों को असमान रूप से प्राथमिकता देते हैं, जो यह सुझाव देता है कि वे मानवीय निर्णय को प्रतिस्थापित करने के बजाय मानवीय निर्णय से विचलन की पहचान करने के लिए अधिक उपयुक्त हैं।

Eun Cheol Choi, Lindsay E. Young, Emilio Ferrara2026-04-13