💬 NLP

Do Models Know Why They Changed Their Mind? Interpretability and Faithfulness of Chain-of-Thought Under Knowledge Conflict

यह शोध पत्र प्रकट करता है कि जहाँ भाषा मॉडलों में चेन-ऑफ-थॉट तर्क मुख्य रूप से ज्ञान का एक स्थिर, निर्णय-अपरिवर्तनीय प्रदर्शन है जो ज्ञान संघर्षों के दौरान उनके विकल्पों की निष्ठापूर्वक व्याख्या करने में विफल रहता है, वहीं स्व-रेटेड आत्मविश्वास निर्णयों की भविष्यवाणी करने के लिए एक कमजोर लेकिन वास्तविक संकेत प्रदान करता है, जो यह सुझाव देता है कि तर्क संबंधी तर्कों का विश्लेषण करने की तुलना में आत्मविश्वास की निगरानी करना अधिक प्रभावी है।

Pruthvinath Jeripity Venkata2026-05-28
🤖 AI

A Query Engine for the Agents

यह शोध पत्र Hyperparam को प्रस्तुत करता है, जो हल्के, ओपन-सोर्स जावास्क्रिप्ट लाइब्रेरीज़ का एक समूह है, जिसे SQL एनालिटिक्स को एसिंक्रोनस (asynchronous) LLM व्याख्या के साथ जोड़कर, क्लाइंट-साइड AI अनुप्रयोगों के भीतर सीधे असंरचित एजेंट डेटा की कुशल, मॉडल-जागरूक क्वेरी सक्षम करने के लिए डिज़ाइन किया गया है।

Kenny Daniel2026-05-28
🤖 machine learning

Locality-Aware Redundancy Pruning for LLM Depth Compression

यह शोध पत्र LoRP का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त (training-free), वन-शॉट डेप्थ प्रूनिंग फ्रेमवर्क है, जो प्रदर्शन को बनाए रखते हुए लार्ज लैंग्वेज मॉडल्स में रेडंडेंसी को प्रभावी ढंग से कम करने के लिए एक नवीन 'रिप्रेजेंटेशन लोकैलिटी स्कोर' के आधार पर लेयर रिमूवल को गतिशील रूप से आवंटित करता है।

Vincent-Daniel Yun, Youngrae Kim, Woosang Lim, YoungJin Heo, Minkyu Kim, Sunwoo Lee2026-05-28
⚡ electrical engineering

GraD-IBD: Graph Representation Learning from Diagnosis Trajectories for Early Detection of Inflammatory Bowel Disease

यह शोध पत्र GraD-IBD प्रस्तावित करता है, जो एक ग्राफ-आधारित मॉडल है जो इफ्फ्लेमेटरी बाउल डिजीज (Inflammatory Bowel Disease) के कुशल, स्केलेबल और सटीक प्रारंभिक पता लगाने के लिए एक नवीन टाइम-डिके मैसेज पासिंग मैकेनिज्म के साथ अनियमित ICD डायग्नोसिस प्रक्षेपवक्रों को टेम्पोरली डायरेक्टेड ग्राफ में पुनर्गठित करता है।

Leo Y. Li-Han, Ellen L. Larson, Elizabeth B. Habermann, Cornelius A. Thiels, Hojjat Salehinejad2026-05-28
🤖 AI

Constrained Auto-Bidding via Generative Response Modeling

यह शोध पत्र जेनेरेटिव रिस्पॉन्स मॉडल (GRM) को प्रस्तुत करता है, जो एक अनुक्रम-आधारित दृष्टिकोण है जो बिड मल्टीप्लायर के फलन के रूप में भविष्य के ट्रैफ़िक और लागत-मूल्य वक्रों की भविष्यवाणी करता है ताकि एक विश्लेषणात्मक नियंत्रक को सक्षम बनाया जा सके जो मौजूदा नियंत्रण और सुदृढीकरण शिक्षण विधियों की तुलना में सिद्ध अनुकूलता सीमाओं और बेहतर स्थिरता के साथ बजट और अनुपात बाधाओं को लागू करता है।

Eunseok Yang, Xingdong Zuo, Kyung-Min Kim2026-05-28
🤖 machine learning

Residualized Temporal Sparse Autoencoders for Interpreting Diffusion Models

यह शोध पत्र रेजिडुअलाइज्ड टेम्पोरल स्पार्स ऑटोएनकोर्स (Residualized Temporal Sparse Autoencoders) को प्रस्तुत करता है, जो एक नवीन ढांचा है जो डिफ्यूजन मॉडल एक्टिवेशन ट्रेजेक्टरीज को एक प्रारंभिक अवस्था और रैखिक रूप से अप्रत्याशित अवशेषों (residuals) में विघटित करता है ताकि स्पार्स, टेम्पोरली स्ट्रक्चर्ड व्याख्या योग्य विशेषताओं की खोज और विश्लेषण को सक्षम बनाया जा सके।

Calvin Yeung, Prathyush Poduval, Ali Zakeri, Zhuowen Zou, Mohsen Imani2026-05-28
🤖 machine learning

ReSAE: Residualized Sparse Autoencoders for Multi-Layer Transformer Interventions

यह शोध पत्र रेसिडुअलाइज्ड स्पार्स ऑटोएनकोर्स (ReSAEs) को प्रस्तुत करता है, जो एक ऐसी विधि है जो युग्मित ट्रांसफॉर्मर परतों के बीच के अनस्पष्ट अवशेषों (unexplained residuals) पर मल्टी-लेयर स्पार्स ऑटोएनकोर्स को प्रशिक्षित करती है ताकि डिकोडर रेडंडेंसी को कम किया जा सके और पारंपरिक लेयर-वाइज़ दृष्टिकोणों की तुलना में मल्टी-लेयर इंटरवेंशन की प्रभावशीलता में महत्वपूर्ण सुधार किया जा सके।

Prathyush Poduval, Calvin Yeung, Neel Desai, Mohsen Imani2026-05-28
🤖 AI

EgoBench: An Interactive Egocentric Multimodal Benchmark for Tool-Using Agents

EgoBench टूल-उपयोग करने वाले एजेंटों के लिए पहला इंटरैक्टिव मल्टीमॉडल बेंचमार्क पेश करता है, जिसमें 1,045 एगोसेंट्रिक वीडियो कार्य और एक सिम्युलेटेड यूजर एनवायरनमेंट शामिल है ताकि धारणा (perception), तर्क (reasoning) और गतिशील संपर्क (dynamic interaction) के तालमेल का कड़ाई से मूल्यांकन किया जा सके, जो यह प्रकट करता है कि वर्तमान अत्याधुनिक मॉडल इन जटिल क्षमताओं के साथ काफी संघर्ष करते हैं।

Yunqi Liu, Tong Niu, Zitong Wang, Zhenlong Dai, Yuqi Qing, Weiqiang Wang, Jian Liu2026-05-28
🤖 AI

Revealing Algorithmic Deductive Circuits for Logical Reasoning

यह शोधपत्र यह जांच करता है कि लार्ज लैंग्वेज मॉडल्स (Large Language Models) तार्किक तर्क (logical reasoning) कैसे करते हैं, जिसमें तथ्यात्मक नियमों को पुनः प्राप्त करने वाले विशिष्ट अटेंशन हेड्स (attention heads) और ग्राफ ट्रैवर्सल (graph traversal) जैसे वैश्विक एल्गोरिद्मिक रणनीतियों को निष्पादित करने के लिए सूचना को एकीकृत करने वाले उच्च-स्तरीय हेड्स की पहचान करने के लिए कॉज़ल मीडिएशन एनालिसिस (causal mediation analysis) का उपयोग किया गया है।

Phuong Minh Nguyen, Tien Huu Dang, Naoya Inoue2026-05-28
🤖 AI

Operational AI Deployment Assurance: Governance-State Orchestration Under Threshold-Sensitive Deployment Conditions -- A Governance Framework for High-Stakes AI Systems

यह शोध पत्र ऑपरेशनल एआई डिप्लॉयमेंट एश्योरेंस (OADA) प्रस्तुत करता है, जो एक ऐसा गवर्नेंस फ्रेमवर्क है जो निष्पक्षता संबंधी असहमति, थ्रेशोल्ड संवेदनशीलता और परिचालन अनिश्चितताओं को गतिशील परिनियोजन तत्परता निर्णयों और एस्केलेशन अवस्थाओं में अनुवादित करता है ताकि स्थिर मूल्यांकन मेट्रिक्स और वास्तविक दुनिया के उच्च-जोखिम वाले एआई परिनियोजन के बीच के अंतर को पाटा जा सके।

Khalid Adnan Alsayed2026-05-28