🤖 AI

Do vision-language models search like humans? Reasoning tokens as a reaction-time analog in classic visual-search paradigms

यह शोध पत्र इस बात की जांच करता है कि क्या विजन-लैंग्वेज मॉडल रीजनिंग टोकन काउंट को रिएक्शन टाइम के प्रॉक्सी के रूप में उपयोग करके मानव जैसे विजुअल सर्च व्यवहार प्रदर्शित करते हैं, जिसमें यह पाया गया है कि हालांकि मॉडल फ्लैट फीचर सर्च कॉस्ट और बढ़ते कंजंक्शन कॉस्ट जैसे प्रमुख मानवीय हस्ताक्षरों की नकल करते हैं, वे टारगेट-प्रेजेंट स्लोप्स, एन्यूमरेशन सटीकता और एडेप्टिव डेलिब्रेशन रणनीतियों में स्पष्ट संज्ञानात्मक विचलन भी प्रकट करते हैं।

Farahnaz Wick2026-06-25
📊 statistics

Training for the Model You Return: Improving Optimization for Iterate-Averaged Language Models

यह शोध पत्र PACE का प्रस्ताव करता है, जो AdamW के लिए एक ऑप्टिमाइज़र रैपर है जो प्रशिक्षण को इटरैट-एवरेज्ड (iterate-averaged) लैंग्वेज मॉडल्स की त्रुटि को कम करने के लिए एक ऑप्टिमल-कंट्रोल समस्या के रूप में मानता है, जो सुपरवाइज्ड फाइन-ट्यूनिंग और प्रीट्रेनिंग कार्यों में सैद्धांतिक अभिसरण गारंटी (theoretical convergence guarantees) और अनुभवजन्य सुधार दोनों को प्रदर्शित करता है।

Kwok Chun Au, Adam Block2026-06-25
🤖 AI

Beyond Shapley: Efficient Computation of Asymmetric Shapley Values

यह शोध पत्र कॉज़ल ग्राफ्स (causal graphs) का लाभ उठाकर एसिमेट्रिक शापली वैल्यूज (Asymmetric Shapley Values) की गणना के लिए कुशल एल्गोरिदम प्रस्तुत करता है, जो यह प्रदर्शित करता है कि रूटेड डायरेक्टेड ट्रीज़ (rooted directed trees) के लिए सटीक गणना बहुपद समय (polynomial time) में संभव है और मानक शापली वैल्यू गणनाओं की #P-कठिनाई (#P-hardness) को दूर करने के लिए किसी भी अनिश्चित कॉज़ल DAGs के लिए एक समान सैंपलिंग-आधारित सन्निकटन विधि प्रस्तावित करता है।

Ezequiel Companeetz, Santiago Cifuentes, Sergio Abriola2026-06-25
🤖 AI

The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing

136 अमेरिकी चिकित्सकों के एक सर्वेक्षण के आधार पर, यह शोध पत्र तर्क देता है कि सुरक्षित स्वायत्त एआई प्रिस्क्राइबिंग (नुस्खा लिखने) के लिए विशिष्ट वास्तुशिल्प विशेषताओं—जैसे कि कैलिब्रेटेड कॉन्फिडेंस थ्रेशोल्ड, विभेदित अनिश्चितता संचार, और अनुमानात्मक पारदर्शिता—की आवश्यकता है ताकि नैदानिक ​​स्वीकृति सुनिश्चित की जा सके, सिस्टम डिजाइनरों के साथ दायित्व को संरेखित किया जा सके, और "स्वायत्त" एआई को प्रभावी ढंग से एक गहन रूप से पर्यवेक्षित निर्णय-सहायता उपकरण के रूप में पुनर्गठित किया जा सके।

Eileanor LaRocco, Sarah Tan, Adarsh Subbaswamy, Anne Andrews, Andrew Taylor, Cree Gaskin, Chirag Agarwal2026-06-25
⚡ electrical engineering

BCoughBench: Benchmarking Respiratory Acoustic Foundation Models Under Body-Coupled Wearable Sensor Conditions

यह शोधपत्र BCoughBench प्रस्तुत करता है, जो यह दर्शाता है कि श्वसन ध्वनिक फाउंडेशन मॉडल (respiratory acoustic foundation models), स्मार्टफोन रिकॉर्डिंग पर प्रभावी होने के बावजूद, उच्च-आवृत्ति सिग्नल क्षीणन (high-frequency signal attenuation) के कारण बॉडी-कपल्ड वियरेबल सेंसर स्थितियों के तहत मूल्यांकन किए जाने पर प्रदर्शन में महत्वपूर्ण गिरावट का सामना करते हैं और नैदानिक संवेदनशीलता थ्रेसहोल्ड को पूरा करने में विफल रहते हैं।

Mayur Sanap, Prasanna Desikan, Edgar Lobaton2026-06-25
🤖 AI

AeroCast: Probabilistic 3D Trajectory Prediction for Non-Cooperative Aerial Obstacles via Transformer-MDN Architecture

यह शोध पत्र AeroCast को प्रस्तुत करता है, जो गैर-सहकारी हवाई बाधाओं के बहु-मोडल (multi-modal) 3D प्रक्षेप पथों की भविष्यवाणी करने के लिए ट्रांसफॉर्मर एनकोडर और मिश्रण घनत्व नेटवर्क (Mixture Density Networks) को संयोजित करने वाला एक वास्तविक समय का संभाव्य ढांचा है, जो मौजूदा नियतात्मक (deterministic) और आवर्ती (recurrent) विधियों की तुलना में काफी कम विस्थापन त्रुटियां और बेहतर वितरण सटीकता प्राप्त करता है।

Syed Izzat Ullah, Jose Baca2026-06-25
🤖 machine learning

Reward-Conditioned Attention: How Reward Design Shapes What Autonomous Driving Agents See

यह शोध पत्र यह प्रदर्शित करता है कि स्वायत्त ड्राइविंग सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) एजेंटों में रिवॉर्ड डिज़ाइन उनके आंतरिक अटेंशन पैटर्न को मौलिक रूप से आकार देता है, जहाँ विशिष्ट रिवॉर्ड कॉन्फ़िगरेशन नेविगेशन पथ या टकराव के जोखिमों जैसे दृश्य तत्वों की ओर अटेंशनल रणनीतियों को न केवल नियंत्रित कर सकते हैं बल्कि गुणात्मक रूप से उलट भी सकते हैं, जिससे अटेंशन विश्लेषण को सुरक्षा-महत्वपूर्ण सिस्टम व्यवहार को सत्यापित करने के लिए एक महत्वपूर्ण नैदानिक उपकरण के रूप में स्थापित किया गया है।

Mohamed Benabdelouahad, Ahmed Djalal Hacini, Nadir Farhi, Aissa Boulmerka2026-06-25
⚡ electrical engineering

Benchmarking the Alignment of Data-Quality Metrics, Human Judgment and Land-Cover Segmentation Performance for Earth Observation

यह शोध पत्र प्रदर्शित करता है कि सिंथेटिक अर्थ ऑब्जर्वेशन (पृथ्वी अवलोकन) डेटा के लिए मानक स्वचालित फिडेलिटी मेट्रिक्स अक्सर मानव धारणा और डाउनस्ट्रीम सेगमेंटेशन प्रदर्शन के साथ गलत संरेखित होते हैं, जो यह प्रकट करता है कि वर्तमान मेट्रिक्स भू-स्थानिक अनुप्रयोगों के लिए अविश्वसनीय हैं और उन्हें कार्य उपयोगिता तथा मानव निर्णय पर आधारित मूल्यांकनों द्वारा प्रतिस्थापित किया जाना चाहिए।

Ümit Mert Çağlar, Alptekin Temizel2026-06-25
🤖 AI

TokenMinds: Pretrained User Tokens and Embeddings for User Understanding in Large Recommender Systems

TokenMinds एक औद्योगिक-स्तर का सिस्टम है जो PLUM फ्रेमवर्क का विस्तार करता है ताकि एक पूर्व-प्रशिक्षित LLM आर्किटेक्चर के माध्यम से डिस्क्रीट (discrete), सिमेंटिक रूप से ग्राउंडेड यूजर टोकन और डेंस एम्बेडिंग्स दोनों को जनरेट किया जा सके, जो लागत कम करने के लिए लॉन्ग-फॉर्म और शॉर्ट-फॉर्म वीडियो व्यवहारों को सफलतापूर्वक एकीकृत करता है और बड़े पैमाने पर YouTube रैंकिंग सिस्टम में पूरक मूल्य प्रदर्शित करता है।

Qingyun Liu, Bo Yan, Yang Liu, Yuji Roh, Ekansh Sharma, Likang Yin, Emma Olowo, Min-hsuan Tsai, Yuxuan Li, Diego Uribe (…)2026-06-25
🤖 AI

Proactive Systems in HCI and AI: Concepts, Challenges, and Opportunities

यह शोधपत्र एक कठोर साझा परिभाषा स्थापित करके और उनके डिज़ाइन एवं मूल्यांकन के लिए मानव-केंद्रित दिशा-निर्देश विकसित करके, प्रोएक्टिव (सक्रिय) एआई प्रणालियों से जुड़ी वैचारिक अस्पष्टता और पद्धतिगत सीमाओं को संबोधित करने के लिए एक बहुविषयक कार्यशाला का प्रस्ताव करता है।

Nima Zargham, Sharon Ferguson, Jaisie Sin, Cosmin Munteanu, Anastasia Kuzminykh2026-06-25