💻 computer science

NoDrift3R: Raymap-Guided Coupling for Drift-Robust Unposed Feed-Forward 3D Reconstruction

यह शोध पत्र NoDrift3R का प्रस्ताव करता है, जो एक पोज-फ्री फीड-फॉरवर्ड 3D गॉसियन स्प्लेटिंग फ्रेमवर्क है जो एक रेमैप-गाइडेड कपलिंग मॉड्यूल को पेश करके लॉन्ग-सीक्वेंस ड्रिफ्ट पर विजय प्राप्त करता है ताकि ज्यामिति (geometry) और अपीयरेंस ऑप्टिमाइज़ेशन को स्पष्ट रूप से सिनर्जाइज किया जा सके, जिससे संचयी पोज त्रुटियों के बिना मजबूत और उच्च-फिडेलिटी 3D पुनर्निर्माण प्राप्त किया जा सके।

Xiangyu Sun, Liu Liu, Seungkwon Yang, Jingbing Han, Seungtae Nam, Zhizhong Su, Eunbyung Park2026-07-09
💻 computer science

Why Fake ? Unveiling the Semantic Vocabulary of Deepfake Detectors

यह शोध पत्र एनकोडिंग-डिकोडिंग डायरेक्शन पेयर्स (EDDP) का उपयोग करते हुए एक पोस्ट-हॉक व्याख्यात्मक एआई फ्रेमवर्क प्रस्तुत करता है ताकि ब्लैक-बॉक्स डीपफेक डिटेक्टरों की अंतर्निहित अर्थपूर्ण शब्दावली और निर्णय लेने वाली प्रक्रियाओं को उजागर किया जा सके, जिससे ग्राउंडेड, स्थानिक रूप से जागरूक स्पष्टीकरण प्रदान किए जा सकें जो मौजूदा बाइनरी प्रेडिक्शन और सतही स्पष्टीकरण विधियों की सीमाओं को दूर करते हैं।

Vazgken Vanian, Alexandros Doumanoglou, Dimitris Zarpalas2026-07-09
💻 computer science

Naming the Concepts Classifiers Rely On: Language-Anchored Decomposition for Faithful Explanation

यह शोध पत्र लैंग्वेज-एंकरड डिकंपोजिशन (LAD) प्रस्तुत करता है, जो एक पोस्ट-हॉक फ्रेमवर्क है जो भाषा-आधारित क्षेत्र मानचित्रों द्वारा सीमित एक कॉन्सेप्ट बेसिस सीखने के लिए नॉन-नेगेटिव मैट्रिक्स फैक्टराइजेशन को उलटने के माध्यम से डीप न्यूरल नेटवर्क के लिए निष्ठावान, स्थानिक रूप से सटीक और मानव-व्याख्या योग्य स्पष्टीकरण उत्पन्न करता है, जिससे मूल मॉडल को संशोधित किए बिना नामित और निर्णय-प्रासंगिक व्याख्याएं प्राप्त की जा सकती हैं।

Ahsan Habib Akash, Dipkamal Bhusal, Stacey Jones, Donald A. Adjeroh, Binod Bhattarai, Prashnna Kumar Gyawali2026-07-09
🤖 AI

CarbonCLIP: Enhance Carbon Prediction from Satellite Imagery via Integrated Street-View Semantics and Temporal Context Training

CarbonCLIP एक मल्टीमॉडल डिस्टिलेशन फ्रेमवर्क है जो प्रीट्रेनिंग के दौरान स्ट्रीट-व्यू छवियों से सिमेंटिक अंतर्दृष्टि और मासिक डेटा से टेम्पोरल संदर्भ को एकीकृत करने के लिए कंट्रास्टिव लर्निंग का लाभ उठाकर उपग्रह-आधारित शहरी कार्बन उत्सर्जन भविष्यवाणी को बढ़ाता है, जिससे केवल उपग्रह इमेजरी का उपयोग करके सटीक और स्केलेबल अनुमान सक्षम होता है।

Zeru Yang, Fang-Ying Gong, Steve H. L. Yim, Chau Yuen2026-07-09
💻 computer science

SoccerNet 2026 Challenges Results

यह शोध पत्र छठे वार्षिक सॉकरनेट (SoccerNet) 2026 चुनौतियों के परिणामों को प्रस्तुत करता है, जिसमें पांच विजन-आधारित फुटबॉल वीडियो समझ कार्यों के मूल्यांकन प्रोटोकॉल, लीडरबोर्ड और शीर्ष प्रदर्शन करने वाली विधियों का विवरण दिया गया है, जिन्होंने 427 टीमों और 1,129 सबमिशन को आकर्षित किया।

Anthony Cioppa, Silvio Giancola, Håkan Ardö, Mohamad Dalal, Jan Held, Jérémie Ochin, Jiayuan Rao, Karen Sanchez, Renaud (…)2026-07-09
🤖 AI

When Prompts Ignore Structure: Graph-Based Attribute Reasoning for Calibrated VLMs

यह शोध पत्र ARGTCA का प्रस्ताव करता है, जो एक ग्राफ-आधारित फ्रेमवर्क है जो एक सिम्बोलिक एट्रिब्यूट ग्राफ और ग्राफ अटेंशन नेटवर्क के माध्यम से अंतर-विशेषता निर्भरताओं (inter-attribute dependencies) को मॉडल करता है ताकि टेस्ट-टाइम अडैप्टेशन के दौरान विजन-लैंग्वेज मॉडल्स के कैलिब्रेशन में महत्वपूर्ण सुधार किया जा सके, जो उन मौजूदा तरीकों से बेहतर प्रदर्शन करता है जो विशेषताओं को स्वतंत्र रूप से मानते हैं।

Tanay Sodha, Aditya Sharma, Ramya Hebbalaguppe, Vinti Agarwal, Pranav Murthy Yeluripaty2026-07-09
🤖 AI

Heterogeneity-Adaptive Diffusion Schrodinger Bridge for PET-Guided Whole-Body MRI Translation

यह शोध पत्र एक हेटेरोजेनिटी-अडैप्टिव डिफ्यूजन श्रोडिंगर ब्रिज (HA-DSB) फ्रेमवर्क प्रस्तावित करता है जो होल-बॉडी एमआरआई ट्रांसलेशन में शारीरिक विषमता (एनाटॉमिकल हेटेरोजेनिटी) को दूर करने और रोग संबंधी निष्ठा (पैथोलॉजिकल फिडेलिटी) को बढ़ाने के लिए PET-निर्देशित मेटाबॉलिक प्रायर्स और विजन-लैंग्वेज मॉडल एम्बेडिंग्स का लाभ उठाता है, जिससे PET-MR स्कैन के लंबे अधिग्रहण समय की समस्या का समाधान होता है।

Chengbo Wang, Jiacheng Yu, Linjie Bian, Ming Qi, Xiaosheng Liu, Tongtong Che, Jichang Zhang, Shuyu Li, Shaoli Song, Xiuy (…)2026-07-09
💻 computer science

A Theory of Contrastive Learning with Natural Images

यह शोध पत्र एक विश्लेषणात्मक ढांचा प्रदान करता है जो यह प्रदर्शित करता है कि प्राकृतिक छवियों पर कंट्रास्टिव लर्निंग (contrastive learning), साइनुसोइडल प्रथम-परत फिल्टर (sinusoidal first-layer filters) और आंशिक व्हाइटनिंग (partial whitening) वाले इष्टतम सीएनएन (CNNs) की ओर अभिसरित होकर उपयोगी निरूपण (representations) उत्पन्न करती है, जहाँ विशिष्ट आवृत्तियाँ और भार डेटासेट के पावर स्पेक्ट्रम (power spectrum) के माध्यम से वॉटरफिलिंग एल्गोरिदम (waterfilling algorithm) द्वारा निर्धारित होते हैं।

Antonio Torralba, Yair Weiss2026-07-09
💻 computer science

Discovering Geometric Biases in 3D Face Reconstruction: A Curvature-Aware Spectral Framework for Fairness Evaluation

यह शोध पत्र 3D फेस रिकंस्ट्रक्शन मॉडल्स में व्यवस्थित जनसांख्यिकीय पूर्वाग्रहों का पता लगाने, उन्हें मापने और उन्हें दृश्यमान बनाने के लिए लाप्लास-बेल्ट्रामी ऑपरेटर (Laplace-Beltrami Operator) का उपयोग करते हुए एक नवीन वक्रता-जागरूक स्पेक्ट्रल फ्रेमवर्क (curvature-aware spectral framework) प्रस्तावित करता है, जो यह प्रदर्शित करता है कि यह ज्यामितीय दृष्टिकोण पारंपरिक यूक्लिडियन दूरी मेट्रिक्स की तुलना में निष्पक्षता का अधिक प्रत्यक्ष रूप से सटीक मूल्यांकन प्रदान करता है।

Veronika Shilova, Emmanuel Malherbe, Giovanni Palma, Panagiotis-Alexandros Bokaris, Laurent Risser, Jean-Michel Loubes2026-07-09
🤖 AI

HIVE: Understanding Post-Hallucination Reasoning in Vision Language Models

यह शोध पत्र HIVE को प्रस्तुत करता है, जो एक ऐसा मूल्यांकन बुनियादी ढांचा है जो विजन लैंग्वेज मॉडल्स में पोस्ट-हैलुसिनेशन रीजनिंग (PHR) की जांच करता है, और यह प्रकट करता है कि हॉलुसिनेटेड कैप्शन आश्चर्यजनक रूप से विजन-लैंग्वेज कार्यों पर सटीकता में सुधार कर सकते हैं, क्योंकि वे व्यापक सेमेंटिक कवरेज प्रदान करते हैं और रीजनिंग डायनेमिक्स को नया आकार देते हैं, जबकि पारंपरिक रूप से उन्हें त्रुटियों के रूप में देखा जाता है।

Feng He, Zhenting Wang, Qifan Wang, Qiang Guan, Dongfang Liu, Ruixiang Tang, Qiankun Li2026-07-09