🤖 machine learning

Signed Rectified Flow: Negativity-Controlled Generation

यह शोध पत्र साइन्ड रेक्टिफाइड फ्लो (Signed Rectified Flow) का परिचय देता है, जो एक जनरेटिव मॉडलिंग फ्रेमवर्क है जो साइन्ड मेजर्स (signed measures) को संभालने के लिए रेक्टिफाइड फ्लो का विस्तार करता है, जिससे छवि की गुणवत्ता और विविधता को बनाए रखते हुए अवांछित सामग्री (जैसे नग्नता या संग्रहीत डेटा) को दबाने के लिए सिद्धांतपूर्ण नकारात्मक सूचना समावेश को सक्षम बनाया जा सके।

Runlong Liao, Baiyu Su, Lizhang Chen, Qiang Liu2026-07-22
💻 computer science

Physics Closure Matters for Machine Olfaction: A Maxwell--Stefan Graph Solver for Identifiable Dynamic Gas Unmixing

यह शोध पत्र UnMixNet प्रस्तुत करता है, जो एक भौतिकी-बंद ग्राफ न्यूरल सॉल्वर है जो गतिशील गैस अनमिक्सिंग की अल्प-निर्धारित व्युत्क्रम समस्या (underconstrained inverse problem) को बेहतर सटीकता और भौतिक निरंतरता के साथ हल करने के लिए मैक्सवेल-स्टीफन परिवहन, प्रतिस्पर्धी अधिशोषण और गैररेखीय ट्रांसडक्शन गतिकी को एक एंड-टू-एंड फ्रेमवर्क में समाहित करता है।

Yue Shi, Liangxiu Han, Xin Zhang, Tam Sobeih2026-07-22
💻 computer science

Text-conditioned Segmentation for Tomato Phenotyping via Procedural Synthetic Data

यह शोध पत्र एक सिम-टू-रियल फ्रेमवर्क प्रस्तुत करता है जो टमाटर के ग्रीनहाउस के एक बड़े पैमाने के प्रक्रियात्मक सिंथेटिक डेटासेट को उत्पन्न करता है ताकि सेगमेंट एनीथिंग मॉडल 3 (SAM 3) को फाइन-ट्यून किया जा सके, जिससे जटिल वास्तविक दुनिया के वातावरण में टमाटर फेनोटाइपिंग के लिए टेक्स्ट-कंडीशन्ड सेगमेंटेशन प्रदर्शन में महत्वपूर्ण सुधार होता है।

Samy Mounir, Mikolaj Cieslak, Najmeddine Dhieb, Hakim Ghazzai, Jonathan Klein, Katja Froehlich, Soeren Pirk, Wojciech Pa (…)2026-07-22
🤖 AI

Norm or Direction? Decoding Vision Mambas for High-Resolution Vision

यह शोध पत्र प्रकट करता है कि जहाँ MambaOut मुख्य रूप से फोरग्राउंड टोकन के परिमाण (magnitude) में क्लास-डिस्क्रिमिनेटिव जानकारी को एनकोड करता है, वहीं VMamba विशिष्ट रूप से टोकन दिशाओं और बैकग्राउंड क्षेत्रों में सिमेंटिक साक्ष्य को वितरित करता है, जो एक विशिष्ट एनकोडिंग रणनीति है जो इसे उच्च-रिज़ॉल्यूशन वाले डेंस प्रेडिक्शन कार्यों में बेहतर स्थिरता और प्रदर्शन प्रदान करती है।

Jin Yu, Juyoun Park2026-07-22
💻 computer science

Seeing Before Generating: Object Perception Enhances Single-View 3D Reconstruction

यह शोध पत्र एक मॉडल-अज्ञेय (model-agnostic), प्लग-एंड-प्ले विधि प्रस्तावित करता है जो जनरेशन प्रक्रिया को निर्देशित करने के लिए प्रीट्रेंड ऑब्जेक्ट परसेप्शन मॉडल्स से सिमेंटिक और ज्योमेट्रिक सिग्नल्स का लाभ उठाकर सिंगल-व्यू 3D ऑब्जेक्ट रिकंस्ट्रक्शन में महत्वपूर्ण सुधार करता है।

Y Huynh, Duc Thanh Nguyen, Mohamed Abdelrazek2026-07-22
💻 computer science

MissingBench-Verified: Probing Vision-Language Models' Inability to Detect Missing Object Parts

यह शोधपत्र MissingBench-Verified को प्रस्तुत करता है, जो एक ऐसा बेंचमार्क है जो यह दर्शाता है कि अग्रणी विजन-लैंग्वेज मॉडल्स (VLMs) अंतर्निहित पूर्वाग्रहों और प्रशिक्षण डेटा की कमी के कारण वस्तुओं के गायब हिस्सों का पता लगाने में लगातार विफल रहते हैं, जो एक ऐसी सीमा है जो बाहरी उपकरणों, विस्तारित तर्क या फाइन-ट्यूनिंग के उपयोग के बावजूद बनी रहती है, जिससे वर्तमान VLMs में एक मौलिक संरचनात्मक दोष का पता चलता है।

Wenqi Marshall Guo, Qingyun Qian, Shiyu Zhou, Guoping Luo, Shan Du2026-07-22
🤖 machine learning

Cross-Dataset Generalization in Breast MRI Tumor Classification via Class-Wise Dataset Mixing

यह शोध पत्र यह प्रदर्शित करता है कि ड्यूक (Duke) और फास्टएमआरआई (fastMRI) कोहॉर्ट्स के बीच क्लास-वाइज डेटासेट मिक्सिंग, डेटासेट-ओरिजिन बायस (dataset-origin bias) को प्रभावी ढंग से कम करती है, जो कन्फाउंडेड डेटा (confounded data) पर प्रशिक्षित मॉडलों की तुलना में स्वतंत्र मामा-मिया (MAMA-MIA) कोहॉर्ट पर ब्रेस्ट एमआरआई ट्यूमर वर्गीकरण के लिए क्रॉस-डेटासेट सामान्यीकरण (cross-dataset generalization) में महत्वपूर्ण रूप से सुधार करती है।

Mohammad Ali Dadrast, Hamid Usefi2026-07-22
⚡ electrical engineering

Attributes Should Come from Images, Not Class Names: Distribution-Conditioned Attribute Selection for Vision-Language Models

यह शोध पत्र एक वितरण-सशर्त (distribution-conditioned) विशेषता चयन पद्धति का प्रस्ताव करता है जो क्लास-नेम-सशर्त LLM विवरणों पर निर्भर रहने के बजाय सीधे लक्ष्य छवियों से दृश्य डिस्क्रिप्टर निकालता है, जिससे वितरण बदलावों (distribution shifts) के दौरान ज़ीरो-शॉट वर्गीकरण की मजबूती में महत्वपूर्ण सुधार होता है और साथ ही डेटासेट की विशेषताओं का एक व्याख्यात्मक सारांश भी मिलता है।

Gautam Rajendrakumar Gare, Jia Shi, Zhiqiu Lin, Deepak Pathak, John Galeotti, Deva Ramanan2026-07-22
🤖 AI

Decoupled Pipeline with Proposal Reranking and Score Fusion for Positive-Unlabeled Marine Species Detection

यह शोध पत्र FathomNetCLEF 2026 प्रतियोगिता के लिए DS@GT ARC के 12वें स्थान वाले समाधान को प्रस्तुत करता है, जो एक फ्रोजन YOLOv8x प्रपोजल जनरेटर को LoRA-फाइनट्यून किए गए DINOv3 क्लासिफायर और स्कोर फ्यूजन के साथ संयोजित करने वाले एक डिकपल्ड पाइपलाइन का उपयोग करके डिस्ट्रीब्यूशन शिफ्ट के तहत पॉजिटिव-अनलेबल समुद्री प्रजातियों का पता लगाने की समस्या का समाधान करता है, जो यह प्रदर्शित करता है कि स्पार्स-लेबल परिदृश्यों में प्रपोजल रिकॉल को बनाए रखना और डाउनस्ट्रीम रैंकिंग को अनुकूलित करना डिटेक्टर फाइन-ट्यूनिंग की तुलना में अधिक प्रभावी है।

Robert James Brock, Sebastian Maximilian Krupa, Jason Kahei Tam2026-07-22
💻 computer science

Continual Video-MLLM Adaptation over Evolving Domains

यह शोध पत्र डिस्ट्रीब्यूशन-अवेयर एक्सपर्ट रूटिंग (DAER) का प्रस्ताव देता है, जो एक पैरामीटर-कुशल ढांचा है जो निरंतर विकसित होते डोमेन के अनुकूल होने और कैटास्ट्रोफिक फॉरगेटिंग एवं क्रॉस-डोमेन इंटरफेरेंस को रोकने के लिए इंट्रा- और इंटर-डोमेन रूटिंग तंत्रों के साथ डोमेन-आइसोलेटेड लाइटवेट एक्सपर्ट्स का उपयोग करता है ताकि वीडियो-MLLMs सक्षम हो सकें।

Rui Cheng, Meixing Shi, Yuxiang Cai, Jingcai Guo, Jianwei Yin, Zhi Chen2026-07-22