💻 computer science

HASTE: A Platform for Rapid Post-Disaster Building Damage Assessment

HASTE एक ओपन-सोर्स, नो-कोड वेब प्लेटफॉर्म है जो गैर-विशेषज्ञ विश्लेषकों को सिंगल-सीन सिमेंटिक सेगमेंटेशन या फ्यू-शॉट फाउंडेशन मॉडल एम्बेडिंग्स का उपयोग करके आपदा के बाद की सैटेलाइट इमेजरी से तेजी से प्रति-भवन क्षति मानचित्र (पर-बिल्डिंग डैमेज मैप्स) उत्पन्न करने में सक्षम बनाता है, जिसने 2023 से तीस से अधिक वास्तविक आपदा प्रतिक्रियाओं को सफलतापूर्वक समर्थन दिया है।

Caleb Robinson, Anthony Ortiz, Simone Fobi Nsutezo, Cameron Birge, Meygha Machado, Marcelo Duarte, Joaquin Rivero Rodrig (…)2026-07-14
🤖 AI

LoRA-Based Cascaded Multimodal Fusion for Action Recognition in Medical Training Environments

यह शोध पत्र एक पैरामीटर-कुशल, कैस्केडेड लो-रैंक एडेप्टेशन (LoRA) फ्रेमवर्क प्रस्तावित करता है जो चिकित्सा प्रशिक्षण वातावरण में क्रिया पहचान (action recognition) के लिए विषम मोडालिटीज़ को क्रमिक रूप से एकीकृत करता है, जो NurViD और नर्स ट्रेनिंग जैसे स्वास्थ्य देखभाल डेटासेट पर व्यक्तिगत मोडालिटी मॉडलों की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Divya Mereddy, Jeevan Beedareddy2026-07-14
💻 computer science

Beyond the Single Camera: Agentic Multi-View Reasoning in Sports Video Understanding

यह शोध पत्र मल्टी-व्यू स्पोर्ट्स वीडियो अंडरस्टैंडिंग के लिए एक नया बेंचमार्क, SportMV-Bench पेश करता है, और SportMV-Agent प्रस्तावित करता है, जो एक एजेंटिक फ्रेमवर्क है जो वर्तमान सिंगल-व्यू मॉडल्स की सीमाओं को दूर करने के लिए प्रासंगिक कैमरा व्यूज़ को पुनरावृत्ति से चुनने और मल्टी-व्यू साक्ष्यों में तर्क को ग्राउंड करने के माध्यम से प्रदर्शन में महत्वपूर्ण सुधार करता है।

Kerui Chen, Jinglu Wang, Xiaoyi Zhang, Yan Lu2026-07-14
💻 computer science

Latent-Identity Tuning in Text-to-Image Personalization Models

यह शोध पत्र एक फ्रोजन एनकोडर के लेटेंट स्पेस का लाभ उठाकर उन सिमेंटिक दिशाओं की पहचान करने की एक ट्रेनिंग-फ्री विधि प्रस्तुत करता है जो क्रॉस-इमेज आइडेंटिटी कंसिस्टेंसी को बनाए रखते हुए स्थानीयकृत चेहरे के संपादन (लोकललाइज्ड फेशियल एडिट्स) को सक्षम बनाती है, जिससे टेक्स्ट-टू-इमेज मॉडल्स में फाइन-ग्रेंड आइडेंटिटी ट्यूनिंग संभव होती है।

Daniel Garibi, Ronen Kamenetsky, Hadar Averbuch-Elor, Daniel Cohen-Or, Or Patashnik2026-07-14
💻 computer science

Multi-Layer Gaussian Splatting for Immersive Anatomy Visualization

यह शोध पत्र मल्टी-लेयर गॉसियन स्प्लेटिंग (Multi-Layer Gaussian Splatting) का प्रस्ताव करता है, जो एक नवीन तकनीक है जो वॉल्यूमेट्रिक सीटी (CT) स्कैन को परतों वाली शारीरिक संरचनाओं और चयनात्मक सक्रियण के साथ एक कुशल, स्थिर मध्यवर्ती प्रतिनिधित्व में संकुचित करती है, जिससे कंप्यूट-सीमित उपकरणों पर पारंपरिक पाथ ट्रेसिंग के प्रमुख खोजपूर्ण गुणों को बनाए रखते हुए वास्तविक समय में, उच्च-गुणवत्ता वाला इमर्सिव विज़ुअलाइज़ेशन सक्षम होता है।

Constantin Kleinbeck, Hannah Schieber, Klaus Engel, Ralf Gutjahr, Daniel Roth2026-07-13
⚡ electrical engineering

On Motion Blur and Deblurring in Visual Place Recognition

यह शोध पत्र तीन डेटासेट के साथ एक व्यापक बेंचमार्क प्रस्तुत करके, मौजूदा डीब्लरिंग (deblurring) विधियों का मूल्यांकन करके, और गतिशील, वास्तविक दुनिया के परिदृश्यों में स्थानीयकरण प्रदर्शन को बेहतर बनाने के लिए अनुकूलन योग्य डीब्लरिंग रणनीतियों का प्रस्ताव देकर विजुअल प्लेस रिकग्निशन (Visual Place Recognition) पर मोशन ब्लर के कम खोजे गए प्रभाव को संबोधित करता है।

Timur Ismagilov, Bruno Ferrarini, Michael Milford, Tan Viet Tuyen Nguyen, SD Ramchurn, Shoaib Ehsan2026-07-13
⚡ electrical engineering

GraphSeg: Segmented 3D Representations via Graph Edge Addition and Contraction

GraphSeg एक ऐसा फ्रेमवर्क है जो गहराई के डेटा के बिना विरल (sparse) 2D छवियों से सुसंगत 3D ऑब्जेक्ट सेगमेंटेशन उत्पन्न करता है, जो सेगमेंटेशन को ग्राफ एज एडिशन और कॉन्ट्रैक्शन समस्या के रूप में स्वरूपित करके असंरचित वातावरण में मजबूत रोबोटिक हेरफेर को सक्षम बनाता है।

Haozhan Tang, Tianyi Zhang, Oliver Kroemer, Matthew Johnson-Roberson, Weiming Zhi2026-07-13
🤖 machine learning

Bi-Manual Joint Camera Calibration and Scene Representation

यह शोध पत्र Bi-JCR को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो 3D फाउंडेशन मॉडल्स का लाभ उठाकर द्वि-हस्त (bi-manual) रोबोट कैमरों के मार्कर-मुक्त, संयुक्त अंशांकन (calibration) और सीधे RGB छवियों से एक एकीकृत, स्केल-सुसंगत 3D दृश्य प्रतिनिधित्व के निर्माण को सक्षम बनाता है, जिससे द्वि-हस्त समन्वय कार्यों को सुगम बनाया जा सके।

Haozhan Tang, Tianyi Zhang, Matthew Johnson-Roberson, Weiming Zhi2026-07-13
🤖 AI

H3Former: Hypergraph-based Semantic-Aware Aggregation via Hyperbolic Hierarchical Contrastive Loss for Fine-Grained Visual Classification

यह शोध पत्र H3Former का प्रस्ताव करता है, जो फाइन-ग्रेन्ड विजुअल क्लासिफिकेशन के लिए एक नवीन टोकन-टू-रीजन फ्रेमवर्क है, जो उच्च-क्रम की सिमेंटिक निर्भरताओं को कैप्चर करने के लिए भारित हाइपरग्राफ बनाने हेतु एक सिमेंटिक-अवेयर एग्रीगेशन मॉड्यूल का उपयोग करता है और एक नॉन-यूक्लिडियन स्पेस में पदानुक्रमित बाधाओं को लागू करने के लिए हाइपरबोलिक हिरार्किकल कॉन्ट्रास्टिव लॉस का उपयोग करता है, जिससे मानक बेंचमार्क पर उत्कृष्ट प्रदर्शन प्राप्त होता है।

Yongji Zhang, Siqi Li, Kuiyang Huang, Yue Gao, Yu Jiang2026-07-13
💻 computer science

Hybrid Foveated Path Tracing with Peripheral Gaussians for Immersive Anatomy

यह शोध पत्र एक हाइब्रिड रेंडरिंग फ्रेमवर्क प्रस्तावित करता है जो उच्च-गुणवत्तापूर्ण, संवादात्मक और इमर्सिव वॉल्यूमेट्रिक एनाटॉमी विज़ुअलाइज़ेशन को व्यापक प्रीप्रोसेसिंग के बिना सक्षम करने के लिए स्ट्रीम किए गए फोविएटेड पाथ ट्रेसिंग को गतिशील रूप से अपडेट किए गए पेरिफेरल गॉसियन स्प्लेटिंग मॉडल के साथ जोड़ता है।

Constantin Kleinbeck, Luisa Theelke, Hannah Schieber, Ulrich Eck, Rüdiger von Eisenhart-Rothe, Daniel Roth2026-07-13