💻 computer science

LRDDv3: High-Resolution Long-Range Drone Detection Dataset with Range Information and Thermal Data

यह शोधपत्र LRDDv3 को प्रस्तुत करता है, जो एक उच्च-रिज़ॉल्यूशन डेटासेट है जिसमें विविध परिस्थितियों में लंबी दूरी से कैप्चर की गई ड्रोन्स की 1,00,000 से अधिक 4K RGB छवियों और लगभग 30,000 युग्मित (paired) थर्मल छवियों का संग्रह शामिल है, जिसे लंबी दूरी की ड्रोन पहचान क्षमताओं को उन्नत करने के लिए डिज़ाइन किया गया है।

Knut Peterson, Zaid Mayers, Azmain Yousuf, Priontu Chowdhury, Asher Zaczepinski, Solmaz Arezoomandan, Reihaneh Maarefdou (…)2026-05-26
💻 computer science

AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond

यह शोध पत्र AnyScene का प्रस्ताव करता है, जो एक एकीकृत ऑक्यूपेंसी-केंद्रित फ्रेमवर्क है जो किसी भी संदर्भ फ्रेम (reference frames) पर निर्भर हुए बिना, मनमाने BEV लेआउट से अत्यधिक नियंत्रणीय, उच्च-सटीक और टेम्पोरल रूप से सुसंगत मल्टी-व्यू ड्राइविंग वीडियो उत्पन्न करने के लिए एक स्पैटियल-टेम्पोरल ऑक्यूपेंसी डिफ्यूजन ट्रांसफॉर्मर और एक ज्योमेट्री-ग्राउंडेड व्यू एक्सपेंशन मॉड्यूल का लाभ उठाता है।

Haiming Zhang, Junfei Zhou, Feng Jiang, Jingzhong Li, Zhenglong Guo, Penglin Dai, Jifeng Dai, Yan Xie, Benjin Zhu2026-05-26
💻 computer science

Using Ensemble Diffusion to Estimate Uncertainty for End-to-End Autonomous Driving

यह शोध पत्र EnDfuser को प्रस्तुत करता है, जो एक एंड-टू-एंड स्वायत्त ड्राइविंग प्रणाली है जो फ्यूज्ड परसेप्शन डेटा से उम्मीदवार प्रक्षेपवक्रों (कैंडिडेट ट्राजेक्टरीज) के वितरण को उत्पन्न करने के लिए एन्सेम्बल डिफ्यूजन का उपयोग करती है, जिससे अनिश्चितता-जागरूक निर्णय लेने में सक्षम होता है जो LAV बेंचमार्क पर ड्राइविंग प्रदर्शन और व्याख्यात्मकता में सुधार करता है।

Florian Wintel, Sigmund H. Høeg, Gabriel Kiss, Frank Lindseth2026-05-25
🤖 AI

V-VLAPS: Value-Guided Planning for Vision-Language-Action Models

यह शोध पत्र V-VLAPS का परिचय देता है, जो एक वैल्यू-गाइडेड प्लानिंग फ्रेमवर्क है जो विजन-लैंग्वेज-एक्शन (VLA) मॉडल्स को ऑफलाइन रोलआउट्स पर प्रशिक्षित एक हल्के वैल्यू हेड के साथ संवर्धित करता है ताकि मोंटे कार्लो रिटर्न्स का पूर्वानुमान लगाया जा सके, जिससे विशेष रूप से बड़े सर्च बजट का उपयोग करते समय, उच्च-वैल्यू वाली शाखाओं की ओर ट्री सर्च को निर्देशित करके लॉन्ग-होरिज़न रोबोटिक टास्क की सफलता दर में सुधार किया जा सके।

Ke Ren, Ali Salamatian, Kieran Pattison, Cyrus Neary2026-05-25
💻 computer science

Remote Teleoperation of Endovascular Intervention Robots: A Systematic Review

16 अध्ययनों का यह व्यवस्थित अवलोकन निष्कर्ष निकालता है कि जबकि टेलीऑपरेटेड एंडोवैस्कुलर रोबोटिक सिस्टम तकनीकी व्यवहार्यता और चिकित्सकों के संपर्क को कम करने तथा रोगी की पहुंच बढ़ाने के संभावित लाभ प्रदर्शित करते हैं, उनका नैदानिक सत्यापन पशु और फैंटम मॉडल पर निर्भरता के कारण सीमित बना हुआ है, जिसके लिए विविध परिवेशों में सुरक्षा और प्रभावकारिता की पुष्टि करने हेतु आगे के बहु-केंद्र परीक्षणों की आवश्यकता है।

Xingyu Chen, Yinchao Yang, Nikola Fischer, Harry Robertshaw, Benjamin Jackson, Mohammad Shikh-Bahaei, Christos Bergeles (…)2026-05-25
💻 computer science

Extending Deep Event Visual Odometry with Sparse Point-Cloud Export

यह शोध पत्र एक स्पार्स पॉइंट-क्लाउड एक्सपोर्ट पाइपलाइन जोड़कर डीप इवेंट विजुअल ओडोमेट्री (DEVO) फ्रेमवर्क का विस्तार करता है जो सिस्टम की आंतरिक 3D संरचना को विज़ुअलाइज़ेशन और आगे के प्रसंस्करण के लिए एक स्पष्ट ज्यामितीय प्रतिनिधित्व में परिवर्तित करता है, जिससे मूल ओडोमेट्री प्रदर्शन को बनाए रखते हुए बेंचमार्क डेटा पर उच्च स्थानीय सटीकता प्राप्त होती है।

Alireza Safdari, Sajad Ashraf2026-05-25
💻 computer science

Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models

एजेंटिक-वीएलए (Agentic-VLA) विजन-लैंग्वेज-एक्शन मॉडल्स के लिए एक कुशल ऑनलाइन अनुकूलन ढांचा है जो रोबोटिक मैनिपुलेशन बेंचमार्क पर सामान्यीकरण, नमूना दक्षता और क्रॉस-टास्क ट्रांसफर को महत्वपूर्ण रूप से सुधारने के लिए एडेप्टिव रिवॉर्ड सिंथेसिस, लैंग्वेज-गाइडेड एक्सप्लोरेशन और एक्सपीरियंस मेमोरी का लाभ उठाता है।

Ruofan Jin, Zaixi Zhang2026-05-25
🧬 biology

Active Sensing Subserves Task-Level Control

यह शोध पत्र प्रस्तावित करता है कि सक्रिय संवेदन (active sensing) मुख्य रूप से अनिश्चितता में कमी जैसे संवेदी लक्ष्यों द्वारा संचालित नहीं होता है, बल्कि एक सुदृढ़ कार्य-स्तरीय नियंत्रण के लिए एक आवश्यक रणनीति के रूप में उभरता है, जहाँ जीव संवेदी फीडबैक को आकार देने के लिए विविक्त "अन्वेषण" (explore) और "दोहन" (exploit) मोड के बीच स्विच करते हैं—एक जैविक सिद्धांत जो इंजीनियर की गई रोबोटिक प्रणालियों के डिज़ाइन को महत्वपूर्ण रूप से उन्नत कर सकता है।

Andrew Lamperski, Debojyoti Biswas, Eric S. Fortune, John Guckenheimer, Kathleen Hoffman, Noah J. Cowan2026-05-25
💻 computer science

Four Simple Proprioceptive Estimators for Legged Robots

यह शोधपत्र लेग्ड रोबोट्स के लिए चार बढ़ते हुए अभिव्यंजक प्रोप्रियोसेप्टिव स्टेट एस्टिमेटर्स प्रस्तुत करता है जो इंटरमिटेंट फुट कॉन्टैक्ट्स का लाभ उठाकर IMU ड्रिफ्ट को कम करते हैं, जिसमें एक कॉन्टैक्ट-एडेड इनवेरिएंट EKF से लेकर एक फिक्स्ड-लैग स्मूदर तक की रेंज शामिल है, और ये सभी पुनरुत्पादकता के लिए GTSAM और ROS2 में कार्यान्वित किए गए हैं।

Frank Dellaert, Chiyun Noh, Varun Agrawal, Ayoung Kim2026-05-25
💬 NLP

Autonomous Frontier-Based Exploration with VLM Guidance

यह शोध पत्र एक प्रशिक्षण-मुक्त, हल्का स्वायत्त अन्वेषण पाइपलाइन प्रस्तुत करता है जो मानचित्रों और दृश्य छवियों के मल्टीमॉडल प्रॉम्प्ट्स का विश्लेषण करके उच्च-स्तरीय रणनीतिक निर्णय लेने के लिए विजन-लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे अज्ञात वातावरणों में मौजूदा ज्यामितीय ह्यूरिस्टिक विधियों की तुलना में मानचित्र कवरेज को 24% तक सुधारा जा सकता है।

Aarush Aitha, Avideh Zakhor2026-05-25