💻 computer science

FalconTrack: Photorealistic Auto-Labeled Perception and Physics-Aware Vision-Based Aerial Tracking

FalconTrack एक एकीकृत ढांचा है जो एक मल्टी-हेड परसेप्शन और फिजिक्स-अवेयर ट्रैकिंग सिस्टम को प्रशिक्षित करने के लिए फोटोरियलिस्टिक लेबल वाले डेटा के तीव्र, स्वचालित उत्पादन हेतु गाऊसी स्प्लेटिंग सिम्युलेटर का उपयोग करता है, जिससे वास्तविक हार्डवेयर पर जीपीएस-रहित (GPS-denied) हवाई ट्रैकिंग में मजबूत ज़ीरो-शॉट सिम-टू-रियल ट्रांसफर और उच्च सफलता दर प्राप्त होती है।

Yan Miao, Karteek Gandiboyina, Noah Giles, Hideki Okamoto, Bardh Hoxha, Georgios Fainekos, Sayan Mitra2026-06-30
💻 computer science

Legible Shared Autonomy: Implicit Communication of Robot Belief through Motion

यह शोध पत्र एक सुपाठ्य साझा स्वायत्तता ढांचे (legible shared autonomy framework) को प्रस्तुत करता है जो रोबोट के अनुमानित लक्ष्यों और आत्मविश्वास के स्तरों को स्पष्ट रूप से संप्रेषित करने के लिए सहायक गति को नियंत्रित करके मोटर-बाधित उपयोगकर्ताओं के लिए मानव-रोबोट सहयोग को बढ़ाता है, जिससे पारंपरिक प्रणालियों की तुलना में उपयोगकर्ता की समझ में सुधार होता है और अनावश्यक नियंत्रण प्रयास कम होता है।

Jinwei Liu, Pengfei Li, Shaofeng Chen, Tao Wang, Yun-Bo Zhao2026-06-30
💻 computer science

Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models

यह शोध पत्र T²VLA को प्रस्तुत करता है, जो एक टेस्ट-टाइम सुदृढीकरण लर्निंग (reinforcement learning) फ्रेमवर्क है जो विज़न-लैंग्वेज-एक्शन मॉडल्स को आंतरिक आत्मविश्वास संकेतों और एक ड्यूल-एक्सपर्ट बूटस्ट्रैपिंग तंत्र का लाभ उठाकर स्व-बूटस्ट्रैपिंग पॉलिसी सुधार प्राप्त करने में सक्षम बनाता है, जिससे बाहरी पर्यावरणीय पुरस्कारों की आवश्यकता समाप्त हो जाती है।

Siyao Chen, Jiakang Yuan, Jiaxin Wang, Tao Chen2026-06-30
💻 computer science

Critical Interval MSE: Toward Reliable Offline Validation for Robot Manipulation Policies

यह शोध पत्र क्रिटिकल इंटरवल MSE (CI-MSE) प्रस्तुत करता है, जो एक सुदृढ़ ऑफलाइन वैलिडेशन मेट्रिक है जो त्रुटि गणना को कार्य-महत्वपूर्ण खंडों तक सीमित करता है और वास्तविक दुनिया के रोबोटिक मैनिपुलेशन प्रदर्शन के साथ काफी मजबूत सहसंबंध प्राप्त करने के लिए एक्शन-अलाइनमेंट प्रक्रियाओं को शामिल करता है, जो मानक रॉ MSE की तुलना में बेहतर है।

Haoxu Huang, Tongsam Zheng, Yifan Chen, Jiacheng You, Yang Gao2026-06-30
💻 computer science

Pondering the Way: Spatial-perceiving World Action Model for Embodied Navigation

यह शोध पत्र SWAM का प्रस्ताव करता है, जो एक कार्य-केंद्रित विश्व क्रिया मॉडल (task-centric world action model) है जो एकल-पास अनुमान (single-pass inference) के माध्यम से मोनोकुलर RGB इनपुट से लक्ष्य-संगत RGB-D अनुक्रमों और क्रिया प्रक्षेपवक्रों (action trajectories) को एक साथ उत्पन्न करता है, जो नेविगेशन दक्षता, सटीकता और सामान्यीकरण में मौजूदा सत्यापन-केंद्रित योजनाकारों (verification-centric planners) से काफी बेहतर प्रदर्शन करता है।

Hong Chen, Daqi Liu, Zehan Zhang, Haiguang Wang, Tianhao Lu, Longfei Yan, Haiyang Sun, Fangzhen Li, Hongwei Xie, Bing Wa (…)2026-06-30
💻 computer science

Flying to Image-Specified Objects: 3D Quadrotor Navigation via Cross-Graph Memory and Viewpoint Planning

यह शोध पत्र 3D क्वाड्रोटर इंस्टेंस-विशिष्ट इमेज-गोल नेविगेशन के लिए एक पदानुक्रमित नेविगेशन ढांचे का प्रस्ताव करता है जो निरंतर 3D वातावरण में सीमित दृश्य क्षेत्र और सुरक्षा बाधाओं जैसी चुनौतियों को प्रभावी ढंग से दूर करने के लिए क्रॉस-ग्राफ मेमोरी, व्यूपॉइंट-अवेयर एक्शन नोड जनरेशन और ट्रैजेक्टरी प्लानिंग को जोड़ता है।

Junjie Gao, Yuqi Chen, Yongzhou Pan, Yaosheng Deng, Jiaping Xiao, Mir Feroskhan2026-06-30
💻 computer science

RoamFlow: Reinforcement-Aligned One-Step Action MeanFlow Policy for Image-Goal Navigation

RoamFlow एक जनरेटिव नेविगेशन फ्रेमवर्क है जो कुशल कुछ-चरणों वाले प्रक्षेपवक्र संश्लेषण (trajectory synthesis) के लिए MeanFlow का उपयोग करता है और सिम्युलेटेड एवं वास्तविक दुनिया के वातावरण में उच्च-प्रदर्शन वाली इमेज-गोल नेविगेशन प्राप्त करने के लिए विशेषज्ञ अनुकरण (expert imitation) के साथ सुदृढीकरण शिक्षण (reinforcement learning) को संयोजित करने वाली एक दो-चरणीय प्रशिक्षण रणनीति का उपयोग करता है।

Zixuan Zhang, Yuqi Chen, Junjie Gao, Siyuan Song, Yongzhou Pan, Beichen Wang, Mir Feroskhan2026-06-30
💻 computer science

REPAIR-Bench: A Benchmark for Robot Error Perception And Interaction Recovery

REPAIR-Bench एक नया बेंचमार्क है जो 214 मानव-रोबोट इंटरेक्शन परीक्षणों से प्राप्त किया गया है, जो सिंक्रोनाइज़्ड मल्टीमॉडल डेटा और तीन नवीन मूल्यांकन कार्यों के माध्यम से पूर्व विफलता मॉडलिंग की सीमाओं को संबोधित करता है ताकि इंटर-डिपेंडेंट विफलताओं का पता लगाने, विफलता के प्रकारों के दृश्य वर्गीकरण और रिकवरी रणनीतियों के उपयोगकर्ता-केंद्रित पूर्वानुमान को आगे बढ़ाया जा सके।

Giuliano Pioldi, Yashika Batra, Arman Ibrayeva, Yuanchen Bai, Purnjay Maruur, Promise Ekpo, Angelique Taylor2026-06-30
💻 computer science

Seeing Touch from Motion: A Unified Modality-Aware Visuo-Tactile Policy with Tactile Motion Correlation

यह शोध पत्र एक एकीकृत मोडैलिटी-अवेयर विज़ुओ-टैक्टाइल पॉलिसी प्रस्तावित करता है जो सूक्ष्म संपर्क अस्पष्टता को हल करने के लिए क्षणिक (transient) और संचयी (cumulative) स्पर्श गति के बीच सहसंबंध का लाभ उठाता है और संपर्क-समृद्ध हेरफेर (contact-rich manipulation) के लिए विज़ुअल और टैक्टाइल मोडैलिटीज़ को प्रभावी ढंग से फ्यूज करने के लिए 'मिक्सचर-ऑफ-ट्रांसफॉर्मर्स' आर्किटेक्चर का उपयोग करता है।

Shengqi Xu, Guojin Zhong, Yang Liu, Fanjie Wang, Hu Luo, Hanyu Zhou, Weiyao Zhang, Ziyi Ye, Zuxuan Wu, Yu-Gang Jiang2026-06-30
💻 computer science

Heterogeneous Tactile Transformer

यह शोधपत्र हेट्रोजेनियस टैक्टाइल ट्रांसफॉर्मर (HTT) का परिचय देता है, जो एक नवीन 1.6M-फ्रेम युग्मित डेटासेट का लाभ उठाते हुए विविध सेंसर प्रकारों के बीच साझा स्पर्श संबंधी (tactile) निरूपणों को सीखने के लिए एक ढांचा प्रदान करता है, जिससे स्केलेबल और हस्तांतरणीय संपर्क-समृद्ध हेरफेर नीतियों को सक्षम बनाया जा सके।

Jianxin Bi, Qiang Wang, Jayaram Reddy, Kelvin Lin, Soibkhon Khajikhanov, Ruihan Gao, Harold Soh2026-06-30