💻 computer science

BayesFP: Posterior Estimation for Flow-Based Policies via Feynman-Kac Sampling

BayesFP एक एकीकृत, रिट्रेनिंग-मुक्त इन्फरेंस-टाइम फ्रेमवर्क प्रस्तुत करता है जो डिफ्यूजन और फ्लो-मैचिंग पॉलिसियों दोनों के लिए पोस्टीरियर सैंपलिंग को सक्षम करने हेतु फेनमैन-काक सुधारक (Feynman-Kac corrector) का लाभ उठाता है, जिससे रोबोट्स को सीखे गए विशेषज्ञ व्यवहार के प्रति वफादार रहते हुए सुरक्षा बाधाओं और कार्य उद्देश्यों को पूरा करने वाले प्रक्षेप पथ (trajectories) उत्पन्न करने की अनुमति मिलती है।

Sreevardhan Sirigiri, Weiming Zhi, Fabio Ramos2026-06-23
💻 computer science

ReFPO: Reflow Regularization for Flow Matching Policy Gradients

ReFPO एक सरल, कुशल ऑनलाइन सुदृढीकरण शिक्षण (reinforcement learning) विधि है जो एक स्पष्ट रिफ्लो (Reflow) नियमितीकरण पद को पेश करके फ्लो मैचिंग पॉलिसी ग्रेडिएंट्स को बेहतर बनाता है, जो प्रशिक्षण को स्थिर करता है, प्रॉक्सी-अनुपात स्पाइक्स को कम करता है, और बिना किसी अतिरिक्त कम्प्यूटेशनल ओवरहेड के उच्च-सटीकता वाले एक-चरण अनुमान (one-step inference) को सक्षम बनाता है।

Ge Wang, Yibo Peng, Fan Feng, Shenhao Yan, Chengsi Yao, Jiahao Yang, Honghao Cai, Yiming Zhao, Xi Li, Jinke Ren, Shuguan (…)2026-06-23
💻 computer science

MV-WAM: Manifold-Aware World Action Model with Value Augmentation

यह शोध पत्र MV-WAM का परिचय देता है, जो एक अभिनव एंड-टू-एंड फ्रेमवर्क है जो मैनिफोल्ड-अवेयर ऑप्टिमाइज़ेशन और वैल्यू ऑग्मेंटेशन का उपयोग करके सिमुलेटेड और वास्तविक दुनिया के मैनिपुलेशन कार्यों में महत्वपूर्ण रूप से बेहतर सामान्यीकरण और मजबूती प्राप्त करने के लिए एम्बॉडीड रोबोटिक्स में विजुअल और एक्शन मोडैलिटीज के बीच संरचनात्मक बेमेल को संबोधित करता है।

Jintao Chen, Peidong Jia, Qingpo Wuwu, Jiaming Liu, Mengfei Du, Chun-Kai Fan, Xiaowei Chi, Hao Chen, Chengyu Bai, Zezhon (…)2026-06-23
💻 computer science

Pose-Agnostic Robotic Functional Grasping via Observation-Action Canonicalization

यह शोध पत्र AnyMug प्रस्तुत करता है, जो एक सिमुलेशन-प्रशिक्षित विज़ुओमोटर सुदृढीकरण लर्निंग (visuomotor reinforcement learning) ढांचा है, जो विविध मुद्राओं में मग की ज़ीरो-शॉट वास्तविक दुनिया की कार्यात्मक पकड़ (zero-shot real-world functional grasping) प्राप्त करने के लिए प्रेक्षणों (observations) और क्रियाओं (actions) दोनों को एक साझा ऑब्जेक्ट-सेंट्रिक फ्रेम में कैनोनिकल (canonicalize) करता है ताकि विभिन्न विन्यासों में सुसंगत नीति व्यवहार सुनिश्चित किया जा सके।

Le Qiu, Cole Harrison, Jiankai Sun, Yao Liu, Suning Huang, Qianzhong Chen, Yang You, Marco Pavone2026-06-23
🤖 AI

OmniV2X: A Generative Foundation Planner for Efficient End-to-End Cooperative Driving

OmniV2X एक व्हीकल-टू-एवरीथिंग (V2X) कोऑपरेटिव ड्राइविंग के लिए एक जनरेटिव फाउंडेशन मॉडल है जो क्रॉस-अटेंशन इंजेक्शन और बड़े पैमाने के सिंगल-एजेंट डेटा पर प्री-ट्रेनिंग का लाभ उठाता है ताकि मौजूदा विधियों की तुलना में काफी कम कम्प्यूटेशनल लागत, डेटा आवश्यकताओं और संचार बैंडविड्थ के साथ अत्याधुनिक प्रदर्शन प्राप्त किया जा सके।

Juntong Peng, Juanwu Lu, Yupeng Zhou, Can Cui, Yaobin Chen, Ziran Wang2026-06-23
💻 computer science

Remember what you did?: Learning Behavioral Memories for Partially Observable Object Manipulation

यह शोध पत्र कंप्रेस्ड एक्शन मेमोरी पॉलिसी (CAMP) को प्रस्तुत करता है, जो एक नवीन दृष्टिकोण है जो रोबोटों को आंशिक दृश्यता (partial observability) के तहत अपने स्वयं के एक्शन इतिहास के स्व-पर्यवेक्षित, संकुचित प्रतिनिधित्व (compressed representation) को सीखकर प्रगति को स्पष्ट रूप से ट्रैक करने और बाहरी पर्यवेक्षण के बिना विफलताओं से उबरने में सक्षम बनाता है, जिससे वे लंबी अवधि के, संपर्क-समृद्ध हेरफेर कार्यों में महारत हासिल कर सकते हैं।

Kuancheng Wang, Seungho Yeom, Jinglin Cao, Yuheng Zhi, Nikhil Shinde, Michael Yip2026-06-23
🤖 AI

FleetAgent: Teleoperation Assistant for Autonomous Fleets via Vectorized V2N Messages

FleetAgent एक क्लाउड-होस्टेड मल्टीमॉडल असिस्टेंट है जो कॉम्पैक्ट, स्ट्रक्चर्ड व्हीकल-टू-नेटवर्क संदेशों को प्रोसेस करने के लिए VecFormer नामक एक नवीन वेक्टर-टू-एम्बेडिंग इंटरफेस का लाभ उठाता है, जो कच्चे सेंसर या टेक्स्ट-आधारित दृष्टिकोणों की तुलना में डेटा ट्रांसमिशन और मेमोरी ओवरहेड को काफी कम करते हुए बड़े पैमाने पर स्वायत्त बेड़े के लिए कुशल, व्याख्यात्मक और प्राथमिकतापूर्ण टेलीऑपरेशन निगरानी को सक्षम बनाता है।

Juntong Peng, Qi Chen, Deyuan Qu, Takayuki Shimizu, Yaobin Chen, Ziran Wang2026-06-23
💻 computer science

Ultra-Fusion: A Resilient Tightly-Coupled Multi-Sensor Fusion SLAM Framework under Sensor Degradation and Spatiotemporal Perturbation for Intelligent Transportation Systems

यह शोध पत्र अल्ट्रा-फ्यूजन (Ultra-Fusion) को प्रस्तुत करता है, जो एक लचीला टाइटली-कपल्ड मल्टी-सेंसर SLAM फ्रेमवर्क है जो चुनौतीपूर्ण सेंसर डिग्रेडेशन और कैलिब्रेशन व्यवधानों के तहत विविध इंटेलिजेंट ट्रांसपोर्टेशन सिस्टम्स के लिए सटीक लोकलाइजेशन बनाए रखने हेतु एक एकीकृत स्लाइडिंग-विंडो एस्टिमेटर, ऑब्जर्वेबिलिटी-अवेयर इनिशियलाइजेशन और ऑनलाइन स्पैटियोटेम्पोरल कैलिब्रेशन का लाभ उठाता है।

Yihong Tian, Junjie Zhang, Liuyang Li, Deteng Zhang, Yunfei Zuo, Jie Yin2026-06-23
💻 computer science

A Human-Inspired Thumb-Index Robotic Hand with Strain Gauges Embedded in Soft Joints

मानव जैव-यांत्रिकी (बायोमैकेनिक्स) से प्रेरित, सेफ थम्ब-इंडेक्स रोबोटिक (STIR) हैंड, बाहरी विज़न या फिंगरटिप टैक्टाइल सेंसर पर निर्भर हुए बिना पैसिव ग्रैस्प अडैप्टेशन और उच्च-सटीक वस्तु वर्गीकरण प्राप्त करने के लिए एम्बेडेड सॉफ्ट-जॉइंट स्ट्रेन गेज के साथ एक हल्के, अंडर-एक्चुएटेड डिज़ाइन का उपयोग करता है।

Jonas Papenbrock, Shubhan Patni, Tomaso Lisini Baldi, Michele Guerri, Elia Landi, Ada Fort, Matej Hoffmann2026-06-23
💻 computer science

RogueRover: Autonomous Rogue Device Localization for Incident Response

RogueRover एक इंफ्रास्ट्रक्चर-मुक्त प्रणाली है जो एक क्वाड्रुपेड रोबोट को केवल मानक 802.11 RSSI मापों और शून्य पूर्व साइट अंशांकन (कैलिब्रेशन) का उपयोग करके, अनधिकृत वायरलेस उपकरणों को स्वायत्त रूप से पहचानने और उच्च सटीकता के साथ भौतिक रूप से स्थानीयकृत करने में सक्षम बनाती है, जिससे साइबर-फिजिकल घटना प्रतिक्रिया की महत्वपूर्ण बाधाओं को दूर किया जा सकता है।

Priyanka Prakash Surve, Asaf Shabtai, Yuval Elovici2026-06-23