💻 computer science

Nano-U: Efficient Terrain Segmentation for Tiny Robot Navigation

यह शोध पत्र Nano-U प्रस्तुत करता है, जो एक अत्यधिक कॉम्पैक्ट बाइनरी सेगमेंटेशन नेटवर्क है जिसे क्वांटिज़ेशन-अवेयर डिस्टिलेशन (Quantization-Aware Distillation) के माध्यम से प्रशिक्षित किया गया है और एक Rust-आधारित कंपाइलर का उपयोग करके कम लागत वाले ESP32-S3 माइक्रोकंट्रोलर पर तैनात किया गया है ताकि अनस्ट्रक्चर्ड वातावरण में छोटे रोबोटों के लिए कुशल, कम-विलंबता वाली टेरेन परसेप्शन (terrain perception) को सक्षम बनाया जा सके।

Federico Pizzolato, Francesco Pasti, Nicola Bellotto2026-07-07
💻 computer science

Learning 3D Affordances for Blade Insertion in Cluttered Stowing

यह शोध पत्र VulcanVoxel को प्रस्तुत करता है, जो एक स्थानिक अनुमान ढांचा (spatial inference framework) है जो अव्यवस्थित वातावरण में बिना एनोटेट किए गए वास्तविक दुनिया के डेटा से सीधे मल्टी-मोडल ब्लेड इंसर्शन अफोर्डेंस (multi-modal blade insertion affordances) सीखने के लिए 3D ऑक्यूपेंसी फील्ड्स पर मास्क किए गए ऑटोएनकोडर्स का उपयोग करता है, जो कवरेज और अनुमान गति दोनों में पारंपरिक पोज़-आधारित विधियों से काफी बेहतर प्रदर्शन करता है।

Tianyu Li, Harpreet Sawhney, Minju Jung, Aditya Mehrotra, Kunal Mehrotra, Mudit Agrawal2026-07-07
💻 computer science

GigaWorld-1: A Roadmap to Build World Models for Robot Policy Evaluation

यह शोध पत्र WMBench को पेश करके और वर्ल्ड मॉडल डिज़ाइन में प्रमुख अंतर्दृष्टि प्राप्त करके एम्बॉडीड रोबोट फाउंडेशन मॉडल्स के मूल्यांकन की बाधा को संबोधित करता है, जो स्केलेबल और विश्वसनीय पॉलिसी इवैल्यूएशन के लिए अनुकूलित एक विशेष वर्ल्ड मॉडल, GigaWorld-1 की रिलीज़ के रूप में परिणत होता है।

GigaWorld Team, Angyuan Ma, Boyuan Wang, Bohan Li, Chaojun Ni, Guo Li, Guan Huang, Guosheng Zhao, Hao Li, Hengtao Li, Ji (…)2026-07-07
💻 computer science

A Spiking Sequence Generator for Polar Trajectories on Neuromorphic Hardware

यह शोध पत्र न्यूरोमॉर्फिक हार्डवेयर पर ध्रुवीय प्रक्षेपवक्र (polar trajectories) उत्पन्न करने के लिए एक व्याख्या योग्य, ऊर्जा-कुशल स्पाइकिंग न्यूरल नेटवर्क आर्किटेक्चर प्रस्तुत करता है, जो पारंपरिक कंप्यूटिंग प्लेटफॉर्मों की तुलना में वॉल-क्लॉक समय और ऊर्जा खपत में महत्वपूर्ण कमी प्राप्त करता है।

William R. P. Nourse, Roger D. Quinn2026-07-07
💻 computer science

CLEAR: Closed-Loop Reinforcement Learning at Scale for End-to-End Autonomous Driving

CLEAR एक विषम सिमुलेशन पाइपलाइन का उपयोग करके प्रीट्रेन्ड विजन-लैंग्वेज-एक्शन मॉडल्स पर एक रेसिडुअल वेपॉइंट पॉलिसी को प्रशिक्षित करने वाले एंड-टू-एंड ऑटोनॉमस ड्राइविंग के लिए एक स्केलेबल क्लोज्ड-लूप रीइन्फोर्समेंट लर्निंग फ्रेमवर्क पेश करता है, जो पारंपरिक इमिटेशन लर्निंग की डिस्ट्रीब्यूशन शिफ्ट सीमाओं को पार करके चुनौतीपूर्ण बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Yunxiao Shi, Hong Cai, Mohammad Ghavamzadeh, Fatih Porikli2026-07-07
💻 computer science

Continuous-Time Gaussian Belief Trees for Motion Planning

यह शोध पत्र अनिश्चितता के तहत मोशन प्लानिंग के लिए एक निरंतर-समय गॉसियन बिलीफ ट्री फ्रेमवर्क का प्रस्ताव करता है जो हाइब्रिड बिलीफ प्रोपेगेशन को बिलीफ-बैरियर-फंक्शन सेफ्टी चेकर के साथ एकीकृत करता है ताकि पूरे प्रक्षेपवक्र खंडों पर संभाव्य सुरक्षा सुनिश्चित की जा सके, जिससे इंटर-सैंपल चांस-कंस्ट्रेंट उल्लंघनों का पता लगाने में डिस्क्रीट-टाइम विधियों की सीमाओं को दूर किया जा सके।

Rayan Mazouz, Qi Heng Ho, Zachary N. Sunberg, Morteza Lahijanian2026-07-07
💻 computer science

Beyond Point-Attached Semantics: Object-Centric Semantic Fields for Generalizable Manipulation

यह शोध पत्र एक ऑब्जेक्ट-सेंट्रिक निरंतर सिमेंटिक फील्ड (object-centric continuous semantic field) प्रस्तावित करता है जो ऑब्जेक्ट पॉइंट क्लाउड्स से स्थिर, व्यूपॉइंट-इनवेरिएंट (viewpoint-invariant) 3D पार्ट-अवेयर एम्बेडिंग्स उत्पन्न करता है, जो मौजूदा पॉइंट-अटैच्ड या 2D-लिफ्टेड फीचर बेसलाइन्स की तुलना में सामान्यीकरण योग्य रोबोट मैनिपुलेशन प्रदर्शन में महत्वपूर्ण सुधार करता है।

Zheng Sun, Lerong Zhang, Zhihao Li, Zhuo Li, Quentin Rouxel, Fei Chen2026-07-07
🤖 AI

AnchorVLA: Bridging Discrete Decisions and Continuous Trajectories for Vision-Language-Action Planning

AnchorVLA एक पदानुक्रमित विजन-लैंग्वेज-एक्शन (Vision-Language-Action) प्लानिंग फ्रेमवर्क है जो ड्राइविंग निर्णयों को स्थानीय मोशन पैटर्न के लिए सिमेंटिक "एंकर" के रूप में प्रस्तुत करके उच्च-स्तरीय तर्क और निरंतर प्रक्षेपवक्र निष्पादन (continuous trajectory execution) के बीच सेतु बनाता है, जिससे मौजूदा ऑटोरेग्रेसिव या कमजोर रूप से बाधित विधियों की अक्षमताओं और संरेखण संबंधी समस्याओं को दूर करते हुए Bench2Drive बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त किया जा सके।

Qi Liu, Yabei Li, Hongsong Wang, Heng Zhang, Lei He2026-07-07
💻 computer science

Invisible Strings: Deriving Puppetry Principles and their Hidden Connections to Robot Behavior Design

यह शोधपत्र तर्क देता है कि कठपुतली कला (पपेट्री), भौतिक रूप से मूर्त रोबोटिक व्यवहारों को डिजाइन करने के लिए एनिमेशन की तुलना में एक अधिक उपयुक्त आधार प्रदान करती है, जो विशेषज्ञ ज्ञान और ग्रंथों का लाभ उठाकर सिद्धांतों का एक अनूठा सेट प्राप्त करती है जो रोबोटिक्स में रूपात्मक, व्यवहारिक और संवादात्मक डिजाइन चुनौतियों का समाधान करते हैं।

Claire Lewis, Sawyer Collins, Alyssa Hanson, Johanna Smith, Tom Williams2026-07-07
🤖 AI

HiMe: Hierarchical Embodied Memory for Long-Horizon Vision-Language-Action Control

यह शोध पत्र HiMe को प्रस्तुत करता है, जो एक पदानुक्रमित एम्बोडीड मेमोरी फ्रेमवर्क (hierarchical embodied memory framework) है जो वास्तविक समय के निष्पादन (real-time execution), वर्किंग मेमोरी और रणनीतिक योजना को अलग करके तथा आत्म-सुधार के लिए गतिशील ज्ञान प्रबंधन को सक्षम करके लंबी अवधि के रोबोटिक कार्यों में फ्रीक्वेंसी-कॉम्पिटेंस विरोधाभास (frequency-competence paradox) को हल करता है।

Li Ji, Siyin Wang, Pengfang Qian, Xiaopeng Yu, Yihai Tian, Zhaoye Fei, Jingjing Gong, Xipeng Qiu2026-07-07