💻 computer science

ROSA: A Robotics Foundation Model Serving System for Robot Factories

ROSA एक रोबोटिक्स फाउंडेशन मॉडल सर्विंग सिस्टम है जिसे रोबोट फैक्ट्रियों के लिए डिज़ाइन किया गया है जो साझा GPU पूल्स, मल्टी-मॉडल प्रोग्रामिंग एब्स्ट्रैक्शन और फैक्ट्री-ऑब्जेक्टिव-ड्रिवन शेड्यूलिंग का लाभ उठाता है ताकि समग्र उत्पादकता को अधिकतम किया जा सके, जो पारंपरिक समर्पित सर्विंग सिस्टमों की तुलना में 12.06x तक का सुधार प्राप्त करता है।

Wenqi Jiang, Jason Clemons, Rowland O'Flaherty, Hugo Hadfield, Alperen Degirmenci, Shuran Song, Yashraj Narang, Christos (…)2026-07-02
💻 computer science

Technical Report: Asynchronous Distributed Trajectory Estimation of Multi-Robot Systems

यह शोध पत्र मल्टी-रोबोट सिस्टम में वितरित प्रक्षेपवक्र अनुमान (ट्रैजेक्टरी एस्टीमेशन) के लिए एक एसिंक्रोनस ब्लॉक कोऑर्डिनेट डिसेंट एल्गोरिदम प्रस्तावित करता है जो संचार ओवरहेड को काफी कम करता है, घातांकीय अभिसरण (एक्सपोनेंशियल कन्वर्जेंस) की गारंटी देता है, और सटीकता तथा विलंब (डिले) के प्रति मजबूती दोनों में अत्याधुनिक तरीकों से बेहतर प्रदर्शन करता है।

Adam Pooley, Matthew Hale2026-07-02
💻 computer science

Structured 4D Latent Predictive Model for Robot Planning

यह शोध पत्र एक स्ट्रक्चर्ड 4D लेटेंट प्रेडिक्टिव मॉडल पेश करता है जो मौजूदा वीडियो-आधारित प्लानर्स की 2D सीमाओं को पार करने के लिए एक स्ट्रक्चर्ड लेटेंट स्पेस में 3D दृश्य विकास (scene evolution) का पूर्वानुमान लगाता है, जिससे जटिल रोबोटिक मैनिपुलेशन कार्यों के लिए बेहतर 3D निरंतरता, दृश्य गुणवत्ता और सुदृढ़ सामान्यीकरण प्राप्त होता है।

Zhiyi Li, Peilin Wu, Xiaoshen Han, Ruojin Cai, Yilun Du2026-07-02
⚡ electrical engineering

GPU-Parallel Linearization Error Bounds for Real-Time Robust Optimal Control of Nonlinear and Neural Network Dynamics

यह शोध पत्र GPUSLS-LEO प्रस्तुत करता है, जो एक GPU-समानांतर फ्रेमवर्क है जो उच्च-आयामी अनिश्चित गैररेखीय प्रणालियों के लिए वास्तविक समय में, औपचारिक रूप से सत्यापित सुदृढ़ इष्टतम नियंत्रण को सक्षम करने हेतु एनालिटिक और न्यूरल नेटवर्क डायनेमिक्स दोनों के लिए सटीक, विभेदनीय लीनियराइजेशन एरर बाउंड्स की गणना करता है।

Jeffrey Fang, Keyi Shen, Anutam Srinivasan, Glen Chou2026-07-02
🤖 AI

FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model

यह शोधपत्र FurnitureVLA प्रस्तुत करता है, जो एक विजन-लैंग्वेज-एक्शन मॉडल है जो वास्तविक-पैमाने के, दीर्घ-अवधि वाले द्विपक्षीय फर्नीचर असेंबली को सक्षम बनाता है, जो सिमुलेशन और वास्तविक दुनिया के सत्यापन दोनों में बेसलाइन की तुलना में सफलता दर में महत्वपूर्ण सुधार प्राप्त करने के लिए एक प्रोग्रेस-एन्हांस्ड आर्किटेक्चर और उच्च-गुणवत्ता वाले टेलीऑपरेटेड प्रदर्शनों का लाभ उठाता है।

Chenyang Ma, Yue Yang, Radu Corcodel, Siddarth Jain, Andrew Wu, Chiori Hori, Diego Romeres2026-07-02
💻 computer science

Combined Constrained Sampling and Reinforcement Learning for Robotic Manipulation

यह शोध पत्र एक नवीन दृष्टिकोण प्रस्तावित करता है जो जटिल, संपर्क-समृद्ध (contact-rich) वातावरणों में सार्वभौमिक, गैर-पकड़ (non-prehensile) रोबोटिक हेरफेर नीतियों को प्रभावी ढंग से प्रशिक्षित करने के लिए संरचित रीसेट रणनीतियों और अन्वेषण को बढ़ाने के लिए पाठ्यक्रम शिक्षण (curriculum learning) का लाभ उठाते हुए, संकुचित अवस्था नमूनाकरण (constrained state sampling) को सुदृढीकरण शिक्षण (reinforcement learning) के साथ जोड़ता है।

Marc Toussaint, Cornelius V. Braun, Armand Jordana, Sayantan Auddy, Eckart Cobo-Briesewitz, Denis Shcherba, Tilman Burgh (…)2026-07-01
💻 computer science

ShapeGrasp: Simultaneous Visuo-Haptic Shape Completion and Grasping for Improved Robot Manipulation

ShapeGrasp एक नवीन रोबोटिक प्रणाली है जो अपरिचित वस्तुओं पर ग्रैस्पिंग (पकड़ने) के दौरान 3D वस्तु आकार पुनर्निर्माण को परिष्कृत करने और ग्रैस्प सफलता दरों में सुधार करने के लिए दृश्य अनुमान (visual estimation) को स्पर्श फीडबैक (tactile feedback) के साथ पुनरावृत्ति से संयोजित करती है।

Lukas Rustler, Matej Hoffmann2026-07-01
💻 computer science

Locker-based Truck-Drone Routing with Integrated Considerations of Pickups, Deliveries, and No-Fly Zones

यह शोध पत्र पिकअप, डिलीवरी और नो-फ्लाई ज़ोन (LTDRP-PDNF) के एकीकृत समाधान के साथ लॉकर-आधारित ट्रक-ड्रोन रूटिंग समस्या को हल करने के लिए एक दो-चरणीय डीप रीइन्फोर्समेंट लर्निंग-आधारित न्यूरल ह्यूरिस्टिक का प्रस्ताव करता है, जो बैटरी सीमाओं और प्रतिबंधित हवाई क्षेत्र जैसे जटिल वास्तविक दुनिया के बाधाओं को संबोधित करते हुए परिचालन लागत को प्रभावी ढंग से कम करता है।

Xuanyu Liu, Hui Hu, Jiao Zhao, Ziliang Wang, Zhengbing He2026-07-01
💻 computer science

Position: Vision-Language-Action Models Cannot Be Verified to Perform Physical Reasoning

यह स्थिति पत्र तर्क देता है कि विजन-लैंग्वेज-एक्शन (VLA) मॉडलों के लिए वर्तमान मूल्यांकन प्रोटोकॉल सिमेंटिक मैचिंग और वास्तविक भौतिक तर्क के बीच अंतर करने में विफल रहते हैं, जिससे भौतिक सामान्यीकरण के दावे अपुष्ट हो जाते हैं और ऐसे नए प्रयोगात्मक डिजाइनों की आवश्यकता होती है जो इन विशिष्ट क्षमताओं को कारणवश अलग कर सकें।

Taozhao Chen, Ian Manchester, Huaming Chen2026-07-01
💻 computer science

ViTL: Temporal Logic-Guided Zero-Shot Natural Language Navigation via Vision-Language Models

यह शोध पत्र ViTL प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो जटिल कमांड्स को मल्टी-टारगेट निष्पादन को समन्वित करने के लिए लीनियर टेम्पोरल लॉजिक फॉर्मूला में बदलकर और विजन-लैंग्वेज मॉडल-निर्देशित अन्वेषण को बढ़ाने के लिए एक दिशात्मक स्कोरिंग तंत्र पेश करके अज्ञात वातावरणों में ज़ीरो-शॉट लॉन्ग-होरिज़ोन नेचुरल लैंग्वेज नेविगेशन को सक्षम बनाता है।

Kaier Liang, Hengde Dai, Cristian-Ioan Vasile2026-07-01