💻 computer science

Factorized Spatio-Temporal Convolutions for Human Pose Estimation from Planar Lidar

यह शोध पत्र एक हल्का, फैक्टराइज्ड स्पैटियो-टेम्पोरल कनवल्शन नेटवर्क प्रस्तुत करता है जो केवल सर्वदिशीय प्लेनर LiDAR का उपयोग करके, कंप्यूटेशनल रूप से सीमित सर्विस रोबोट्स पर रीयल-टाइम मानव पहचान और 2D पोज़ एस्टीमेशन को सक्षम बनाता है, जो बिना किसी मैनुअल LiDAR लेबल के क्रॉस-मोडल सेल्फ-सुपरवाइज्ड ट्रेनिंग के माध्यम से बेहतर सटीकता प्राप्त करता है।

Simone Arreghini, Mirko Nava, Nicholas Carlotti, Antonio Paolillo, Alessandro Giusti2026-07-24
💬 NLP

GS-Agent: Creating 4D Physical Worlds With Generative Simulation

GS-Agent एक एंड-टू-एंड मल्टी-एजेंट फ्रेमवर्क पेश करता है जो एसेट मैनेजमेंट, मटेरियल ट्यूनिंग, मोशन कंट्रोल और रेंडरिंग के लिए मानव-समान वर्कफ़्लो का अनुकरण करते हुए, नेचुरल लैंग्वेज विवरणों से स्वचालित रूप से गतिशील, भौतिक रूप से प्रशंसनीय और नियंत्रणीय 4D दुनिया उत्पन्न करने के लिए फाउंडेशन मॉडल्स और फिजिक्स इंजनों का लाभ उठाता है।

Hongxin Zhang, Chunru Lin, Junyan Li, Zhou Xian, Tsun-Hsuan Wang, Chuang Gan2026-07-24
💻 computer science

AXIS: A Growable Community-Driven Data Engine for Scalable Robot Manipulation

यह शोध पत्र AXIS को प्रस्तुत करता है, जो एक स्केलेबल, समुदाय-संचालित डेटा इंजन और बेंचमार्क है जो विविध रोबोट मैनिपुलेशन कार्यों के बड़े पैमाने के डेटासेट को उत्पन्न करने के लिए ब्राउज़र-आधारित टेलीऑपरेशन और स्वचालित डेटा प्रोसेसिंग का लाभ उठाता है, यह प्रदर्शित करते हुए कि इस डेटा पर निरंतर प्रीट्रेनिंग मौजूदा मॉडलों की तुलना में पॉलिसी प्रदर्शन और स्केलिंग व्यवहार में महत्वपूर्ण सुधार करती है।

Mengfei Zhao, Dihong Huang, Yikai Tang, Peihao Li, Mingxuan Yan, Ruiqi Zhuang, Yanjia Huang, Jie Wang, Hai Zhai, Tony Zh (…)2026-07-24
💻 computer science

Counterfactual Reasoning and Environment Design for Active Preference Learning

यह शोध पत्र CRED को प्रस्तुत करता है, जो एक नवीन सक्रिय प्राथमिकता शिक्षण (active preference learning) ढांचा है जो मानव प्राथमिकता रैंकिंग के लिए विविध और सूचनात्मक प्रश्नों को उत्पन्न करने हेतु प्रतितथ्यात्मक तर्क (counterfactual reasoning) के माध्यम से पर्यावरण डिजाइन और प्रक्षेपवक्र चयन को संयुक्त रूप से अनुकूलित करके दीर्घ-क्षितिज रोबोटिक कार्यों में पुरस्कार अनुमान को बढ़ाता है।

Yi-Shiuan Tung, Bradley Hayes, Alessandro Roncone2026-07-23
🤖 machine learning

PGTT: Phase-Guided Terrain Traversal for Perceptive Legged Locomotion

यह शोध पत्र PGTT को प्रस्तुत करता है, जो एक धारणा-जागरूक (perception-aware) डीप रिइन्फोर्समेंट लर्निंग फ्रेमवर्क है जो चरण-निर्देशित पुरस्कार शेपिंग (phase-guided reward shaping) का उपयोग करता है ताकि प्रतिबंधात्मक गेट प्रायर्स (gait priors) या ब्लाइंड कंट्रोल रणनीतियों पर निर्भर रहे बिना विविध भूभागों में सुदृढ़, आकार-निरपेक्ष (morphology-agnostic) लेग्ड लोकमोशन को सक्षम बनाया जा सके।

Alexandros Ntagkas, Chairi Kiourt, Konstantinos Chatzilygeroudis2026-07-23
💻 computer science

ModPack: An Extensible Teleoperation Interface for Bimanual Mobile Manipulation

ModPack एक ओपन-सोर्स, मॉड्यूलर टेलीऑपरेशन सिस्टम है जिसमें एक स्व-निहित वियरेबल बैकपैक शामिल है जो विविध रोबोट प्लेटफॉर्म्स के लिए द्विपक्षीय मोबाइल मैनिपुलेशन हेतु एक एकीकृत, प्लग-एंड-प्ले फ्रेमवर्क प्रदान करता है, जिससे स्केलेबल डेटा कलेक्शन और पॉलिसी लर्निंग सुलभ होती है।

Joshua Citron, Renee Zbizika, Zeyi Liu, Shuran Song2026-07-23
💻 computer science

A Splitting Architecture for Exact Reduced Coulomb Friction

यह शोध पत्र एक स्प्लिटिंग आर्किटेक्चर प्रस्तुत करता है जो गैर-संबद्ध युग्मन (non-associated coupling) के लिए एक बाहरी पुनरावृत्ति और एक आंतरिक दृढ़ उत्तल शंकु-प्रतिबंधित द्विघातीय प्रोग्राम (strongly convex cone-constrained quadratic program) में समस्या को अलग करके सटीक न्यूनीकरण वाले कूलम्ब घर्षण (reduced Coulomb friction) को हल करता है, जिससे बिना किसी स्मूथिंग या रिलैक्सेशन के सटीक घर्षण पूरकता (frictional complementarity) को पुनरुत्पादित किया जाता है।

Hongcheng Song, Ye Fan, Uri M. Ascher, Dinesh K. Pai2026-07-23
💻 computer science

LENS: LLM-guided Environment Simplification for Planning and Control in Clutter

यह शोध पत्र LENS को पेश करता है, जो एक प्लग-एंड-प्ले फ्रेमवर्क है जो वस्तुओं को मर्ज या प्रून (छंटनी) करके कार्य-विशिष्ट दृश्य अमूर्तता (scene abstractions) को स्वचालित रूप से उत्पन्न करने और गतिशील रूप से अपडेट करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे अत्यधिक अव्यवस्थित रोबोटिक मैनिपुलेशन वातावरणों में विभिन्न प्लानिंग और कंट्रोल विधियों के प्रदर्शन में महत्वपूर्ण सुधार होता है।

Aileen Liao, Rachel Holladay, Dinesh Jayaraman, Michael Posa2026-07-23
⚡ electrical engineering

Digital Twin Modeling of a Highly Automated Agricultural Tractor

यह शोध पत्र मेवेआ (Mevea) सिमुलेशन और पायथन-आधारित CAN संचार का उपयोग करके AMX G-trac कृषि ट्रैक्टर के लिए एक डिजिटल ट्विन के विकास और सत्यापन को प्रस्तुत करता है, जो पार्श्व गतिकी (lateral dynamics) में उच्च सटीकता प्रदर्शित करता है और हाइड्रोलिक एवं इम्प्लीमेंट एकीकरण के साथ भविष्य के संस्करणों को समर्थन देने के लिए बेहतर अनुदैर्ध्य मॉडलिंग (longitudinal modeling) की आवश्यकता को रेखांकित करता है।

Clay Hallman, Lukas Pindl, Timo Oksanen2026-07-23
🤖 machine learning

Diffusion ReRoll: Revisable Denoising for Robotic Sequential Prediction

यह शोध पत्र डिफ्यूजन रीरोल (Diffusion ReRoll) का प्रस्ताव करता है, जो रोबोटिक अनुक्रमिक भविष्यवाणी (robotic sequential prediction) के लिए एक नवीन डिफ्यूजन-आधारित ढांचा है जो स्थानीय रूप से स्थिर क्षेत्रों के चयनात्मक पुन: शोर (selective re-noising) के माध्यम से पुनरावृत्ति क्रॉस-होरिज़न संशोधन को सक्षम बनाता है, जो लॉन्ग-होरिज़न प्लानिंग, पॉलिसी लर्निंग और यूनिफाइड वीडियो-एक्शन मॉडलिंग में मौजूदा विधियों से काफी बेहतर प्रदर्शन करता है।

Seonsoo Kim, Seongil Hong, Jun-Gill Kang2026-07-23