🤖 AI

Token-Based Affordance Grounding with Large Vision-Language Models

यह शोध पत्र TokAG का प्रस्ताव करता है, जो एक ज़ीरो-शॉट अफोर्डेंस ग्राउंडिंग फ्रेमवर्क है जो लार्ज विज़न-लैंग्वेज मॉडल्स से ऑब्जेक्ट-केंद्रित अटेंशन मैप्स निकालने के लिए एक स्थानिक-जागरूक टोकन-चयन तंत्र का लाभ उठाता है, जिससे बाहरी पर्यवेक्षण के बिना क्रिया-प्रासंगिक क्षेत्रों को स्थानीयकृत करने में पूर्व कमजोर रूप से पर्यवेक्षित विधियों की तुलना में बेहतर प्रदर्शन प्राप्त होता है।

Seung Il Lee, Qinqian Lei, Daguang Xu, Dong Yang, Robby T. Tan, Yixin Chen, Bo Wang2026-07-07
💻 computer science

A Vision Based System for Guided and Collaborative Reconstruction of Fragmented Documents

यह शोध पत्र एक सहयोगात्मक विज़न-आधारित प्रणाली प्रस्तुत करता है जो खंडित सांस्कृतिक विरासत दस्तावेजों के लचीले, वास्तविक समय और सटीक पुनर्निर्माण को सक्षम करने के लिए एक विशेष सक्शन अटैचमेंट वाले कोबोट (cobot) को AI-संचालित SE2-LoFTR मिलान के साथ एकीकृत करता है।

Oliver Krumpek, Diana Leo2026-07-07
🤖 machine learning

Learning 3D-Gaussian Simulators from RGB Videos

यह शोध पत्र 3DGSim का प्रस्ताव करता है, जो एक एंड-टू-एंड सीखा गया 3D सिम्युलेटर है जो मल्टी-व्यू RGB डेटा से यथार्थवादी नोवेल व्यू वीडियो उत्पन्न करने और भौतिक अंतःक्रियाओं को सीधे कैप्चर करने के लिए 3D पुनर्निर्माण, पार्टिकल डायनेमिक्स प्रेडिक्शन और टेम्पोरल एग्रीगेशन को एकीकृत करता है, जिसमें बिना किसी विशेषाधिकार प्राप्त 3D ग्राउंड ट्रुथ की आवश्यकता नहीं होती है।

Mikel Zhobro, Andreas René Geist, Georg Martius2026-07-03
💻 computer science

Latent Policy Barrier: Learning Robust Visuomotor Policies by Staying In-Distribution

यह शोध पत्र लेटेंट पॉलिसी बैरियर (LPB) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो विशेषज्ञ अनुकरण (expert imitation) को आउट-ऑफ-डिस्ट्रीब्यूशन रिकवरी से अलग करके विज़ुओमोटर पॉलिसियों की मजबूती और डेटा दक्षता को बढ़ाता है, जिसमें एक डायनेमिक्स मॉडल का उपयोग करके लेटेंट अवस्थाओं को अनुकूलित किया जाता है और उन्हें बिना किसी अतिरिक्त मानवीय सुधार के विशेषज्ञ प्रदर्शनों के सुरक्षित वितरण के भीतर रखा जाता है।

Zhanyi Sun, Shuran Song2026-07-03
🤖 AI

Active Matter as a framework for living systems-inspired Robophysics

यह परिप्रेक्ष्य लेख सक्रिय-पदार्थ भौतिकी (active-matter physics) और जैविक सिद्धांतों को उनके मॉडलिंग और डिज़ाइन में एकीकृत करने की वकालत करते हुए, जैव-प्रेरित रोबोटिक समूहों (bio-inspired robotic collectives) में मौलिक दक्षता और समन्वय संबंधी चुनौतियों को संबोधित करता है।

Giulia Janzen, Gaia Maselli, Juan F. Jimenez, Lia Garcia-Perez, D A Matoz Fernandez, Chantal Valeriani2026-07-03
💻 computer science

Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation

यह शोध पत्र AtomSkill प्रस्तुत करता है, जो एक नवीन ढांचा है जो व्यवहारों को पुन: प्रयोज्य, प्रगति-जागरूक कौशलों में विभाजित करके सुदृढ़, सामान्यीकरण योग्य बहु-कार्य रोबोटिक हेरफेर को सक्षम करने के लिए कंट्रास्टिव अलाइनमेंट और कीपोज़ इमेजिनेशन के माध्यम से एक अर्थपूर्ण रूप से संरेखित परमाणु कौशल स्थान (एटॉमिक स्किल स्पेस) सीखता है।

Yihang Zhu, Weiqing Wang, Shijie Wu, Ye Shi, Jingya Wang2026-07-03
⚡ electrical engineering

SPOT: Spatio-Temporal Obstacle-free Trajectory Planning for UAVs in Unknown Dynamic Environments

यह शोध पत्र SPOT प्रस्तुत करता है, जो अज्ञात गतिशील वातावरण में क्वाड्रोटर्स के लिए एक मैपलेस रिएक्टिव मोशन प्लानिंग फ्रेमवर्क है, जो मैप फ्यूजन पर निर्भर रहे बिना सुरक्षित और टकराव-मुक्त नेविगेशन सुनिश्चित करने के लिए विजन-आधारित सेफ कॉरिडोर जनरेशन और एक बैकअप मॉड्यूल के साथ 4D स्पैटियो-टेम्पोरल प्लानिंग को जोड़ता है।

Astik Srivastava, Thomas J Chackenkulam, Bitla Bhanu Teja, Antony Thomas, Madhava Krishna2026-07-03
💻 computer science

BIEVR-LIO: Robust LiDAR-Inertial Odometry through Bump-Image-Enhanced Voxel Maps

BIEVR-LIO एक सुदृढ़ LiDAR-Inertial Odometry प्रणाली है जो एक उच्च-रिज़ॉल्यूशन वाले वोक्सेल-आधारित बम्प-इमेज मैप प्रतिनिधित्व और सूक्ष्म ज्यामितीय विविधताओं का लाभ उठाने के लिए एक लक्षित पॉइंट सैंपलिंग रणनीति का उपयोग करके चुनौतीपूर्ण, कम-सूचना वाले वातावरण में पंजीकरण सटीकता को बढ़ाता है।

Patrick Pfreundschuh, Turcan Tuna, Cedric Le Gentil, Roland Siegwart, Cesar Cadena, Helen Oleynikova2026-07-03
🤖 machine learning

Certified World Models: Predictability Across Configuration, Horizon, and Resolution

यह शोध पत्र इक्विवैरिएंट लेटेंट वर्ल्ड मॉडल्स (equivariant latent world models) के लिए एक कंप्यूट करने योग्य प्रेडिक्टेबिलिटी सर्टिफिकेट (predictability certificate) प्रस्तुत करता है जो कॉन्फ़िगरेशन, होराइजन और रेज़ोल्यूशन में रोलआउट त्रुटियों को सीमित करने के लिए सिमेट्री (symmetry) का लाभ उठाता है, यह प्रदर्शित करते हुए कि सटीक इक्विवैरिएंस (exact equivariance) इनवेरिएंट एरर सुनिश्चित करती है जबकि अनुमानित इक्विवैरिएंस (approximate equivariance) विश्वसनीय निर्णय लेने के लिए मार्गदर्शन हेतु लयापुनोव स्पेक्ट्रा (Lyapunov spectra) के माध्यम से होराइजन एस्टीमेशन (horizon estimation) की अनुमति देती है।

Hongbo Wang2026-07-03
💻 computer science

Simulation Based Reward Function Validation for Multi-Agent On Orbit Inspection

यह शोध पत्र मल्टी-एजेंट सुदृढीकरण शिक्षण (Multi-Agent Reinforcement Learning) के लिए एक सामान्यीकृत सिमुलेशन-आधारित रिवॉर्ड फंक्शन का प्रस्ताव करता है जो निरीक्षण अंतरिक्ष यान को निश्चित निरीक्षण बिंदुओं से आगे बढ़कर, इमेजरी संग्रह के इष्टतम स्थानों और समय को स्वायत्त रूप से निर्धारित करने में सक्षम बनाता है, ताकि 3D पुनर्निर्माण में सुधार किया जा सके और कक्षीय निरीक्षण कार्यों के लिए व्यापक अंतर्दृष्टि प्राप्त की जा सके।

Patrick Quinn, Bala Prenith Reddy Gopu, George M. Nehma, Madhur Tiwari2026-07-03