🤖 AI

Geometric-Photometric Event-based 3D Gaussian Ray Tracing

تقترح هذه الورقة إطار عمل جديد لتقنية "Gaussian Splatting" ثلاثية الأبعاد القائمة على الأحداث، والذي يفصل بين رندرة الهندسة ورندرة الإشعاع إلى فرعين، أحدهما يعتمد على الحدث تلو الآخر والآخر يعتمد على اللقطات، وذلك لتحقيق إعادة بناء ثلاثية الأبعاد رائدة وخالية من المسبقات ذات دقة زمنية عالية وتفاصيل حواف حادة.

Kai Kohyama, Yoshimitsu Aoki, Guillermo Gallego, Shintaro Shiba2026-03-02
💻 computer science

RoboMIND 2.0: A Multimodal, Bimanual Mobile Manipulation Dataset for Generalizable Embodied Intelligence

تقدم هذه الورقة RoboMIND 2.0، وهي مجموعة بيانات متعددة الوسائط واسعة النطاق تضم 310 ألف مسار من مسارات التلاعب ثنائي اليد والمتنقل في العالم الحقيقي، والمعززة ببيانات لمسية وتوائم رقمية، إلى جانب نظام MIND-2 الهرمي الذي يستفيد من التعلم المعزز غير المتصل لتحقيق ذكاء متجسد قابل للتعميم عبر هياكل روبوتية متنوعة.

Chengkai Hou, Kun Wu, Jiaming Liu, Zhengping Che, Di Wu, Fei Liao, Guangrun Li, Jingyang He, Qiuxuan Feng, Zhao Jin, Che (…)2026-03-02
💻 computer science

Point Bridge: 3D Representations for Cross Domain Policy Learning

يُعد Point Bridge إطار عمل يُمكّن من نقل سياسات التحكم من المحاكاة إلى الواقع بنمط "التعلم الصفري" (zero-shot) في مهام التلاعب الروبوتي، وذلك عبر الاستفادة من تمثيلات نقطية موحدة ومستقلة عن النطاق يتم استخراجها بواسطة نماذج الرؤية واللغة، مما يتغلب على الفجوات البصرية في النطاقات ويحقق مكاسب أداء كبيرة مقارنة بالطرق السابقة.

Siddhant Haldar, Lars Johannsmeier, Lerrel Pinto, Abhishek Gupta, Dieter Fox, Yashraj Narang, Ajay Mandlekar2026-03-02
🤖 AI

DECO: Decoupled Multimodal Diffusion Transformer for Bimanual Dexterous Manipulation with a Plugin Tactile Adapter

تقدم هذه الورقة DECO، وهو محول انتشار متعدد الوسائط منفصل مع محول لمسي إضافي ومجموعة بيانات DECO-50 المصاحبة له، والذي يحقق أداءً هو الأفضل في فئته في مجال المناولة الماهرة ثنائية اليد من خلال دمج الرؤية، وحس الإدراك العميق، والإشارات اللمسية بفعالية مع أكثر من 2,000 تقييم حقيقي للروبوت.

Xukun Li, Yu Sun, Lei Zhang, Bosheng Huang, Yibo Peng, Yuan Meng, Haojun Jiang, Shaoxuan Xie, Guocai Yao, Alois Knoll, Z (…)2026-03-02
🤖 machine learning

Flow-Enabled Generalization to Human Demonstrations in Few-Shot Imitation Learning

تقترح الورقة البحثية إطار عمل SFCrP، وهو إطار مبتكر يجمع بين نموذج التنبؤ بتدفق المشهد للتعلم عبر الأجسال المختلفة وسياسة مشروطة بالتدفق، لتمكين الروبوتات من التعميم من عروض توضيحية قليلة إلى مهام معقدة باستخدام فيديوهات بشرية كمصدر أساسي للبيانات.

Runze Tang, Penny Sweetser2026-03-02
⚡ electrical engineering

Beyond Ground: Map-Free LiDAR Relocalization for UAVs

تقدم هذه الورقة البحثية MAILS، وهو إطار عمل جديد لإعادة تحديد الموقع باستخدام ليدار (LiDAR) بدون خرائط مصمم خصيصاً للطائرات بدون طيار، والذي يستفيد من الانتباه الحافظ للمحلية والآليات المستقلة عن الإحداثيات لتحقيق تحديد دقيق للمواقع في البيئات التي تفتقر إلى نظام تحديد المواقع العالمي (GNSS)، مصحوباً بإنشاء مجموعة بيانات جديدة واسعة النطاق لمعالجة نقص بيانات طيران الطائرات بدون طيار الواقعية.

Hengyu Mu, Jianshi Wu, Yuxin Guo, XianLian Lin, Qingyong Hu, Sheng Ao, Chenglu Wen, Cheng Wang2026-03-02
🤖 AI

IntentCUA: Learning Intent-level Representations for Skill Abstraction and Multi-Agent Planning in Computer-Use Agents

يُعد IntentCUA إطار عمل متعدد الوكلاء يعزز أتمتة استخدام الكمبيوتر طويلة الأمد من خلال الاستفادة من الذاكرة المشتركة لتجريد تمثيلات النوايا متعددة الرؤى والمهارات القابلة لإعادة الاستخدام، مما يؤدي إلى استقرار التنفيذ وتحسين معدلات نجاح المهام وكفاءتها بشكل كبير مقارنة بالنهج الحالية.

Seoyoung Lee, Seobin Yoon, Seongbeen Lee, Yoojung Chun, Dayoung Park, Doyeon Kim, Joo Yong Sim2026-03-02
💻 computer science

Towards Intelligible Human-Robot Interaction: An Active Inference Approach to Occluded Pedestrian Scenarios

تقترح هذه الورقة إطار عمل قائماً على الاستدلال النشط للقيادة الذاتية يستخدم مرشح الجسيمات القائم على تقنية "راو-بلاك-ويلد" (Rao-Blackwellized Particle Filter)، وإعادة ضبط الاعتقاد المشروط، وحقن الفرضيات لنمذجة نوايا المشاة المحجوبين، مما يتيح اتخاذ قرارات قابلة للتفسير وتحاكي السلوك البشري، وهو ما يقلل بشكل كبير من معدلات الاصطدام مقارنة بالنهج التقليدية ونهج التعلم المعزز.

Kai Chen, Yuyao Huang, Guang Chen2026-03-02
💻 computer science

Motion-aware Event Suppression for Event Cameras

تقدم هذه الورقة إطار عمل خفيف الوزن ويعمل في الوقت الفعلي لكبح الأحداث القائم على الحركة، والذي يقوم بدمج تجزئة وتنبؤ الحركة المستقبلية للأجسام المتحركة المستقلة والحركة الذاتية لتصفية الأحداث الديناميكية، محققاً أداءً هو الأفضل في فئته على مقيء EVIMO مع تسريع التطبيقات اللاحقة مثل محولات الرؤية (Vision Transformers) وتقدير المسافة البصرية (visual odometry) بشكل كبير.

Roberto Pellerito, Nico Messikommer, Giovanni Cioffi, Marco Cannici, Davide Scaramuzza2026-03-02
💻 computer science

Demystifying Action Space Design for Robotic Manipulation Policies

تقدم هذه الورقة دراسة تجريبية واسعة النطاق تُظهر أن تصميم فضاء العمليات لسياسة التحكم في التلاعب الروبوتي يؤثر بشكل كبير على أداء التعلم، مما يكشف أن التنبؤ بحركات التغير (delta actions) يحسن النتائج، بينما تقدم تمثيلات فضاء المفاصل وفضاء المهام فوائد متكاملة فيما يتعلق بالاستقرار والتعميم على التوالي.

Yuchun Feng, Jinliang Zheng, Zhihao Wang, Dongxiu Liu, Jianxiong Li, Jiangmiao Pang, Tai Wang, Xianyuan Zhan2026-03-02