💻 computer science

sim2art: Accurate Articulated Object Modeling from a Single Video using Synthetic Training Data Only

تقدم الورقة البحثية sim2art، وهو إطار عمل قائم على البيانات يستعيد بدقة تقسيم الأجزاء ثلاثية الأبعاد ومعلمات المفاصل للأجسام المفصلية من فيديو أحادي العدسة واحد عبر الاستفوتادة من تمثيل قوي لنقاط السطح لكل إطار تم تدريبه حصريًا على بيانات اصطناعية، مما يلغي الحاجة إلى تكييف النطاق أو التوصيفات الواقعية مع التفوق على الأساليب الحالية الرائدة.

Arslan Artykov, Tom Ravaud, Corentin Sautier, Vincent Lepetit2026-03-24
🤖 machine learning

Contractive Diffusion Policies: Robust Action Diffusion via Contractive Score-Based Sampling with Differential Equations

تقدم هذه الورقة سياسات الانتشار الانكماشية (CDPs)، وهي طريقة تعزز متانة واتساق التحكم غير المتصل القائم على الانتشار من خلال إحداث ديناميكيات انكماشية في عملية أخذ العينات، مما يخفف من أخطاء الحل والمطابقة للدرجة، مع تحسين الأداء، لا سيما في سيناريوهات ندرة البيانات.

Amin Abyaneh, Charlotte Morissette, Mohamad H. Danesh, Anas El Houssaini, David Meger, Gregory Dudek, Hsiu-Chin Lin2026-03-24
🤖 AI

Goal Force: Teaching Video Models To Accomplish Physics-Conditioned Goals

تقدم الورقة البحثية "Goal Force"، وهو إطار عمل مبتكر يدرب نماذج توليد الفيديو على بدائيات سببية اصطناعية باستخدام ناقلات قوة صريحة كأهداف، مما يتيح تعميماً صفرياً للمهام الفيزيائية المعقدة في العالم الحقيقي ويعمل كمحاكي فيزيائي عصبي ضمني للتخطيط الدقيق.

Nate Gillman, Yinghua Zhou, Zitian Tang, Evan Luo, Arjan Chakravarthy, Daksh Aggarwal, Michael Freeman, Charles Herrmann (…)2026-03-24
💻 computer science

Causal World Modeling for Robot Control

تقدم هذه الورقة البحثية LingBot-VA، وهو إطار عمل انتشار ذاتي الانحدار يوحد بين نمذجة عالم الفيديو والتدريب المسبق للرؤية واللغة عبر فضاء كامن مشترك، وتدفق مغلق الحلقة، واستدلال غير متزامن لتحقيق تحكم روبوتي طويل الأمد يتسم بالكفاءة، والقدرة على التعميم، وكفاءة البيانات.

Lin Li, Qihang Zhang, Yiming Luo, Shuai Yang, Ruilin Wang, Fei Han, Mingrui Yu, Zelin Gao, Nan Xue, Xing Zhu, Yujun Shen (…)2026-03-24
💻 computer science

Your Robot Will Feel You Now: Empathy in Robots and Embodied Agents

تستعرض هذه الورقة الأبحاث الحالية حول تطبيق التعاطف في الروبوتات والوكلاء الحواريين المتجسدين من خلال الذكاء الاجتماعي والعاطفي متعدد الوسائط، بهدف تطبيق هذه الرؤى على الوكلاء اللغويين المعاصرين مثل ChatGPT.

Angelica Lim, Ö. Nilay Yalçin2026-03-24
💻 computer science

Beyond Scalar Rewards: Distributional Reinforcement Learning with Preordered Objectives for Safe and Reliable Autonomous Driving

تقدم هذه الورقة إطار عمل لعمليات ماركوف لاتخاذ القرار متعددة الأهداف ذات الترتيب المسبق، مقترناً بمقياس هيمنة المئينات المبتكر لتمكين التعلم التعزيزي التوزيعي الذي يحترم أهداف السلامة والأداء الهرمية، مما يؤدي إلى سياسات قيادة ذاتية أكثر أماناً ومتانة مقارنة بالطرق التقليدية القائمة على القيم القياسية.

Ahmed Abouelazm, Jonas Michel, Daniel Bogdoll, Philip Schörner, J. Marius Zöllner2026-03-24
💻 computer science

TRGS-SLAM: IMU-Aided Gaussian Splatting SLAM for Blurry, Rolling Shutter, and Noisy Thermal Images

تقدم هذه الورقة نظام TRGS-SLAM، وهو نظام تحديد مواقع ورسم خرائط ثلاثي الأبعاد يعتمد على تقنية Gaussian Splatting ومعزز بوحدة قياس القصور الذاتي (IMU)، والذي يتيح بشكل فريد تحديد المواقع ورسم الخرائط بدقة عبر الصور الحرارية الصعبة من خلال تقديم تقنيات رندرة وتحسين متخصصة للتغلب على ضبابية الحركة، وتشويهات الغالق المتدحرج، وضوضاء النمط الثابت.

Spencer Carmichael, Katherine A. Skinner2026-03-24
💻 computer science

GHOST: Ground-projected Hypotheses from Observed Structure-from-Motion Trajectories

تقدم هذه الورقة البحثية GHOST، وهي طريقة ذاتية الإشراف قابلة للتوسع تستفيد من مسارات البنية من الحركة أحادية العدسة واسعة النطاق المستخرجة من فيديوهات كاميرات لوحة القيادة (dashcam) لتوليد أقنعة مكانية مسقطة على الأرض، مما يتيح تدريب شبكة تقسيم عميقة تتنبأ بفرضيات مسارات المركبات الممكنة في البيئات الحضرية المعقدة دون الحاجة إلى تسميات توضيحية يدوية.

Tomasz Frelek, Rohan Patil, Akshar Tumu, Henrik I. Christensen2026-03-24
💻 computer science

Enhancing Vision-Based Policies with Omni-View and Cross-Modality Knowledge Distillation for Mobile Robots

تقترح هذه الورقة إطار عمل لتقطير المعرفة ينقل معرفة العمق وثبات المشهد والرؤية الشاملة من سياسة معلم قوية إلى سياسة طالب أحادية العدسة خفيفة الوزن، مما يتغلب بفعالية على قيود قابلية نقل المشهد، والموارد الحسابية، وتكاليف المستشعرات للروبوتات المتنقلة.

Kai Li, Shiyu Zhao2026-03-24
🤖 machine learning

RoboECC: Multi-Factor-Aware Edge-Cloud Collaborative Deployment for VLA Models

تقدم الورقة البحثية RoboECC، وهو إطار عمل جديد للنشر التعاوني بين الحافة والسحابة لنماذج الرؤية واللغة والعمل (Vision-Language-Action)، والذي يستخدم استراتيجية تقسيم مدركة للنموذج والعتاد ونهج تعديل مدرك للشبكة للتغلب على تحديات التنوع الهيكلي وتقلبات الشبكة، محققاً تسريعاً يصل إلى 3.28 ضعفاً مع حد أدنى من العبء الإضافي.

Zihao Zheng, Hangyu Cao, Jiayu Chen, Sicheng Tian, Chenyue Li, Maoliang Li, Xinhao Sun, Guojie Luo, Xiang Chen2026-03-24