🤖 AI

Prismatic World Model: Learning Compositional Dynamics for Planning in Hybrid Systems

يعالج نموذج العالم المنشوري (PRISM-WM) أوجه القصور في نماذج العالم الكامنة المتجانسة في الأنظمة الروبوتية الهجينة عبر توظيف بنية "خليط من الخبراء" مدركة للسياق مع تعامد كامن لتفكيك الديناميكيات المعقدة إلى بدائيات قابلة للتركيب، مما يقلل من انحراف التنبؤ طويل الأمد ويُمكّن من التخطيط الموثوق للمسافات الطويلة.

Mingwei Li, Xiaoyuan Zhang, Chengwei Yang, Zilong Zheng, Yaodong Yang2026-05-14
💻 computer science

TouchGuide: Inference-Time Steering of Visuomotor Policies via Touch Guidance

يُعد TouchGuide إطار عمل جديد للتوجيه أثناء الاستدلال، يعمل على تعزيز سياسات الحركة البصرية الحركية سابقة التدريب من أجل عمليات المناولة الغنية بالتلامس، وذلك عبر دمج نموذج فيزيائي للتلامس مُدرب تباينياً لتنقية الأفعال البصرية التقريبية بتوجيه لمسي، مدعوماً بنظام جمع بيانات TacUMI منخفض التكلفة.

Zhemeng Zhang, Jiahua Ma, Xincheng Yang, Xin Wen, Yuzhi Zhang, Boyan Li, Yiran Qin, Jin Liu, Can Zhao, Li Kang, Haoqin H (…)2026-05-14
💻 computer science

Perception with Guarantees: Certified Pose Estimation via Reachability Analysis

تقدم هذه الورقة طريقة معتمدة لتقدير الوضعية ثلاثية الأبعاد للوكلاء السيبرانيين الفيزيائيين ذوي المهام الحرجة للسلامة، والتي تستخدم تحليل إمكانية الوصول والتحقق الرسمي من الشبكة العصبية لتوفير ضمانات سلامة للحالات الأسوأ بناءً فقط على صور الكاميرا وهندسة الهدف المعروفة.

Tobias Ladner, Yasser Shoukry, Matthias Althoff2026-05-14
🤖 machine learning

Learning When to Act: Communication-Efficient Reinforcement Learning via Run-Time Assurance

تقترح هذه الورقة إطار عمل للتعلم التعزيزي الآمن وفعال في الاتصالات، يتعلم توقيت التشغيل المتكيف جنباً إلى جنب مع سياسات التحكم، باستخدام طبقة ضمان وقت التشغيل مع نسخ احتياطية قائمة على دالة ليابونوف لضمان الاستقرار مع التفوق بشكل كبير على طرق السلامة ذات المعدل الثابت والقائمة على التوقع عبر مختلف الأنظمة الروبوتية.

Adam Haroon, Erick J. Rodríguez-Seda, Cody Fleming, Tristan Schuler2026-05-14
💻 computer science

Action Emergence from Streaming Intent

تقدم هذه الورقة البحثية "النية المتدفقة" (Streaming Intent)، وهو إطار عمل جديد للقيادة الذاتية من طرف إلى طرف يتيح ظهور الأفعال عبر اشتقاق النية المتدفقة دلاليًا عبر آلية سلسلة من الأفكار لتوجيه مولد أفعال قائم على مطابقة التدفق، محققًا أداءً تنافسيًا وقدرة تحكم غير مسبوقة في الوفاء بالنية على معيار وايمو (Waymo).

Pengfei Jing, Victor Shea-Jay Huang, Hengtong Lu, Jifeng Dai, Xie Yan, Benjin Zhu2026-05-14
💻 computer science

MindVLA-U1: VLA Beats VA with Unified Streaming Architecture for Autonomous Driving

يقدم MindVLA-U1 أول بنية موحدة للبث الرؤيوي-اللغوي-الحركي للقيادة الذاتية تدمج الاستدلال اللغوي التوليدي ذاتي الانحدار مع توليد الحركة المستمرة عبر مطابقة التدفق من خلال عمود فقري وقناة ذاكرة مشتركة، مما يتيح التحكم في المسار بتوجيه لغوي يتفوق على الأداء البشري في معيار WOD-E2E مع الحفاظ على معدل إنتاجية في الوقت الفعلي.

Yuzhou Huang, Benjin Zhu, Hengtong Lu, Victor Shea-Jay Huang, Haiming Zhang, Wei Chen, Jifeng Dai, Yan Xie, Hongsheng Li2026-05-14
💻 computer science

Driving Intents Amplify Planning-Oriented Reinforcement Learning

تقدم الورقة البحثية إطار عمل DIAL، وهو إطار عمل ثنائي المراحل يجمع بين مطابقة التدفق المشروطة بالنية وبين التعلم المعزز القائم على تفضيلات النوايا المتعددة للتغلب على انهيار النمط في سياسات القيادة ذات الإجراءات المستمرة، مما يمكنها من تجاوز كل من النماذج السابقة ذات الأداء العالي والقيادة البشرية في الأداء.

Hengtong Lu, Victor Shea-Jay Huang, Chengmin Yang, Pengfei Jing, Jifeng Dai, Yan Xie, Benjin Zhu2026-05-14
💻 computer science

Multistep Belief Space Dynamics Learning For Risk-Aware Control

تقدم هذه الورقة إطار عمل تعلمي للتنبؤ بالديناميكيات التوزيعية يتيح التحكم التنبئي بالنماذج في الوقت الفعلي والمدرك للمخاطر، والذي تم التحقق من صحته من خلال دراسات استئصال دقيقة ونشر ناجح على مركبة كاملة الحجم تتنقل في تضاريس وعرة وصعبة.

Jason Gibson, Bogdan Vlahov, Patrick Spieler, Evangelos A. Theodorou2026-05-14
💻 computer science

COSMIC: Concurrent Optimization of Structure, Material, and Integrated Control for robotic systems

تقدم هذه الورقة COSMIC، وهو إطار عمل للتصميم المشترك قائم على التدرج يعمل على تحسين الطوبولوجيا، وتوزيع المواد، وسياسة التحكم لروبوتات الشبكة الجمالونية (truss-lattice) في آن واحد داخل محاكي قابل للتفاضل، مما يظهر أداءً فائقًا ورؤى تصميمية متفوقة مقارنة بنهج التصميم المنفصل التقليدية.

Qinsong Guo, Liwei Wang2026-05-14
💻 computer science

3D RL-DWA: A Hybrid Reinforcement Learning and Dynamic Window Approach for Goal-Directed Local Navigation in Multi-DoF Robots

تقدم هذه الورقة إطار عمل هجينًا مبتكرًا يجمع بين التعلم المعزز ونهج النافذة الديناميكية لتمكين الروبوتات المجهرية القابلة للتشوه ذات درجات الحرية العالية من تحقيق ملاحة ثلاثية الأبعاد قوية وموجهة نحو الهدف في البيئات الوعائية المعقدة والمقيدة باستخدام بيانات السحابة النقطية المتفرقة.

Chiara Castellani, Enrico Turco, Domenico Prattichizzo2026-05-14