🤖 AI

Mind the Phase: Effective Rank and Representation Health in Legged Locomotion

تُظهر هذه الورقة أن تحليل الرتبة الفعالة المشروطة بالطور لسياسات الحركة للأرجل يكشف عن انحيازات معمارية في سلامة التمثيل، والتي يمكن استغلالها لتقليل الارتجاف المفصلي بشكل كبير وتحسين الانتقال من المحاكاة إلى الواقع.

Felipe Tommaselli, Thiago H. Segreto, Juliano D. Negri, Ricardo V. Godoy, Marcelo Becker2026-09-09
🤖 AI

From LLM-Generated Specifications to Learned Quadruped Locomotion

تُثبت هذه الورقة البحثية أن النماذج اللغوية الكبيرة يمكنها توليد مواصفات منطق زمني إشاري معلمي (PSTL) من أوصاف باللغة الطبيعية لاستخلاص دوال مكافأة قابلة للتفسير تلقائياً، مما يمكّن الروبوتات رباعية الأرجل من تحقيق حركة قوية وعالية السرعة بنسب نجاح تصل إلى 100%، وهي نتائج تتفوق بشكل كبير على طرق المكافأة المصممة يدوياً والمستندة إلى الأكواد البرمجية.

Merve Atasever, Keyan Azbijari, Cagan Bakirci, Alfredo Reina Corona, Tolga Izdas, Richard Yang, Erdem Biyik, Jyotirmoy V (…)2026-09-09
💻 computer science

OpenWAM: An Open, Modular Exploration Towards Systematic World-Action Model Pretraining

تقدم هذه الورقة OpenWAM، وهو عبارة عن حزمة بحثية مفتوحة ونمطية تستقصي بشكل منهجي التدريب المسبق لنماذج العالم والعمل (World-Action Model) من خلال تجارب محكومة لاستخلاص مبادئ التصميم الأساسية، وصولاً إلى إصدار نموذج OpenWAM-α\alpha عالي الأداء الذي تم تدريبه على 6,400 ساعة من البيانات المتجسدة المتنوعة.

Yuran Wang, Siqiao Huang, Mingleyang Li, Chenhao Zhang, Jiaqi Liang, Weiyang Jin, Yue Chen, Xuemin Chi, Donghao Zhou, Qi (…)2026-09-09
💻 computer science

Measuring Language Transfer in Robot Policies: Adding Greek to a Cosmos3 Vision-Language-Action Policy

تستقصي هذه الورقة إضافة اللغة اليونانية إلى سياسة الرؤية واللغة والعمل الخاصة بالروبوت باستخدام تعليمات أعيدت صياغتها آلياً فقط، كاشفةً أن التقييم القوي يتطلب معايير مرجعية صفرية وتكراراً للبذور لتجنب الاستنتاجات الخاطئة، بينما تثبت أن التدريب ثنائي اللغة يحقق تحسينات متسقة مقارنة بمجموعات الضبط رغم الإفراط في التخصيص لصياغات محددة.

Ayoub Kirouane, Georgios Giaples, Christos Petrocheilos2026-09-09
💻 computer science

Generation of Vectorized Maps Beyond Vehicle View

تقدم هذه الورقة البحثية المشكلة المستحدثة المتمثلة في توليد الخرائط المتجهة لما وراء مجال الرؤية للتغلب على نطاق الاستشعار المحدود للمركبات ذاتية القيادة، مقترحةً الحل الأول، BeyondFormer، إلى جانب مجموعة بيانات مخصصة لإثبات جدوى التنبؤ بالخرائط القائم على التعلم من أجل الملاحة الآمنة.

Clara Gomez, Alberto Jaenal, Antonio Artuñedo, Jorge Godoy, Jorge Villagra2026-09-09
💻 computer science

ICI-VLA: In-Context Imitation with Spatiotemporally Aligned Demonstrations for Vision-Language-Action Models

يُعد ICI-VLA إطار عمل للتدريب والاسترجاع يُمكّن نماذج الرؤية واللغة والعمل (Vision-Language-Action) الثابتة من تحقيق تكيف سريع في زمن الاختبار باستخدام عينات قليلة، وذلك عبر تكييف توليد العمل بناءً على عروض توضيحية مجهرية متوافقة مكانيًا وزمانيًا وموسومة دلاليًا، مما يلغي الحاجة إلى تحديثات إضافية للتدرج مع التفوق بشكل ملحوظ على النماذج المرجعية في العديد من معايير التحكم الروبوتي.

Songhua Yang (Wuhan University), Ziyu Liu (Wuhan University), Xuetao Li (Wuhan University), Ruqi Xiao (Wuhan University) (…)2026-09-09
💻 computer science

Dex-X: Learning Visual-Tactile Dexterous Manipulation From Human Videos with Simulated Interaction

إن DEX-X هو إطار عمل يسخر المحاكاة كمحرك إكمال لمسي لإعادة بناء تفاعلات اليد مع الأشياء ذات الأساس الفيزيائي من فيديوهات بشرية أحادية الكاميرا، مما يتيح تدريب ونشر سياسات التلاعب البارع البصرية-اللمسية في العالم الحقيقي دون الحاجة إلى جمع بيانات من جانب الروبوت.

Ruoqu Chen, Feixiang Ruan, Liu Cao, Zihao Wang, Botian Xu, Shiqin Tong, Jiajun Liu, Mingzhi Pei, Chenyu Zhang, Wanli Xin (…)2026-09-09
💻 computer science

M3-Tele: A Unified Multimodal Teleoperational Framework for Compliant Whole-Body Mobile Manipulation

تقدم هذه الورقة البحثية M3-Tele، وهو إطار عمل موحد للتحكم عن بُعد متعدد الوسائط يدمج الاستشعار البصري واللمسي والقوة والحس العميق لتمكين التلاعب المتنقل المتوافق لكامل الجسم، مما يحسن بشكل كبير من أداء المهام الغنية بالتلامس ويثبت قيمة الاستشعار المشترك للمس والقوة لتعلم السياسات في المهام اللاحقة.

Hengxiang Chen, Shenwen Deng, Yujian Ma, Gan Ma, Qiang Li, Nutan Chen2026-09-09
💻 computer science

Conditional Timed Partial Orders: An Expressive and Interpretable Framework for Robot Task Specification and Planning

تقدم هذه الورقة البحثية الترتيبات الجزئية الزمنية الشرطية (cTPOs)، وهي إطار عمل تعبيري لتوصيف مهام الروبوت يوسع الترتيبات الجزئية الزمنية التقليدية (TPOs) بقيود زمنية وشرطية أكثر ثراءً، وتقترح خوارزمية تفكيك كاملة لحل مشكلات التخطيط المعقدة الناتجة عنها بكفاءة من خلال تقسيمها إلى مشكلات فرعية أصغر وأكثر قابلية للتفسير مع تحقيق تسريع كبير في العمليات الحسابية.

Sebastian Escobar, Morteza Lahijanian2026-09-09
💻 computer science

mjorbit: A Simulation Framework for Space Robotics

تقدم هذه الورقة mjorbit، وهو إطار عمل محاكاة مفتوح المصدر وعالي الأداء مبني على MuJoCo يدمج انتشار المدار مع ديناميكيات الروبوتات متعددة الأجسام لتمكين أبحاث الخدمة والتجميع والتصنيع في المدار بكفاءة عبر واجهات خلفية لكل من وحدة المعالجة المركزية (CPU) ووحدة معالجة الرسومات (GPU).

John Z. Zhang, Joris Verhagen, Fausto Vega, Patrick McKeen, Zachary Manchester2026-09-09