💻 computer science

P3: Probabilistic Policy Propagation for Stable VAE-Based Robot Learning

تقدم هذه الورقة البحثية إطار عمل "الانتشار الاحتمالي للسياسة" (P³)، وهو إطار تحسين مدرك للتوزيع يعالج التباين والانحياز الناتجين عن التقريبات البدائية أحادية العينة في خوارزمية PPO القائمة على المشفرات التلقائية المتغيرة (VAE)، مما يؤدي إلى تحسين كفاءة البيانات بشكل كبير، وتقليل خطوات التقارب، وتمكين التعلم القوي لمهام الباركور البشرية الصعبة.

Liyun Yan, Jianming Ma, Yang Zhang, Shengcheng Fu, Zhanxiang Cao, Keqi Zhu, Yizhi Chen, Yue Gao2026-07-29
💻 computer science

Tripody: An Overconstrained 3-SPR-like Parallel Robot for High-Reach Construction Tasks

تقدم هذه الورقة بحث "Tripody"، وهو روبوت موازٍ ذو عجلات خفيف الوزن، يشبه في تصميمه نظام (3-SPR) ومفرط التقييد، يستخدم الامتثال المرن لتحقيق صلابة التوائية عالية ودقة تحديد مواقع بمستوى المليمتر لمهام بناء الأسقف ذات الأحمال الثقيلة.

Julien Kindle, Jakub Raczy, Riccardo Balbi, Andrea Alessandretti, Cesar Cadena, Marco Hutter2026-07-29
💻 computer science

Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design

تقدم الورقة البحثية "Transformer Transformer"، وهو نموذج محول انتشار موحد (diffusion transformer) مُدرب على رموز روبوتية (RoboTokens) يتيح التصميم المشترك للروبوتات المعتمد على الحركة من خلال توليد هيئات روبوتية وأجهزة تحكم محسنة لمهام ومكافآت غير مرئية عبر آلية مبتكرة للتوجيه الذاتي للديناميكيات (Dynamics Self-Guidance)، محققاً تحسينات كبيرة في الأداء مقارنة بالنماذج التطورية المرجعية.

Huy Ha, C. Karen Liu, Shuran Song2026-07-29
💻 computer science

DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models

يُعد DC-WAM إطار عمل يرتكز على الديناميكية ويعزز نماذج العالم-الفعل (World-Action Models) عبر نقل الإشراف من المظهر الواقعي الفوتوغرافي إلى الديناميكيات البصرية المستحثة بالتفاعل، وتوظيف متنبئ ذي صلة ديناميكية على مستوى الرمز (token-wise)، مما يؤدي إلى تحسين أداء التحكم الروبوتي والمتانة تجاه الاضطرابات البيئية دون الحاجة إلى وسائط إضافية عند التشغيل.

Haoyuan Ji, Lingxiang Fan, Shang Su, Yinqiao Lu, Mengkai Shi, Jun Gao, Shuo Feng2026-07-29
💻 computer science

S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information

تقدم هذه الورقة البحثية S2A2، وهو إطار عمل للتعلم بالتقليد متعدد الوسائط يدمج الميزات البصرية مع المعلومات المكانية والصوتية لتمكين الروبوتات من أداء مهام المناولة بفعالية من خلال استخدام الإشارات السمعية لتحديد موقع الهدف والتعرف عليه.

Kaneyoshi Hiratsuka, Benjamin Yen, Ryosuke Kojima2026-07-29
🤖 machine learning

πR2\pi\mathbf{R}^2: Reactive Real-time Flow Policies

تقدم الورقة البحثية πR2\pi\mathbf{R}^2، وهو إطار عمل يعزز سياسات تدفق تقطيع الأفعال العامة بالقدرة على التفاعل في الوقت الفعلي من خلال فصل التكييف الحسي العميق السريع عن التكييف البصري البطيء واستخدام جدول تدفق متكيف مع زمن التأخير، مما يتيح التحكم في الحلقة المغلقة بتردد عالٍ ويحسن معدلات النجاح بشكل كبير في مهام المعالجة الديناميكية دون الحاجة إلى بنيات هيكلية جديدة.

Sungjae Park, Shubham Tulsiani2026-07-29
⚡ electrical engineering

Unifying Complementarity Constraints and Control Barrier Functions for Safe Whole-Body Robot Control

تُثبت هذه الورقة وجود تكافؤ رسمي بين قيود التكامل (complementarity constraints) ودوال الحاجز للتحكم (control barrier functions) للأنظمة من الدرجة الأولى ذات العينات المتقطعة، مما يوحد هاتين المنهجيتين لتمكين التطبيق المتبادل لضمانات المتانة والتحسينات الخوارزمية في التحكم الآمن للروبوتات كاملة الجسم.

Rafael I. Cabral Muchacho, Riddhiman Laha, Florian T. Pokorny, Luis F. C. Figueredo, Nilanjan Chakraborty2026-07-28
🤖 AI

CoopReflect: Towards Natural Language Communication for Cooperative Autonomous Driving via Multi-Agent Learning

تقدم هذه الورقة CoopReflect، وهو إطار عمل للتعلم متعدد الوكلاء يُمكّن المركبات ذاتية القيادة من التواصل عبر اللغة الطبيعية من أجل قيادة تعاونية أكثر أماناً وكفاءة، وذلك عبر الجمع بين التعلم بالتجربة والخطأ وبين استخلاص المعلومات متعدد الوكلاء للتغلب على قيود التنسيق التي تواجه وكلاء النماذج اللغوية الكبيرة القياسيين.

Jiaxun Cui, Chen Tang, Jarrett Holtz, Janice Nguyen, Alessandro G. Allievi, Hang Qiu, Peter Stone2026-07-28
⚡ electrical engineering

ACCESS-AV: Adaptive Communication-Computation Codesign for Sustainable Autonomous Vehicle Localization in Smart Factories

تقترح الورقة البحثية إطار عمل ACCESS-AV، وهو إطار عمل تكيفي للاتصالات والحوسبة يستفيد من كتل إشارات المزامنة الحالية لشبكات الجيل الخامس (5G) وخوارزمية MUSIC محسّنة لتحقيق تحديد موقع للمركبات ذاتية القيادة بدقة تقل عن 30 سم في المصانع الذكية، مما يؤدي إلى تقليل استهلاك الطاقة بنسبة 43.09% مقارنة بالأنظمة غير التكيفية.

Rajat Bhattacharjya, Arnab Sarkar, Ish Kool, Sabur Baidya, Nikil Dutt2026-07-28
💻 computer science

Agentic Reward Modeling: Verifying GUI Agent via Progressive Trajectory-Grounded Interaction

تقدم هذه الورقة VAGEN، وهو إطار عمل يستخدم وكيل تحقق مدعوم بالأدوات مع آلية تحقق تدريجية من السطح إلى الكامن للتغلب على قيود طرق نمذجة المكافأة السلبية والمفرطة في الاستقصاء الحالية، مما يؤدي إلى تحسين دقة وكفاءة تقييم وكيل واجهة المستخدم الرسومية (GUI) بشكل كبير على معايض مثل OSWorld-Verified وAndroidWorld.

Chaoqun Cui, Jing Huang, Shijing Wang, Liming Zheng, Qingchao Kong, Zhixiong Zeng2026-07-28