🤖 machine learning

Posterior-driven Heuristic Support Adaptation in a Probabilistic Treatment of Real2Sim2Real for Vision-Driven Deformable Linear Object Manipulation

تقترح هذه الورقة طريقة تكيف دعم استدلالي مدفوع بالاحتمال اللاحق (باستخدام استراتيجيات EDGE وMODE وCENTRE) للتغلب على قيود دعامات أخذ العينات الثابتة في الاستدلال الخالي من الاحتمالية، مما يحسن تحديد المعلمات وتعلم السياسات القوي للتحكم في الأجسام الخطية القابلة للتشوه في سيناريوهات Real2Sim2Real.

Georgios Kamaras, Craig Innes, Subramanian Ramamoorthy2026-09-10
🤖 AI

Toward Learning POMDPs Beyond Full-Rank Actions and State Observability

تقدم هذه الورقة طريقة لتعلم مصفوفات الانتقال والملاحظة الصريحة لعمليات ماركوف لاتخاذ القرار خفية الملاحظة (POMDPs) من البيانات المتسلسلة عبر الاستفادة من النهج الطيفي وتحلل التنسور تحت افتراضات رتبة مخففة، مما يمكّن الوكيل من التخطيط لوظائف مكافأة متنوعة مع وضع حدود نظرية لقابلية تحديد الحالة.

Seiji Shaw, Travis Manderson, Chad Kessens, Nicholas Roy2026-09-10
💻 computer science

Advancing Accessible Underwater Robotics: The Mini-Girona I-AUV at RAMI 2025

تقدم هذه الورقة تصميم وتطوير والأداء التنافسي لمركبة Mini-Girona I-AUV منخفضة التكلفة، والتي حصدت المركز الثاني في مسابقة طلاب RAMI 2025 من خلال إثبات إمكاناتها كمنصة ميسرة لأبحاث الروبوتات تحت الماء والتعليم رغم مواجهتها لتحديات حرارية وتحديات في الوصول.

Taqi Hamoda, Bilal Ahmed, Deborah Ele-Ojo, Thi Tran Ha Bao, Adel Saidani, Mazen Elgabalawy, Alaaeddine Chaarani, Sebasti (…)2026-09-10
💻 computer science

Geometry Conditioning in an Embodied SLM: Training Controls and Robustness Diagnostics in a 0.8B Hybrid Model

تتقصى هذه الورقة البحثية تأثير التكييف الهندسي على نموذج لغوي مجسد هجين بحجم 0.8 مليار، كاشفةً أن محاذاة مدخلات الحالة الفيزيائية أثناء التدريب لا تحقق أي ميزة موثوقة مقارنة بالهندسة المبعثرة أو الغائبة، ومسلطةً الضوء على فجوة كبيرة بين الثبات الإحداثي والتعميم على المخطط الفيزيائي في السياسات البصرية.

Hao Li, Haofei Sun, Lin He2026-09-10
⚡ electrical engineering

No Free Checker: A Survey of Verifiers for Robot Policies

تستعرض هذه الورقة ما يقرب من 150 أداة للتحقق من سياسات الروبوتات، مصنفةً إياها حسب مصدرها ومحللةً المقايضة الجوهرية حيث يؤدي تزايد التوافر (انخفاض التكلفة، والتبكير، وكثافة التغذية الراجعة) حتماً إلى انخفاض المصداقية (القابلية للتلاعب)، مما يثبت عدم وجود "مُتحقق مجاني" ويقترح تسعة مقاييس للتحقق من ادعاءات أدوات التحقق المستقبلية.

Yang Wan, Xihang Yue, Zhirui Liu, Ziyuan Chu, Shuxun Wang, Yuhan Chen, Xiaonan Jiang, Xukun Zhu, Yubo Dong, Linchao Zhu2026-09-10
🤖 AI

Compact Visuotactile World Models for Lifting: Prediction, Reward Alignment, and Force Constraints

تتقصى هذه الورقة كيف يؤدي دمج الاستشعار البصري اللمسي في نموذج عالم مدمج إلى تحسين التنبؤ بالتلامس ومواءمة المكافأة لمهام الرفع الروبوتية بشكل كبير، رغم أنها تكشف عن مقايضة مستمرة بين تحقيق معدلات نجاح عالية للمهمة والالتزام الصارم بقيود القوة دون إثبات انتقال من المحاكاة إلى الواقع.

Qinzhen Ma (Rice University), Sida Peng (Zhejiang University)2026-09-10✓ Author reviewed
📊 statistics

Why Learning Rediscovers the Closed-Form Diagonal Regularizer

تحدد هذه الورقة مبدأ تشبع قطري في المسائل العكسية المنوالية حيث يتبع منظم تيكونو التيف (Tikhonov) الأمثل بايزياً قانون قوة مغلق الصيغة محددًا فقط من خلال التوزيع القبلي، مما يجعل معظم البنيات القطرية المتعلمة فائضة عن الحاجة بينما يسلط الضوء على أن التعلم لا يوفر فوائد كبيرة إلا من خلال الاقتران عبر الأنماط.

Jeahn Han, Pyojin Kim2026-09-10
💻 computer science

PccDiffuser: Multi-solution Motion Planning for Continuum Robots

تقدم الورقة البحثية PccDiffuser، وهو إطار عمل انتشار شرطي يستفيد من الإحداثيات الأسية، والشبكات العصبية الرسومية، والكينماتيكا التفاضلية التحليلية لتوليد حلول تخطيط حركة متعددة وقابلة للتنفيذ للروبوتات المستمرة بكفاءة في البيئات المعقدة والغنية بالعوائق وبمعدلات نجاح عالية.

Ke Qiu, Sifan Chen, Si Wang, Rong Xiong, Yue Wang, Haojian Lu2026-09-10
🤖 AI

HiRAD: A Flexible Large-Scale AGV Routing System

تقدم هذه الورقة HiRAD، وهو إطار عمل للتعلم التعزيزي الهرمي يتغلب على قيود القابلية للتوسع والوقت الفعلي لأنظمة توجيه المركبات الموجهة آلياً (AGV) الكلاسيكية والقائمة على التعلم التعزيزي الحالية، وذلك من خلال توظيف تمثيلات الفضاء المستمر، واستراتيجية تحكم مفككة، ومسار معالجة غير متزامن مدفوع بالأحداث لتقليل زمن الإنجاز وزمن انتقال الاستدلال بشكل كبير.

Yunjie Huang, Ruizhong Wu, Mengxuan Zhang, Frodo Kin Sun Chan, Yan Nei Law, Lei Li2026-09-10
💻 computer science

RealSimLoop: Online Real-to-Sim Adaptation via Differentiable Reduced-Order Simulation with Vision Feedback

يُعد RealSimLoop إطار عمل للمحاكاة القابلة للتفاضل وذات الرتبة المنخفضة، والذي يستفيد من التغذية الراجعة البصرية وهدف النافذة المنزلقة لتحقيق تكيف شبه فوري في الوقت الفعلي بين الواقع والمحاكاة عبر الإنترنت، مما يتيح الاستعادة الدقيقة للكميات الفيزيائية الخفية مثل مجالات الإجهاد والخصائص المادية المتغيرة مع الزمن من خلال ملاحظات متفرقة.

Zhihao Cen, Chuhua Xian, Hailin Sun, Yuliang Liufu, Zhen Zhang, Xiangyu Chu, Hongmin Cai, Yunbo Zhang, Guoxin Fang2026-09-10