💻 computer science

SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot

إن SAIN هو إطار عمل يعتمد على التعلم الصفري (zero-shot) يعمل على تعزيز ملاحة الروبوتات المتنقلة في ظل التعليمات الغامضة من خلال تحويل الحوار النشط إلى حالات مكانية وموضوعية مستمرة ومنظمة، مما يؤدي إلى تحسين معدلات النجاح بشكل كبير في معيار VL-LN IIGN دون الحاجة إلى تدريب سياسات خاصة بالمهام.

Yuhao Cao, Xiao Liu, Yang Xie, Lu Liu, Haoyao Chen2026-08-11
⚡ electrical engineering

Real-Time Nonlinear MPC via Sequential Quadratic Programming with Structure-Exploiting ADMM and Interior-Point Methods for Underactuated Double-Pendulum Swing-Up

تقدم هذه الورقة استراتيجية تحكم تنبؤي نموذجي غير خطي في الوقت الفعلي تعتمد على البرمجة التربيعية المتتالية، والتي تحقق بنجاح عملية التأرجح للأعلى والاستقرار لنظام بندول مزدوج ناقص التفعيل على أجهزة غير معروفة من أجل مسابقة "AI Olympics with RealAIGym".

Nick Karydakis, Konstantinos Chatzilygeroudis2026-08-11
🤖 AI

WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for Embodied Manipulation

تقدم هذه الورقة WorldSimProbe، وهو إطار تشخيصي قائم على القدرات يصيغ "عقد محاكي قابل للملاحظة" لتقييم دقة نماذج العالم المشروطة بالأفعال تقييماً صارماً من خلال مجموعات خاضعة للتحكم لتقييم الاستحثاث الحركي، وتجذير التفاعل، والديناميكيات، مما يكشف عن إخفاقات منهجية في النماذج الحالية تغفل عنها المقاييس البصرية أو القائمة على المهام التقليدية.

Peterson Co, Sicheng Hu, Chunxuan Jiao, Hongyang Cheng, Yulin Luo, Yijie Xu, Sixiang Chen, Zhongxia Zhao, Zihao Wang, Da (…)2026-08-11
🤖 machine learning

SAFE-CHEM: Uncertainty-Aware Policy Switching for Robust Robotic Chemistry

تقدم الورقة البحثية SAFE-CHEM، وهو إطار عمل مدرك لعدم اليقين يعزز سلامة وموثوقية الكيميائيين الروبوتيين المستقلين من خلال الانتقال ديناميكيًا من السياسات المتعلمة إلى النسخ الاحتياطية القائمة على القواعد عندما يتجاوز عدم اليقين المعرفي عتبة مُعايرة، مما يقلل من الإخفاقات الحرجة في التجارب الكيميائية عالية المخاطر.

Laura Jones, Shazil Shahzad, Ayesha Sana, Gabriella Pizzuto2026-08-11
💻 computer science

DH-VLM: Dual-Horizon Cooperative Latent Reasoning for Autonomous Driving

تقترح الورقة البحثية إطار عمل DH-VLM، وهو إطار استدلال كامن تعاوني ثنائي الأفق يستفيد من الاستدلال العالمي المجمع عبر البنية التحتية لتنقيح اتخاذ القرار للمركبة ذاتية القيادة من خلال توجيه كامن فعال، محققاً أداءً رائدًا في التخطيط مع تقليل تكاليف الاتصال واستهلاك الذاكرة بشكل كبير مقارنة بالطرق الحالية.

Ziyi Song, Chen Xia, Hang Yu, Sheng Zhou, Zhisheng Niu2026-08-11
💻 computer science

JEPA-WAM: Learning Vision-Language-Action Policies with Joint-Embedding World Modeling

يقدم نموذج JEPA-WAM نموذج عمل عالمي كامن مبني على فضاء V-JEPA مدرب مسبقاً يوحد بين التنبؤ المستقبلي ذو البنية المكانية وتوليد الأفعال المستمرة من خلال متنبئ مشترك، محققاً أداءً رائداً في معايير قياس التلاعب الروبوتي دون الحاجة إلى تدريب مسبق للسياسات على نطاق واسع.

Yihan Lin, Jiawei He, Shifeng Bao, Chen Zhao, Yang Li, Xiaobo Wang, Yan Wang, Cheng Chi, Jing Zhang2026-08-11
💻 computer science

VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction

يُعد VANE إطار عمل موثوقاً للتدريب في وقت الاختبار لنماذج الرؤية واللغة والعمل، حيث يقوم بتكييف السياسات بشكل انتقائي عبر عزل التحديثات المرشحة وعدم اعتمادها إلا بعد التحقق من نجاحها من خلال التنبؤ بالتمثيل البصري المستقبلي، مما يؤدي إلى تحسين أداء التلاعب في الحلقة المغلقة.

Hongjin Ji, Guoyang Xia, Luoyang Sun, Fangxiang Feng, Lei Ren2026-08-11
💻 computer science

Rethink Before You Execute: Adaptive Execution for World Action Models

تقدم الورقة البحثية TempoWAM، وهو إطار عمل تنفيذ تكيفي خفيف الوزن لنماذج أفعال العالم (World Action Models)، يقرر ديناميكيًا متى يعيد التخطيط بناءً على مراقبة تقدم المهمة في الوقت الفعلي بدلاً من أفق فعل ثابت، مما يحسن بشكل كبير من مقايضة الكفاءة والنجاح في كل من المهام الروبوتية المحاكاتية والواقعية.

Feng Ye, Yiming Zhao, Yong Yu, Hongxu Zhou, Yong Pan, Yuan Xue, Peng Jia, Chuanmin Jia2026-08-11
⚡ electrical engineering

TDMA Based Communications Control Co-Design for Cooperative Carrying: Delay Calibration and Sampling-Rate Optimization

تقدم هذه الورقة دراسة محاكاة قائمة على الفيزياء تُظهر أن الجمع بين التعديل التكيفي لمعدل أخذ العينات والقيادة الدوارة في أنظمة الحمل التعاوني متعددة الروبوتات القائمة على الوصول المتعدد بتقسيم الزمن (TDMA) يوازن بفعالية بين استقرار التحكم، وكفاءة الاتصال، والتوزيع العادل لوقت البث في ظل قيود الشبكة الواقعية.

Zahra Seifaei, Maximilian Luebke, Torsten Reissland, Danial Dehghani, Norman Franchi2026-08-11
💻 computer science

GenTrack3: Hybrid Stochastic-Deterministic Online Multi-Object Tracking with Cluster-Aware Association

تقدم هذه الورقة GenTrack3، وهو إطار عمل لتتبع الأجسام المتعددة عبر الإنترنت يدمج بين المبادئ الحتمية والعشوائية مع طريقة ربط جديدة واعية بالمجموعات لتحقيق تتبع قوي وقابل للتوسع في ظل عدم اليقين مع دعم ديناميكيات المجموعات.

Toan Van Nguyen, Rasmus G. K. Christiansen, Dirk Kraft, Leon Bodenhagen2026-08-11