💻 computer science

A Scene Language Model for Open-Vocabulary Scene Mapping

تقدم الورقة البحثية SceneLM، وهو نموذج رؤية-لغة يحافظ على خريطة مشهد ثلاثية الأبعاد مستمرة ومفتوحة المفردات في شكل قائمة نصية مهيكلة وموجزة، محققاً أداءً تنافسياً في التحديد والاسترجاع مع تقليل استهلاك الذاكرة بشكل كبير مقارنة بأنظمة رسم الخرائط التقليدية.

Adam Lilja, Fabio Hübel, Siming He, Junsheng Fu, Claire Tomlin, Lars Hammarstrand, Jitendra Malik, Jonas Frey, Marco Pav (…)2026-09-21
⚡ electrical engineering

Tilt as a Certified Resource: Preserving Motor Wrench-Rate Authority on Articulated Multirotors

تقترح هذه الورقة استراتيجية تخصيص قائمة على دالة حاجز التحكم للمروحيات متعددة المروحيات المفصلية كاملة التفعيل، والتي تستخدم إمالة السيرفو كمورد هندسي لفرض شهادة جاهزية تعتمد على المحرك فقط، مما يحافظ على سلطة معدل عزم الدوران ويمنع انتهاكات السلامة تحت الاضطرابات الشديدة حيث تفشل الطرق الكلاسيكية.

Giuseppe Silano, Martin Saska2026-09-21
💻 computer science

A High-Payload Wall-Climbing Robot Using Passive Bistable Suction Cups

تقدم هذه الورقة روبوتًا مبتكرًا لتسلق الجدران ذو حمولة عالية يستخدم نظامًا قائمًا على المسارات لتعشيق أكواب شفط سلبية ثنائية الاستقرار، مما يتيح الالتصاق بدون طاقة والقدرة على تسلق مختلف الأسطح الملساء أثناء سحب حمولة تبلغ 7.940 كجم.

Andrew Nguyen, Mingyuan Li, Daniel Bruder2026-09-21
💻 computer science

Towards Fine-Grained Object Manipulation: SAM3-Guided Visuomotor Policy with Persistent Memory Learning and Focused Visual Conditioning

تقدم هذه الورقة إطار عمل بصري حركي بتوجيه من SAM3 يتميز بـ FOM-SAM3 للذاكرة المستمرة للأجسام وFSAE للتكييف البصري المركّز، مما يمكّن الروبوتات من التمييز بين الأجسام دقيقة التفاصيل ومعالجتها بمتانة وسط المشتتات والتشابهات البصرية.

Haolong Meng, Fangbo Qin, Mengchen Bai, Houwu Wang, Cirong Liu, Shan Yu2026-09-21
⚡ electrical engineering

RAYA: Learning Where and When to Intervene for Robot Recovery

تقدم الورقة البحثية RAYA، وهو إطار عمل هجين يجمع بين التعلم والتحليل يعمل على دمج هامش استرداد متعلم وجدول مهام تكيفي بشكل استباقي في وحدة تحكم الروبوت لتمكين الاسترداد من الفشل دون تدريب مسبق (zero-shot)، مما يظهر معدلات بقاء متفوقة في كل من المحاكاة المكثفة والرحلات الجوية باستخدام الأجهزة الحقيقية مقارنة بالنماذج المرجعية الحالية.

Ishaan Mahajan, Charles Chen, Frederike Dümbgen, Brian Plancher2026-09-21
💻 computer science

Sandwich-Residuals: Parameter-Efficient Test-time Adaptation of World Models

تقدم الورقة البحثية "Sandwich-Residuals"، وهي طريقة فعالة من حيث المعلمات للتكيف عند وقت الاختبار لنماذج العالم الكامنة، تقوم بتجميد الأوزان مسبقة التدريب وتتعلم فقط تصحيحات متبقية صغيرة عبر الإنترنت باستخدام أخطاء التنبؤ ذاتية الإشراف، مما يحقق معدلات نجاح محسنة بشكل كبير تحت تحولات التوزيع مع تكييف أقل بنسبة 97-99% من المعلمات مقارنة بالأساليب الحالية.

Krishnam Soni, Aditya Sehgal, Vedant Dave, Elmar Rueckert2026-09-21
🤖 AI

ForceTwin: Physics-informed Digital Twins for Robotic Manipulation from Instrumented Human Interaction

يُعد ForceTwin نظاماً يحدد التوائم الرقمية القائمة على الفيزياء للأجسام المفصلية من خلال تحليل التفاعلات البشرية المزودة بأجهزة استشعار مع مقابض حساسة للقوة، مما يتيح قدرة أكبر بكثير على التحكم والتلاعب مقارنة بالنهج الحالية التي تعتمد فقط على الكينماتيكا أو المعارف المسبقة القائمة على اللغة المرئية.

Tim Engelbracht, René Zurbrügg, Mayank Mittal, Marco Hutter, Marc Pollefeys, Hermann Blum, Zuria Bauer2026-09-21
💻 computer science

SFVO: Decoupled Confidence-Guided Stereo-Flow Visual Odometry with Bidirectional PnP

إنَّ SFVO هو إطار عمل لتقدير المسافات البصرية الست درجات الحرية (6-DoF) يعتمد على المراسلات، ويستفيد من نماذج مطابقة ستيريو وتدفق بصري مدربة مسبقاً لتوليد قيود هندسية منفصلة وموجهة بالثقة من أجل تقدير متين للمسافة والوضعية، دون تعلم الوضعية مباشرة من الصور.

Kai Zhang, Guoyang Zhao, Jun Ma2026-09-21
🤖 machine learning

From Pretraining to Proficiency: Real-World Subtask RL for Long-Horizon Manipulation with Minimal Human Intervention

تقدم الورقة البحثية إطار عمل PARTS، وهو إطار عمل للتعلم التعزيزي في العالم الحقيقي يقوم بضبط سياسات الروبوتات مسبقة التدريب من خلال تركيز التدخل البشري فقط على اختناقات المهام الفرعية الحرجة، مما يؤدي إلى تحسين معدلات نجاح عمليات التحكم في المهام طويلة المدى بشكل كبير مع بذل حد أدنى من الجهد البشري مقارنة بالطرق الحالية.

Sichang Su, Benjamin Yang, Zhiyun Deng, Boyuan Liang, Yip Fun Yeung, Zelin Wang, Lingfeng Sun2026-09-21
💻 computer science

A Sim-to-Real Integration Pipeline for Training and Deployment of Chunk-Based VLA Manipulation Policies

تقدم هذه الورقة مساراً مفتوح المصدر للانتقال من المحاكاة إلى الواقع يعالج عقبة ندرة البيانات في تدريب سياسات المناولة القائمة على الرؤية واللغة والأفعال (VLA) بنظام الكتل، وذلك عبر إعادة تشغيل مسارات الخبراء من المحاكاة على أجهزة حقيقية لتوليد مجموعات بيانات مقترنة، مما يتيح تدريباً وتقييماً فعالين للسياسة وقياساً مباشراً للفجوة بين المحاكاة والواقع.

Mathilde Kappel, Clémence Grislain, Mohamed Chetouani, Olivier Sigaud, Louis Annabi, Fa\"ız Ben Amar, Stéphane Doncieux (…)2026-09-21