💻 computer science

Zeva: In-Context Causal Learning for Generalizable Embodied Manipulation

تُعد Zeva إطار عمل مبتكر يُمكّن من التلاعب المجسد القابل للتعميم عبر استخراج التفاعلات السببية من التجارب الفيزيائية للروبوت إلى ذاكرة ثنائية المقياس الزمني، مما يسمح لنموذج سياسة مجمد بالتطور الذاتي وتحسين أدائه عبر المهام من خلال التعلم داخل السياق دون الحاجة إلى تحديثات التدرج.

Fu Chen, Xin Ding, Bingjia Huang, Xiangyu Li, Mingju Wang, Jiawei He, Kun Li, Wei Sun, Yunxin Liu, Hao Wu, Ting Cao2026-09-01
🔬 physics

The Structure of Merging Turbulent Jets Beneath a Small Quadrotor

تستخدم هذه الدراسة تقنية قياس سرعة الصور الجسيمية لتوصيف تدفق الدوامات الهابطة المندمج لمركبة كويزي فلاي 2.1 (Crazyflie 2.1) رباعية المراوح أثناء التحليق، مما يكشف أنه بينما تتحول ملامح متوسط السرعة إلى تشابه ذاتي لنفاث مستدير نموذجي بعد خمسة أطوال لأذرع الدوار، فإن الإجهادات العمودية المضطربة تحتفظ ببصمة ثنائية النمط متميزة لمصدر المراوح الأربعة عبر نطاق القياس بأكمله.

Anoop Kiran, Nora Ayanian, Kenneth Breuer2026-09-01
💻 computer science

LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation

يُعد LightNav-0 نموذجاً مدمجاً وعاماً للملاحة المتجسدة، يستفيد من واجهة رموز موحدة لاستحضاء ومواءمة الذكاء المكاني للنماذج اللغوية البصرية مسبقة التدريب مع التحكم الروبوتي، محققاً أداءً رائداً في أحدث التقنيات وتعميماً صفري القدرة عبر مهام وبيئات وهياكل متنوعة دون الحاجة إلى رؤوس تنبؤ خاصة بالمهام.

Shaoan Wang, Aocheng Luo, Fei Huang, Jingyi Xu, Xiaoyang Wang, Yueyu Wang, Qianli Ma, Fan Yang, Ran Mei, Jia Wei, Jiangp (…)2026-09-01
💻 computer science

SUN: Persistent Programs For Language-Grounded Control-to-Learning-to-Real Policies

تقدم هذه الورقة برامج SUN (الموحدة دلاليًا) ونظام Kuafu، اللذين يجسران الفجوة بين التحكم القائم على النماذج والسياسات المتعلمة من خلال التوليف التلقائي لبرمجيات قابلة للتنفيذ ذات أنواع ومسندة لغويًا توحد بين التحقق من التحكم التنبئي بالنماذج (MPC) وتدريب التعلم المعزز (RL)، مما يتيح معالجة قوية طويلة المدى دون الحاجة إلى مكافآت كثيفة يدوية أو عروض توضيحية بشرية.

Weiqi Wang, Zhi Li, Yudong Lei, David Martinez, Xiaofeng Gao, Yuxin Jiang, Chenfanfu Jiang, Yingnian Wu, Demetri Terzopo (…)2026-09-01
🤖 AI

SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models

تقترح الورقة البحثية استراتيجية SCALE، وهي استراتيجية استدلال أحادية الممر وخالية من التدريب لنماذج الرؤية واللغة والعمل (Vision-Language-Action)، والتي تستفيد من عدم اليقين الذاتي لتعديل كل من الإدراك البصري وتنفيذ العمل بشكل تكيفي، مما يؤدي إلى تحسين المتانة والتفوق على أساليب توسيع وقت الاختبار الحالية دون الحاجة إلى تدريب إضافي أو أدوات تحقق.

Hyeonbeom Choi, Daechul Ahn, Youhan Lee, Taewook Kang, Seongwon Cho, Jonghyun Choi2026-08-31
💻 computer science

SUFLECA: Scaling Up Feature Learning for CAD-to-image Alignment

يُعدُّ SUFLECA إطار عمل يعتمد على الإشراف الضعيف، ويحقق محاذاةً رائدةً من نوعها (state-of-the-art) بين نماذج التصميم بمساعدة الحاسوب (CAD) والصور بنمط الصفر (zero-shot) عبر توسيع نطاق تعلم الميزات القائم على الهندسة عبر مجموعات بيانات متنوعة، وتوظيف خوارزمية مطابقة متسقة هندسياً، مما يتيح تقدير الوضعية ذات الأبعاد التسعة (9D pose) بدقة دون الحاجة إلى تحسين تكراري.

Saad Ejaz, Miguel Fernandez-Cortizas, Javier Civera, Holger Voos, Jose Luis Sanchez-Lopez2026-08-31
💻 computer science

Mind-VLA: Instruction-Aware Spatial Representation Alignment for Vision-Language-Action Models

تُعد Mind-VLA طريقةً لمحاذاة التمثيل المكاني المدركة للتعليمات، والتي تعمل على تعزيز نماذج الرؤية واللغة والعمل (Vision-Language-Action) من خلال محاذاة التمثيلات الكامنة تحديداً مع الهندسة ثلاثية الأبعاد للأجسام المستهدفة المحددة بواسطة التعليمات اللغوية، مما يؤدي إلى تحسين الأداء بشكل كبير في مهام المعالجة دقيقة التفاصيل والمهام التي تتضمن أهدافاً محجوبة.

Xingyu Ding, Yuzhong Zhao, Yang Wu, Chunhai Zhao, Chaoyang Zhao, Yifan Zhang, Jian Cheng2026-08-31
💻 computer science

Beyond Relative Geometry: Metric-Aware Geometry Perception for Robotics

تقدم هذه الورقة البحثية إطار عمل "الإدراك الهندسي المدرك للمقاييس" (MAGP)، وهو إطار عمل جاهز للتشغيل يحل مشكلة عدم اتساق المقياس في طرق إعادة بناء الهندسة النسبية الحالية من خلال الاستفادة من معلمات الكاميرا وملاحظات العمق لإنتاج تمثيلات ثلاثية الأبعاد دقيقة مقياسياً، مما يحسن بشكل كبير من أداء ومتانة سياسات التحكم الروبوتية عبر تكوينات استشعار متنوعة.

Fengjun Zhong, Congjia Chen, Zhaoxu Liu, Jinyang Du, Yuchen Gong, Enqi Mao, Ruihao Gong, ShuJie Wang, Xianglong Liu, Zho (…)2026-08-31
⚡ electrical engineering

Remote Human and Robot Interaction for Greenhouse Gardening Using Virtual Reality

تقيم هذه الدراسة نظاماً بشرياً-روبوتياً عن بُعد قائماً على الواقع الافتراضي للزراعة في البيوت الزجاجية، حيث وجدت أنه بينما يحقق فحص الأوراق دقة في اكتشاف الأمراض تصل إلى 88%، فإن تقييم رطوبة التربة يعوقه بشكل كبير انسداد الكاميرا بسبب المظلات النباتية الكثيفة بدلاً من مهارة المشغل، مما يسلط الض�على الحاجة إلى استراتيجيات استشعار تكيفية.

Daniel Udekwe, Hasan Seyyedhasani2026-08-31
💻 computer science

Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models

تقدم الورقة البحثية VLAct، وهو نهج للتدريب المسبق المستمر متمحور حول التمثيل لنماذج الرؤية واللغة والعمل (Vision-Language-Action)، والذي يستفيد من بيانات متعددة التجسيد غير متجانسة لتحقيق قدرة فائقة على النقل والأداء عبر مهام متنوعة وروبوتات غير مرئية، حتى في ظل ميزانيات حوسبة متواضعة وبيانات لاحقة محدودة.

Senqiao Yang, Chengyao Wang, Yuxin Chen, Zixuan Wang, Longxiang Tang, Haokun Gui, Jinhui Ye, Changsheng Lu, Xiaoyang Wu (…)2026-08-31