💻 computer science

Imitation Learning for Robot Assistance in Open Surgery: A Multi-Policy Evaluation on Suture Following

تقدم هذه الدراسة أول تقييم متعدد السياسات للتعلم بالتقليد عام الأغراض للمساعدة التعاونية بين الجراح والروبوت في الجراحة المفتوحة، مظهرةً أن سياسة π0\pi_0 تحقق متانة فائقة ومعدل إتمام غرز بنسبة 92% مع تحديد إدراك العمق وتصميم النهاية الطرفية كأولويات حاسمة للنقل السريري.

Xucheng Wang, Zhizhou Yang, Xiaoman Zhang, Sung Eun Kim, Romain Hardy, Pranav Rajpurkar2026-07-28
💻 computer science

AgenticNav: Zero-Shot Vision-and-Language Navigation as a Tool-Calling Harness

يقدم AgenticNav إطار عمل خفيف الوزن للملاحة بالرؤية واللغة بنمط "الصفر استباقي" (zero-shot)، يعيد تصور التفاعل بين النموذج اللغوي البصري (VLM) والبيئة كإطار لاستدعاء الأدوات، مما يتيح اختيار الإجراءات المباشرة القائمة على البكسل، والاستعلام عن العمق عند الطلب، والاسترجاع الانتقائي للذاكرة لتحقيق أداء رائد دون الحاجة إلى متنبئات نقاط مسار متعلمة.

Yijian Li, Changze Li, Hantian Shi, Jiaying Luo, Jiyuan Cai, Ming Yang, Tong Qin2026-07-28
🔬 materials science

Scalable Low-Cost Laboratory Automation: A Digital Twin-Integrated Robotic Platform for Autonomous Liquid Handling (RAINBOT)

تقدم هذه الورقة RAINBOT، وهي منصة روبوتية منخفضة التكلفة ومفتوحة المصدر لمعالجة السوائل، مبنية من طابعة ثلاثية الأبعاد معدلة تدمج توأماً رقمياً يعتمد على المتصفح في الوقت الفعلي وإطار عمل للتصميم العكسي لتمكين التجارب المختبرية الميسرة، والتي يمكن الإشراف عليها عن بُعد، والمستقلة، وذلك بجزء ضئيل من تكاليف المنصات التجارية.

Mohamed Rami Ayeche, Souhil Sid, Ahyen Mostofa, Rehaan Hussain, Ali Shayesteh, Fadwa El Mellouhi2026-07-28
🤖 AI

Emergent Compositional Skills in Mixture-of-Experts VLAs

تُثبت هذه الورقة أن نموذج الرؤية واللغة والعمل (VLA) المجهز برأس عمل يعتمد على "خليط من الخبراء" (MoE) مبسط، يمكنه تعلم تفكيك مهام الروبوت المعقدة إلى بدائيات منخفضة المستوى قابلة لإعادة الاستخدام والتفسير واستراتيجيات تسلسل عالية المستوى بشكل انبثاقي من خلال عروض الخبراء وحدها، محققاً أداءً يضاهي النماذج أحادية البنية مع توفير قدر أكبر من الوحدات النمطية وقابلية التفسير.

Shlok Shah, Rhiaan Jhaveri, Tharun Kumar Tiruppali Kalidoss, Chirayu Nimonkar, Ishaan Javali, Dhruv Shah2026-07-28
⚡ electrical engineering

Learning-based Hierarchical Tracheal Anatomy Understanding from Sparse Surgical Demonstration Annotations for Ultrasound Robots

تقدم هذه الورقة إطار عمل قائماً على التعلم يجمع بين عمود فقري لتحديد المواقع من نوع YOLOv8n ومفكك شفرة SAM2 متفرق ومُحسَّن بالتحفيز (prompt-optimized) لتحقيق تقسيم تشريحي للقصبة الهوائية يتسم بالمتانة والوقت الفعلي لعمليات بضع الرغامى الروبوتية الموجهة بالموجات فوق الصوتية، مما يتفوق بشكل كبير على نماذج U-Net المرجعية في كل من الدقة والتعميم مع تمكين التشغيل عن بُعد الروبوتي ذي الحلقة المغلقة.

Hiu Ching Cheung, Wenchao Yue, Zhengran Han, Mingcong Chen, Guanglin Cao, Hongbin Liu, Hongliang Ren2026-07-28
💻 computer science

Pose-Aware Modeling to Mitigate Pose-Related Artifacts in Tactile Gloves

تقدم هذه الورقة إطاراً خوارزمياً يعتمد على وضعية اليد ومستقلاً عن نوع القفاز، يستفيد من معلومات وضعية اليد لنمذجة وتخفيف العيوب المرتبطة بالوضعية في القفازات اللمسية المرنة، مما يقلل بشكل كبير من الحد الأدنى للقوة القابلة للكشف ويحسن دقة اكتشاف التلامس عبر مختلف تصميمات القفازات والمستخدمين.

Tianhong Catherine Yu, Ziyi Kou, Mia Huang, Taylor Niehues, Yiyue Luo, Li Guan, Dingtian Zhang2026-07-28
💬 NLP

Low-Latency Turn-Taking via Context-Aware Preface Generation in a Real-World Dialogue Robot

تقترح هذه الورقة إطار عمل تدريجيًا ذا مرحلتين يولد استجابات تمهيدية مدركة للسياق لتقليل زمن تأخير الحوار، مبرهنةً من خلال تجربة روبوتية في عالم حقيقي أنه بينما يؤخر هذا النهج الاستجابة التمهيدية الأولية قليلاً مقارنة بالاستجابات التمهيدية الثابتة، فإنه يقصر بشكل كبير الفجوة قبل الاستجابة الرئيسية، مما يكشف عن مقايضة في تحسين التوقيت.

Yuki Okafuji, Koji Inoue, Yoshiki Ohira2026-07-28
💻 computer science

Sling2Sim2Real: One-Shot Elastic System Identification for Non-Destructive Slingshot Policy Learning

تقترح الورقة البحثية إطار عمل Sling2Sim2Real، وهو إطار عمل من نوع (Real2Sim2Real) بلمسة واحدة، يحدد معلمات الأجسام المرنة من خلال تفاعل واحد غير مدمر لتمكين تعلم السياسات القائمة على المحاكاة بدقة وتحقيق نقل قوي من نوع (zero-shot) لمهام التلاعب بالمقلاع المرن.

Wonjae Kang, Geonwoo Kim, Minseok Song, Daehyung Park2026-07-28
💻 computer science

PRISM: Polynomial Representations for Interaction-Structured Motor Control

تقدم الورقة البحثية PRISM، وهو تمثيل للسياسة قائم على كثيرات الحدود يعمل على نمذجة هياكل التفاعل بين المتغيرات الفيزيائية بشكل صريح لتحقيق أداء متفوق في مهام حركة الروبوت والتحكم بالأشياء مقارنة بالشبكات العصبية متعددة الطبقات (MLPs) القياسية، مع تمكين السلوك المرن الخالي من المستشعرات دون الحاجة إلى مدخلات قوة أو تلامس صريحة.

Seung Hyun Lee, Stella X. Yu2026-07-28
💻 computer science

LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks

تقترح هذه الورقة إطار عمل LEACL، الذي يسخر النماذج اللغوية الكبيرة لتفكيك مهام التلاعب طويلة المدى تلقائيًا وتوليد المواصفات اللازمة، مما يمكّن وكلاء التعلم التعزيزي من تحقيق أداء فائق من خلال التعلم المنهجي التلقائي باستخدام المكافآت الشحيحة فقط دون الحاجة إلى وظائف مكافأة كثيفة مصممة يدويًا.

Faraz Heravi, James Ouyang, Zifan Xu, Arjun Kumar, Yoonchang Sung, Peter Stone2026-07-28