🤖 AI

GraFT: A Training-Free Framework for Spatial Reasoning in Multimodal Large Language Models via 3D Scene Graphs

يُعد GraFT إطار عمل لا يتطلب تدريباً يعمل على تعزيز الاستدلال المكاني في النماذج اللغوية الكبيرة متعددة الوسائط من خلال الاستفادة من مخطط مشهد ثلاثي الأبعاد لتوفير هندسة حتمية، وتخطيطات متمحورة حول الشيء، وتأريضاً للسمات البصرية، محققاً مكاسب أداء كبيرة في معايير مثل ScanQA وVSI-Bench دون الحاجة إلى ضبط دقيق مكلف أو مشفرات مخصصة.

Junqing Du, Fernando Ropero, Erkin Turkoz, Yanfeng Zhang, Lu Liu2026-09-04
💻 computer science

Toward Unified Robot Learning: Bridging Representation, Vision-Language-Action, and World Models

تقترح هذه الدراسة مسعىً لوجهة نظر موحدة حول تعلم الروبوتات من خلال دمج تعلم التمثيل، ونماذج الرؤية واللغة والعمل، والنماذج العالمية لمعالجة التجزئة الحالية، وتحليل تفاعلات المكونات، ورسم المسارات المستقبلية لأنظمة روبوتية قوية ومرتكزة فيزيائياً وقادرة على التفكير طويل الأمد في البيئات غير المهيكلة.

Shaunak A. Mehta, Ananya Hazarika, Haochen Zhang, Fan Yang, Ryo Moriyama, Wenkai Li, Yash Patel, Kanata Suzuki2026-09-04
🤖 machine learning

Subspace Inference Enables Efficient Active Reward Learning from Preferences

تقدم هذه الورقة البحثية PreferenceEKF، وهي طريقة تعلم نشط ذات كفاءة في استخدام العينات تستفيد من مرشح كالمان الموسع ضمن فضاء فرعي للمعلمات منخفض الأبعاد لتمكين التقييم الكمي القابل للتوسع لعدم اليقين في نماذج مكافأة الشبكات العصبية، مما يؤدي إلى تحسين كفاءة وأداء التعلم التعزيزي من التغذية الراجعة البشرية.

Yutai Zhou, Erdem Bıyık2026-09-04
⚡ electrical engineering

Formation Matrix and Energy-based Control of Multi-Agent Systems

تقترح هذه الورقة إطار تحكم قائم على الطاقة لأنظمة التشكيل متعددة الوكلاء يستخدم نموذج مخطط الروابط (bond graph) ومصفوفة تشكيل مبتكرة لربط ديناميكيات النظام بمخطط "التحكم عبر الترابط" ضمن إطار "بورت-هاميلتونيان" (port-Hamiltonian)، مما يحقق استقرار الحفاظ على التشكيل، وتجنب الاصطدام، وقدرات تتبع القائد، وهو ما تم التحقق منه من خلال المحاكاة العددية.

Martín Crespo, Sergio Junco, Matías Nacusse2026-09-04
⚡ electrical engineering

Deep Reinforcement Learning for Reach-Avoid-Stay Problems

تقترح هذه الورقة إطار عمل للتعلم التعزيزي العميق يتكون من خطوتين، حيث يتعلم بشكل مشترك مجموعة "الوصول-التجنب-البقاء" (Reach-Avoid-Stay) القصوى والمتينة وسياسة تحكم تبديلية مقابلة لها، مما يظهر دقة وأداءً فائقين في ضمان وصول الأنظمة بأمان وبقائها ضمن مجموعات مستهدفة تحت تأثير اضطرابات محدودة مقارنة بالطرق الحالية.

Gabriel Chenevert, Jingqi Li, Achyuta kannan, Sangjae Bae, Donggun Lee2026-09-03
💻 computer science

Passivity-Centric Safe Reinforcement Learning for Contact-Rich Robotic Tasks

تتناول هذه الورقة البحثية قيود السلامة والاستقرار في التعلم التعزيزي التقليدي في المهام الروبوتية الغنية بالتلامس من خلال اقتراح إطار عمل يدمج التدريب المدرك لخاصية السلبية مع قيود قائمة على الطاقة ومرشح سلبية للتشغيل، مما يضمن استقرار التحكم ويحسن كفاءة الطاقة.

Heng Zhang, Gokhan Solak, Sebastian Hjorth, Arash Ajoudani2026-09-03
💬 NLP

Constrained Group Relative Policy Optimization

تقدم هذه الورقة البحثية خوارزمية "Constrained GRPO"، وهي امتداد قائم على طريقة "لاغرانج" لتحسين عملية تحسين السياسة النسبي للمجموعات (Group Relative Policy Optimization)، والتي تعمل على تحسين فرض القيود واستقرار التدريب من خلال تحويل المزايا المعيارية إلى قيم عددية بدلاً من المكافآت الخام، وذلك للقضاء على آثار الاقتران الضارة الناتجة عن التقييس داخل المجموعة الواحدة.

Roger Girgis, Rodrigue de Schaetzen, Luke Rowe, Azalée Robitaille, Christopher Pal, Liam Paull2026-09-03
💬 NLP

Beyond Textual Chain-of-Thought: A Survey on Action-Grounded Reasoning in Autonomous Driving

تقترح هذه الدراسة المسحية تصنيفاً متمحوراً حول التمثيل للاستدلال القائم على الأفعال في القيادة الذاتية من خلال تحليل 171 ورقة بحثية لتصنيف الأساليب إلى أربعة أنواع وتحديد الحاجة الماسة لتمثيلات وسيطة تكون مرتبطة بالواقع، ومقترنة بالوقت الفعلي، وقابلة للتحقق من السلامة.

Zhengxu Tang, Xiaozhou Zhang, Guofeng Cui, Ziyu Gong, Zi Wang, Yunfei Shi, Ruifeng Deng, Chengzhi Qi, Ke Chen, Sachin Pa (…)2026-09-03
💻 computer science

Designing Versatile Samples for Learned Trajectory Scoring

تقدم هذه الورقة طريقة لتعزيز تقييم المسارات المتعلم من خلال توليد عينات تدريبية غنية بالمعلومات عبر الاضطرابات الجانبية والطولية للمسارات البشرية المسجلة، مما يحسن بشكل كبير أداء المخططات التوليدية المجمدة مثل DiffusionDrive وMeanFuser على مجموعة بيانات NAVSIM.

Yaguang Li, Jiaru Zhang, Chuheng Wei, Can Cui, Ziran Wang2026-09-03
💻 computer science

MACAW: Reliable And Efficient Surgical Debridement Using Monocular Adaptive Compact Attention Windows

تقدم هذه الورقة نظام MACAW، وهو نظام تحكم في العمق أحادي العين مدمج مع التوجيه البصري، يُمكّن روبوتًا جراحيًا يعمل بالأسلاك من إجراء عملية تنضير فعالة وموثوقة، محققًا معدلات نجاح وإنتاجية عالية تتفوق بشكل كبير على النماذج المرجعية الإجرائية والمتعلمة الحالية.

Ziyang Chen, Shutong Jin, Preethi Satish, Sareena Mann, Cael Magner, Danyal Fer, Omid Mohareri, Gary Guthart, Ken Goldbe (…)2026-09-03