🤖 AI

Retrieval-grounded robot program generation and simulation-based correction via Model Context Protocol

تقدم هذه الورقة سير عمل يعتمد على النماذج اللغوية يستخدم تقنية التوليد المعزز بالاسترجاع ثنائي المسار وخادم بروتوكول سياق النموذج (MCP) مخصص لتوليد ومحاكاة وتصحيح برامج روبوتات ABB RAP-ID بشكل آلي وتكراري من خلال الأوصاف الطبيعية، مما يقلل الأخطاء الخاصة بالمجال عبر التغذية الراجعة القابلة للتنفيذ من برمجيات المحاكاة الصناعية.

Zhichao Zhou, Siyuan Chen, Omkar Salunkhe, Ebru Turanoglu Bekar, Johan Stahre, Anders Skoogh2026-08-25
💬 NLP

Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing

تعمل هذه الورقة على تنظيم الإخفاقات التشغيلية لأدوات اختبار الاختراق المدفوعة بالنماذج اللغوية الكبيرة من خلال تقييم عملي، مستخلصةً قوانين تصميم كمية ومؤشر احتكاك رباعي الأبعاد لتوجيه بناء أنظمة أمنية وكيلية قوية، متمثلة في منصة Inspectra.

Israt Moyeen Noumi, Tarannum Ahmed Nowshin, Md. Mehedi Hasan Nipu, Mohammad Sakib Mahmood, Md. Jakir Hossain, M. F. Mrid (…)2026-08-25
💻 computer science

Geo-VLA: Geometry-Aware Vision-Language-Action Planning via Internalization of Map Semantics

تقدم هذه الورقة Geo-VLA، وهو إطار عمل جاهز للتشغيل (plug-and-play) يعزز نماذج الرؤية واللغة والعمل للقيادة الذاتية من خلال استيعاب هندسة الطرق عبر مجموعة بيانات جديدة تسمى Geo-QA، محققاً أداءً هو الأفضل في فئته على NAVSIM v1 دون الحاجة إلى خرائط عالية الدقة أثناء الاستدلال.

Ran Chen, Jiaxing Ren, Zhikun Zhang, Yunhao Hou, Junbao Zhuo, Bochao Zou2026-08-25
🤖 AI

Agentic AI for Safety-critical Multi-drone Systems: Challenges and Opportunities

تجادل ورقة الموقف هذه بأن التكامل الناجح للذكاء الاصطناعي الوكيل في أنظمة الطائرات بدون طيار متعددة ذات المهام الحرجة على السلامة يتطلب نهج تصميم اجتماعي تقني يمنح الأولوية للواجهات التي تركز على الإنسان، وآليات الإشراف، والمشاركة المتكررة لأصحاب المصلحة جنباً إلى جنب مع التطوير الخوارزمي.

Timothy Merritt, Alejandro Jarabo-Peñas, Juan Bravo-Arrabal, Maria-Theresa Bahodi, Anders Lyhne Christensen2026-08-25
🤖 AI

Software Frameworks for Explainable AI in Time Series Classification: A Systematic Review

تحلل هذه المراجعة المنهجية أطر عمل البرمجيات الحالية للذكاء الاصطناعي القابل للتفسير في تصنيف السلاسل الزمنية، كاشفةً عن تشرذم كبير وقصور في دعم مجال التردد، ومقاييس التقييم المتخصصة، والاتساق عبر أطر العمل، مع الدعوة إلى تطوير حلول موحدة للذكاء الاصطناعي القابل للتفسير مخصصة للسلاسل الزمنية.

Louis Peter, Nils Gumpfer, Jana Fischer, Christin Seifert, Jennifer Hannig2026-08-25
💻 computer science

FigmaTrace: Capturing Creative Nuances in Human Figma Design Workflows

تقدم الورقة البحثية FigmaTrace، وهي مجموعة بيانات مبتكرة تضم أكثر من 200 ساعة من سير عمل التصميم البشري الذي تم التقاطه بواسطة خبراء وتم تحويله إلى مسارات عبر طريقة قائمة على المراحل، مما يعزز بشكل كبير أداء نماذج اللغة الرؤية (Vision Language Models) في مهام التصميم الإبداعي لتضاهي النماذج المغلقة الرائدة.

Darshan Deshpande, Yoshinari Fujinuma, Martyna Markiewicz, Devanshu Bansal, Shivani Jain, Nicholas Saban, Chirag Maheshw (…)2026-08-25
⚡ electrical engineering

Reliability- and Anatomy-Consistency-Aware Multimodal Learning for Robust Fracture Classification from Bangladeshi Radiographs

تقترح هذه الورقة إطار عمل للتعلم متعدد الوسائط مدركاً للموثوقية واتساق التشريح، يدمج الصور الشعاعية مع البيانات الوصفية السريرية لتحسين دقة تصنيف الكسور والمتانة ضد المعلومات السياقية غير المتطابقة في الصور الشعاعية البنغلاديشية.

Musa Tur Farazi, K G Subarno Bithi2026-08-25
💬 NLP

Forgotten in Weights, Recovered by Tools: Agentic Tool Unlearning for LLM Agents

تقدم هذه الورقة البحثية "إلغاء تعلم الأدوات الوكيل" (Agentic Tool Unlearning - ATU)، وهو إطار عمل ثنائي المراحل يجمع بين كبت المعرفة البارامترية والتعلم التعزيزي على مستوى المسار لمنع وكلاء النماذج اللغوية الكبيرة من استعادة المعلومات المنسية عبر الأدوات الخارجية مع الحفاظ على فائدتهم فيما يتعلق بالمعرفة المستبقاة.

Baicheng Chen, Zheyuan Liu, Jingyu Zhang, Kaize Ding, Ningshan Ma, Yue Huang, Meng Jiang2026-08-25
💬 NLP

Automating Multi-Hop RAG Evaluation via TRIAD: From Context Extraction to Validated Dataset Generation

تقدم هذه الورقة البحثية TRIAD، وهو إطار عمل مؤتمت ثلاثي المراحل يقوم بتوليد والتحقق من صحة مجموعات بيانات الأسئلة والأجوبة متعددة القفزات ذات النطاق المحدد مع سياقات مصنفة حسب الصلة لتقييم أنظمة التوليد المعزز بالاسترجاع (RAG) بفعالية على البيانات المملوكة.

Lorenz Brehme, Adam Jatowt2026-08-25