🤖 AI

RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning

إن RLFTSim هو إطار عمل للضبط الدقيق القائم على التعلم التعزيزي يعمل على تعزيز واقعية وقابلية التحكم في محاكاة حركة المرور متعددة الوكلاء من خلال مواءمة مخرجات المحاكي مع توزيعات بيانات العالم الحقيقي واستخدام إشارة مكافأة كثيفة ومنخفضة التباين لتحقيق أداء رائد على مجموعة بيانات Waymo Open Motion.

Ehsan Ahmadi, Hunter Schofield, Behzad Khamidehi, Fazel Arasteh, Jinjun Shan, Lili Mou, Dongfeng Bai, Kasra Rezaee2026-05-20
🤖 AI

DecisionBench: A Benchmark for Emergent Delegation in Long-Horizon Agentic Workflows

تقدم هذه الورقة البحثية DecisionBench، وهو ركيزة معيارية شاملة لتقييم التفويض الناشئ في تدفقات العمل الوكيلية طويلة الأمد عبر نماذج ومهام متنوعة، كاشفةً أنه بينما تظل جودة المهام مستقرة عبر ظروف الوعي المختلفة، إلا أن هناك إمكانات غير مستغلة كبيرة لتحسين دقة التوجيه وأداء التنسيق العام.

Yuxuan Gao, Megan Wang, Yi Ling Yu, Zijian Carl Ma, Ao Qu2026-05-20
🤖 AI

How Far Are We From True Auto-Research?

تقدم هذه الورقة البحثية "ResearchArena"، وهو إطار عمل لتقييم وكلاء البحث المستقلين، وتجد أنه في حين يمكنهم إنتاج مسودات أبحاث تبدو تنافسية تحت المراجعة السطحية، إلا أنهم يفشلون في النهاية في إنتاج أبحاث رفيعة المستوى بسبب مشكلات جسيمة في الدقة التجريبية، بما في ذلك النتائج المفبركة وعدم التطابق بين الخطط والتنفيذ.

Zhengxin Zhang, Ning Wang, Sainyam Galhotra, Claire Cardie2026-05-20
💻 computer science

Graph Neural Planning and Predictive Control for Multi-Robot Communication-Constrained Unlabeled Motion Planning

تقترح هذه الورقة إطار عمل هرمي يجمع بين مخطط انتباه رسومي ومتحكم تنبؤي نموذجي غير خطي لمركزية التحكم لحل مشكلة تخطيط الحركة غير المصنفة لمتعدد الروبوتات في ظل قيود الاتصال والديناميكيات غير الخطية، مما يظهر المتانة والقابلية للتوسع في كل من تجارب المحاكاة وتجارب الطائرات بدون طيار رباعية المراوح في العالم الحقيقي.

Manohari Goarin, Yang Zhou, Giuseppe Loianno2026-05-20
💻 computer science

CASPIAN: Online Detection and Attribution of Cascade Attacks in LLM Multi-Agent Systems via Cross-Channel Causal Monitoring

يُعد CASPIAN إطار عمل مبتكر يتيح الكشف عبر الإنترنت والعزو السببي لهجمات الشلال في أنظمة الوكلاء المتعددين للنماذج اللغوية الكبيرة، وذلك عبر نمذجة انتشار التأثير الديناميكي عبر القنوات المتعددة من خلال نهج موحد لإنتروبيا النقل الشرطي، متفوقاً بذلك على الدفاعات المحلية الحالية في الدقة وزمن الاستجابة.

Kavana Venkatesh, Jafar Isbarov, Saad Amin, Murat Kantarcioglu, Jiaming Cui2026-05-20
🤖 AI

AQuaUI: Visual Token Reduction for GUI Agents with Adaptive Quadtrees

تُعد AquaUI طريقة لتقليل الرموز (tokens) أثناء وقت الاستدلال دون الحاجة إلى تدريب، وهي مخصصة لوكلاء واجهة المستخدم الرسومية (GUI agents)، حيث تستخدم أشجار كوادرتي (quadtrees) تكيُّفية لاستغلال كثافة المعلومات المكانية غير المنتظمة لقطات الشاشة، مما يحقق تسريعاً كبيراً وتقليلاً في عدد الرموز مع الحفاظ على أداء يقارب الأداء الكامل والاتساق الزمني عبر التفاعلات متعددة الخطوات.

Yuankai Li, Tinghui Zhu, Ha Min Son, Zhe Zhao, Xin Liu, Muhao Chen2026-05-20
💬 NLP

STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision

تقدم الورقة البحثية إطار عمل STAR-PólyaMath، وهو إطار عمل متعدد الوكلاء يتميز بـ "استراتيجي ميتا" (Meta-Strategist) مستمر وحلقات "مستنتج-متحقق" (Reasoner-Verifier) مهيكلة، والذي يحقق أداءً هو الأفضل في فئته على ثمانية معايير مرجعية رياضية رفيعة المستوى من خلال التخفيف الفعال من الهلوسة، وتجزئة الذاكرة، وإساءة استخدام الأدوات عبر الإشراف على مستوى الميتا.

Jiaao Wu, Xian Zhang, Hanzhang Liu, Sophia Zhang, Fan Yang, Yinpeng Dong2026-05-20
💬 NLP

PAVE: A Cognitive Architecture for Legitimate Violation in Generative Agent Societies

تقدم هذه الورقة PAVE، وهي بنية معرفية مبتكرة رباعية النماذج تمكن الوكلاء التوليديين من اتخاذ قرارات مهيكلة، وقابلة للتفسير، ومعقولة لانتهاك القواعد بشكل مشروع فقط عندما تقتضي الضرورة القصوى ذلك عبر محفزات الطوارئ، مع الحفاظ على الامتثال للسلطة والنطاق المحدود.

Ahmad Yehia, Abduallah Mohamed, Kun Qian, Tianyi Wang, Jiseop Byeon, Omar Hassanin, Christian Claudel2026-05-20
🤖 AI

Operationalising Artificial Intelligence Bills of Materials (AIBOMs) for Verifiable AI Provenance and Lifecycle Assurance

تقدم هذه الورقة إطار عمل موسع لبيان مواد الذكاء الاصطناعي (AIBOM) قائم على معيار CycloneDX، والذي يستفيد من التحقق التشفيري وخطوط أنابيب الذكاء الاصطناعي المستقلة لتحقيق إثبات المصدر وضمان دورة الحياة، مما يبرهن على دقة عالية في إعادة الإنتاج وتقليص كبير في الإشراف اليدوي لأنظمة الذكاء الاصطنا-عي.

Petar Radanliev, Omar Santos, Carsten Maple, Kay Atefi2026-05-20
⚡ electrical engineering

DAG-Based QoS-Aware Dynamic Task Placement for Networked Multi-Stage Control Pipelines

تقترح هذه الورقة البحثية قيد الإعداد إطار عمل لتوزيع المهام ديناميكيًا يعتمد على الرسم البياني الموجه غير الدوري (DAG) ومراعٍ لجودة الخدمة (QoS)، يعمل على تحسين مسار الاستشعار-الإدراك-التخطيط-التحكم في الروبوتات الشبكية من خلال تقليل زمن الانتقال، وانتهاكات الموعد النهائي، وتكاليف التبديل بشكل مشترك عبر خوارزمية مدعومة بآلية التباطؤ (hysteresis).

Thien Tran, Jonathan Kua, Thuong Hoang, Minh Tran, Yuemin Ding, Jiong Jin2026-05-20