💻 computer science

CareGuardAI: Context-Aware Multi-Agent Guardrails for Clinical Safety & Hallucination Mitigation in Patient-Facing LLMs

تُعد CareGuardAI إطار عمل متعدد الوكلاء وسياقي، يضمن السلامة السريرية ويحد من الهلوسة في النماذج اللغوية الكبيرة الموجهة للمرضى، وذلك عبر توظيف مسار استدلال متعدد المراحل يتضمن تقييمين مزدوجين للمخاطر (تقييم مخاطر السلامة SRA وتقييم مخاطر الهلوسة HRA) لتصفية وتحسين الاستجابات قبل إصدارها.

Elham Nasarian, Abhilash Neog, Kwok-Leung Tsui, Niyousha HosseiniChimeh2026-05-01
💻 computer science

MARS: Efficient, Adaptive Co-Scheduling for Heterogeneous Agentic Systems

يُعد MARS نظام جدولة مشتركة فعالاً ومتكيفاً ينسق عالمياً بين موارد GPU وCPU غير المتجانسة لوكلاء نماذج اللغة الكبيرة (LLM) المستقلين عبر فصل عملية القبول عن التنفيذ وتحسين استبقاء الحالة، مما يقلل بشكل كبير من زمن الاستجابة النهائي مع الحفاظ على إنتاجية عالية.

Yifei Wang, Hancheng Ye, Yechen Xu, Cong Guo, Chiyue Wei, Qinsi Wang, Dongting Li, Tingjun Chen, Hai "Helen" Li, Danyang (…)2026-05-01
💻 computer science

A High-Throughput Compute-Efficient POMDP Hide-And-Seek-Engine (HASE) for Multi-Agent Operations

تقدم هذه الورقة محرك "Hide-And-Seek-Engine" (HASE)، وهو محرك C++ لعمليات الـ Dec-POMDP يتميز بإنتاجية عالية وكفاءة في الحوسبة، حيث يستفيد من التصميم الموجه للبيانات (Data-Oriented Design) وجسور الذاكرة خالية النسخ (zero-copy memory bridges) لتحقيق ما يصل إلى 33 مليون خطوة في الثانية، مما يقلل بشكل جذري من تعقيد العينات ووقت التدريب لتعلم التعزيز متعدد الوكلاء.

Timothy Flavin, Sandip Sen2026-05-01
🔬 physics

Nothing Deceives Like Success: Social Learning and the Illusion of Understanding in Science

تجادل هذه الورقة بأن التعلم الاجتماعي المدفوع بالنجاح في المجتمعات العلمية يؤدي، على نحو مفارِق، إلى تقويض الاكتشاف الجماعي من خلال تعزيز "وهم الفهم" حيث يبالغ العلماء في تقدير جودة نظرياتهم، مما يؤدي إلى تضييق نطاق الاستكشاف وزيادة عدم المساواة، لا سيما في مجالات المشكلات المعقدة.

Avery W. Louis, Marina Dubova2026-05-01
🤖 AI

When Roles Fail: Epistemic Constraints on Advocate Role Fidelity in LLM-Based Political Statement Analysis

تقدم هذه الورقة أول اختبار تجريبي منهجي للوفاء بالدور في سلاسل نماذج اللغات الكبيرة متعددة الوكلاء لتحليل الخطاب السياسي، كاشفةً أن النماذج تخفق بشكل متكرر في الحفاظ على الأدوار المعارضة الموكلة إليها بسبب آليات مثل "تجاوز الدور المعرفي"، مع وجود تباينات كبيرة في أنماط الفشل والوفاء اعتماداً على النموذج المحدد، واللغة، وأدوات التحقق من الحقائق المستخدمة.

Juergen Dietrich2026-05-01
🤖 AI

Reinforced Agent: Inference-Time Feedback for Tool-Calling Agents

تقدم هذه الورقة "الوكيل المعزز" (Reinforced Agent)، وهو إطار عمل للاستدلال في وقت التنفيذ يستخدم مراجعاً متخصصاً لتقييم استدعاءات الأدوات قبل تنفيذها، مما يتيح التصحيح الفوري للأخطاء ويثبت من خلال مقاييس "المساعدة-الضرر" الجديدة أن فصل التنفيذ عن المراجعة يسمح بتحقيق مكاسب أداء منهجية عبر اختيار النموذج وتحسين الأوامر دون إعادة تدريب الوكيل الأساسي.

Anh Ta, Junjie Zhu, Shahin Shayandeh2026-05-01
🤖 AI

Autonomous Traffic Signal Optimization Using Digital Twin and Agentic AI for Real-Time Decision-Making

تقدم هذه الورقة إطار عمل ثلاثي الطبقات لتحسين إشارات المرور ذاتية التحكم، يستفيد من التوأم الرقمي، والذكاء الاصطنا-الوكيل، والحوسبة الحافية، لتقليل أوقات الانتظار ديناميكيًا وتحسين كفاءة تدفق حركة المرور بشكل عام، متفوقًا بذلك على كل من النماذج المرجعية ذات التوقيت الثابت والنماذج القائمة على التعلم المعزز.

Salman Jan, Toqeer Ali Syed, Shahid Kamal, Qamar Wali, Ali Akarma2026-05-01
🤖 AI

ObjectGraph: From Document Injection to Knowledge Traversal -- A Native File Format for the Agentic Era

تقدم هذه الورقة البحثية تنسيق OBJECTGRAPH (.og)، وهو تنسيق ملف أصلي يعيد تصور المستندات كرسوم بيانية معرفية نمطية وقابلة للتنقل بدلاً من كونها نصوصاً خطية، مما يمكّن وكلاء النماذج اللغوية الكبيرة (LLM) المستقلين من تحقيق خفض في عدد الرموز (tokens) يصل إلى 95.3% دون فقدان في الدقة من خلال استرجاع المعلومات ذات الصلة فقط عبر مجموعة عليا صارمة من لغة مارك داون (Markdown).

Mohit Dubey, Open Gigantic2026-05-01
💻 computer science

I Would If I Could: Reasoning about Dynamics of Actions in Multi-Agent Systems

تقدم هذه الورقة نموذج ATL-D وامتداده القائم على المعرفة ATEL-D لنمذجة المنح والتعليق الديناميكي للأفعال في الأنظمة متعددة الوكلاء، مع تحليل قدرتها التعبيرية، وعلاقتها بالأنظمة المعيارية، والتعقيد الحسابي لها.

Rustam Galimullin, Hermine Grosinger, Munyque Mittelmann2026-04-30
🤖 AI

Operating-Layer Controls for Onchain Language-Model Agents Under Real Capital

تُثبت هذه الورقة أن اعتماد وكلاء النماذج اللغوية ذاتية القيادة والموثوقة التي تدير رأس مال حقيقي في الأسواق على السلسلة (onchain) يعتمد بشكل أقل على قدرات النموذج الأساسي وبشكل أكبر على طبقة تشغيل قوية تتميز بضوابط نمطية، وتحقق من السياسات، وحواجز تنفيذ، والتي قللت مجتمعةً من الإخفاقات الحرجة مثل قواعد التداول المفبركة ومكنت من تحقيق نجاح عالٍ في التسوية عبر نشر واسع النطاق لمدة ٢١ يوماً.

T. J. Barton, Chris Constantakis, Patti Hauseman, Annie Mous, Alaska Hoffman, Brian Bergeron, Hunter Goodreau2026-04-30