💻 computer science

On Strong Equivalence Notions in Logic Programming and Abstract Argumentation

تتناول هذه الورقة انهيار التكافؤ القوي بين البرمجة المنطقية والمجادلة المجردة في السياقات الديناميكية من خلال تقديم مفهوم جديد للتكافؤ القوي لبرامج المنطق يستعيد التوافق عبر هذه الأشكال الصورية تحت الترجمة.

Giovanni Buraglio, Wolfgang Dvorak, Stefan Woltran2026-05-15
💬 NLP

Agentifying Patient Dynamics within LLMs through Interacting with Clinical World Model

تقدم هذه الورقة SepsisAgent، وهو نموذج لغوي كبير معزز بنموذج عالمي تم تدريبه عبر منهج تعليمي ثلاثي المراحل لمحاكاة استجابات المرضى وتحسين قرارات العلاج بشكل تكراري، مما أظهر تفوقاً في السلامة والأداء في إدارة تعفن الدم مقارنة بالنماذج المرجعية التقليدية للتعلم التعزيزي والنماذج اللغوية الكبيرة.

Minghao Wu, Yuting Yan, Zhenyang Cai, Ke Ji, Chuangsen Fang, Ziying Sheng, Xidong Wang, Rongsheng Wang, Hejia Zhang, Shu (…)2026-05-15
🤖 machine learning

TAPIOCA: Why Task- Aware Pruning Improves OOD model Capability

تُثبت هذه الورقة أن التقليم المدرك للمهمة يحسن أداء النموذج خارج التوزيع (OOD) عن طريق إزالة الطبقات التي تضخم التشوهات الهندسية في مدخلات خارج التوزيع، مما يعيد محاذاة تمثيلاتها مع الهندسة المتكيفة مع المهمة للنموذج والمُثبتة على بيانات داخل التوزيع.

Krish Sharma, Omar Naim, Soumadeep Saha, Nicholas Asher2026-05-15
⚡ electrical engineering

Addressing Terminal Constraints in Data-Driven Demand Response Scheduling

تقترح هذه الورقة نهجاً هجيناً للتعلم التعزيزي يدمج التخطيط في فضاء الهدف مع خوارزمية التدرج السياساتي الحتمي العميق لتعزيز كفاءة العينات وتلبية قيود النهاية طويلة المدى في جدولة الاستجابة للطلب القائمة على البيانات للعمليات الكيميائية المكهربة.

Maximilian Bloor, Martha White, Ehecatl Antonio del Rio Chanona, Calvin Tsay2026-05-15
💬 NLP

Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining

تقدم الورقة البحثية Video2GUI، وهو إطار عمل مؤتمت يقوم بتخليق مجموعة بيانات ضخمة تضم 12 مليون مسار تفاعل مع واجهات المستخدم الرسومية (GUI) من فيديوهات إنترنت غير مصنفة للتغلب على ندرة البيانات وتعزيز أداء تعميم وكلاء واجهات المستخدم الرسومية متعددي الوسائط بشكل كبير.

Weimin Xiong, Shuhao Gu, Bowen Ye, Zihao Yue, Lei Li, Feifan Song, Sujian Li, Hao Tian2026-05-15
💻 computer science

XDomainBench: Diagnosing Reasoning Collapse in High-Dimensional Scientific Knowledge Composition

تقدم هذه الورقة البحثية XDomainBench، وهو معيار تشخيصي يتكون من أكثر من 8,500 جلسة تفاعلية عبر 20 مجالاً علمياً، والذي يكشف أن النماذج اللغوية الكبيرة تعاني من انهيار استدلالي منهجي في سير العمل المعقد ومتعدد التخصصات نتيجة لكل من زيادة صعوبة التركيب وأنماط التفاعل المسببة لتضخيم الأخطاء.

Gong Zhiren, Tiantong Wu, Jiaming Zhang, Fuyao Zhang, Che Wang, Yurong Hao, Yikun Hou, Foo Ping, Yilei Zhao, Fei Huang (…)2026-05-15
💻 computer science

Probabilistic Verification of Recurrent Neural Networks for Single and Multi-Agent Reinforcement Learning

تقدم الورقة البحثية RNN-ProVe، وهو إطار عمل احتمالي يقدر احتمالية السلوكيات غير المرغوب فيها في السياسات القائمة على الشبكات العصبية المتكررة لتعلم التعزيز أحادي ومتعدد الوكلاء، وذلك باستخدام أخذ العينات المدفوع بالسياسة للتغلب على قيود أدوات التحقق الحالية في البيئات ذات الإدراك الجزئي.

Luca Marzari, Enrico Marchesini2026-05-15
💻 computer science

AI Outperforms Humans in Personalized Image Aesthetics Assessment via LLM-Based Interviews and Semantic Feature Extraction

تقدم هذه الورقة نظاماً متكاملاً من التعلم العميق ونماذج اللغات الكبيرة يتفوق على المتنبئين البشر وحتى على ذات الشخص المستقبلية في تقييم جماليات الصور الشخصية من خلال استثارة التفضيلات بنشاط عبر مقابلات شبه منظمة والاستفادة من الميزات الدلالية منخفضة المستوى وعالية المستوى.

Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi2026-05-15
⚡ electrical engineering

Streaming Speech-to-Text Translation with a SpeechLLM

تقترح هذه الورقة نظاماً للترجمة الفورية من الكلام إلى النص يعتمد على نموذج لغوي صوتي (SpeechLLM) يقرر ديناميكياً متى يرسل رموز المخرجات بناءً على المدخلات الصوتية، محققاً جودة ترجمة قريبة من المستوى المرجعي مع تقليل زمن الاستجابة بشكل كبير بمقدار 1-2 ثانية.

Titouan Parcollet, Shucong Zhang, Xianrui Zheng, Rogier C. van Dalen2026-05-15
💻 computer science

MediaClaw: Multimodal Intelligent-Agent Platform Technical Report

يقدم هذا التقرير التقني منصة MediaClaw، وهي منصة وكلاء متعددة الوسائط مبنية على منظومة OpenClaw تعالج تحديات نشر المحتوى المولد بواسطة الذكاء الاصطناعي (AIGC) من خلال بنية ثلاثية الطبقات تتكون من التجريد الموحد، والامتدادات القائمة على الملحقات، وتنسيق سير العمل لتحويل عمليات الإنتاج المعقدة إلى أصول قابلة لإعادة الاستخدام.

Shaoan Zhao, Huanlin Gao, Qiang Hui, Ting Lu, Xueqiang Guo, Yantao Li, Xinpei Su, Fuyuan Shi, Chao Tan, Fang Zhao, Kai W (…)2026-05-15