💻 computer science

Evaluating Large Language Models as Live Strategic Agents: Provider Performance, Hybrid Decomposition, and Operational Gaps in Timed Risk Play

تقيم هذه الدراسة النماذج اللغوية الكبيرة كوكلاء استراتيجيين حيّين في بيئة لعبة "Risk" محكومة بزمن، حيث كشفت أن تفوق Gemini-1.5-pro-preview الملحوظ على المزودين الآخرين في اللعب من البداية إلى النهاية يعود في المقام الأول إلى موثوقية التنفيذ وتتبع الأهداف، وليس إلى قدرات التخطيط وحدها.

H. C. Ekne2026-05-22
💻 computer science

Unlocking Proactivity in Task-Oriented Dialogue

تتناول هذه الورقة تحدي جعل وكلاء الحوار الموجهين نحو المهام استباقيين من خلال تقديم محاكي مستخدم معرفي ينمذج مخاوف المستخدم الخفية، وإطار عمل لتحسين السياسة ذي الرؤية غير المتماثلة المستحثة من المحاكي يستفيد من هذه الإشارات الكامنة لتدريب الوكلاء على القدرة على توجيه المحادثات بفعالية نحو القبول.

Hongbin Zhang, Ning Gao, Yuqin Dai, Ruiyuan Wu, Jinpeng Wang, Rena Wei Gao, Bingdong Tan, Shuzheng Gao, Zongjie Li, Chao (…)2026-05-22
📊 statistics

Explainable AI for Data-Driven Design of High-Dimensional Predictive Studies

تقدم هذه الورقة إطار عمل لمُوصٍ بالذكاء الاصطناعي الاستكشافي يستفيد من الذكاء الاصطناعي القابل للتفسير لتوليد توصيات مدفوعة بالبيانات تلقائياً لاختيار الميزات، والحدود غير الخطية، والتفاعلات، مما يعزز بشكل كبير الأداء التنبؤي ومعايرة النماذج الإحصائية الشفافة للدراسات السريرية عالية الأبعاد.

Junyu Yan, Damian Machlanski, Kurt Butler, Panagiotis Dimitrakopoulos, Ewen M Harrison, Bruce Guthrie, Sotirios A Tsafta (…)2026-05-22
💻 computer science

Tailoring Teaching to Aptitude: Direction-Adaptive Self-Distillation for LLM Reasoning

تقدم هذه الورقة البحثية نموذج "التقطير الذاتي المتكيف مع الاتجاه" (DASD)، وهو نموذج تدريب لاحق جديد للنماذج اللغوية الكبيرة يعمل على تحسين الاستدلال المعقد من خلال توجيه إشراف المعلم ديناميكيًا بناءً على عدم اليقين في الرموز (tokens)—حيث يدفع الرموز ذات الإنتروبيا العالية بعيدًا عن المعلم للحفاظ على الاستكشاف، بينما يجذب الرموز ذات الإنتروبيا المنخفضة نحوه لضمان دقة التنفيذ.

Hongbin Zhang, Chaozheng Wang, Kehai Chen, Youcheng Pan, Yang Xiang, Jinpeng Wang, Min Zhang2026-05-22
💻 computer science

Detecting Atypical Clients in Federated Learning via Representation-Level Divergence

تقترح هذه الورقة مقياساً خفيف الوزن على مستوى التمثيل، يحدد كمياً تباعد العملاء في التعلم الاتحادي من خلال تحليل التغيرات في تقسيم فضاء المدخلات المستحث بالتنشيط على مجموعة اختبار مشتركة، مما يتيح الكشف الفعال عن العملاء غير النمطيين والتجميع المدرك للمخاطر دون الاعتماد على مقارنات المعلمات أو التدرجات.

Cristian Pérez-Corral, Jose I. Mestre, Alberto Fernández-Hernández, Manuel F. Dolz, Enrique S. Quitana-Ortí2026-05-22
💻 computer science

EmoTrack: Robust Depression Tracking from Counseling Transcripts across Session Regimes

تقدم الورقة البحثية EmoTrack، وهو إطار عمل قوي لتتبع شدة الاكتئاب عبر نصوص الاستشارات التي تجمع بين الإشارات السريرية المستخرجة بواسطة النماذج اللغوية الكبيرة (LLM) والتضمينات الدلالية والذاكرة عبر الجلسات، محققاً تحسينات ملحوحة في الأداء على كل من معايير الجلسة الواحدة ومعايير الجلسات المتعددة.

Zhaomin Wu, Jiayi Li, Bingsheng He2026-05-22
💻 computer science

SciCore-Mol: Augmenting Large Language Models with Pluggable Molecular Cognition Modules

يُعد SciCore-Mol إطار عمل معياريًا يسد الفجوة بين الرموز اللغوية والبيانات الجزيئية من خلال دمج وحدات إدراك وتوليد واستدلال قابلة للاستبدال في نموذج لغوي كبير يضم 8 مليارات معلمة، محققًا أداءً تنافسيًا مع النماذج المملوكة عبر مهام كيميائية متنوعة.

Yuxuan Chen, Changwei Lv, Yunduo Xiao, Zhongjing Du, Daquan Zhou, Yukun Yan, Zheni Zeng, Zhiyuan Liu2026-05-22
💻 computer science

Meta-Soft: Leveraging Composable Meta-Tokens for Context-Preserving KV Cache Compression

يُعد Meta-Soft إطار عمل ديناميكي لضغط ذاكرة التخزين المؤقت لمفاتيح القيم (KV cache) يعالج أوجه القصور في طرق الاستبعاد الثابتة عبر توليف رموز ناعمة مدركة للسياق من خلال مكتبة ميتا قابلة للتعلم، والحفاظ على المعلومات الدلالية عبر آلية دمج تدفق الانتباه، مما يحقق كفاءة ومعالجة فائقة للسياقات الطويلة.

Wei Luo, Yi Huang, Songchen Ma, Huanyu Qu, Jiang Cai, Mingkun Xu2026-05-22
💻 computer science

Bernini: Latent Semantic Planning for Video Diffusion

يُعد "بيرنيني" (Bernini) إطار عمل موحداً لتوليد وتحرير الفيديو يستفيد من تقسيم العمل حيث يقوم مخطط يعتمد على نموذج لغوي متعدد الوسائط (MLLM) بإجراء الاستدلال الدلالي في فضاء تضمين المحولات البصرية (ViT)، وذلك لتوجيه مُصيّر يعتمد على محول الانتشار (DiT)، محققاً أداءً هو الأفضل في فئته من خلال تدريب منفصل وفعال ومكونات مبتكرة مثل التضمين الموضعي الدوراني ثلاثي الأبعاد الواعي للتقطيع (Segment-Aware 3D Rotary Positional Embedding).

Bernini Team, Chenchen Liu, Junyi Chen, Lei Li, Lu Chi, Mingzhen Sun, Zhuoying Li, Yi Fu, Ruoyu Guo, Yiheng Wu, Ge Bai (…)2026-05-22
💬 NLP

TransitLM: A Large-Scale Dataset and Benchmark for Map-Free Transit Route Generation

تقدم هذه الورقة TransitLM، وهي مجموعة بيانات ومعيار واسع النطاق يحتوي على أكثر من 13 مليون سجل نقل، مما يمكّن النماذج اللغوية الكبيرة من توليد مسارات نقل عام صالحة هيكلياً وخالية من الخرائط مباشرة من معلومات نقطة الأصل والوجهة دون الاعتماد على البنية التحتية التقليدية للخرائط.

Hanyu Guo, Jiedong Yang, Chao Chen, Longfei Xu, Kaikui Liu, Xiangxiang Chu2026-05-22