💬 NLP

Structural Rationale Distillation via Reasoning Space Compression

تقترح هذه الورقة البحثية طريقة "التقطير عبر ضغط مسار الاستدلال" (D-RPC)، وهي طريقة تعمل على تحسين نقل المعرفة من النماذج اللغوية الكبيرة إلى الصغيرة من خلال تقييد مبررات النموذج المعلم بمصرف يتم صيانته ديناميكيًا من مسارات الاستدلة عالية المستوى القابلة لإعادة الاستخدام، مما يؤدي إلى تقليل ضجيج الإشراف وتحقيق أداء متفوق عبر العديد من معايير الاستدلال مقارنة بتقنيات التقطير الحالية.

Jialin Yang, Jiankun Wang, Jiajun Wu, Henry Leung, Jiayu Zhou, Steve Drew2026-05-11
🤖 AI

Neurosymbolic Framework for Concept-Driven Logical Reasoning in Skeleton-Based Human Action Recognition

تقدم هذه الورقة إطار عمل عصبي رمزي للتعرف على الأفعال البشرية القائم على الهيكل العظمي، والذي يجسّر الفجوة بين التعلم العميق والاستدلال الرمزي عبر ربط الأوليات الحركية بمفاهيم منطقية قابلة للتفسير، مما يتيح أداءً تنافسياً مع تقديم تفسيرات شفافة ومقروءة بشرياً.

Talha Ilyas, Deval Mehta, Zongyuan Ge2026-05-11
🤖 AI

MathlibPR: Pull Request Merge-Readiness Benchmark for Formal Mathematical Libraries

تقدم الورقة البحثية MathlibPR، وهو معيار مستمد من سجلات طلبات السحب الحقيقية لـ Lean/Mathlib4، لتقييم قدرة النماذج اللغوية الكبيرة والوكلاء على التمييز بين المساهمات الجاهزة للدمج وتلك غير المدمجة، مما يكشف عن معاناتهم الحالية ويسلط الضوء على إمكانات المعيار في تطوير مساعدي المراجعة ونماذج المكافأة.

Zixuan Xie, Xinyu Liu, Shangtong Zhang2026-05-11
🤖 AI

SREGym: A Live Benchmark for AI SRE Agents with High-Fidelity Failure Scenarios

تقدم هذه الورقة SREGym، وهو معيار مرجعي حي، مفتوح المصدر، عالي الدقة، ومبني على مجموعات تقنية سحابية أصلية من الواقع، يحاكي سيناريوهات الفشل المعقدة لتقييم أداء وكلاء الذكاء الاصطناعي في هندسة موثوقية الموقع (SRE) بشكل صارم.

Jackson Clark, Yiming Su, Saad Mohammad Rafid Pial, Yifang Tian, Lily Gniedziejko, Hans-Arno Jacobsen, Yinfang Chen, Tia (…)2026-05-11
🤖 AI

Repeated Deceptive Path Planning against Learnable Observer

تقدم هذه الورقة البحثية تخطيط المسار الخداعي المتكرر (RDPP) لمعالجة تحدي إخفاء الوجهة الحقيقية للوكيل عن المراقبين القابلين للتعلم والتكيف، مقترحةً إطار عمل جديد للتحسين على مستويين يسمى التخطيط الميتا الخداعي (DeMP) والذي يتفوق بشكل كبير على الأساليب الحالية من خلال التخفيف من فجوة التأخر في التكيف عبر التغذية الراجعة عبر الحلقات وتعديلات السياسة قصيرة المدى.

Shiyue Cao, Pei Xu, Likun Yang, Lei Cui, Shizhao Yu, Shiyu Zhang, Yongjian Ren, Xiaotang Chen, Kaiqi Huang2026-05-11
🤖 machine learning

Learning Multi-Relational Graph Representations for DNA Methylation-Based Biological Age Estimation

تقدم الورقة البحثية RelAge-GNN، وهو إطار عمل لشبكة عصبية رسومية متعددة العلاقات يدمج أنماط الميثيل المشترك، والتوضع الجيني المشترك، والارتباطات على مستوى الجينات لتحسين دقة التقدير العمري القائم على ميثيلة الحمض النووي (DNA) وقابليته للتفسير البيولوجي مقارنة بالطرق الحالية.

Qing Qing, Xikun Zhang, Zhongyuan Zhang, Jiarui Liu, Xingtong Yu, Xiaotao Shen, Ziqi Xu, Qixin Zhang, Zhe Wang, Renqiang (…)2026-05-11
🤖 machine learning

HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents

يُعد HyperEyes وكيل بحث متوازي متعدد الوسائط تم تدريبه عبر إطار تعزيز كفاءة ثنائي الحبيبات يدمج التأسيس البصري والاسترجاع في إجراءات متزامنة، محققاً دقة فائقة وتكاليف استدلال منخفضة بشكل كبير مقارنة بالوكلاء المتسلسلين الحاليين.

Guankai Li, Jiabin Chen, Yi Xu, Xichen Zhang, Yuan Lu2026-05-11
💬 NLP

The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval

تحدد هذه الورقة ظاهرة "الوادي غير الطبيعي للنص" حيث تُظهر النماذج اللغوية الكبيرة تدهوراً غير رتيب في الأداء في مهام استرجاع المعلومات مع زيادة فساد حدود الكلمات، وهو انخفاض على شكل حرف U ناتج عن انتقال مضطرب بين أنماط المعالجة غير الفعالة على مستوى الكلمة والمستوى الحرفي.

Zekai Tong, Ruiyao Xu, Aryan Shrivastava, Chenhao Tan, Ari Holtzman2026-05-11
🤖 AI

Three-in-One World Model: Energy-Based Consistency, Prediction, and Counterfactual Inference for Marketing Intervention

تقترح هذه الورقة بنية نموذج عالم "ثلاثي في واحد" تدمج آلة بولتزمان عميقة لتعلم تمثيلات الاعتقاد المجمدة مع مهايئات خاصة بالمهام لتحقيق تقييم الاتساق القائم على الطاقة، والتنبؤ بالنتائج، والاستدلال المضاد للواقع في آن واحد، مما يظهر أداءً فائقاً في استعادة آثار العلاج غير المتجانسة ومعاقبة المسارات المضادة للواقع غير المعقولة مقارنة بالنماذج المرجعية الحالية.

Junichiro Niimi2026-05-11
💬 NLP

PSK@EEUCA 2026: Fine-Tuning Large Language Models with Synthetic Data Augmentation for Multi-Class Toxicity Detection in Gaming Chat

حقق فريق PSK@EEUCA 2026 المركز الرابع في تحدي كشف السمية في لعبة World of Tanks عبر دمج نموذج Llama 3.1 8B مع ضبط دقيق باستخدام تقنية LoRA وتعزيز البيانات الاصطناعية بنسبة 5% للوصول إلى درجة F1-macro بلغت 0.6234، بينما حدد أيضاً "فخ التحقق" الحرج حيث يفشل الأداء العالي في مجموعة التحقق في التعميم على مجموعة الاختبار.

Srikar Kashyap Pulipaka2026-05-11