🤖 AI

An Embarrassingly Simple Graph Heuristic Reveals Shortcut-Solvable Benchmarks for Sequential Recommendation

تكشف هذه الورقة أن معايير التقييم المستخدمة على نطاق واسع في التوصية المتسلسلة غالباً ما تكون "قابلة للحل عبر طرق مختصرة" بواسطة خوارزمية رسوم بيانية بسيطة لا تتطلب تدريباً، مما يشير إلى أن الأداء القوي على هذه المجموعات من البيانات قد يعكس خصائص محددة للبيانات بدلاً من القدرات النمذجة المتقدمة التي تدعيها أنظمة التوصية التوليدية الحديثة.

Haoyu Han, Li Ma, Hanbing Wang, Bingheng Li, Daochen Zha, Chun How Tan, Huiji Gao, Xin Liu, Stephanie Moyerman, Sanjeev (…)2026-05-11
🤖 AI

RRCM: Ranking-Driven Retrieval over Collaborative and Meta Memories for LLM Recommendation

تقترح الورقة البحثية إطار عمل RRCM، وهو إطار عمل قائم على التصنيف يُمكّن أنظمة التوصية القائمة على النماذج اللغوية الكبيرة من استرجاع والاستدلال ديناميكيًا على ذكريات التعاون والبيانات الوصفية عبر واجهات لغة طبيعية، مع تحسين قرارات الاسترجاع مباشرةً من خلال تحسين السياسة النسبية للمجموعات للتغلب على اختناقات كفاءة السياق وتحسين جودة التوصية.

Shijun Li, Wooseong Yang, Yu Wang, Tianxin Wei, Joydeep Ghosh2026-05-11
🤖 machine learning

GAD in the Wild: Benchmarking Graph Anomaly Detection under Realistic Deployment Challenges

تقدم هذه الورقة معياراً شاملاً للكشف عن الشذوذ في الرسوم البيانية (Graph Anomaly Detection) يقيم النماذج في ظل تحديات النشر الواقعية — وتحديداً الرسوم البيانية بمقياس الملايين، والندرة الشديدة للشذوذ، والسمات المفقودة — مما يكشف أن الأساليب الحالية المتطورة غالباً ما تفشل في التوسع أو الحفاظ على الأداء في بيئات الإنتاج مقارنة بنتائجها المختبرية.

Jingjing Zhou, Shiyu Huang, Qing Qing, Zuquan Yuan, Huafei Huang, Ziqi Xu, Mingliang Hou, Xikun Zhang, Renqiang Luo, Iva (…)2026-05-11
💬 NLP

Region4Web: Rethinking Observation Space Granularity for Web Agents

يقدم البحث إطار عمل Region4Web، الذي يعيد تعريف ملاحظة الوكيل الويب من مستوى العناصر إلى مستوى المناطق الوظيفية من خلال التفكيك الهرمي ومسار PageDigest المستمر، محققاً معدلات نجاح أعلى للمهام وتقليلاً في أطوال الملاحظات على معيار WebArena عبر نماذج لغوية كبيرة متنوعة.

Donguk Kwon, Dongha Lee2026-05-11
💬 NLP

Structural Rationale Distillation via Reasoning Space Compression

تقترح هذه الورقة البحثية طريقة "التقطير عبر ضغط مسار الاستدلال" (D-RPC)، وهي طريقة تعمل على تحسين نقل المعرفة من النماذج اللغوية الكبيرة إلى الصغيرة من خلال تقييد مبررات النموذج المعلم بمصرف يتم صيانته ديناميكيًا من مسارات الاستدلة عالية المستوى القابلة لإعادة الاستخدام، مما يؤدي إلى تقليل ضجيج الإشراف وتحقيق أداء متفوق عبر العديد من معايير الاستدلال مقارنة بتقنيات التقطير الحالية.

Jialin Yang, Jiankun Wang, Jiajun Wu, Henry Leung, Jiayu Zhou, Steve Drew2026-05-11
🤖 AI

Neurosymbolic Framework for Concept-Driven Logical Reasoning in Skeleton-Based Human Action Recognition

تقدم هذه الورقة إطار عمل عصبي رمزي للتعرف على الأفعال البشرية القائم على الهيكل العظمي، والذي يجسّر الفجوة بين التعلم العميق والاستدلال الرمزي عبر ربط الأوليات الحركية بمفاهيم منطقية قابلة للتفسير، مما يتيح أداءً تنافسياً مع تقديم تفسيرات شفافة ومقروءة بشرياً.

Talha Ilyas, Deval Mehta, Zongyuan Ge2026-05-11
🤖 AI

MathlibPR: Pull Request Merge-Readiness Benchmark for Formal Mathematical Libraries

تقدم الورقة البحثية MathlibPR، وهو معيار مستمد من سجلات طلبات السحب الحقيقية لـ Lean/Mathlib4، لتقييم قدرة النماذج اللغوية الكبيرة والوكلاء على التمييز بين المساهمات الجاهزة للدمج وتلك غير المدمجة، مما يكشف عن معاناتهم الحالية ويسلط الضوء على إمكانات المعيار في تطوير مساعدي المراجعة ونماذج المكافأة.

Zixuan Xie, Xinyu Liu, Shangtong Zhang2026-05-11
🤖 AI

SREGym: A Live Benchmark for AI SRE Agents with High-Fidelity Failure Scenarios

تقدم هذه الورقة SREGym، وهو معيار مرجعي حي، مفتوح المصدر، عالي الدقة، ومبني على مجموعات تقنية سحابية أصلية من الواقع، يحاكي سيناريوهات الفشل المعقدة لتقييم أداء وكلاء الذكاء الاصطناعي في هندسة موثوقية الموقع (SRE) بشكل صارم.

Jackson Clark, Yiming Su, Saad Mohammad Rafid Pial, Yifang Tian, Lily Gniedziejko, Hans-Arno Jacobsen, Yinfang Chen, Tia (…)2026-05-11
🤖 AI

Repeated Deceptive Path Planning against Learnable Observer

تقدم هذه الورقة البحثية تخطيط المسار الخداعي المتكرر (RDPP) لمعالجة تحدي إخفاء الوجهة الحقيقية للوكيل عن المراقبين القابلين للتعلم والتكيف، مقترحةً إطار عمل جديد للتحسين على مستويين يسمى التخطيط الميتا الخداعي (DeMP) والذي يتفوق بشكل كبير على الأساليب الحالية من خلال التخفيف من فجوة التأخر في التكيف عبر التغذية الراجعة عبر الحلقات وتعديلات السياسة قصيرة المدى.

Shiyue Cao, Pei Xu, Likun Yang, Lei Cui, Shizhao Yu, Shiyu Zhang, Yongjian Ren, Xiaotang Chen, Kaiqi Huang2026-05-11
🤖 machine learning

Learning Multi-Relational Graph Representations for DNA Methylation-Based Biological Age Estimation

تقدم الورقة البحثية RelAge-GNN، وهو إطار عمل لشبكة عصبية رسومية متعددة العلاقات يدمج أنماط الميثيل المشترك، والتوضع الجيني المشترك، والارتباطات على مستوى الجينات لتحسين دقة التقدير العمري القائم على ميثيلة الحمض النووي (DNA) وقابليته للتفسير البيولوجي مقارنة بالطرق الحالية.

Qing Qing, Xikun Zhang, Zhongyuan Zhang, Jiarui Liu, Xingtong Yu, Xiaotao Shen, Ziqi Xu, Qixin Zhang, Zhe Wang, Renqiang (…)2026-05-11