🤖 machine learning

Simple KNN-Based Outlier Detection Achieves Robust Clustering

تُثبت هذه الورقة أن تقريبًا استدلاليًا لإزالة القيم المتطرفة يعتمد على خوارزمية "أقرب KK من الجيران" (K-Nearest-Neighbor) يحقق ضمانات تقريب ذات عامل ثابت وأداءً تجريبيًا فائقًا لنموذج تجميع kk-means القوي، مما يجسّر الفجوة بفعالية بين تقنيات كشف القيم المتطرفة وتقنيات التجميع دون الحاجة إلى مراكز إضافية أو خوارزميات معقدة.

Tianle Jiang, Yufa Zhou2026-05-11
🤖 machine learning

GAD in the Wild: Benchmarking Graph Anomaly Detection under Realistic Deployment Challenges

تقدم هذه الورقة معياراً شاملاً للكشف عن الشذوذ في الرسوم البيانية (Graph Anomaly Detection) يقيم النماذج في ظل تحديات النشر الواقعية — وتحديداً الرسوم البيانية بمقياس الملايين، والندرة الشديدة للشذوذ، والسمات المفقودة — مما يكشف أن الأساليب الحالية المتطورة غالباً ما تفشل في التوسع أو الحفاظ على الأداء في بيئات الإنتاج مقارنة بنتائجها المختبرية.

Jingjing Zhou, Shiyu Huang, Qing Qing, Zuquan Yuan, Huafei Huang, Ziqi Xu, Mingliang Hou, Xikun Zhang, Renqiang Luo, Iva (…)2026-05-11
💬 NLP

Structural Rationale Distillation via Reasoning Space Compression

تقترح هذه الورقة البحثية طريقة "التقطير عبر ضغط مسار الاستدلال" (D-RPC)، وهي طريقة تعمل على تحسين نقل المعرفة من النماذج اللغوية الكبيرة إلى الصغيرة من خلال تقييد مبررات النموذج المعلم بمصرف يتم صيانته ديناميكيًا من مسارات الاستدلة عالية المستوى القابلة لإعادة الاستخدام، مما يؤدي إلى تقليل ضجيج الإشراف وتحقيق أداء متفوق عبر العديد من معايير الاستدلال مقارنة بتقنيات التقطير الحالية.

Jialin Yang, Jiankun Wang, Jiajun Wu, Henry Leung, Jiayu Zhou, Steve Drew2026-05-11
🤖 AI

MathlibPR: Pull Request Merge-Readiness Benchmark for Formal Mathematical Libraries

تقدم الورقة البحثية MathlibPR، وهو معيار مستمد من سجلات طلبات السحب الحقيقية لـ Lean/Mathlib4، لتقييم قدرة النماذج اللغوية الكبيرة والوكلاء على التمييز بين المساهمات الجاهزة للدمج وتلك غير المدمجة، مما يكشف عن معاناتهم الحالية ويسلط الضوء على إمكانات المعيار في تطوير مساعدي المراجعة ونماذج المكافأة.

Zixuan Xie, Xinyu Liu, Shangtong Zhang2026-05-11
🤖 machine learning

Learned Lagrangian Models of PDEs via Euler-Lagrange Residual Minimization

تقدم هذه الورقة طريقة مبتكرة تتعلم مباشرة نماذج لاغرانج المستمرة للمعادلات التفاضلية الجزئية عبر تقليل بقايا أويلر-لاغرانج باستخدام متكامل قائم على الأمثلة خالٍ من الشبكات، مما يتيح تنبؤات مستقرة وطويلة المدى مع قابلية توسع خطية وتعميم على أي شروط حدودية دون الحاجة لإعادة التدريب.

Lyra Zhornyak, Eric Forgoston, M. Ani Hsieh2026-05-11
💬 NLP

Topic Is Not Agenda: A Citation-Community Audit of Text Embeddings

تُظهر هذه الورقة أن تمثيلات النصوص (text embeddings) الحالية، رغم أدائها الكافي على مستويات المجالات الفرعية الأوسع، تفشل في التقاط الأجندات البحثية دقيقة التفاصيل، مما يكشف عن قصور حرج في عمليات التوليد المعزز بالاسترجاع العلمي (scientific RAG) يمكن معالجته جزئياً عبر الاستفادة من إشارات الاستشهاد المرجعي.

Junseon Yoo2026-05-11
🤖 machine learning

Neurosymbolic Imitation Learning with Human Guidance: A Privileged Information Approach

تقترح هذه الورقة إطار عمل للتعلم بالتقليد العصبي الرمزي يجمع بين قدرة الشبكات العصبية على معالجة البيانات عالية الأبعاد وقدرات التعميم للطرق الرمزية، وذلك عبر الاستفادة من معلومات التدريب المتميزة مثل بيانات تتبع حركة العين لتحسين الكفاءة والحد من الإفراط في التخصيص.

Nikhilesh Prabhakar, Varun Balaji, Athresh Karanam, Kristian Kersting, Sriraam Natarajan2026-05-11
⚡ electrical engineering

Cost-Ordered Feasibility for Multi-Armed Bandits with Cost Subsidy

تقدم هذه الورقة خوارزمية الجدوى المرتبة بالتكلفة (COF) للمتعدد الأذرع ذات التكاليف المدعومة، حيث تضع حدوداً نظرية أكثر إحكاماً تعتمد على الحالة، وتُظهر أداءً تجريبياً متفوقاً في تقليل التكاليف مع تلبية قيود المكافأة مقارنة بالنماذج المرجعية الحالية.

Ishank Juneja, Carlee Joe-Wong, Osman Yağan2026-05-11
🤖 machine learning

Learning Multi-Relational Graph Representations for DNA Methylation-Based Biological Age Estimation

تقدم الورقة البحثية RelAge-GNN، وهو إطار عمل لشبكة عصبية رسومية متعددة العلاقات يدمج أنماط الميثيل المشترك، والتوضع الجيني المشترك، والارتباطات على مستوى الجينات لتحسين دقة التقدير العمري القائم على ميثيلة الحمض النووي (DNA) وقابليته للتفسير البيولوجي مقارنة بالطرق الحالية.

Qing Qing, Xikun Zhang, Zhongyuan Zhang, Jiarui Liu, Xingtong Yu, Xiaotao Shen, Ziqi Xu, Qixin Zhang, Zhe Wang, Renqiang (…)2026-05-11
🤖 machine learning

HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents

يُعد HyperEyes وكيل بحث متوازي متعدد الوسائط تم تدريبه عبر إطار تعزيز كفاءة ثنائي الحبيبات يدمج التأسيس البصري والاسترجاع في إجراءات متزامنة، محققاً دقة فائقة وتكاليف استدلال منخفضة بشكل كبير مقارنة بالوكلاء المتسلسلين الحاليين.

Guankai Li, Jiabin Chen, Yi Xu, Xichen Zhang, Yuan Lu2026-05-11