🤖 AI

FLOATBench: A Dataset and Benchmark for Floating Offshore Wind Turbine Tower Fatigue

تقدم هذه الورقة FLOATBench، وهو عبارة عن مجموعة بيانات ومعيار مرجعي يضم أكثر من 580,000 ملصق لتلف الإجهاد مستخرجة من عمليات محاكاة عالية الدقة لتوربينات رياح بحرية عائمة بقدرة 22 ميجاواط، والمصمم لتوحيد تقييم النماذج البديلة من خلال بروتوكول مبتكر مدرك للنظام يعالج أوجه القصور في عملية التحقق التقليدية القائمة على التقسيم العشوائي في تطبيقات طاقة الرياح في المياه العميقة.

João Alves Ribeiro, Bruno Alves Ribeiro, Francisco Pimenta, Sérgio M. O. Tavares, Faez Ahmed2026-05-26
🤖 AI

Learning to Search and Searching to Learn for Generalization in Planning

تقترح هذه الورقة إطار عمل ذاتي التحسين يدمج بين الشبكة العصبية الرسومية العلاقاتية وبحث WA\mathrm{WA}^\star لتمكين وكلاء التعلم التعزيزي العميق من تحقيق تعميم قوي في حالة الصفر (zero-shot generalization) في مجالات التخطيط ذات المكافآت الشحيحة، مما يحل حالات مشكلات أكبر بكثير دون الحاجة إلى بحث أو عروض توضيحية من خبراء.

Michael Aichmüller, Yannik Hesse, Hector Geffner2026-05-26
🤖 machine learning

DeGRe: Dense-supervised Generative Reranking for Recommendation

يُعد DeGRe إطار عمل لإعادة الترتيب التوليدي يعالج تحديات انحياز التسمية وتعيين الائتمان في أنظمة التوصية من خلال استخدام مقيم استباقي غير متصل بالإنترنت لتوليد إشارات إشراف كثيفة، مما يمكّن مولداً عبر الإنترنت خفيف الوزن من تقريب الحلول المثلى العالمية بكفاءة من خلال تمريرة فك تشفير جشعة واحدة.

Chaotian Song, Jingyao Zhang, Chenghao Chen, Zisen Sang, Dehai Zhao, Guodong Cao, Boxi Wu, Deng Cai, Jia Jia2026-05-26
🤖 AI

Benchmarking Pathology Foundation Models for Spatial Domain Understanding

تقدم هذه الورقة SpaPath-Bench، وهو معيار مرجعي شامل على مستوى التمثيل يقيم نماذج التأسيس في علم الأمراض بناءً على قدرتها على التقاط العلاقات المكانية للأنسجة ذات المعنى من خلال صياغة تحديد النطاق المكاني كمهمة تشخيصية باستخدام بيانات صور الشرائح الكاملة والترانسكريبتوميات المكانية المزدوجة.

Bokai Zhao, Yiyang Zhang, Yuanchi Zhu, Hanqing Chao, Long Bai, Tai Ma, Minfeng Xu, Ming Song, Tianzi Jiang2026-05-26
🤖 machine learning

Concept Unlearning via Cross-Attention Activation Projection for Diffusion Models

تقترح الورقة البحثية طريقة PURE، وهي طريقة صياغة مغلقة لنسيان المفاهيم تعمل على إسقاط أوزان مفاتيح وقيم الانتباه المتقاطع بناءً على تمثيلات فضاء التنشيط لمحو المفاهيم المستهدفة بفعالية من نماذج الانتشار تحت المطالبات المعاد صياغتها والمطالبات العدائية مع الحفاظ على توليد المفاهيم المُحتفظ بها.

Saemi Moon, Suhyeon Jun, Seoyeon Lee, Dongwoo Kim2026-05-26
📊 statistics

Efficient Benchmarking Is Just Feature Selection and Multiple Regression

تُثبت هذه الورقة أن تقييم النماذج اللغوية الكبيرة (LLM) بكفاءة يمكن تحسينه بشكل كبير من خلال إعادة صياغة المشكلة كنموذج انحدار متعدد باستخدام انحدار الحافة الجيرية (kernel ridge regression) للتنبؤ وخوارزمية الحد الأدنى من الارتباط مع الحد الأقصى من التباين (mRMR) لاختيار المجموعات الفرعية المثلى من الأسئلة، مما يؤدي إلى أخطاء تنبؤ أقل، وارتباطات ترتيب أعلى، وأداء أسرع وأكثر استقرارًا مقارنة بالطرق الحالية.

Sam Bowyer, Acyr Locatelli, Kris Cao2026-05-26
🤖 machine learning

NPSolver: Neural Poisson Solver with Iterative Physics Supervision

تقدم الورقة البحثية NPSolver، وهو حلّال بواسون عصبي يحقق تدريباً مستقراً وفعالاً على النطاقات المعقدة وغير المنتظمة دون الحاجة إلى بيانات مصنفة، وذلك عبر الاستفادة من الإشراف الفيزيائي التكراري من خلال خطوات مترافق التدرج المسبق وتصميم بنية Transolver الواعية بالحدود.

Bocheng Zeng, Rui Zhang, Runze Mao, Mengtao Yan, Xuan Bai, Yang Liu, Zhi X. Chen, Hao Sun2026-05-26
📊 statistics

On the Benefits of Free Exploration for Regret Minimization in Multi-Armed Bandits

تقدم هذه الورقة إطاراً جديداً لمسألة "المتعدد الأذرع العشوائية" (stochastic multi-armed bandit) حيث يستخدم الوكيل ميزانية استكشاف حر لوغاريتمية قبل تراكم الندم، وتقترح خوارزمية UFE-KLUCB-H وتضع حدوداً وثيقة تعتمد على الحالة تثبت تقليلاً كبيراً في الندم مقارنة بالطرق التقليدية.

Yunlong Hou, Zixin Zhong, Vincent Y. F. Tan2026-05-26
🤖 AI

When Can We Trust Early Warnings? Leakage-Excluded Early Outcome Prediction from LMS Interaction Logs

تقدم هذه الورقة بروتوكول LEAP، المصمم للقضاء على التسرب الزمني في نماذج الإنذار المبكر من خلال فرض قطع صارم للبيانات بناءً على عتبات زمنية، مما يثبت من خلال تجارب OULAD أن هذا الانضباط يمنع تقديرات الأداء المبالغ فيها مع الكشف عن أن الغابات العشوائية (Random Forest) وتعزيز التدرج (Gradient Boosting) هما أكثر المتنبئات فعالية في مراحل مختلفة من المساق.

Ngoc Luyen Le, Marie-Hélène Abel, Bertrand Laforge2026-05-26
💬 NLP

SAMark: A Self-Anchored Text Watermarking with Paragraph-Level Paraphrase Robustness

تقترح الورقة البحثية SAMark، وهو إطار عمل للعلامات المائية النصية ذاتية الارتكاز يحقق مقاومة قوية لإعادة الصياغة على مستوى الفقرة من خلال إنشاء ركائز دلالية مستقلة عن الخطوات واستخدام تسجيل زائدي متعدد القنوات، متفوقاً بشكل ملحوظ على النماذج المرجعية السابقة مع الحفاظ على جودة توليد عالية.

Jiahao Huo, Wenjie Qu, Yibo Yan, Kening Zheng, Jiaheng Zhang, Xuming Hu, Philip S. Yu, Mingxun Zhou2026-05-26