💬 NLP

Reasoning Models Don't Just Think Longer, They Move Differently

تُثبت هذه الورقة أنه بعد التصحيح لطول عملية التوليد، تُظهر النماذج المدربة على الاستنتاج هندسات مسارات داخلية متميزة — لا سيما في مجالات البرمجة — تعكس تحولات استراتيجية حقيقية ومراقبة لعدم اليقين بدلاً من كونها مجرد عمليات حسابية ممتدة.

Anders Gjølbye, Lars Kai Hansen, Sanmi Koyejo2026-05-18
📊 statistics

Don't Stop Me Yet: Sampling Loss Minima via Dissipative Riemannian Mechanics

تقدم هذه الورقة DiMS، وهو عيِّن يعتمد على الميكانيكا الريمانية المبددة يستخدم الطاقة الحركية، وجذب الجاذبية، والاحتكاك لأخذ عينات دقيقة من الحلول غير المتغيرة بإعادة التشكيل على مستويات حد أدنى من الخسارة، مما يحسن تقدير عدم اليقين في الاستدلال البايزي مقارنة بالطرق الحالية.

Albert Kjøller Jacobsen, Leo Uhre Jakobsen, Johanna Marie Gegenfurtner, Georgios Arvanitidis2026-05-18
🤖 machine learning

DrugSAGE:Self-evolving Agent Experience for Efficient State-of-the-Art Drug Discovery

إنّ DrugSAGE هو إطار عمل لوكيل ذاتي التطور يراكم ويعيد استخدام الخبرات العابرة للمهام — مثل المهارات التي تم التحقق منها، والاستراتيجيات الفعالة، وإصلاحات الأخطاء — لبناء نماذج اكتشاف أدوية متطورة بكفاءة، مما يتفوق بشكل كبير على الوكلاء الحاليين من خلال تقليل أو إلغاء الحاجة إلى البحث المكلف في المهام الجديدة.

Yikun Zhang, Xiwei Cheng, Tianyu Liu, Yuanqi Du, Wengong Jin2026-05-18
🤖 machine learning

Layer-wise Derivative Controlled Networks

تقدم هذه الورقة البحثية ChainzRule، وهي بنية عصبية مبتكرة توظف محركاً متعدد الحدود مع تنظيم تفاضلي (DREG) للتناغم بين الدقة العالية، والكفاءة في الأجهزة، والاستقرار الوظيفي من خلال كبح الحساسية المفرطة عبر التحكم المستهدف في المشتقات، مما يحقق أداءً فائقاً بعدد أقل بكثير من المعلمات مقارنة بالنماذج القياسية.

Rowan Martnishn, Sean Anderson2026-05-18
🤖 machine learning

GRLO: Towards Generalizable Reinforcement Learning in Open-Ended Environments from Zero

تقدم الورقة البحثية GRLO، وهو نهج تعلم تعزيزي عالي الكفاءة يدرب النماذج من الصفر على مجموعة صغيرة من التفاعلات الحوارية المفتوحة لتحقيق تعميم قوي عبر مجالات متنوعة مثل الرياضيات والبرمجة، مما يقلل بشكل كبير من متطلبات البيانات والحوسبة مقارنة بطرق RLVR التقليدية الخاصة بالمجال نفسه.

Shangjian Yin, Yu Fu, Yue Dong, Zhouxing Shi2026-05-18
🔬 physics

Njord: A Probabilistic Graph Neural Network for Ensemble Ocean Forecasting

إن Njord هو شبكة عصبية رسومية احتمالية مبتكرة تستفيد من المتغيرات الكامنة العميقة وشبكات تجميع K-means التكيفية لتوليد توقعات محيطية تجميعية فعالة ومدركة لعدم اليقين على كل من النطاقين العالمي والإقليمي، متفوقة بذلك على النماذج الحتمية المرجعية في اختبار OceanBench.

Daniel Holmberg, Joel Oskarsson, Erik Larsson, Fredrik Lindsten, Teemu Roos2026-05-18
🤖 machine learning

When Does Sparse MoE Help in Vision? The Role of Backbone Compute Leverage in Sparse Routing

تستقصي هذه الورقة الظروف التي يؤدي فيها توجيه خليط الخبراء (MoE) المتناثر إلى تحسين تصنيف الرؤية، حيث تكشف أن مكاسب الدقة الإيجابية تعتمد على توجيه جزء كبير من الحوسبة وعلى اختيار خبراء متعددين، مع تحديد التوزيع عبر محور الدفعة (batch-axis dispatch) كنمط فشل حرج في إعدادات الشبكات العصبية التلافيفية (CNN) لكل عينة.

Libo Sun, Po-wei Harn, Peixiong He, Xiao Qin2026-05-18
🤖 machine learning

Ghosted Layers: Unconstrained Activation Alignment for Recovering Layer-Pruned LLMs

تقترح الورقة البحثية "الطبقات الشبحية" (Ghosted Layers)، وهي طريقة لا تتطلب تدريباً، لاستعادة أداء النماذج اللغوية الكبيرة التي تم تقليص طبقاتها عبر اشتقاق مؤثر خطي أمثل ذي صيغة مغلقة لمحاذاة توزيعات التنشيط بين الطبقات المتبقية، مما يؤدي إلى التفوق على النماذج المرجعية المقيدة الحالية مع الحفاظ على مكاسب الكفاءة.

Vincent-Daniel Yun, Junhyuk Jo, Sai Praneeth Karimireddy, Sunwoo Lee2026-05-18
🤖 machine learning

Learning with Conflicts of Interest

تقترح هذه الورقة إطاراً قائماً على نظرية الألعاب مع خوارزميات قابلة للتوسع ومضمونة نظرياً لحماية المستخدمين من المعلومات المنحازة والتلاعبية في أنظمة تعلم الآلة، وذلك من خلال النمذجة الصريحة ومعالجة تضارب المصالح المتأصل بين مالكي الأنظمة والمستخدمين.

Nischal Aryal, Arash Termehchy, Ali Vakilian, Marianne Winslett2026-05-18
🤖 AI

X-SYNTH: Beyond Retrieval -- Enterprise Context Synthesis from Observed Human Attention

يُعد X-SYNTH إطار عمل مبتكر يعزز تركيب سياق الذكاء الاصطناستري للمؤسسات عبر نمذجة آثار الانتباه الرقمي للعمال الأفراد كخطوط أساس سلوكية لتحديد بصمات النشاط ذات الصلة سببيًا، مما يؤدي إلى تحسين دقة المهام وتقليل المسارات الخاطئة بشكل كبير مقارنة بالطرق التقليدية القائمة على الاسترجاع.

Guruprasad Raghavan, George Nychis, Rohan Narayana Murthy2026-05-18