💻 computer science

Orbax: Distributed Checkpointing with JAX

تقدم هذه الورقة Orbax، وهي مكتبة نقاط تفتيش (checkpointing) موزعة، نمطية، وأصلية لـ JAX، تعمل على تجريد تعقيدات النظام وتقدم أداءً أسرع بكثير في عمليات الحفظ والتحميل مقارنة بمنافسيها من PyTorch.

Colin Gaffney, Shutong Li, Daniel Ng, Anastasia Petrushkina, Niket Kumar, Adam Cogdell, Mridul Sahu, Yaning Liang, Nikhi (…)2026-05-25
🤖 machine learning

The Attribution Contract: Feature Attribution for Generative Language Models

تقدم هذه الورقة "عقد الإسناد"، وهو إطار مفاهيمي يحل حالات الغموض في إسناد الميزات للنماذج اللغوية التوليدية من خلال التعريف الصريح للمخرجات، والميزات المؤهلة، والعملية التوليدية، والشروط الثابتة، ودرجة النموذج، مما يعيد صياغة الخلافات حول الإسناد باعتبارها اختلافات في عقود تفسيرية بدلاً من كونها عيوباً خوارزمية.

Giang Nguyen2026-05-25
🤖 machine learning

ThriftAttention: Selective Mixed Precision for Long-Context FP4 Attention

تعد ThriftAttention آلية انتباه انتقائية مختلطة الدقة تقوم ديناميكيًا بحساب جزء صغير فقط من كتل الاستعلام والمفتاح الحرجة بدقة FP16 بينما تعالج البقية بدقة FP4، مما يستعيد بفعالية جودة السياق الطويل لتكون قريبة من أداء FP16 الكامل دون التضحية بكفاءة الاستدلال منخفض البت.

Joe Sharratt2026-05-25
📊 statistics

KAPLAN: Kolmogorov-Arnold Prognostic Learnable Activation Networks for Survival Analysis

تقدم الورقة البحثية KAPLAN-HR، وهي شبكة كولموغوروف-أرنولد تعتمد على B-spline لتحليل البقاء، والتي تتعلم تلقائياً التفاعلات المعقدة بين المتغيرات والآثار المتغيرة زمنياً دون تحديد يدوي، مما يوفر معدلات تقارب مستقلة عن الأبعاد وأداءً تنبؤياً فائقاً عبر مجموعات البيانات السريرية.

Stelios Boulitsakis Logothetis, Angela Wood, Pietro Li ò2026-05-25
🤖 machine learning

The Implicit Bias of Depth: From Neural Collapse to Softmax Codes

تُثبت هذه الورقة أنه في نماذج الميزات غير المقيدة وغير المنتظمة والعميقة، يؤدي العمق وحده إلى فرض انحياز ضمني منخفض الرتبة يعزز أكواد "softmax" على حساب ظاهرة "الانهيار العصبي" الملاحظة تقليدياً، وذلك عبر تغيير ديناميكيات التدريب وتقليص حوض الجذب للحلول عالية الرتبة.

Connall Garrod, Jonathan P. Keating, Christos Thrampoulidis2026-05-25
🤖 machine learning

Dreaming Smoothly and Sample Efficiently with Gradient Penalized Latent Dynamics

تقدم هذه الورقة GPLD، وهو منظم ديناميكيات كامن مُعاقب بالتدرج لنموذج DreamerV3 يفرض سلاسة محلية في تعلم الانتقال عبر عقوبة جاكوبي صفية، مما يؤدي إلى تحسين كفاءة العينات واتساق التعلم في بيئات التحكم المستمر.

Romil V. Sonigra (Texas A&M University), P. R. Kumar (Texas A&M University)2026-05-25
📊 statistics

LLM Sparsity Prior for Robust Feature Selection

تقدم هذه الورقة البحثية "أولوية تشتت النماذج اللغوية الكبيرة" (LSP)، وهي إطار عمل قوي يدمج ديناميكيًا الأوزان المولدة بواسطة النماذج اللغوية الكبيرة في نماذج الاختيار المتغير البايزي لتحسين دقة اختيار الميزات والصلة السريرية، لا سيما في حالات ندرة البيانات، مع التخفيف من مخاطر المخرجات غير الدقيقة للنماذج اللغوية الكبيرة من خلال الضبط التكيفي للمعلمات الفائقة.

Caleb Skinner, Yihan Guo, Meng Li2026-05-25
📊 statistics

Robust OT-Guided Generative Residual Domain Adaptation for Bike-Sharing Demand Prediction under Temporal Domain Shift

تقترح هذه الورقة Gen-ROTDA، وهو إطار عمل للتكيف النطاقي المتبقي التوليدي الموجه بالنقل الأمثل القوي، والذي يتنبأ بفعالية بالطلب على مشاركة الدراجات في ظل التحولات النطاقية الزمنية من خلال نقل الأنماط المتبقية وتقليم مطابقات النقل عالية التكلفة، متفوقاً بذلك على مختلف النماذج المرجعية في السيناريوهات الصاخبة ومتعددة السنوات.

Yiming Ma2026-05-25
🤖 machine learning

When Determinants Are Not Enough: Private Rare Switching

تتناول هذه الورقة فشل قواعد التبديل النمطية القائمة على المحدد في خوارزميات "المنظمات النادرة" (rare switching) في نماذج "البانديت الخطي الخاص" (private linear bandits) والناجم عن عدم الرتابة المستحثة بواسطة الضجيج الغاوسي، وذلك عبر تقديم قاعدة تحديث جديدة قائمة على "خارج قسمة رايلي المعمم" (generalized Rayleigh quotient) تستعيد التحديثات اللوغاريتمية للسياسة وتحليل الندم الصالح.

Xingyu Zhou2026-05-25
🤖 machine learning

Archimedean Copula Inference via Taylor-Mode AD

تقدم هذه الورقة البحثية \textsc{acopula}، وهو إطار عمل مبني على JAX يتيح استدلالاً دقيقاً وفعالاً لـ "كوبولا أرخميدس" المتداخلة التعسفية مع وجود رقابة لكل متغير ومولدات عصبية، وذلك من خلال الاستفادة من التفاضل التلقائي بنمط تايلور لاستبدال الصيغ المشتقة يدوياً بعملية حسابية واحدة قابلة للتفاضل.

Cambridge Yang, Dongdong Li2026-05-25