📊 statistics

Sharp Risk Bounds for Early-Stopping in Gaussian Linear Regression

تثبت هذه الورقة أن خوارزمية "هبوط المرآة" (mirror descent) ذات التوقف المبكر تحقق حدود مخاطر حادة ومثالية في الحد الأدنى الأقصى (minimax-optimal) للانحدار الخطي الغاوسي عالي الأبعاد فوق مجموعات محدبة تعسفية، مما يطابق أداء مُقدّر المربعات الصغرى مع توفير أضيق الحدود المعروفة للإعدادات المقيدة بـ ℓ1\ell_1.

Tobias Wegel, Gil Kur, Patrick Rebeschini2026-04-29
💬 NLP

Cheaper, Better, Faster, Stronger: Robust Text-to-SQL without Chain-of-Thought or Fine-Tuning

تقدم هذه الورقة البحثية "N-rep"، وهي طريقة فعالة من حيث التكلفة لتحويل النص إلى SQL تحقق أداءً هو الأفضل في فئته على معيار BIRD بتكلفة تبلغ 0.039 دولار فقط لكل استعلام، وذلك عبر الاستفادة من تمثيلات متعددة للمخططات لضمان المتانة دون الاعتماد على استدلال "سلسلة الأفكار" المكلف أو الضبط الدقيق.

Yusuf Denizay Dönder, Derek Hommel, Andrea W Wen-Yi, David Mimno, Unso Eun Seo Jo2026-04-29
📊 statistics

WISCA: A Consensus-Based Approach to Harmonizing Interpretability in Tabular Datasets

تقدم هذه الدراسة WISCA، وهو إطار عمل جديد قائم على الإجماع يعمل على توحيد تفسيرات القابلية للتفسير المتضاربة لمجموعات البيانات الجدولية من خلال دمج احتمالات الفئات وقيم العزو المعيرة، مما يؤدي إلى تحسين موثوقية التفسيرات عبر نماذج تعلم آلي متنوعة.

Antonio Jesús Banegas-Luna, Horacio Pérez-Sánchez, Carlos Martínez-Cortés2026-04-29
🤖 machine learning

Revisiting the Past: Data Unlearning with Model State History

تقدم هذه الورقة "حسابات حالة النموذج" (Model State Arithmetic - MSA)، وهي خوارزمية مبتكرة تستفيد من نقاط تفتيش النماذج السابقة لنسيان بيانات محددة من النماذج اللغوية الكبيرة بكفاءة وفعالية، متفوقة بذلك على الأساليب الحالية مع تجنب التكاليف الباهظة لإعادة التدريب الكامل.

Keivan Rezaei, Mehrdad Saberi, Abhilasha Ravichander, Soheil Feizi2026-04-29
🤖 machine learning

Measuring the stability and plasticity of recommender systems

تقترح هذه الورقة بروتوكول تقييم غير متصل (offline) مبتكر لقياس الاستقرار والمرونة في أنظمة التوصية، مما يتيح فهماً أعمق لكيفية احتفاظ النماذج بالأنماط الماضية مقابل تكيفها مع البيانات الجديدة بمرور الوقت، مع الكشف عن مقايضة محتملة بين هاتين الخاصيتين عبر الخوارزميات المختلفة.

Maria João Lavoura, Robert Jungnickel, João Vinagre2026-04-29
🤖 machine learning

Thermodynamically consistent machine learning model for excess Gibbs energy

تقدم الورقة البحثية نموذج HANNA، وهو نموذج تعلم آلي متسق ديناميكيًا حراريًا يدمج القوانين الفيزيائية كقيود صارمة ويستخدم طريقة الإسقاط الهندسي للتنبؤ بدقة بطاقة جيبس الحرة الزائدة للمزيج السائل متعدد المكونات مباشرة من البنى الجزيئية، متفوقًا بذلك على المعايير المرجعية الأحدث في كل من الدقة ونطاق التطبيق.

Marco Hoffmann, Thomas Specht, Quirin Göttl, Jakob Burger, Stephan Mandt, Hans Hasse, Fabian Jirasek2026-04-29
🤖 machine learning

Curl Descent: Non-Gradient Learning Dynamics with Sign-Diverse Plasticity

تُثبت هذه الورقة أن الشبكات العصبية البيولوجية يمكنها تحسين دالات الخسارة بفعالية باستخدام ديناميكيات تعلم "دوارة" (curl) غير تدرجية ناشئة عن قواعد لدونة متنوعة، والتي يمكنها إما زعزعة استقرار التعلم أو، على نحو غير متوقع، تسريعه من خلال تمكين الهروب من النقاط السرجية، مما يتحدى ضرورة الاعتماد الصرف على التدرج النزولي في التعلم العصبي.

Hugo Ninou, Jonathan Kadmon, N. Alex Cayco-Gajic2026-04-29
🤖 machine learning

CHUCKLE -- When Humans Teach AI To Learn Emotions The Easy Way

تقدم الورقة البحثية CHUCKLE، وهو إطار عمل للتعلم المنهجي القائم على الإدراك يستفيد من اتفاق الملحظين البشريين لتحديد صعوبة العينات، مما يؤدي إلى تحسين كفاءة تدريب نماذج التعرف على العواطف ومتانتها وأدائها مقارنة بالنماذج المرجعية غير المنهجية.

Ankush Pratap Singh, Houwei Cao, Yong Liu2026-04-29
🤖 machine learning

Rethinking Entropy Interventions in RLVR: An Entropy Change Perspective

تقدم هذه الورقة البحثية طريقة STEER، وهي طريقة مبدئية لتعديل الإنتروبيا في التعلم المعزز بالمكافآت القابلة للتحقق (RLVR)، تعالج انهيار الإنتروبيا من خلال اشتقاق إطار نظري لتغيرات إنتروبيا مستوى الرمز (token) وإعادة وزن الرموز بشكل تكيفي للتفوق على التدخلات الاستدلالية الحالية عبر اختبارات معايير الرياضيات والبرمجة.

Zhezheng Hao, Hong Wang, Haoyang Liu, Jian Luo, Jiarui Yu, Hande Dong, Qiang Lin, Can Wang, Jiawei Chen2026-04-29
💬 NLP

From Local to Global: Revisiting Structured Pruning Paradigms for Large Language Models

تقدم هذه الورقة GISP، وهي طريقة تقليم هيكلي تكراري عالمية تجمع درجات الأهمية القائمة على الخسارة من الدرجة الأولى لتجميع رؤوس الانتباه وقنوات MLP بكفاءة، مما يتفوق بذلك على النماذج المحلية التقليدية عبر تثبيت الدقة عند مستويات التشتت العالية وتمكين التحسين الخاص بمهمة معينة دون الحاجة إلى ضبط دقيق وسيط.

Ziyan Wang, Enmao Diao, Qi Le, Pu Wang, Minwoo Lee, Shu-ping Yeh, Evgeny Stupachenko, Hao Feng, Li Yang2026-04-29