💬 NLP

Learnability-Informed Fine-Tuning of Diffusion Language Models

تقدم هذه الورقة البحثية LIFT، وهو خوارزمية ضبط دقيق مستندة إلى قابلية التعلم لنماذج اللغة الانتشارية، تعمل على مواءمة صعوبة تعلم الرموز ديناميكيًا مع السياق المتاح عند خطوات زمنية انتشار مختلفة، مما يتفوق بشكل كبير على النماذج المرجعية الحالية للضبط الدقيق الخاضع للإشراف في اختبارات التفكير.

Shubham Parashar, Atharv Chagi, Jacob Helwig, Lakshmi Jotsna, Sushil Vemuri, James Caverlee, Dileep Kalathil, Shuiwang J (…)2026-05-25
🤖 machine learning

Human-Centered Learning Mechanics: A Dynamical Framework for Entropy-Regulated Representation Learning

تقترح هذه الورقة آليات التعلم المتمحورة حول الإنسان (HCLM)، وهي إطار عمل ديناميكي يصيغ تنظيم الإنتروبيا من خلال "قوة المعلومات الفعالة" لمنع التدرجات المتدهورة، مما يثبت أن بدائل الإنتروبيا الهندسية مثل لوغاريتم محدد التباين تحفز تعلم تمثيل أكثر استقراراً ومتانة في ظل القيود الواقعية.

Kim Phuc Tran2026-05-25
🤖 machine learning

Certification from Examples is Hard for Circuits and Transformers under Minimal Overparametrization

تُثبت هذه الورقة أن حتى الحد الأدنى من الإفراط في المعلمات في دوائر العتبة ونماذج "ترانسفورمر" ذات الدقة اللوغاريتمية يمكن أن يجعل التصديق الدقيق والتقريبي صعباً بشكل أسي، وهو حاجز نظري يتم التحقق منه تجريبياً من خلال صعوبة اكتشاف الأخطاء في النماذج المدربة التي تؤدي عملية الجمع الثنائي.

Artur Back de Luca, Kimon Fountoulakis2026-05-25
🤖 machine learning

Learned Relay Representations for Forward-Thinking Discrete Diffusion Models

تقدم هذه الورقة تمثيلات الترحيل المتعلمة (Relay)، وهي طريقة تُمكّن نماذج الانتشار المقنعة من نقل المعلومات الكامنة عبر خطوات إزالة الضجيج من خلال قناة لكل رمز قابلة للتفاضل، مما يحسن الأداء في مهام التخطيط والبرمجة مع تقليل زمن الاستجابة عند الاستدلال بشكل كبير.

Benjamin Rozonoyer, Jacopo Minniti, Dhruvesh Patel, Neil Band, Avishek Joey Bose, Tim G. J. Rudner, Andrew McCallum2026-05-25
🤖 machine learning

A mathematical theory of balancing relational generalization and memorization

تقدم هذه الورقة مهمة "الاستدلال المتعدي مع الاستثناءات" المبتكرة لدراسة كيفية موازنة أنظمة التعلم بين التعميم العلاقاتي والحفظ، مقدمةً نظرية تحليلية لانحدار كيرن ريدج تتنبأ بحساسيات تمثيلية محددة وأخطاء منهجية، والتي يتم التحقق من صحتها لاحقاً في النماذج اللغوية الضبطية.

Luke Cheng, Samuel Lippl2026-05-25
🤖 machine learning

Worse than Random: The Importance of a Baseline for Unsupervised Feature Selection

تجادل الورقة البحثية بأن اختيار الميزات العشوائي يجب أن يكون بمثابة خط أساس إلزامي لتقييم طرق اختيار الميزات غير الخاضعة للإشراف، حيث أُثبت تجريبياً أن العديد من الأساليب الحديثة تتفوق عليها عملية الاختيار العشوائي في كل من الأداء والكفاءة.

Muhammad Rajabinasab, Michael E. Houle, Oussama Chelly, Arthur Zimek2026-05-25
💬 NLP

Memorization Dynamics of Fill-in-the-Middle Pretraining

تتقصى هذه الورقة ديناميكيات الحفظ لتدريب "الملء في المنتصف" (FIM) المسبق مقارنة بأهداف التدريب القياسية من اليسار إلى اليمين، كاشفةً أنه بينما يتفوق "الملء في المنتصف" في استعادة الفراغات القصيرة أو الجزئية، فإنه يظل معتمداً بشكل كبير على سياق البادئة للاستدعاء الحرفي، ويظهر نمواً خطياً في الحفظ مع تكرار البيانات.

Tobias von Arx, Tanguy Dieudonné2026-05-25
🤖 machine learning

Test-Time Training Undermines Safety Guardrails

تكشف هذه الورقة أن التدريب في وقت الاختبار (TTT) يستحدث ثغرات جديدة حرجة تسمح للمهاجمين بتجاوز ضوابط السلامة بشكل كبير وزيادة معدلات نجاح عمليات كسر الحماية، مما يستلزم آليات كشف جديدة واستراتيجيات محاذاة ديناميكية للتخفيف من حدة هذه التهديدات الناشئة.

Simone Antonelli, Sadegh Akhondzadeh, Aleksandar Bojchevski2026-05-25
🧬 biology

Active Sensing Subserves Task-Level Control

تقترح هذه الورقة أن الاستشعار النشط لا ينبع أساساً من أهداف حسية مثل تقليل عدم اليقين، بل يبرز كاستراتيجية ضرورية للتحكم القوي على مستوى المهام، حيث تنتقل الكائنات بين نمطي "الاستكشاف" و"الاستغلال" المنفصلين لتشكيل التغذية الراجعة الحسية — وهو مبدأ بيولوجي يمكن أن يطور بشكل كبير تصميم الأنظمة الروبوتية الهندسية.

Andrew Lamperski, Debojyoti Biswas, Eric S. Fortune, John Guckenheimer, Kathleen Hoffman, Noah J. Cowan2026-05-25
🤖 machine learning

Smoothed Elicitation Complexity for Approximate Γ\Gamma-calibration of Discrete Classification Tasks

تقدم هذه الورقة أول إطار عمل للمعايرة التقريبية للخصائص المنفصلة في التصنيف متعدد الفئات عبر استخدام وسائط مستمرة ليبشيتز للتغلب على التعقيد الأسي، مما يؤدي إلى توصيف تعقيد الاستخلاص الممهد للخصائص المنفصلة القابلة للترتيب بقوة مثل الأنماط والتصنيفات.

Jessica Finocchiaro, Victor Ganson, Drona Khurana2026-05-25