🤖 machine learning

Gradient-Based Optimization on Gödel Logic as Discrete Local Search

تقترح هذه الورقة إطار عمل للتحسين القائم على التدرج في منطق غودل، والذي يربط بين قابلية التفاضل المستمر والاشباع البولياني المنفصل من خلال إثبات تكافئه مع البحث المحلي المنفصل، مع تقديم "خدعة غودل" للتغلب على القيم المثلى المحلية والتحقق من صحة النهج عبر اختبارات معايير المسائل المرضية (SAT) ومهام سودوكو البصرية.

Alessandro Daniele, Emile van Krieken2026-05-01
💬 NLP

FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning

تقدم الورقة البحثية FinChain، وهو أول معيار لتقييم تسلسل الأفكار المالي القابل للتحقق والذي يتميز بقوالب رمزية قابلة للتنفيذ آلياً ومقياس CHAINEVAL، الذي يكشف عن قصور كبير في قدرات النماذج اللغوية الكبيرة الحالية في التحليل المالي متعدد الخطوات مع تسليط الضون على إمكانات النماذج المتكيفة مع المجال.

Zhuohan Xie, Daniil Orel, Rushil Thareja, Dhruv Sahnan, Hachem Madmoun, Fan Zhang, Debopriyo Banerjee, Georgi Georgiev (…)2026-05-01
🤖 AI

EXPO: Stable Reinforcement Learning with Expressive Policies

تقترح الورقة البحثية خوارزمية تحسين السياسة التعبيرية (EXPO)، وهي خوارزمية تعلم تعزيزي عبر الإنترنت ذات كفاءة في استخدام العينات، تعمل على تثبيت التدريب للسياسات التعبيرية من خلال فصل تعظيم القيمة عن السياسة الأساسية المعقدة واستخدام سياسة تعديل غاوسية خفيفة الوزن بدلاً من ذلك لتحسين الإجراءات آنياً، مما يحقق تحسينات كبيرة في كفاءة استخدام العينات لكل من الضبط الدقيق والتدريب عبر الإنترنت باستخدام البيانات غير المتصلة بالإنترنت.

Perry Dong, Qiyang Li, Dorsa Sadigh, Chelsea Finn2026-05-01
🤖 machine learning

Constraint-Aware Flow Matching via Randomized Exploration

تقترح هذه الورقة إطار عمل لمطابقة التدفق مدركاً للقيود يعالج انتهاكات القيود في النماذج التوليدية من خلال إدخال عقوبة قائمة على المسافة للقيود القابلة للتفاضل واستراتيجية استكشاف عشوائية للقيود القائمة على الأوراكل، مما يظهر كفاءة حوسبية فائقة وتحقيقاً للقيود عبر مهام التوليد الاصطناعية والعدائية.

Zhengyan Huan, Jacob Boerma, Li-Ping Liu, Shuchin Aeron2026-05-01
🤖 machine learning

ActiNet: An Open-Source Tool for Activity Intensity Classification of Wrist-Worn Accelerometry Using Self-Supervised Deep Learning

تقدم الورقة البحثية أداة ActiNet، وهي أداة مفتوحة المصدر تستخدم نموذج تعلم عميق ذاتي الإشراف (HARNet) مدمجاً مع تنعيم نموذج ماركوف المخفي، والتي تُظهر دقة فائقة في تصنيف شدة نشاط مقياس التسارع المرتدى على المعصم عبر مجموعات متنوعة من الأعمار والأجناس مقارنة بطرق الغابة العشوائية التقليدية، مما يوفر حلاً قوياً للدراسات الوبائية واسعة النطاق.

Aidan Acquah, Shing Chan, Aiden Doherty2026-05-01
🤖 machine learning

NashPG: A Policy Gradient Method with Iteratively Refined Regularization for Finding Nash Equilibria

تقدم هذه الورقة NashPG، وهو خوارزمية تدرج سياسة قابلة للتوسع تستخدم تنظيماً مُحسناً بشكل تكراري لضمان التقارب إلى توازنات ناش في ألعاب المعلومات الناقصة ذات اللعبتين الصفريتين، متفوقة بذلك على الأساليب الحالية في كل من المعايير المرجعية الكلاسيكية والمجالات واسعة النطاق مثل لعبة "No-Limit Texas Hold'em".

Eason Yu, Tzu Hao Liu, Clément L. Canonne, Yunke Wang, Chang Xu, Nguyen H. Tran, Stefano V. Albrecht2026-05-01
🤖 machine learning

PVeRA: Probabilistic Vector-Based Random Matrix Adaptation

تقدم هذه الورقة البحثية PVeRA، وهي امتداد احتمالي لمحول VeRA يقوم بتعديل مصفوفاته منخفضة الرتبة المشتركة للتعامل بشكل أفضل مع غموض المدخلات وتحقيق أداء متفوق في معيار VTAB-1k مقارنة بطرق التكيف الفعالة في المعلمات الموجودة.

Leo Fillioux, Enzo Ferrante, Paul-Henry Cournède, Maria Vakalopoulou, Stergios Christodoulidis2026-05-01
⚛️ quantum physics

LUNA: LUT-Based Neural Architecture for Fast and Low-Cost Qubit Readout

تقدم هذه الورقة البحثية LUNA، وهو مسرع لقراءة الكيوبتات فائقة التوصيل يتميز بالسرعة وانخفاض التكلفة، حيث يجمع بين المعالجة المسبقة القائمة على التكامل البسيط والشبكات العصبية القائمة على جداول البحث (LUT) وتحسين التطور التفاضلي لتحقيق تخفيضات كبيرة في المساحة وزمن الاستجابة مع الحفاظ على دقة عالية مقارنة بالحلول الرائدة الحالية.

M. A. Farooq, G. Di Guglielmo, A. Rajagopala, N. Tran, V. A. Chhabria, A. Arora2026-05-01
💬 NLP

Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed

تقدم هذه الورقة Efficient-DLM، وهو إطار عمل يحول النماذج التنبؤية ذاتية الانحدار سابقة التدريب إلى نماذج لغوية انتشارية عالية الكفاءة من خلال توظيف نمط انتباه قائم على الكتل وقناع رموز يعتمد على الموضع، مما يحقق دقة وإنتاجية متفوقة مقارنة بالنماذج الرائدة الحالية.

Yonggan Fu, Lexington Whalen, Zhifan Ye, Xin Dong, Shizhe Diao, Jingyu Liu, Chengyue Wu, Hao Zhang, Enze Xie, Song Han (…)2026-05-01
🤖 machine learning

GAVEL: Towards Rule-Based Safety Through Activation Monitoring

تقدم هذه المساهمة GAVEL، وهو إطار عمل مبتكر يعزز سلامة النماذج اللغوية الكبيرة (LLMs) من خلال نمذجة التنشيطات كعناصر معرفية قابلة للتفسير وتطبيق المراقبة القائمة على القواعد لتحقيق كشف دقيق وقابل للتخصيص والتحقق من السلوكيات الضارة دون الحاجة إلى إعادة تدريب النموذج.

Shir Rozenfeld, Rahul Pankajakshan, Itay Zloczower, Eyal Lenga, Gilad Gressel, Yisroel Mirsky2026-05-01