🤖 machine learning

VORT: Adaptive Power-Law Memory for NLP Transformers

تقدم هذه الورقة البحثية VORT، وهي بنية "ترانسفورمر" (Transformer) مبتكرة تستبدل الاضمحلال الأسي القياسي بنواة ذاكرة ذات قانون قوة كسرية قابلة للتعلم، والتي يتم تقريبها بكفاءة عبر تفكيك مجموع الأسس لالتقاط التبعيات طويلة المدى في اللغة الطبيعية بشكل أفضل، مع توفير ضمانات نظرية صارمة بشأن دقة التقريب والتقارب.

Nabil Mlaiki2026-05-12
🤖 machine learning

PMCTS: Particle Monte Carlo Tree Search for Principled Parallelized Inference Time Scaling

تقدم هذه الورقة البحثية خوارزمية "Particle MCTS" (PMCTS)، وهي أول خوارزمية موازية مبنية على أسس منهجية لـ MCTS تحافظ على ضمانات التحسين المنهجي للسياسات مع التوسع بفعالية مع الحوسبة المتوازية والتفوق على النماذج المرجعية القائمة على الاستدلال عبر مجالات متنوعة.

Yaniv Oren, Viliam Vadocz, Joery A. de Vries, Wendelin Böhmer, Matthijs T. J. Spaan, Hendrik Baier2026-05-12
🤖 machine learning

Benchmarking Compositional Generalisation for Machine Learning Interatomic Potentials

تقدم هذه الورقة معياراً يتألف من أربع مهام لتقييم قدرات التعميم التركيبي لإمكانات الذرات المعتمدة على تعلم الآلة، مما يكشف أن حتى النماذج التأسيسية الحديثة تعاني بشكل كبير في التعميم على الهياكل الجزيئية غير المرئية مقارنة بأدائها على البيانات الموزعة ضمن النطاق.

Amir Masoud Nourollah, Irtaza Khalid, Stefano Leoni, Steven Schockaert2026-05-12
🤖 machine learning

Machine Learning-Based Graph Simplification for Symbolic Accelerators

تقدم هذه الورقة AutoSlim، وهو إطار عمل يعتمد على تعلم الآلة يستخدم مصنف "الغابة العشوائية" (Random Forest) لتقليم العقد والحواف الزائدة في الرسوم البيانية للأتمتة، مما يقلل من استخدام موارد مصفوفات البوابات المنطقية القابلة للبرمجة (FPGA) بنسبة تصل إلى 40% مع تحسين معدل الإنتاجية وكفاءة الطاقة للمسرعات الرمزية مثل +NAPOLY.

Tiffany Yu, Rye Stahle-Smith, Darssan Eswaramoorthi, Rasha Karakchi2026-05-12
🤖 machine learning

Non-Parametric Rehearsal Learning via Conditional Mean Embeddings

تقدم هذه الورقة إطار عمل لتعلم التكرار غير المعلمي لمشكلة "تجنب المستقبل غير المرغوب فيه"، والذي يستخدم تضمينات المتوسط الشرطي وانحدار ريج للكرنل لنمذجة ديناميكيات القرار المعقدة وغير الخطية دون افتراضات معلمية مقيدة، مع توفير ضمانات اتساق نظرية وتحقق تجريبي.

Wen-Bo Du, Tian-Zuo Wang, Han-Jia Ye, Zhi-Hua Zhou2026-05-12
🤖 machine learning

Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning

تُثبت هذه الورقة أن الضبط الدقيق الخاضع للإشراف للنماذج اللغوية الكبيرة مسبقة التدريب على مسارات مُصنفة من قِبل "أوراكل" (oracle) بشكل غير متصل، يعزز بشكل كبير قدرات التعلم في السياق لاتخاذ القرارات المتسلسلة عبر عمليات ماركوف لاتخاذ القرار (MDPs)، وعمليات ماركوف لاتخاذ القرار ذات الملاحظة الجزئية (POMDPs)، وعمليات ماركوف لاتخاذ القرار ذات الملاحظة الجزئية والآلية (APOMDPs)، محققةً فجوات مثالية أقل بكثير من الطرق المرجعية، لا سيما في البيئات المعقدة، وطويلة الأفق، وذات الملاحظة الجزئية.

Minmin Zhang, Sina Aghaei, Soroush Saghafian2026-05-12
🤖 machine learning

A Geometric Perspective on Next-Token Prediction in Large Language Models: Three Emerging Phases

من خلال إعادة توظيف عدسات التمثيل كأدوات تشخيص هندسية لتتبع تطور الفضاءات الفرعية للقراءة التنبؤية عبر الطبقات، يكشف هذا البحث أن النماذج اللغوية الكبيرة تعالج التنبؤ بالرمز التالي من خلال ثلاث مراحل هندسية متميزة — التعددية البذرية، والتعلية الإحلالية، والتقارب البؤري — حيث تعمل زيادة عمق النموذج أساساً على تعزيز فك التباس المرشحين بدلاً من توسيع القدرة التمثيلية.

Gianfranco Lombardo, Giuseppe Trimigno, Stefano Cagnoni2026-05-12
🤖 machine learning

LLiMba: Sardinian on a Single GPU -- Adapting a 3B Language Model to a Vanishing Romance Language

تقدم الورقة البحثية نموذج LLiMba، وهو نموذج لغوي للغة السردينية بـ 3 مليارات معلمة تم تكييفه على وحدة معالجة رسومات استهلاكية واحدة عبر التدريب المسبق المستمر والضبط الدقيق، مما يثبت أن تكوين rsLoRA عالي الرتبة يتفوق على طرق التكيف الأخرى في جودة الترجمة مع تسليط الضوء على القيود الحرجة للمقاييس القياسية في رصد الإخفاقات النوعية مثل تسرب النصوص (script leakage) والهلوسة الواقعية.

Luca Ballore2026-05-12
🤖 machine learning

GAMBIT: A Three-Mode Benchmark for Adversarial Robustness in Multi-Agent LLM Collectives

تقدم هذه الورقة GAMBIT، وهو معيار ومجموعة بيانات مبتكرة تتميز بخصوم تكيفيين متطورين في مجموعات من النماذج اللغوية الكبيرة متعددة الوكلاء، لإثبات أن التقييم بنمط "الصفر محاولة" (zero-shot) مضلل تجاه التهديدات التكيفية، وأن إعادة المعايرة بنمط "القليل من الأمثلة" (few-shot) أمر بالغ الأهمية للكشف القوي عن المنتحلين.

Alexandre Le Mercier, Chris Develder, Thomas Demeester2026-05-12
🤖 machine learning

Spherical Boltzmann machines: a solvable theory of learning and generation in energy-based models

تقدم هذه الورقة "آلة بولتزمان الكروية" كنموذج قائم على الطاقة عالي الأبعاد وقابل للحل، يستفيد من نظرية المصفوفات العشوائية ونظرية المجال المتوسط الديناميكي لتوصيف ديناميكيات التدريب، والدليل البايزي، والتحولات الطورية بدقة، مما يكشف كيف تدعم هذه الآليات النظرية الظواهر التوليدية المعقدة مثل "الانحدار المزدوج" والانحيازات غير المتوازنة مع الحالة المستقرة الملحوظة في البنى القياسية.

Thomas Tulinski, Simona Cocco, Rémi Monasson, Jorge Fernandez-De-Cossio-Diaz2026-05-12