🔬 physics

Real-time virtual circuits for plasma shape control via neural network emulators

تقدم هذه الورقة نهجاً قائماً على الشبكة العصبية يقوم بتوليد دوائر افتراضية في الوقت الفعلي ومدركة للحالة من مكتبة تضم أكثر من مليون حالة توازن محاكية، مما يتيح تحكماً مستقلاً دقيقاً وقوياً في معلمات شكل البلازما المقترنة لتوكاماك "ماست أبجريد" (MAST Upgrade).

Alasdair Ross, George K. Holt, Kamran Pentland, Adriano Agnello, Nicola C. Amorisco, Pedro Cavestany, Aran Garrod, Timot (…)2026-05-15
📊 statistics

InfoSFT: Learn More and Forget Less with Information-Aware Token Weighting

تُعد InfoSFT مخططاً مبدئياً لترجيح أوزان الرموز (tokens) في الضبط الدقيق الخاضع للإشراف، حيث تعمل على تركيز إشارات التعلم على الرموز ذات المعلومات القصوى والثقة المتوسطة لتحسين القدرة على التعميم عبر المهام المتنوعة، مع الحفاظ بشكل أفضل على قدرات النموذج الموجودة مسبقاً مقارنةً بالضبط الدقيق الخاضع للإشراف القياسي وطرق التخفيف الحالية.

Mahdi Sabbaghi, George Pappas, Adel Javanmard, Hamed Hassani2026-05-15
🤖 machine learning

Second-Order Actor-Critic Methods for Discounted MDPs via Policy Hessian Decomposition

تقترح هذه الورقة طريقة "ممثل-ناقد" (actor-critic) من الدرجة الثانية، مستقرة وفعالة حاسوبياً لعمليات ماركوف لاتخاذ القرار (MDPs) المخصومة، والتي تستخدم حاصل ضرب هسيان-متجه عبر الاستفادة من إطار عمل ذي مقياس زمني مزدوج لتبرير التعامل مع دالة قيمة الفعل كدالة ثابتة محلياً أثناء تحديثات الممثل.

Sanjeev Manivannan, Shuban V2026-05-15
🤖 machine learning

Generalized Priority-Aware Shapley Value

تقدم هذه الورقة قيمة شابلي المعممة والمدركة للأولويات (GPASV)، وهي طريقة تقييم مبتكرة توسع قيمة شابلي لتشمل الرسوم البيانية الموجهة والموزونة ذات الأولويات التعسفية من خلال فرض عقوبات بدلاً من حظر انتهاكات الترتيب، مما يتيح تقييماً قوياً في سيناريوهات العالم الحقيقي المعقدة مثل تفضيلات مجموعات النماذج اللغوية الكبيرة (LLM) الدورية.

Kiljae Lee, Ziqi Liu, Weijing Tang, Yuan Zhang2026-05-15
⚡ electrical engineering

SpeakerLLM: A Speaker-Specialized Audio-LLM for Speaker Understanding and Verification Reasoning

يُعد SpeakerLLM إطار عمل لنماذج اللغة الصوتية المتخصصة الذي يوحد بين توصيف المتحدث، وتحليل ظروف التسجيل، والاستدلال التحققي المنظم بالأدلة من خلال مُجزئ هرمي وتتبعات قرار مهيكلة لتعزيز فهم المتحدث والتحقق منه في الوكلاء المعتمدين على الصوت أولاً.

KiHyun Nam, Jungwoo Heo, Siu Bae, Ha-Jin Yu, Joon Son Chung2026-05-15
🤖 machine learning

DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models

تقترح الورقة البحثية DiffusionOPD، وهو نموذج تدريب موحد متعدد المهام لنماذج الانتشار يستفيد من تقطير السياسة عبر الإنترنت لفصل استكشاف المهمة الواحدة عن تكامل المهام المتعددة، مما يقدم بديلاً ذا أساس نظري ومنخفض التباين لتعلم التعزيز يحقق أداءً وكفاءةً رائدين عبر مختلف المعايير المرجعية.

Quanhao Li, Junqiu Yu, Kaixun Jiang, Yujie Wei, Zhen Xing, Pandeng Li, Ruihang Chu, Shiwei Zhang, Yu Liu, Zuxuan Wu2026-05-15
💬 NLP

Concurrency without Model Changes: Future-based Asynchronous Function Calling for LLMs

تقدم هذه الورقة AsyncFC، وهو إطار عمل يقلل من زمن انتقال وكلاء النماذج اللغوية الكبيرة (LLM agents) عن طريق فصل فك تشفير النموذج عن تنفيذ الدوال لتمكين استخدام الأدوات بشكل غير متزامن ومتوازٍ دون الحاجة إلى أي ضبط دقيق للنموذج أو تغييرات في البروتوكول.

Guangyu Feng, Huanzhi Mao, Prabal Dutta, Joseph E. Gonzalez2026-05-15
📊 statistics

Average Gradient Outer Product in kernel regression provably recovers the central subspace for multi-index models

تُثبت هذه الورقة أن حساب حاصل الضرب الخارجي لمتوسط التدرج (AGOP) من متنبئ انحدار كيرنل ريدج يستعيد بشكل مبرهن الفضاء الجزئي المركزي في نماذج المؤشرات المتعددة في نظام عينة أقل بكثير مما هو مطلوب للتنبؤ الدقيق، مما يؤسس لفصل نظري بين التنبؤ وتعلم التمثيل.

Libin Zhu, Damek Davis, Dmitriy Drusvyatskiy, Maryam Fazel2026-05-15
📊 statistics

Logging Policy Design for Off-Policy Evaluation

تقترح هذه الورقة إطاراً موحداً لتصميم سياسات التسجيل التي تقلل من خطأ التقييم خارج السياسة من خلال توصيف مقايضة جوهرية بين المكافأة والتغطية واستخلاص الاستراتيجيات المثلى عبر مختلف الأنظمة المعلوماتية لتوجيه الشركات في اختيار سياسات العلاج للتجارب عالية المخاطر.

Connor Douglas, Joel Persson, Foster Provost2026-05-15