🤖 AI

From Passive Delegates to Strategic Negotiators: Reinforcing Social Reasoning in Small Language Models with SocialRL

تقدم الورقة البحثية SocialRL، وهي وصفة تدريبية تحول النماذج اللغوية الصغيرة إلى مفاوضين استراتيجيين عبر تعزيز التفكير الاجتماعي وسقالات نظرية العقل، مما يمكّن نموذجاً بـ 4 مليارات معلمة من مضاهاة أو تجاوز أداء النماذج الرائدة الأكبر بكثير مثل GPT-5 عبر استراتيجيات التدريب داخل النطاق والنقل عبر النطاقات في مجالات تفاوض متنوعة.

Wenyue Hua, Zachary Huang, Tyler Payne, Safoora Yousefi, Saleema Amershi, Asli Celikyilmaz2026-08-17
🤖 machine learning

PPAPlace: Differentiable Cross-Stage Objectives for Chip Placement Optimization

يقدم PPAPlace نموذجاً بديلاً قابلاً للتفاضل وموجهاً بالتوقيت، تم تدريبه على تسميات ما بعد التوجيه العالمي، والذي يستفيد من الانتباه الرسومي والمكاني ثنائي المسار للتنبؤ وتحسين مقاييس القدرة والأداء والمساحة (PPA) لما بعد التوجيه، مما يحسن بشكل كبير أسوأ سلب سلبي (WNS) وإجمالي السلب السلبي (TNS) مقارنة بالنماذج المرجعية الهرمية دون الحاجة إلى إعادة تدريب الدائرة الاختبارية.

Ruogu Chen, Jie Han2026-08-17
📊 statistics

On the Brittleness of Maximum Likelihood Estimation for Gaussian Process Hyperparameter Optimization

تتقصى هذه الورقة البحثية هشاشة تقدير الإمكانية القصوى (MLE) عند تدريب العمليات الغاوسية، حيث تُبين أنه عندما تُنتهك الافتراضات الأساسية، يؤدي تقدير الإمكانية القصوى إلى تعميم ضعيف، وتقترح حلولاً عملية ذات أسس نظرية تتفوق على الأساليب الحالية في الدقة، وتقدير عدم اليقين، وتكلفة الاستدلال للمهام الهندسية اللاحقة.

Tyler R. Johnson, Kian Ben-Jacob, Christopher P. Muller, Ramin Bostanabad2026-08-17
🤖 machine learning

Dynamic Multi-Depot Vehicle Routing with Online Requests: Event-Driven Transformer--DRL and Rolling-Horizon Benchmarking

تقترح هذه الورقة إطار عمل يعتمد على "ترانسفورمر" (Transformer) والتعلم التعزيزي العميق (DRL) القائم على الأحداث لمسألة توجيه المركبات الديناميكية متعددة المستودعات مع الطلبات عبر الإنترنت، مظهرةً أنه في حين تتيح السياسات المتعلمة اتخاذ قرارات بمستوى الميلي ثانية وتنتقل إلى نماذج أكبر دون إعادة تدريب، إلا أنها تُهزم من قِبل خوارزمية تقريبية تعتمد على أقرب نقطة صالحة في جودة التوجيه، ومن مُحسِّن الأفق المتدحرج في سرعة الاستجابة للخدمة، مما يسلط الضوء على عدم تفوق أي طريقة منفردة عبر جميع مقاييس الكفاءة والاستقرار والحوسبة.

Faezeh Ardali, Gerald M. Knapp2026-08-17
🤖 machine learning

What preferences can - and cannot - predict in multi-agent online learning

تتقصى هذه الورقة حدود استخدام رسوم التفضيل البيانية للتنبؤ بالنتائج طويلة الأمد في التعلم عبر الإنترنت متعدد الوكلاء، حيث تُبين أنه بينما يُعد الاستقرار التفضيلي ضروريًا للاستقرار الديناميكي، فإنه ليس كافيًا في الألعاب العامة، وتقترح "المرونة تحت الانحرافات الإجمالية" كشرط أقوى قائم على العوائد لضمان الاستقرار التقاربي.

Omar Abbadi, Rida Laraki, Panayotis Mertikopoulos2026-08-17
🔬 materials science

SPEAR: Structure Property Explainability with Attention Regularization

تقدم الورقة البحثية إطار عمل SPEAR، الذي يعزز التفسير الفيزيائي والاستقرار لنماذج التعلم الآلي القائمة على آلية الانتباه لاكتشاف المواد من خلال تطبيق قيود قابلة للتعلم على درجة الحرارة والنعومة على آليات الانتباه، مما يولد تفسيرات متماسكة ومتوافقة سببيًا دون المساس بدقة التنبؤ.

Aditya Raghavan, Utkarsh Pratiush, Dalton A. Pearl, Jade Holliman Jr, Katharine Page, Philip D Rack, Sergei V Kalinin2026-08-17
🤖 machine learning

HI-MeshGraphNets: Efficient and Accurate Mesh-based Physics Learning with Hierarchical Multi-scale Graph Neural Networks

يقدم HI-MeshGraphNets (HI-MGN) إطار عمل للشبكات العصبية الرسومية متعددة المقاييس الهرمية، والذي يعزز كفاءة ودقة النماذج البديلة للفيزياء القائمة على الشبكات من خلال تمكين انتشار المعلومات بعيدة المدى عبر تمرير الرسائل خشن الحبيبات والاستيفاء المتعلم، مما يقلل التكاليف الحسابية ومخاطر التنعيم المفرط مقارنة بالبنيات المسطحة التقليدية.

SiHun Lee, Dong-Hyuk Park, Taesoo Bang, Seung-Hoon Kang2026-08-17
🤖 machine learning

Geometric Filtering of LLM-Generated Samples for Few-Shot Text Classification

تقترح هذه الورقة إطار عمل للترشيح الهندسي يعمل على تحسين التصنيف النصي قليل العينات من خلال اختيار العينات الاصطناعية المولدة بواسطة النماذج اللغوية الكبيرة بناءً على مسافتها الإقليدية من أمثلة الفئات الحقيقية في فضاء التضمين، محققةً مكاسب كبيرة في الأداء مقارنة بالطرق الحالية مثل SMOTE عبر مجموعات بيانات ونماذج متنوعة.

Benjamín Schindler, Gonzalo A. Ruz2026-08-17
🤖 machine learning

Variation Brownian Kernel Ladders

تقدم هذه الورقة "سلم كيرنل براون المتغير" (VBKL)، وهو إطار عمل فضاء الدوال ذو المسار الذري الذي يفصل بين بناء القاموس التكراري غير الخطي وبين التراكب الخطي للمتغيرات لإرساء ضمانات نظرية حول الانتظام، والتماسك، والتعميم، مع إظهار مقايضات مواتية بين الدقة والتعقيد في تجارب منضبطة.

Mahdi Mohammadigohari2026-08-17
🤖 machine learning

Hybrid Quantum-inspired Kolmogorov-Arnold Networks for Privacy-Aware Federated Biosignal Learning

تقترح هذه الورقة شبكة كولموغوروف-أرنولد هجينة مستوحاة من الكم (HQKAN) لتصنيف تخطيط كهربائية القلب في بيئة تعلم اتحادي تراعي الخصوصية، مبرهنةً على أنها تتفوق على المدركات المتعددة الطبقات التقليدية في الدقة والمتانة مع تقليل المعلمات القابلة للتدريب وتكاليف الاتصال بشكل كبير عبر تكوينات العملاء المتنوعة.

Chun-Hua Lin, Samuel Yen-Chi Chen, Yu-Chao Hsu, Kuo-Chung Peng, Jiun-Cheng Jiang, Chi-Sheng Chen, Tai-Yue Li, Nan-Yow Ch (…)2026-08-17