📊 statistics

A Repeated Measurements Approach to SoHSoH Battery Modelling of Cyclic Aged Data in a Laboratory Environment

تقدم هذه الورقة نموذجاً جديداً للقياسات المتكررة غير الخطية والمُخَطَّطة خطياً من الدرجة الأولى باستخدام المربعات الصغرى المعممة التكرارية المنظمة للتنبؤ بدقة بحالة صحة البطارية (SoH) بهامش خطأ قدره ±0.191% عن طريق التمييز بين ضوضاء القياس والتباين بين الخلايا في البيانات الدورية المتقادمة مختبرياً.

Mark Cary, Charles Bokor2026-08-21
💬 NLP

EnvHarness: Awakening Static Worlds for Agent Learning

تقدم الورقة البحثية EnvHarness، وهي طبقة برمجية تعيد تشكيل البيئات الساكنة ديناميكيًا لاستهداف نقاط ضعف الوكيل دون تعديل المنطق الأساسي، وEnvRigger، وهو نظام مؤتمت يعمل على تخليق هذه المكونات لتحسين أداء الوكيل بشكل كبير وتمكين التطور المشترك المستمر عبر مجالات متنوعة.

Chengsong Huang, Zifeng Wang, Rujun Han, Jun Yan, Yanfei Chen, Zoey CuiZhu, Ke Jiang, Peng Xia, Han Yu, Yufan Zhuang, Yi (…)2026-08-21
🔬 physics

The impact of feature engineering and an optimisation framework for ocean colour machine learning

تقترح هذه الورقة إطاراً لتحسين هندسة الميزات مكوناً من سبع مستويات يعزز بشكل كبير دقة نماذج تعلم الآلة لتقدير معاملات لون المحيط مثل الكلوروفيل-أ وعمق قرص سيتشي في المياه الساحلية النرويجية، مما يثبت أن تحويل البيانات المصمم خصيصاً أمر بالغ الأهمية للتفوق على الخوارزميات القياسية.

Edson Silva, Julien Brajard, Simon Cappe, Lasse H. Pettersson, François Counillon2026-08-21
📊 statistics

Where Does the Union Bound Go? Best-Arm Identification and Strong FWER Control

توضح هذه الورقة سبب ضرورة حدّ الاتحاد (union bound) في تحديد الذراع الأفضل عند الثقة الثابتة، وذلك من خلال إثبات أن مسألة التعدد الظاهري تستمر بغض النظر عن توجه الفرضية، حيث تظهر إما في صورة تعدد القيم الصفرية الحقيقية أو كمسارات متعددة للرفض الخاطئ للقيمة الصفرية الحقيقية الوحيدة.

Rianne de Heide2026-08-21
🤖 machine learning

Auditing Recorded Predictive Lead Service-Line Classifications Against Physical Verification: A Statewide Study of New York

تكشف هذه الدراسة الشاملة لولاية نيويورك أنه بينما تتوافق نماذج التنبؤ بخطوط الخدمة الأمامية لدى معظم المرافق مع عمليات التحقق الميداني، فإن نظام مدينة نيويورك يظهر تباينًا ذا دلالة إحصائية حيث يصنف النموذج أكثر من 43,000 عنوان كـ "أخرى معروفة" رغم أن عمليات التنقيب الميداني أكدت وجود الرصاص في ما يقرب من 121,000 عنوان، إلى جانب وجود أدلة على أن بعض التقديرات من جانب الجانب العام قد نُسخت خطأً من مخرجات النموذج الخاصة بجانب العميل.

Muhammad Sarmad Sohail2026-08-21
⚛️ high-energy experiments

Green BOA: Determining the environmental break-even point for ML-based data compression

تقيم هذه الورقة الاستدامة البيئية لضغط البيانات القائم على تعلم الآلة من خلال حساب نقطة التعادل في مكافئ الكربون حيث تعوض وفورات الطاقة الناتجة عن تقليل التخزين البصمة الكربونية للبنية التحتية للتدريب والاستدلال.

Caterina Doglioni, Akshat Gupta, Thomas Elliott, Hanzila Hussain, Sanjiban Sengupta2026-08-21
🤖 machine learning

End-to-end Early Classification of Time Series in Non-Stationary Environments

تتحدى هذه الورقة البحثية قيود التصميمات المنفصلة الحالية للتصنيف المبكر للسلاسل الزمنية (ECTS) في البيئات غير المستقرة من خلال تقديم DQeND، وهو إطار عمل متكامل يعتمد على التعلم التعزيزي يعمل على تحسين التمثيل والتصنيف والتحفيز بشكل مشترك، مما يظهر متانة وقدرة فائقة على التكيف عبر سيناريوهات الانجراف المختلفة مقارنة بالنماذج المرجعية المتطورة.

Aurélien Renault, Alexis Bondu, Antoine Cornuéjols, Vincent Lemaire2026-08-21
💬 NLP

Auditing Cross-Lingual Fairness in Language Model Watermarking

تقدم هذه الورقة إطار تقييم شامل للعدالة عبر اللغات في العلامات المائية للنماذج اللغوية، مما يكشف عن تفاوتات هيكلية عبر العائلات اللغوية التصنيفية، ويثبت أن التقييمات الحالية التي تركز على اللغة الإنجليزية تفشل في رصد فجوات الكشف والجودة الحرجة في عمليات النشر متعددة اللغات.

Alexander Nemecek, Osama Zafar, Debargha Ganguly, Vikash Singh, Vipin Chaudhary, Erman Ayday2026-08-21
💬 NLP

Reward-Guided Autoregressive Graph Generation for Efficient Multi-Agent Communication Topology Design

تقدم هذه الورقة RGA-Designer، وهي طريقة لتوليد الرسوم البيانية ذاتية الانحدار والموجهة بالمكافأة مستوحاة من التعلم المعزز من التغذية الراجعة البشرية (RLHF)، والتي تعمل على تحسين طوبولوجيا التواصل بين الوكلاء لتقليل استهلاك الرموز (tokens) بمتوسط قدره 20.5% مع الحفاظ على دقة المهام.

Poomphob Suwannapichat, Boonyarit Changaival, Caesar Wu, Pascal Bouvry2026-08-21
📊 statistics

Discrete Diffusion Inference-Time Control with Nested Sequential Monte Carlo

تقدم هذه الورقة طرق مونت كارلو التسلسلية المتداخلة، بما في ذلك نسخة مصححة ومتكيفة كلياً، لتوجيه نماذج اللغة ذات الانتشار المنفصل بفعالية نحو مكافآت مستوى التسلسل أثناء التحكم في وقت الاستدلال، مما يظهر أداءً متفوقاً على النهج القائم على الجسيمات الموجودة حالياً مثل "أفضل من n" و"SMC التمهيدي".

Lohithsai Yadala Chanchu, Hany Abdulsamad, Christian A. Naesseth2026-08-21