🌀 nonlinear sciences

Eigenanalysis framework for autoregressive neural emulators of multi-scale chaotic dynamics

تقدم هذه الورقة إطار عمل للتحليل الذاتي يحدد نصف قطر الطيف لمصفوفة جاكوبي باعتباره المحدد الرئيسي للاستقرار في المحاكيات العصبية ذاتية الانحدار للأنظمة الفوضوية، مما يكشف أن البنيات المقيدة بالتكامل تحقق استقراراً محايداً، وتقترح دالة خسارة مقابلة لتعزيز دقة التنبؤ والمتانة الديناميكية.

Conrad Ainslie, Pedram Hassanzadeh, Michael W. Mahoney, Ashesh Chattopadhyay2026-08-18
🤖 machine learning

Behaviour Is an Incomplete Measure of Reasoning Development: Cross-surface pre-arrival accessibility and the limits of developmental inference in a recurrent-depth reasoner

تُثبت هذه الورقة أنه في المستنتج ذي العمق المتكرر، يمكن لمجسات الحالة الخفية الداخلية اكتشاف قدرات الاستنتاج قبل وقت طويل من ظهورها في السلوك الملحوظ، مما يكشف أن العتبات السلوكية وإمكانية الوصول إلى فك التشفير هما مقاييس متميزة وغير مكتملة للجدول الزمني الفعلي لتطور الاستنتاج.

Simon Lam-Muir2026-08-18
🤖 AI

Assessing LLMs' mathematical abilities requires understanding the various mechanisms of mathematical creativity

تجادل الورقة بأن تقييم القدرات الرياضية للنماذج اللغوية الكبيرة يتطلب تجاوز المعايير التجميعية نحو تصنيف دقيق لآليات إبداعية متميزة وغير قابلة للاستبدال، مما يشير إلى أنه في حين تتفوق النماذج الحالية في إعادة دمج المعرفة الموجودة، إلا أنها قد تفتقر جوهرياً إلى القدرة على أشكال أخرى من الابتكار الرياضي التي تزداد قيمتها مع تحسن توليد البراهين الآلي.

Silvère Gangloff2026-08-18
🤖 machine learning

TokenSTFormer: A Tokenized Spatial-temporal Attention Model for Holistic Motion Analysis in Adolescent Idiopathic Scoliosis Screening

تقدم هذه الورقة مجموعة بيانات ScoliGait ونموذج TokenSTFormer، وهو نموذج انتباه مكاني-زماني مُجزأ (tokenized) مبتكر يحقق دقة هي الأفضل في حالتها في فحص الجنف مجهول السبب لدى المراهقين من خلال الاستفادة من سمات حركة المشي الشمولية للتغلب على قيود الطرق التقليدية.

Dong Chen, Kenneth M. C. Cheung2026-08-18
🤖 AI

When Single-Dataset Conclusions Fail: A 45-Task Study of Threshold Tuning and Resampling for Imbalanced Classification

تُظهر هذه الدراسة أن الاعتماد على تقييمات مجموعة بيانات واحدة في التصنيف غير المتوازن هو أمر مضلل، حيث يكشف تحليل شامل لـ 45 مهمة أن ضبط العتبة وتقنيات إعادة أخذ العينات مثل SMOTE تُحسن الأداء بشكل كبير عبر نسب عدم توازن متنوعة، خلافاً للنتائج الصفرية التي لوحظت في مجموعة بيانات الاحتيال في بطاقات الائتمان الشهيرة ولكن غير الممثلة.

Diyorbek Musaev2026-08-18
🤖 AI

TRCA: Transition-wise Rubric Credit Assignment for Long-horizon LLM Agents

تقترح هذه الورقة البحثية طريقة "تخصيص ائتمان المعايير حسب الانتقال" (TRCA)، وهي طريقة تولد مكافآت دقيقة على مستوى الخطوات لوكلاء النماذج اللغوية الكبيرة (LLM) ذوي الأفق الطويل من خلال تقييم الانتقالات المستحثة بالأفعال مقابل معايير الأدلة، والتنفيذ، وعدم الصلاحية، مما يتغلب على ندرة المسارات الناجحة ويحسن الأداء في اختبارات قياسية مثل WebShop وSearchQA دون الاعتماد على مقيمين متعلمين.

Huan Zhang, Mingju Chen, Dongxu Zhou, Can Lv, Heng Chang, Sen Cui, Faguo Wu, Shiji Zhou2026-08-18
🤖 machine learning

Digital Twin Degradation: Detecting Cyber Physical Attacks via Temporal Inconsistencies

تقترح هذه الورقة إطاراً للكشف غير الخاضع للإشراف يستفيد من التناقضات الزمنية بين نظام سيبراني فيزيائي وتوأمه الرقمي الذي قد يكون متدهوراً لتحديد الهجمات السيبرانية الفيزيائية بشكل موثوق دون الحاجة إلى بيانات هجوم مصنفة أو تواقيع محددة.

Konstantinos E. Kampourakis, Vasileios Gkioulos, Sokratis Katsikas2026-08-18
🤖 machine learning

Domain-Specific Text Embedding Models for Entity Resolution

تُثبت هذه الورقة أن الضبط الدقيق لنماذج تضمين النصوص العامة باستخدام تدريب الثلاثيات الخاص بمجال معين يحسن بشكل كبير قدرتها على التمييز بين سجلات الكيانات المتطابقة وتلك المتشابهة للغاية غير المتطابقة، مما يعزز الأداء في مهام حل الكيانات واسترجاع السجلات المكررة.

Khajesh Sapram, Srivardhani Raju, Kishore Konda2026-08-18
🤖 AI

QUMem: Personalized Memory for Query-Conditioned User-State Inference in LLM Agents

يُعد QUMem إطار عمل ذاكرة مهيكلة يعزز تخصيص وكلاء النماذج اللغوية الكبيرة من خلال تقسيم سجلات التفاعل إلى حلقات دلالية، وتفكيكها إلى أنواع ذاكرة قابلة للاسترجاع بشكل مستقل، وتوظيف عملية استرجاع متعددة الوكلاء لاستنتاج حالات مستخدم صالحة زمنياً وسياقياً، مما يحقق أداءً رائدًا في معايير قياس التخصيص.

Heng Wang, Yifei Li, Lingling Zhang, Pengyu Li, Xinyu Che, Xinyu Zhang, Zesheng Yang2026-08-18
🤖 AI

Agent-Native Telemetry: Verifiable State-Delta Evidence for Autonomous Operations

تقدم هذه الورقة "القياس عن بُعد الأصيل للوكيل" (Agent-Native Telemetry)، وهو بنية أدلة قابلة للتحقق تستخدم "بروتوكول قياس الوكيل عن بُعد" (ATP) و"سجل أدلة فروق الحالة" (State-Delta Evidence Ledger) لاستبدال السجلات الموسعة الموجهة للبشر بتغييرات حالة مدمجة وموقعة تشفيرياً، مما يقلل بشكل جذري من تكاليف السياق وأعباء الاستعلام مع ضمان المصدر والأمان لوكلاء الذكاء الاصطناعي المستقلين.

Jun He, Deying Yu2026-08-18