🤖 AI

Cooperative Coevolution for Resource-Constrained Agentic LLM Post-Training

تقدم الورقة البحثية استراتيجية التطور التعاوني في الفضاء الفرعي للمعلمات (CoPES)، وهي طريقة فعالة من حيث استهلاك الذاكرة تعمل على تفكيك فضاء المعلمات لتمكين التدريب اللاحق الفعال للنماذج اللغوية الكبيرة الوكيلية في ظل قيود الموارد، محققةً 92% من مكاسب أداء خوارزمية GRPO كاملة المعلمات مع متطلبات أقل بكثير لذاكرة وحدة معالجة الرسومات.

Zhiyuan Wang, Shengcai Liu, Jiahao Wu, Ning Lu, Hui Ouyang, Shaofeng Zhang, Haoze Lv, Ke Tang2026-08-04
🔬 physics

Network Information Enhances Unreliable News Domain Detection

تُثبت هذه الورقة أن الاستفضاء من بنية الشبكة المستمدة من أنماط مشاركة روابط الـ URL عبر الشبكات العصبية الرسومية (Graph Neural Networks) يحسن بشكل كبير من اكتشاف نطاقات الأخبار غير الموثوقة، متفوقاً بذلك على النماذج المرجعية التي تعتمد على المحتوى فقط حتى في الحالات التي يكون فيها تحليل المحتوى غير ممكن.

Raphaela Keßler, Roman David Ventzke, Viola Priesemann, Giordano De Marzo2026-08-04
⚡ electrical engineering

Deep Learning-Based Estimation of Ground Reaction Forces in Parkinsonian Gait Using an Optimized Set of IMU Data

تقدم هذه الدراسة إطار عمل جديداً للتعلم العميق باستخدام نموذج هجين من الشبكات العصبية الالتفافية والذاكرة الطويلة قصيرة المدى ثنائية الاتجاه (CNN-BiLSTM) وتكوين مُحسَّن لوحدة قياس القصور الذاتي (IMU) مكونة من أربعة مستشعرات لتقدير قوى رد فعل الأرض الرأسية الثنائية بدقة لدى مرضى باركنسون، مما يوفر حلاً عملياً وقابلاً للتوسع لتحليل المشية القابل للارتداء والمراقبة عن بُعد.

Run Lin, Yingtian Tang, Jiawen Xu, Dongfei Huo, Lefan Wang, Helen Dawes, Dominic J. Farris, Dong Wang, Xijin Hua2026-08-04
🤖 machine learning

Foundations of Reinforcement Learning and Control:Connections and New Perspectives

يسد هذا البرنامج التعليمي الفجوة بين التعلم المعزز ونظرية التحكم من خلال تقديم التحكم التكيفي وخوارزميات الممثل-الناقد، موضحاً تطبيقهما المشترك على مشكلة التحكم في الحركة لتعزيز التفاهم المتبادل واتخاذ القرار القائم على البيانات بين المجتمعين.

Claire Vernade, Onno Eberhard, Martha White, Florian Dörfler, Csaba Szepesvári, Miroslav Krstic, Michael Muehlebach2026-08-04
🤖 machine learning

Intention Inference Under Execution Noise: Separating Aleatoric and Epistemic Uncertainty in Social Dilemmas

تقترح هذه الورقة إطار عمل لعملية ماركوف لاتخاذ القرار خاضعة للملاحظة الجزئية (POMDP) ضمن الاستدلال النشط للتمييز بين النوايا العدائية وأخطاء التنفيذ في المعضلات الاجتماعية المشوبة بالضجيج، مظهرةً أنه في حين يؤدي استنتاج النوايا إلى تحسين التعاون ضد الخصوم المشروطين، فإن الاستنتاج المتبادل في ظل الضجيج العالي يمكن أن يؤدي بشكل متناقض إلى انهيار مترابط مدفوع بالاعتقاد.

Kival Mahadew, Jonathan Shock2026-08-04
🤖 machine learning

Advancing Relevance Measurement with Vision-Language Models for Web-Scale Search

تقدم هذه الورقة مسار تقييم آلي لمدى الصلة يعتمد على نماذج الرؤية واللغة (VLM) تم نشره في بحث Pinterest، والذي يتوافق مع التقييمات البشرية لتحسين كفاءة القياس بشكل كبير، وتوسيع نطاق تغطية الاستعلامات، وتقليل الحد الأدنى من التأثيرات القابلة للكشف في تجارب A/B عبر الإنترنت.

Han Wang, Alex Whitworth, Pak Ming Cheung, Zhenjie Zhang, Krishna Kamath, Xi Chen, Roberto Konow, Kurchi Subhra Hazra2026-08-04
🤖 machine learning

Aggregate-then-Calibrate for Human-centered Assessment with Theoretical Guarantees

تقترح هذه الورقة إطار عمل "التجميع ثم المعايرة" (AtC)، وهو إطار عمل ثنائي المراحل يعمل نظرياً وتجريبياً على تحسين التقييم المتمحور حول الإنسان من خلال تجميع الأحكام البشرية غير المتجانسة في تصنيف إجماع موثوق، ثم معايرة درجات النموذج عبر الإسقاط المتساوي (isotonic projection) لتحقيق دقة ومتانة فائقتين عند عدم توفر الحقيقة الأرضية.

Zejun Xie, Xintong Li, Guang Wang, Desheng Zhang2026-08-04
🤖 AI

Real-Time Detection and Repair of LLM Agent Failures

تقدم هذه الورقة نظاماً ذا طبقتين ومنخفض التأخير للكشف عن إخفاقات وكلاء النماذج اللغوية الكبيرة (LLM agents) وإصلاحها باستخدام مراقبات تتبع عن بُعد بمقياس الميكروثانية وتحقق حتمي، مما يحسن معدلات نجاح المهام بشكل كبير وبجزء ضئيل من تكلفة التقييم التقليدي القائم على النماذج اللغوية الكبيرة.

Sunny Dubey2026-08-04
💬 NLP

Cultural Awareness is Represented but Not Decoded: Tracing Mythological Knowledge across 18 Open-Source LLMs

تستقصي هذه الورقة ١٨ نموذجاً من النماذج اللغوية الكبيرة مفتوحة المصدر، وتجد أنه بينما تمثل هذه النماذج داخلياً المعرفة الميثولوجية من ثقافات متنوعة، فإن فشلها في استرجاع التقاليد غير السائدة ينبع من انحياز في قراءة فك التشفير يؤدي إلى انهيار هذه التمثيلات على رموز التقاليد السائدة، وهو قصور يتأثر أيضاً بلغة المطالبة.

Iaroslav Chelombitko, Ekaterina Chelombitko, Mika Hämäläinen2026-08-04
🤖 machine learning

Beyond Modern Asymptotics for Log-Likelihood Ratios in Logistic Regression

تضع هذه الورقة حدوداً غير تقاربية ومنتظمة على أسوأ حالات الربيعات لإحصائية نسبة الأرجحية في الانحدار اللوجستي الثنائي، كاشفةً عن مقياس عالمي قدره dlog(n/d)d\log(n/d) للأبعاد d3d \geq 3، وسلوكيات لوغاريتمية متميزة لـ d=1d=1 و d=2d=2، واستعادة لمقياس ويلكس الكلاسيكي في ظل تصميمات غاوسية مستقلة ومتماثلة التوزيع.

Hugo Chardon, Reese Pathak, Nikita Zhivotovskiy2026-08-04