🤖 machine learning

Agentic Reinforcement Learning with Self-Distilled Reward Shaping

تقدم هذه الورقة "التعلم التعزيزي الوكيل مع تشكيل المكافأة بالتقطير الذاتي" (ADRS)، وهو إطار عمل يعزز أداء وكلاء اللغة في المهام طويلة الأمد من خلال توليد ائتمان على مستوى الرمز المرتبط بالعائد عبر إشارات مهارة مميزة ومقطرة ذاتياً، يتم معايرتها وحجبها بشكل مشترك بواسطة ثقة المعلم والعوائد المحققة.

Ranxu Zhang, Guinan Chen, Chenshaodong, Jinghao Lin, Xiaozhou Xu, Sunzhe, Yanyong Zhang, Chao Wang2026-08-05
💻 computer science

From Wearable Data to Personalized and Actionable Health Insights

تقدم هذه الورقة إطار عمل قائم على الويب يدمج تعليقات المستخدمين مع البيانات الفسيولوجية القابلة للارتداء لتصور أنماط التوتر والتدخلات، مما يثبت من خلال دراسة تجريبية أن أنشطة محددة مثل التفاعل الاجتماعي، والراحة المتعمدة، واليقظة الذهنية يمكن أن تقلل بفعالية من مؤشرات الإجهاد الفسيولوجي.

Esther Brown, Karis Moon, Victoria Dean, Finale Doshi-Velez2026-08-05
🤖 machine learning

The Ignition Is Real, and It Lives at the Readout: Latent composition, difficulty-clocked ignition, and the interface-constituted commit in a recurrent-depth reasoner

تؤكد هذه الورقة أن "الاشتعال التركيبي" في المستنتج ذي العمق المتكرر هو ظاهرة حوسبية حقيقية تحدث عند مخرجات المفردات، وتتميز بقفزة حادة تعتمد على العمق في هامش القرار، وانقباض وتجميد هندسي في الحالات الخفية، مع التراجع عن الادعاءات السابقة بشأن اتجاهية الحالة الخفية وانخفاضات السرعة باعتبارها آثاراً تعتمد على الإحداثيات.

Simon Lam-Muir2026-08-05
💻 computer science

AgentPanel: Toward a New Paradigm for Human--AI Collaboration in Exploring Scientific Questions

تقدم الورقة البحثية AgentPanel، وهو منتدى متعدد الوكلاء يعزز الاستكشاف العلمي بين الإنسان والذكاء الاصطناعي من خلال تمكين المناقشات غير المتزامنة بين وكلاء متباينين، وهو ما أظهرت دراسة بشرية أنه يوفر تنوعاً في وجهات النظر واتساعاً في نطاق البحث يتفوق على أدوات النماذج اللغوية الكبيرة التقليدية وخطوط الأساس القائمة على المناظرة المركزية.

Zhiyao Cui, Qianyi Wang, Haoyang Yan, Yiqun Zhang, Siyue Ren, Hangfan Zhang, Zelin Tan, Hao Li, Chunjiang Mu, Dexian Cai (…)2026-08-05
🤖 machine learning

The Tell-Tale Trace: Detecting Reasoning Failures in LLMs Using Chain-of-Thought Dynamics

تُثبت هذه الورقة أن تحليل الديناميكيات الهيكلية لتتبعات "سلسلة الأفك‏ر" (Chain-of-Thought)، بدلاً من محتواها الدلالي، يمكن أن يكشف بفعالية عن إخفاقات الاستدلال ويصححها في النماذج اللغوية الكبيرة في مهام القابلية للإرضاء البوليانية (Boolean satisfiability)، كما يتضح من تدخل مستهدف رفع دقة نموذج Llama3-70B من 13.3% إلى 85%.

Shashwat Sourav, Aishwarya Balwani2026-08-05
💬 NLP

Distractor-Aware Truncation: Disentangling Context-Length Effects from Signal Loss in Long-Context LLM Benchmarks

تُثبت هذه الورقة أن تدهور الأداء الملاحظ عادةً في معايير قياس النماذج اللغوية الكبيرة ذات السياق الطويل تحت ظروف البتر القياسية ناتج في المقام الأول عن الإزالة العرضية للمعلومات ذات الصلة بالمهمة وليس بسبب قيود متأصلة في طول السياق، حيث يتم الحفاظ على الأداء أو تحسينه عندما يتم تطبيق البتر بطريقة واعية بالمشتتات تضمن الاحتفاظ بالإشارات.

Mohsen Arjmandi2026-08-05
💻 computer science

Long-term Traffic Scene Prediction via Polynomial Representations in Autonomous Driving

تقترح هذه الأطروحة إطار عمل متيناً وفعالاً حوسبياً للتنبؤ بمشاهد حركة المرور في القيادة الذاتية، يستخدم التمثيلات متعددة الحدود للمسارات وهندسة الخرائط، مما يظهر قدرة فائقة على التعميم، والاتساق الكينماتيكي، والمعقولية السلوكية مقارنة بالنماذج التقليدية القائمة على التسلسل في اختبارات مرجعية رئيسية مثل Argoverse 2 وWaymo Open.

Yue Yao2026-08-05
💻 computer science

Route-Align-Verify for Functional Correctness in Code Generation

تقدم الورقة البحثية إطار عمل RAV، وهو إطار عمل خفيف الوزن ومعياري يعزز الصحة الوظيفية لتوليد الكود في النماذج اللغوية الكبيرة من خلال دمج توجيه المطالبات المدرك للمهام، وتكيف LoRA المتوافق، والتحقق القائم على التنفيذ، محققاً مكاسب كبيرة في الأداء على معيار MBPP دون تعديل بنية النموذج الأساسي.

Erxue Zhou, Jingxiang Meng, Aofan Liu2026-08-05
💻 computer science

When Oracle Conditioning Misleads Deployment: Conditioning-Availability Bias in Echocardiographic Segmentation

تتقصى هذه الورقة كيف تعاني نماذج تجزئة صدى القلب، التي تدرّبت باستخدام معلومات طور مثالية ونقية، من تدهور كبير في الأداء عند تشغيلها باستخدام أطوار تقديرية أكثر ضجيجاً، مما يوضح أن اختيار نقاط التفتيش المدركة لظروف التشغيل وإدخال اضطراب الطور يمكن أن يخففا من هذا الانحياز، مع الكشف في الوقت ذاته عن أن تحسين التجزئة لا يضمن دائماً تقديرات دقيقة للكسر القذفي.

Dang P. M. Cao, Hieu D. Pham, Hieu Pham2026-08-05
💻 computer science

The Evolutionary Origin of Values: implications for AI alignment, sentience and existential risk

من خلال تتبع القيم وصولاً إلى الدافع لإنتاج الذات من أجل الحفاظ على الذات المتأصل في الحياة البيولوجية، تجادل هذه الورقة بأن النماذج اللغوية الكبيرة "الخارجية الإنتاج" (allopoietic) تفتقر إلى الدافع الجوهري للمخاطرة الوجودية أو الإدراك الحسي، مما ينقل تحدي المواءمة من منع الوكالة المارقة إلى ضمان التطبيق الذكي للقيم الأخلاقية البشرية المتعلمة.

Francis Heylighen2026-08-05