🤖 AI

How AI Assistance Affects Human Skill Development: A Study of Learning with Logic Puzzles

تُظهر هذه الدراسة أنه في حين أن المساعدة المقدمة من الذكاء الاصطناكنة منخفضة التكلفة تُحسن الأداء الفوري للمهام، إلا أنها تعيق تطوير المهارات على المدى الطويل من خلال استبدال التفكير المستقل، مما يؤدي إلى أداء أسوأ دون مساعدة وتوقعات مبالغ فيها للقدرة بمجرد إزالة الذكاء الاصطناعي.

Shang Wu, Catarina G Belem, Shuyuan Fu, Mark Steyvers, Padhraic Smyth2026-08-25
📊 statistics

ConvergeFlow: Language Flow with Provable Convergence to Token Embeddings

تقدم الورقة البحثية ConvergeFlow، وهو نموذج لغوي قائم على التدفق يقيد التنبؤات ضمن الغلاف المحدب لتمثيلات الرموز (token embeddings)، ويثبت التقارب نحو الرموز الصالحة، مما يتيح توليد الرموز بشكل مباشر دون الحاجة إلى فك تشفير خاضع لإشراف الإنتروبيا المتقاطعة (cross-entropy-supervised decoder)، محققاً بذلك أداءً منافساً للنماذج المنفصلة والمستمرة الحالية.

Na Li, Yuchen Jiao, Changxiao Cai, Gen Li2026-08-25
🤖 AI

Prime Agent: A Self-Improving RLM Harness

يُعد Prime Agent عبارة عن إطار عمل مفتوح المصدر وذاتي التحسين يستخدم بيئة IPython REPL مستمرة وعملاء فرعيين متكررين لتوحيد التنفيذ وإدارة الموارد، مما يعزز أداء النموذج بشكل كبير في المهام المعقدة طويلة الأمد مثل ARC-AGI-3 والبرمجة المستقلة.

Seth Karten, Alex L. Zhang, Kevin Thomas, Sebastian Müller, Elie Bakouch, Daniel Auras, Mika Senghaas, Fares Obeid, Kons (…)2026-08-25
💬 NLP

SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

يقدم البحث SWE Refactor Bench، وهو معيار مرجعي صارم يضم ٢٠ عملية هجرة لمستودعات برمجية كاملة وبروتوكول تقييم ثلاثي المراحل للكشف عن القيود الحالية لوكلاء البرمجة، الذين حققوا نسبة نجاح تبلغ ٥.٤٪ فقط في إتمام عمليات هجرة المجموعات البرمجية المعقدة وطويلة الأمد بشكل مستقل دون الاعتماد على حيل سلوكية.

Deyao Hong, Yizhe Chi, Wenyi Li, Xiaoqiu Wang, Mingju Gao, Kaisen Yang, Bingxiang He, Youjie Zheng, Calvin Xiao, Qinhuai (…)2026-08-25
🤖 AI

ReWorld: An Interactive World Model with Long-Horizon Memory

يُعد ReWorld نموذج عالم تفاعلي يحل التوتر الهيكلي بين التحكم قصير المدى والذاكرة طويلة المدى عبر الفصل بين هاتين القدرتين أثناء التدريب باستخدام آليات انتباه مختلطة، وتوحيدهما عند الاستدلال عبر نظام استرجاع معالم مفهرس بالوضعية، محققاً بذلك دقة فائقة في الأفعال، وجودة عالية في الفيديو، واتساقاً زمنياً يمتد لدقائق عبر مجالات بصرية متنوعة.

Zhifei Chen, Luozhou Wang, Guibao Shen, Dongyu Yan, Shuai Yang, Tianshuo Xu, Yihua Du, Wei Wang, Tianyi Gui, Lianghua Hu (…)2026-08-25
⚡ electrical engineering

Graphon Particle Systems, Part II: Dynamics of Distributed Stochastic Continuum Optimization

تقترح هذه الورقة وتحلل خوارزميات التدرج الاشتقاقي العشوائي وتتبع التدرج للتحسين الموزع عبر متصل من العقد الممثلة بواسطة "غرافون" (graphon)، وتثبت أنه تحت شروط مناسبة، تحقق هذه الطرق الإجماع وتتقارب نحو الحد الأدنى العالمي مع لحظات ثانية محدودة بانتظام.

Yan Chen, Tao Li, Xiaofeng Zong2026-08-24
🤖 AI

Two Heads are Better Than One: Test-time Scaling of Multi-agent Collaborative Reasoning

تقترح هذه الورقة إطار عمل لنظام متعدد الوكلاء من أجل التوسع في وقت الاختبار يتغلب على قيود الوكيل الواحد عبر تفكيك الاستدلال إلى سياقات تعاونية، وتم التحقق من ذلك من خلال مجموعة بيانات M500، ووكيل "رئيس تنفيذي" للتوجيه التكيفي، ونماذج مضبوطة بدقة تتفوق بشكل كبير على نظيراتها الأساسية.

Can Jin, Hongwu Peng, Qixin Zhang, Yujin Tang, Dimitris N. Metaxas, Tong Che2026-08-24
🤖 AI

Can you see how I learn? Human observers' inferences about Reinforcement Learning agents' learning processes

تتقصى هذه الورقة كيفية استنتاج المراقبين البشريين لعمليات التعلم لدى وكلاء التعلم المعزز من خلال نموذج مبتكر قائم على الملاحظة، حيث تحدد أربعة موضوعات تفسيرية جوهرية (الأهداف، والمعرفة، واتخاذ القرار، وآليات التعلم) التي تتطور بمرور الوقت للمساهمة في تصميم أنظمة تفاعل بين الإنسان والروبوت أكثر شفافية وقابلية للتفسير.

Bernhard Hilpert, Muhan Hou, Kim Baraka, Joost Broekens2026-08-24
🔬 physics

MeltwaterBench: Deep learning for spatiotemporal downscaling of surface meltwater

تقدم هذه الورقة MeltwaterBench، وهو إطار عمل للتعلم العميق يدمج بيانات الاستشعار عن بعد مع النماذج القائمة على الفيزياء لإنشاء خرائط يومية لمياه الذوبان السطحي بدقة 100 متر فوق نهر هيلهيم الجليدي في جرينلاند، محققاً دقة أعلى بكثير (95%) من النهج الحالية غير القائمة على التعلم العميق، مع توفير مجموعة بيانات مرجعية جديدة لأبحاث تقليل النطاق الزماني والمكاني.

Björn Lütjens, Patrick Alexander, Raf Antwerpen, Til Widmann, Guido Cervone, Marco Tedesco2026-08-24
🤖 AI

Crypto x AI, AI x Crypto: A Survey

يستعرض هذا الاستطلاع بشكل منهجي العلاقة ثنائية الاتجاه بين الذكاء الاصطناعي والعملات المشفرة، موضحاً الإنجازات والفرص والتحديات الراهنة، مع تفنيد المفاهيم الخاطئة في هذا القطاع، ليخلص إلى أن التكامل الهادف بين المجالين لا يزال في مراحله الأولى.

Sarah Allen, Pranay Anchuri, James Austgen, Maryam Bahrani, Samuel Breckenridge, Aaron Buchwald, Christian Cachin, André (…)2026-08-24