🤖 AI

MUSE: An Interactive Meta-Agent for Understanding and Steering LLM-powered Data Science Systems

تقدم الورقة البحثية MUSE، وهو وكيل ميتا تفاعلي يعزز فهم المستخدم وتحكمه في أنظمة علوم البيانات المدعومة بالنماذج اللغوية الكبيرة من خلال إعادة هيكلة آثار التنفيذ ديناميكيًا، وتمكين التغذية الراجعة السياقية، ودعم التوجيه ذي المبادرة المختلطة، وهو ما أظهر تحسنًا في كفاءة المهام وثقة المستخدم في دراسة مستخدمين.

Wei-Hao Chen, Weixi Tong, Yuan Tian, Chenglong Wang, Tianyi Zhang2026-08-18
🤖 machine learning

Understanding and Stabilizing Deep Q-Learning via Controlled Bootstrapping and Regulated Value Dynamics

تقدم هذه الورقة تحليلاً موحداً لعدم استقرار تعلم كيو العميق (deep Q-learning) من خلال تحديد ثلاثة مصادر متفاعلة للخطأ — وهي التحيز على مستوى العامل، وحساسية المقدر، واختلال ديناميكيات المعلمات — وتقترح إطار عمل للاستقرار يتميز بالتمهيد المحكوم (controlled bootstrapping)، وتقدير المئينات التجميعي (ensemble quantile estimation)، وتنظيم المعلمات القائم على النبضات (spike-based parameter regulation)، مما يحقق أداءً تنافسياً مع تحسن في استقرار التدريب على معايير Atari-100K وProcgen.

Bozhou Chen, Yongyi Wang, Hanyu Liu, Xionghui Yang, Wenxin Li2026-08-18
🤖 AI

Securing AI-Generated Code: A Just-in-Time Vulnerability Detection and Remediation Pipeline

تقدم هذه الورقة وتقيم مساراً أمنياً مؤتمتاً وفورياً (just-in-time) يكتشف الثغرات في كود بايثون المُنشأ بواسطة الذكاء الاصطناعي، ويُثريها بسياق التهديدات، ويعالجها، مما يثبت أن نهجاً متعدد المراحل يجمع بين التحليل الساكن والتحقق والتوليد القائم على النماذج اللغوية الكبيرة يقلل بشكل كبير من النتائج الأمنية المتبقية عبر نماذج مختلفة، حتى عندما لا يعتمد المسار الأفضل أداءً على نموذج توليد الكود الأعلى جودة.

Mikhail Surikov2026-08-18
🤖 AI

Competing at Every Price Point with Agentic Evolution over a Menu of LLMs

تُثبت هذه الورقة أن RoboPhD، وهو عميل ميتا تطوري، يمكنه تلقائياً توليد برامج وكلاء تحقق أداءً مهيمناً وفق معيار باريتو عبر نقاط سعرية متعددة في اختبارات معيارية متنوعة (DS-1000 وPaperFindingBench) من خلال التطور عبر قائمة من النماذج اللغوية الكبيرة باستخدام عدد قليل فقط من أمثلة التدريب.

Andrew Borthwick2026-08-18
🤖 AI

Process-Constituted Intelligence: A Shared Criterion for Humans and Machines

تجادل هذه الورقة بأن الذكاء الحقيقي يتحدد من خلال العملية المعرفية التكرارية وليس من خلال المخرجات، مقترحةً إطار عمل لـ "التكافؤ القوي" يقوم على سبعة سمات عملياتية للتمييز بين الإدراك البشري والذكاء الاصطنا Generative الحالي الذي يكتفي بمجرد إعادة إنتاج آثار المخرجات، مع تقديم مبادئ تصميمية وعمليات تدقيق لضمان أن تعمل أدوات الذكاء الاصطناعي على تعزيز القدرات التوليدية البشرية بدلاً من تآكلها.

Michael J. Richardson, Ayeh Alhasan, Cassandra Crone, M. Paula Diaz Monfort, Patrick Nalepka, Mark Dras, Rachel W. Kalle (…)2026-08-18
🤖 AI

HiPHI: A Large-Scale Benchmark for High-Precision Human Motion and Object-Interaction

تُعدُّ HiPHI مجموعة بيانات مرجعية واسعة النطاق وعالية الدقة، تضم أكثر من 600 ساعة من بيانات حركة جسم الإنسان وتفاعله مع الأشياء، وقد صُممت للتغلب على قيود مجموعات البيانات الحالية المخصصة للنماذج المجسدة عبر الجمع بين دقة تبلغ أجزاءً من المليمتر وتنوع موجه نظرياً لتمكين التدريب والتقييم القابل للتوسع لسياسات الروبوتات البشرية.

Jiahao Ji, Ji Ma, Runhan Zhang, Runyi Yu, Wenjia Wang, Weiheng Chi, Qianqian Peng, Weichao Yan, Yongfei Gu, Ye Tian, Tin (…)2026-08-18
🤖 AI

A cross-modal generative model for incomplete and degraded prostate MRI with multicentre clinical validation

تقدم هذه الورقة MSCNet، وهو إطار توليدي عابر للأنماط ينجح في إعادة بناء تسلسلات رنين مغناطيسي مفقودة أو متدهورة للبروستاتا، مما يظهر دقة فائقة في الصور وأداءً تشخيصيًا غير أدنى في اكتشاف السرطان ذي الأهمية السريرية مقارنة بالطرق المرجعية عبر عمليات التحقق السريري متعددة المراكز.

Siyuan Ma, Liang He, Mengying Zhu, Yi Chai, Mengyao Lyu, Haowei Wang, Qizhen Lan, HaoBo Sun, Qixin Zhang, Jingli Chen, X (…)2026-08-18
🤖 AI

Software Engineering for AI-driven Building Operation

تحدد هذه الورقة التحديات الفريدة في هندسة البرمجيات عند نشر عمليات المباني المدفوعة بالذكاء الاصطناي—حيث تترتب على الإخفاقات عواقب مادية لا رجعة فيها بدلاً من مجرد عواقب رقمية—وتقترح أساساً جديداً وأفضل الممارسات لسد الفجوة بين ممارسات برمجيات الذكاء الاصطناعي الحالية والطبيعة الحرجة للسلامة في الأنظمة السيبرانية الفيزيائية للمباني.

Philipp Zech, Sascha Hammes, Johannes Weninger, Jürgen Pannosch, Gernot Steidl2026-08-18
🤖 AI

Defake-o3: From Speculative Rationales to Verifiable Evidence for Explainable AIGI Detection

تقدم الورقة البحثية Defake-o3، وهو كاشف للصور المولدة بواسطة الذكاء الاصطناعي قابل للتفسير يستبدل المبررات التخمينية بأدلة بصرية قابلة للتحقق من خلال الجمع بين البحث البصري التكراري ومُحقِّق أدلة (Evidence Verifier) مُدرب بشرياً، مدعوماً بمجموعة بيانات GroundFake الجديدة ومعيار FakeFrontier.

Bowen Deng, Jiahui Zhan, Yikun Ji, Haozhen Yan, Jianfu Zhang2026-08-18
🤖 AI

Decoupled Temporal Encoding for Generative Recommendation

تقترح هذه الورقة البحثية "الترميز الزمني المنفصل" (DTE)، وهو إطار عمل خفيف الوزن للتوصية التوليدية يعمل على تحسين الأساليب الحالية من خلال فصل الديناميكيات الزمنية عن ترتيب العناصر عبر وحدتين متكاملتين: وحدة زمنية كبرى مخصصة للأنماط الزمنية الواسعة، ووحدة تسلسلية دقيقة ذات بوابة زمنية للتفاعلات المحلية الكثيفة.

Pengfei Jia, Jingjian Wang, Jingmao Li, Ge Zhang, Feng Shi2026-08-18