🤖 machine learning

Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning

تقدم هذه الورقة "إعادة تشغيل النقاط الطرفية" (Endpoint Replay)، وهي طريقة تضغط ذاكرة إعادة تشغيل الخبرة عبر تخزين انتقالات ممثلة من نهايات المتواليات المتصلة ذات الخطوات-n، محققة أداءً مماثلاً للذاكرات الكبيرة التقليدية مع تقليل متطلبات التخزين بمقدار عشرة أضعاف.

Parham Mohammad Panahi, Armin Ashrafi, Haoyu Du, Andrew Patterson, Martha White, Adam White2026-07-29
💬 NLP

Deep Label-Wise Attentive Temporal Convolutional Networks Improve Medical Coding

تقترح هذه الورقة نموذجاً عصبياً عميقاً يجمع بين الشبكات التلافيفية الزمنية متعددة الطبقات والانتباه القائم على الملصقات لتحسين الترميز الطبي من خلال التقاط الاعتمادات طويلة المدى بفعالية والتركيز على الجوانب الخاصة بكل وثيقة لكل رمز، مما يؤدي إلى مكاسب كبيرة في درجات F-1 والاستدعاء مقارنة بالطرق السابقة التي تمثل أحدث ما توصل إليه العلم.

Muhammed Yavuz Nuzumlalı, Alexander Fabbri, Irene Li, Dragomir Radev2026-07-29
🤖 machine learning

Learning from 53.6K Real-World Developer Edits of AI-Generated Code

تقدم هذه الورقة DECODE، وهي مجموعة بيانات تضم 53,600 تعديل من واقع العمل داخل بيئات التطوير المتكاملة (IDE) لأكواد برمجية تم إنشاؤها بواسطة الذكاء الاصطناعي من أكثر من 1,000 مطور، والتي تكشف أن معظم التعديلات تحدث خلال 15 دقيقة من القبول وتثبت أن الضبط الدقيق للنماذج الأصغر على هذه البيانات يتفوق بشكل كبير على النماذج اللغوية الكبيرة الرائدة في التنبؤ بتعديلات الأكواد البرمجية.

Jenny T. Liang, Mihika Bairathi, Wayne Chi, Ameet Talwalkar, Nishant Subramani, Valerie Chen2026-07-29
🤖 AI

ScalableRAG: High-Quality RAG at Zero Ingestion Cost

تقدم الورقة البحثية ScalableRAG، وهو نهج توليد معزز بالاسترجاع عالي الجودة يحقق دقة فائقة عبر مجموعات بيانات متعددة بتكاليف استيعاب صفرية من خلال استخدام مساحة عمل ديناميكية للاستنتاج التجميعي الفوري، بينما يقدم أيضاً نسخة "الاستيعاب المحدود" التي تعزز الأداء بشكل أكبر على نطاق واسع مع حد أدنى من استخدام قاعدة بيانات المتجهات.

Hilaf Hasson, Aditya Chakravarty, Jayant Thomas, Krishna Gogineni2026-07-29
🔢 mathematics

A Riemannian View on Active Subspaces

تعمم هذه الورقة مفهوم الفضاءات الفرعية النشطة من الفضاء الإقليدي إلى المتشعبات الريمانية عبر استخدام النقل المتوازي لإنشاء إطار جوهري لتحليل الكميات القياسية محل الاهتمام، مبرهنةً على فعاليتها من خلال المقارنات النظرية والأمثلة العددية على الكرات الفائقة لتطبيقات في تحليل الشكل الإحصائي.

Zachary Grey2026-07-29
🤖 machine learning

CondPSE: A Polynomial-Filtered Structural Encoder with Conditional Modulation for Graphs

يُعد CondPSE مشفراً هيكلياً مُرشحاً بمتعدد حدود مُتعلماً يتفوق بشكل كبير على الأساليب الحالية في تمييز الرسوم البيانية غير المتماثلة بنيوياً عبر الاختبارات المعيارية الاصطناعية من خلال تعديل نمط FiLM، رغم أن تطبيقه المجمد لا يحقق سوى نتائج مماثلة، بدلاً من كونها متفوقة، في مهام التنبؤ بخصائص الجزيئات في العالم الحقيقي.

Woohyun Lee, Hogun Park2026-07-29
📊 statistics

Lloyd's KK-Means Clustering Algorithm Is Frank-Wolfe in Disguise

تثبت هذه الورقة أن خوارزمية "Lloyd's K-means" هي حالة خاصة من طريقة "Frank-Wolfe"، مما يستنتج معدل تقارب غير تقاربي قدره O(1/t)\mathcal{O}(1/t) إلى حد أدنى محلي لهدف مجموع مربعات الأخطاء، وتوسع هذا التحليل للتعامل مع المجموعات الفارغة عبر متغير شبه سلس.

Michael Pokojovy, J. Marcus Jobe, Simon Lacoste-Julien2026-07-29
🤖 machine learning

Rethinking CD: A Reproducibility Study and Extension on the Ineffectiveness of Contrastive Decoding at Mitigating Object Hallucinations in MLLMs

تعيد هذه الورقة إنتاج وتوسيع أبحاث سابقة لتثبت أن فك التشفير التبايني يفشل في الحد حقيقةً من هلاوس الكائنات في النماذج اللغوية الكبيرة متعددة الوسائط، حيث إن مكاسبه الظاهرية في الأداء على معايير مثل POPE غالباً ما تكون زائفة ولا تعكس تحسناً في التجذر البصري.

Arnav Bendre, Guneesh Gupta, Kavish Grover, Chayan Aggarwal, Shreyansh Modi2026-07-29
🤖 machine learning

Neurai-VN Benchmark: Standardized Machine Learning Models for Multimodal Digital Phenotyping in Mental Health Classification

تقدم هذه الورقة معيار Neurai-VN، وهو إطار عمل معياري يستخدم مجموعة بيانات متعددة الوسائط عالية الدقة من 100 بالغ فيتنامي لتقييم نماذج التعلم الآلي القابلة للتكرار لتصنيف حالات الصحة العقلية مثل الاكتئاب والقلق والاضطرابات السريرية.

Quoc-Cuong Pham, Hoang-Thuy-Duong Vu, Thi-Thanh-Huong Ha, Huy-Hieu Pham2026-07-29
📊 statistics

Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions

تقدم هذه الورقة البحثية LURE، وهي الطريقة الأولى للتعلم المعزز غير المتصل (offline reinforcement learning) مع وجود أفعال خفية، والتي تستفيد من متغيرات الحالة التالية كبدائل لتمكين تقدير قيمة السياسة بشكل قوي متعدد وصالح إحصائياً في عمليات ماركوف لاتخاذ القرار ذات الأفق اللانهائي.

Zeyu Bian, Ying Zhou, Yifan Cui2026-07-29