🤖 AI

Static Pruning Across Sparse Retrieval Regimes: What Transfers, What Breaks, and What Still Helps

تقدم هذه الورقة أول دراسة عبر المحركات تثبت أنه في حين أن التقليم الساكن من جانب الفهرس يقلل باستمرار من زمن الاستجابة والحجم عبر أنظمة استرجاع متباعدة متنوعة، فإن تقليم الاستعلام غالباً ما يكون فائضاً عن الحاجة في المحركات الحديثة، ويمكن للممارسين الجمع بأمان بين التقليم الساكن والديناميكي لتحقيق تسريع كبير دون تدهور جودة التصنيف حتى عتبة محددة لـ Recall@10.

Zirui Song, Yuye Zhu, Yang Yang2026-08-18
🤖 AI

Revisiting the Performance of Generative Artificial Intelligence on Introductory Object-Oriented Programming Assessments: Insights from 2026

تقيم هذه الدراسة لعام 2026 خمسة أنظمة متقدمة للذكاء الاصطناعي التوليدي في تقييمات مقدمة في البرمجة كائنية التوجه، حيث وجدت أنه بينما تتفوق هذه الأنظمة عمومًا على الطلاب المتوسطين وتظهر تحسنًا ملحوظًا عن العام السابق، إلا أنها لا تزال تواجه صعوبات في مفاهيم متقدمة محددة مثل الواجهات (interfaces) والأصناف المجردة (abstract classes)، بالإضافة إلى المهام المتعلقة بالرسومات.

Marina Lepp, Joosep Kaimre2026-08-18
🤖 AI

Step-Level On-Policy Distillation: Interpolating Between On-Policy Distillation and Supervised Fine-Tuning

تقترح الورقة البحثية تقنية التقطير في الموقع على مستوى الخطوة (SOPD)، وهي طريقة مبتكرة تدمج بين الضبط الدقيق الخاضع للإشراف والتقطير في الموقع لتوفير تصحيحات كاملة على مستوى الخطوة للمسارات التي يولدها الطالب، مما يؤدي إلى تفوقها بشكل كبير على كلا النهجين التقليديين في مهام الاستنتاج والوكلاء.

Changhui Sun, Lanbo Liu, Hang Lei, Tong Ling, Jiahang Xie, Zhiyong Zheng, Yujia Wang, Hao Liu, Feng Xiao, Lu Liu, Yanlon (…)2026-08-18
🤖 AI

HalluTracer: Hallucination Detection via Depth-Averaging Truth Signals

يعتبر HalluTracer إطار عمل للكشف عن الهلوسة بنظام الصندوق الأبيض، وهو يعمل على تحسين الدقة من خلال تجميع إشارات الصدق عبر جميع طبقات المحولات (transformer layers) عبر عملية متوسط عمق بسيطة، مما يتغلب بذلك على فقدان المعلومات في الأساليب الحالية التي تعتمد على طبقات أو مكونات معزولة.

Zhihao Guo, Zonghan Wu, Huan Huo, DaYong Ye, Junwei Zhang, Weiran Yao, Zhiwei Liu, Qingsong Wen, Yilei Shao2026-08-18
🤖 AI

MELD: A Protocol for Merging Knowledge Across Distributed Agentic Memories

تقدم الورقة البحثية بروتوكول MELD، وهو بروتوكول ذاتي الإدارة يُمكّن الوكلاء المستقلين الموزعين من التوفيق بين رسومهم البيانية للمعرفة ودمجها من خلال رقع برمجية قابلة للتدقيق وتتبع حالة قائم على هياكل البيانات المتكررة والكونية (CRDT)، محققاً استدعاءً عالياً وكفاءة في التخزين مع الحفاظ على التناقضات من أجل التسوية اللاحقة دون وجود منسق مركزي.

Lauri Lovén, Jaakko Sauvola, Jukka Riekki, Sasu Tarkoma2026-08-18
🤖 machine learning

OceanDepths: A Global Dataset of Paired Subsurface and Surface Ocean Observations

تقدم هذه الورقة OceanDepths، وهي أول مجموعة بيانات مفتوحة وعالمية وجاهزة للذكاء الاصطناعي تجمع بين حقول سطح المحيط عالية الدقة المستمدة من الأقمار الصناعية (درجة حرارة سطح البحر، وملوحة سطح البحر، وارتفاع مستوى سطح البحر) مع مقاطع لدرجة الحرارة والملوحة تحت السطحية من الموقع نفسه من عام 2000 إلى 2024، لتمكين الأبحاث المتقدمة في تعلم الآلة حول ديناميكيات المحيطات وإعادة بناء الحالة.

Simon Donike, Ruben Cartuyvels, Antonino Ian Ferola, Elisa Carli, Diego Fernandez Prieto, Marie-Helene Rio2026-08-18
🤖 AI

Adaptive Post-Processing Drives Instance-Level Detection in Stroke Lesion Segmentation

تُثبت هذه الورقة أن مخطط المعالجة اللاحقة التكيفي المشروط بالحجم (VCAP)، والذي يضبط عتبات اكتشاف الآفات ديناميكيًا بناءً على العبء المتوقع، يتفوق بشكل كبير على الابتكارات الهيكلية في تحسين مقاييس اكتشاف آفات السكتة الدماغية على مستوى الحالة، محققًا درجة (Lesion-F1) تبلغ 0.614 مقارنة بـ 0.573 للنموذج المرجعي.

Qinghui Liu, Jon André Ottesen, Atle Bjørnerud, Kyrre Eeg Emblem2026-08-18
🤖 AI

Synthetic Data Augmentation for Satellite-Based Analysis of Battle-Damaged Agricultural Fields in Ukraine

تُثبت هذه الورقة أن تعزيز صور الأقمار الصناعية النادرة ببيانات اصطناعية ناتجة عن نماذج الانتشار الاحتمالية لإزالة الضجيج (DDPMs) يحسن بشكل كبير من دقة وأداء التوازن لمصنفات الرؤية الحاسوبية في اكتشاف الحقول الزراعية المتضررة من المعارك في أوكرانيا.

Marta Sumyk, Oleksandr Kosovan, Iryna Voitsitska2026-08-18
🤖 AI

Counting Documents Is Not Counting Text: Unit Bias in Web-PDF Corpus Statistics

تكشف هذه الورقة أن إحصائيات مجموعة بيانات الويب بصيغة PDF تعاني من "تحيز وحدة" كبير عبر الإبلاغ عن المقاييس لكل مستند بدلاً من كل رمز (token)، مما يحجب حقيقة أن جزءاً صغيراً من المستندات الكبيرة يحتوي على غالبية النص، وأن سياسات الاقتطاع الحالية تؤدي إلى فقدان أكثر من نصف المحتوى الإجمالي للمجموعة.

Luca Foppiano2026-08-18
🤖 AI

A Policy Algebra for Trust-Preserving Agentic AI Execution

تقدم هذه الورقة جَبْرًا سياساتيًا يحدد غلاف موثوقية يحافظ على الثقة للذكاء الاصطناعي الوكيل، وذلك عبر صياغة قيود أمنية والتزامات وقت التشغيل صياغةً تركيبية، مما يمكّن النظام من التدخل في جميع انتهاكات السياسة تقريبًا مع الحفاظ على معدلات عالية لإكمال المهام وضمان اكتمال التدقيق.

Bhaskar Tripathi, Anurag Kumar, Ramendra Kumar, Bhavesh Gadhe2026-08-18