💬 NLP

When Iterative RAG Beats Ideal Evidence: A Diagnostic Study in Scientific Multi-hop Question Answering

تقدم هذه الورقة دراسة تشخيصية تُظهر أن إطار عمل استرجاع معزز توليدي (RAG) تكراري وخالٍ من التدريب، والذي يتبادل بين الاسترجاع والاستدلال، يتفوق باستمرار على نموذج (RAG) "السياق الذهبي" الاستاتيكي المثالي في مهام الأسئلة والأجوبة العلمية متعددة الخطوات، وذلك عبر التصحيح الديناميكي لانحراف الفرضيات والتخفيف من فرط حمولة السياق، حتى عند تزويده بأدلة مثالية.

Mahdi Astaraki, Mohammad Arshi Saloot, Ali Shiraee Kasmaee, Hamidreza Mahyar, Soheila Samiee2026-05-06
🤖 machine learning

Do Not Waste Your Rollouts: Recycling Search Experience for Efficient Test-Time Scaling

تقدم هذه الورقة البحثية "إعادة تدوير تجربة البحث" (RSE)، وهي استراتيجية لا تتطلب تدريباً تعمل على تعزيز التوسع في وقت الاختبار من خلال تقطير وإعادة استخدام الرؤى الوسيطة من عمليات التدحرج الفاشلة والناجحة للقضاء على التكرار الحسابي وتحسين كفاءة الاستدلال في المهام المعقدة.

Xinglin Wang, Jiayi Shi, Shaoxiong Feng, Peiwen Yuan, Yiwei Li, Yueqi Zhang, Chuyi Tan, Ji Zhang, Boyuan Pan, Yao Hu, Ka (…)2026-05-06
💬 NLP

CoFrGeNet: Continued Fraction Architectures for Language Generation

تقدم هذه الورقة البحثية CoFrGeNets، وهي عائلة معمارية مبتكرة مستوحاة من الكسور المستمرة تستبدل مكونات المحولات (Transformer) القياسية ببدائل كفؤة من حيث المعلمات، محققةً أداءً تنافسيًا أو متفوقًا في النماذج اللغوية واسعة النطاق بعدد أقل بكثير من المعلمات وأوقات تدريب مسبق أقصر.

Amit Dhurandhar, Vijil Chenthamarakshan, Dennis Wei, Tejaswini Pedapati, Karthikeyan Natesan Ramamurthy, Rahul Nair2026-05-06
🤖 machine learning

Stochastic Attention: Connectome-Inspired Randomized Routing for Expressive Linear-Time Attention

مستوحاةً من المخطط العصبي لذبابة الفاكهة، تقترح هذه الورقة "الانتباه العشوائي" (Stochastic Attention)، وهو آلية توجيه عشوائية تعزز انتباه النافذة المنزلقة لتحقيق مجالات استقبال عالمية بعمق لوغاريتمي مع الحفاظ على تعقيد زمني خطي، مما يظهر أداءً فائقاً في كل من سيناريوهات ما قبل التدريب والاستدلال الخالي من التدريب.

Zehao Jin, Yanan Sui2026-05-06
💬 NLP

SCARV: Structure-Constrained Aggregation for Stable Sample Ranking in Redundant NLP Datasets

تقدم الورقة البحثية SCARV، وهو إطار عمل معياري يعمل على تحسين استقرار وقابلية تكرار التصنيفات على مستوى العينات في مجموعات بيانات معالجة اللغات الطبيعية الفائضة عن الحاجة، وذلك عبر الجمع بين التجميع القوي متعدد البذور والمعالجة المدركة للبنية لمجموعات التكرار.

Xu Zheng, Feiyu Wu, Linhong Wu, Zhuocheng Wang, Hui Li2026-05-06
💬 NLP

MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audio

تقدم هذه المساهمة MedMosaic، وهو مجموعة بيانات مرجعية واسعة النطاق تضم 46,701 زوجاً متنوعاً من الأسئلة والأجوبة الصوتية الطبية المصممة لتقييم وكشف القيود الكبيرة في الاستنتاج لدى النماذج الحالية متعددة الوسائط ذات الأداء العالي في السيناريوهات السريرية الواقعية.

Harshit Rajgarhia, Shuubham Ojha, Asif Shaik, Akhil Pothanapalli, Rachuri Lokesh, Abhishek Mukherji, Prasanna Desikan2026-05-06
💬 NLP

LLM Ghostbusters: Surgical Hallucination Suppression via Adaptive Unlearning

تقدم هذه المساهمة "التعلم غير المتكيف" (Adaptive Unlearning - AU)، وهو إطار عمل لما بعد النشر يعمل على كبح الهلوسات في النماذج اللغوية الكبيرة جراحياً — لا سيما في توليد الأكواد البرمجية، حيث تُمكّن هجمات "الاستيلاء عبر الحشو" (Slopsquatting) — من خلال هدف هجين على مستوى الرموز (token-level) وحلقة اكتشاف تكيفية، مما يقلل معدل الهلوسة بنسبة 81% دون الحاجة إلى تعليق بشري أو إعادة تدريب كاملة للنموذج.

Joseph Spracklen, Pedram Aghazadeh, Farinaz Koushanfar, Murtuza Jadliwala2026-05-06
💬 NLP

RECAP: An End-to-End Platform for Capturing, Replaying, and Analyzing AI-Assisted Programming Interactions

تقدم الورقة البحثية منصة RECAP، وهي منصة مفتوحة المصدر تلتقط وتوحد جلسات الدردشة مع الذكاء الاصطماعي بشكل سلبي مع تعديلات دقيقة على الكود البرمجي لتمكين إعادة التشغيل التفاعلي والتحليل المتقدم لأنماط التفاعل بين المطور والذكاء الاصطناعي، كما تم التحقق من ذلك من خلال عملية نشر شملت 41 طالباً.

Keyu He, Qianou Ma, Valerie Chen, Wayne Chi, Tongshuang Wu2026-05-06
🤖 AI

Arithmetic in the Wild: Llama uses Base-10 Addition to Reason About Cyclic Concepts

تكشف هذه الورقة أن نموذج Llama-3.1-8B يستنتج المفاهيم الدورية ليس عبر إجراء عمليات حسابية معيارية خاصة بفترة المفهوم، بل من خلال إعادة استخدام آلية جمع عشري (أساس 10) غير مرتبطة بمهمة محددة، مدفوعة بخصائص فوريه ومجموعة متفرقة من عصبونات الـ MLP المشتركة لحساب المجاميع قبل إعادة رسم خرائطها إلى النطاق الدوري.

Sheridan Feucht, Tal Haklay, Usha Bhalla, Daniel Wurgaft, Can Rager, Raphaël Sarfati, Jack Merullo, Thomas McGrath, Owen (…)2026-05-06
💬 NLP

Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation

تقدم الورقة البحثية "سلسلة الأدلة" (Chain of Evidence - CoE)، وهو إطار عمل غير مرتبط بنوع محدد من أدوات الاسترجاع، يستفيد من نماذج الرؤية واللغة لتمكين الإسناد البصري على مستوى البكسل في عملية التوليد المعزز بالاسترجاع التكراري، مما يتغلب على قيود التحليل النصي فقط عبر التفكير المباشر في لقطات الشاشة للمستندات لتوفير استشهادات دقيقة لمربعات الإحاطة والحفاظ على معلومات التخطيط البصري الأساسية.

Peiyang Liu, Ziqiang Cui, Xi Wang, Di Liang, Wei Ye2026-05-06