💻 computer science

From Naive RAG to Deep Agentic Retrieval: An Evolving Context Engineering Pipeline for Regulatory Compliance

تُفصّل هذه الورقة تطور نظام استرجاع الامتثال التنظيمي في شركة "أونتاريو لتوليد الطاقة" من نظام استرجاع معزز بسيط (RAG) إلى بنية متطورة متعددة الوكلاء تُسمى "الاستحواذ التدريجي على الأدلة مع التصعيد الواعي بالتكلفة" (PEA-CAE)، مما يثبت أن هندسة السياق المتقدمة والاستحواذ التكيفي على الأدلة أكثر جدوى اقتصادية وفعالية من الضبط الدقيق المتخصص للمجال بالنسبة للمجموعات النصية الضخمة والمتطورة في المؤسسات.

Mishca de Costa, Muhammad Saleh Anwar, Dave Mercier, Issam Hammad2026-07-29
💻 computer science

Retrieval, not hallucinations, will be the limiting factor for LLM-based clinical AI tools

تجادل هذه الورقة بأن العائق الأساسي أمام أدوات الذكاء الاصطناعي السريرية القائمة على النماذج اللغوية الكبيرة ليس الهلوسة، بل الفشل في استرجاع بيانات مستوى المريض الضرورية بدقة، مما يستوجب تحول التركيز نحو تحسين الاستدعاء وتقييم الاسترجاع.

Kirk Roberts, Steven Bedrick, Kurt Miller, William R. Hersh, Hongfang Liu2026-07-29
🧬 biology

Reading Without a Reader: Large Language Models Collapse Reading and Writing into a Single Entangled Code

تُبين هذه الورقة أنه، على خلاف أنظمة القراءة والكتابة المنفصلة في الدماغ البشري، تعتمد النماذج اللغوية الكبيرة على آلية تراجعية ذاتية الانحدار واحدة ومتشابكة، حيث تظل رموز المدخلات والمخرجات مقترنة سلوكياً رغم التمايز التمثيلي الجزئي، مما يضع النماذج اللغوية الكبيرة كنوع متميز من العقل الذي شكلته القيود الثقافية بدلاً من القيود التطورية.

Diego Saldaña Ulloa2026-07-29
💻 computer science

Influence of Prompt Engineering on Small Language Models for Guarded Query Routing

تُثبت هذه الورقة أن تقنيات هندسة الأوامر، ولا سيما تحسين التعلم من أمثلة قليلة (few-shot optimization) وتوقيعات DSPy، تعزز بشكل كبير أداء توجيه الاستعلامات المحروسة للنماذج اللغوية الصغيرة المدمجة، مما يمكنها من الاقتراب من دقة النماذج الرائدة الأكبر حجماً مع الحفاظ على زمن استجابة منخفض.

Richard Šléher, William Brach, Kristián Košťál, Lukas Galke Poech2026-07-29
💻 computer science

SourceMinds at CheckThat! 2026: NLI-Grounded Citation Auditing in a Multi-Agent Pipeline for Full Fact-Checking Article Generation

تقدم هذه الورقة SourceMinds، وهو مسار عمل متعدد الوكلاء لمهمة CLEF 2026 CheckThat! Lab Task 3، يقوم بتوليد مقالات تدقيق حقائق مستندة إلى المصادر من خلال دمج الاسترجاع الكثيف للأدلة، والتخطيط الهيكلي، والنقد الذاتي المبوّب، وتدقيق الاستشهاد القائم على الاستدلال اللغوي الطبيعي (NLI).

Farhan Sharukh Hasan, Anirban Saha Anik, Eric Liu, Xiaoying Song, Mohotarema Rashid, Lingzi Hong2026-07-29
💻 computer science

SciClaimSeekers at CheckThat! 2026: Retrieving Scientific Sources for Social Media Claims with LLM Reranking

يعالج نظام SciClaimSeekers المعروض في هذه الورقة تحدي التحقق من الادعاءات العلمية على وسائل التواصل الاجتماعي من خلال توظيف مسار استرجاع هجين يجمع بين BM25 وMultilingual E5 مع تقنية دمج الرتب المتبادلة (Reciprocal Rank Fusion)، متبوعاً بإعادة ترتيب باستخدام نموذج Qwen2.5-14B-Instruct، والذي حقق معدل رتب متوسط (MRR@5) بنسبة 64.39% على مجموعة اختبار المهمة الأولى لـ CLEF-2026 CheckThat!، وأثبت أن مثل هذه المسارات المصممة بعناية يمكن أن تضاهي النهج القائمة على الضبط الدقيق.

Mohotarema Rashid, Nansu Baniya, Anirban Saha Anik, Xiaoying Song, Lingzi Hong2026-07-29
💻 computer science

Retrieval-Augmented Generation in LLMs for Mental Health: Quantifying the Incremental Contribution of Retrieval Within a Layered Safety Architecture

تُظهر هذه الدراسة أن دمج تقنية التوليد المعزز بالاسترجاع (RAG) في بنية سلامة متعددة الطبقات للتدخلات الرقمية في مجال الصحة النفسية يحسن بشكل كبير من دقة وحساسية اكتشاف النوايا في المواقف الحرجة، مثل إيذاء النفس، وذلك عبر الاستفادة من السياق المسترجع للحد من الهلوسة في النماذج اللغوية الكبيرة، رغم وجود مقايضة تتمثل في زيادة الإنذارات الكاذبة بما يتماشى مع مبادئ التصميم التي تضع السلامة أولاً.

Anand Gupta, Akshat Surolia, Shubham Mishra, Shakil Imtiaz, Chaitali Sinha2026-07-29
💬 NLP

Neuromorphic Diffusion Language Models: Addressing Compute and Memory Bottlenecks via Sparsity and Block Denoising

تقترح هذه الورقة نماذج لغوية ذات انتشار عصبي (N-MDLMs)، والتي تجمع بين الانتشار الكتلي والندرة القائمة على النبضات لتحسين إنتاجية الاستدلال وكفاءة الطاقة بشكل كبير من خلال تمكين توليد عدة رموز لكل عملية وصول إلى المعلمات مع تقليل الحوسبة الفعلية عبر تخطي القنوات غير النشطة.

Dengyu Wu, Clement Ruah, Jiechen Chen, Bipin Rajendran, Osvaldo Simeone2026-07-29
💬 NLP

Agent Retrieval Bench: Evaluating Repository Context Retrieval for Coding Agents

تقدم هذه الورقة "Agent Retrieval Bench"، وهو معيار شامل على مستوى الملفات لتقييم استرجاع السياق في وكلاء البرمجة باستخدام إشارات سير العمل الحقيقية، والذي يكشف أنه لا توجد طريقة استرجاع واحدة تهيمن عبر المهام المتنوعة، ويسلط الضل على فجوات كبيرة في قدرة الوكلاء الحاليين على تحديد ملفات المستودع الضرورية.

Bowen Qin, Yi Xie2026-07-29
💬 NLP

Beyond "What to Retrieve": Uncertainty in Retrieval-Augmented Code Generation

تقدم هذه الورقة OpenCoder، وهو إطار عمل مدرك لعدم اليقين يقوم بتقدير واستغلال عدم اليقين الخاص بالمصدر لتصفية وترتيب أدلة الاسترجاع غير المتجانسة، مما يحسن صحة توليد الكود على مستوى المستودع مع إثبات أن فوائده تعتمد على النموذج اللغوي الكبير الخلفي وتفاعلات الأدلة.

Chandan Kumar Sah, Xiaoli Lian, Li Zhang2026-07-29