💬 NLP

The Effect of Document Selection on Query-focused Text Analysis

تقيم هذه الورقة بشكل منهجي سبع طرق لاختيار المستندات عبر أربع تقنيات لتحليل النصوص ومجموعتي بيانات، مما يثبت أن استراتيجيات الاسترجاع الدلالي أو الهجين توفر التوازن الأكثر فعالية بين الأداء والكفاءة مع ترسيخ اختيار البيانات كقرار منهجي حاسم.

Sandesh S Rangreji, Mian Zhong, Anjalie Field2026-04-15
🤖 AI

Long-Horizon Plan Execution in Large Tool Spaces through Entropy-Guided Branching

تقدم هذه الورقة SLATE، وهو معيار واسع النطاق لتقييم الوكلاء المعززين بالأدوات، وتقترح التفرع الموجه بالإنتروبيا (Entropy-Guided Branching)، وهو خوارزمية بحث مدركة لعدم اليقين تعمل على تحسين كفاءة تنفيذ المهام طويلة الأمد ومعدلات النجاح بشكل كبير في مساحات الأدوات الضخمة.

Rongzhe Wei, Ge Shi, Min Cheng, Na Zhang, Pan Li, Sarthak Ghosh, Vaibhav Gorde, Leman Akoglu2026-04-15
💬 NLP

When Self-Reference Fails to Close: Matrix-Level Dynamics in Large Language Models

تُثبت هذه الورقة أنه بينما يظل الإحالة الذاتية المرتكزة مستقرة في النماذج اللغوية الكبيرة، فإن المحفزات التي تستحث التكرار الحقيقي غير المغلق (NCTR) تسبب اضطرابات داخلية كبيرة على مستوى المصفوفات — مثل ارتفاع الرتبة الفعالة للانتباه وتفرط التباين — عبر بنيات وطبقات متعددة، مما يؤدي إلى زيادة التناقضات في المخرجات ويشير إلى وجود صلة بمشكلات عدم استقرار شبه زمرة المصفوفات الكلاسيكية.

Ji Ho Bae2026-04-15
🤖 AI

Beyond Factual Grounding: The Case for Opinion-Aware Retrieval-Augmented Generation

تحدد هذه الورقة التحيز الواقعي في أنظمة التوليد المعزز بالاسترجاع الحالية التي تعامل الآراء الذاتية كضجيج، وتقترح إطاراً نظرياً يميز بين اليقين الإبستيمي (المعرفي) واليقين الأليتوري (العشوائي) لتبرير الحفاظ على تنوع الآراء، وتقدم بنية "RAG" الواعية بالرأي التي تحسن بشكل كبير تنوع الاسترجاع والتمثيل الديموغرافي في بيانات التجارة الإلكترونية.

Aditya Agrawal, Alwarappan Nakkiran, Darshan Fofadiya, Alex Karlsson, Harsha Aduri2026-04-15
💬 NLP

From Plan to Action: How Well Do Agents Follow the Plan?

تقدم هذه الورقة تحليلاً منهجياً لـ 16,991 مساراً للوكلاء يكشف أنه بينما تعمل الخطط الصريحة عموماً على تحسين النجاح في المهام، إلا أن الوكلاء غالباً ما يفشلون في اتباعها بسبب الاعتماد على سير عمل داخلي مفرط في التخصيص، وأن الخطط سيئة التصميم أو غير المتوافقة يمكن أن تؤدي في الواقع إلى تدهور الأداء، مما يسلط الضيأ على الحاجة إلى نماذج تدريب تعلم الاستدلال التكيفي بدلاً من حفظ الخطط.

Shuyang Liu, Saman Dehghan, Jatin Ganhotra, Martin Hirzel, Reyhaneh Jabbarvand2026-04-15
💬 NLP

AlphaEval: Evaluating Agents in Production

تقدم هذه الورقة AlphaEval، وهو معيار مرجعي قائم على بيئة الإنتاج يضم 94 مهمة من واقع العمل في سبع شركات، لتقييم أنظمة وكلاء الذكاء الاصطناًعي الكاملة باستخدام إطار عمل مبتكر يحول المتطلبات الحقيقية إلى تقييمات قابلة للتنفيذ، مما يعالج الفجوة بين المعايير المرجعية الحالية التي تركز على النماذج وبين الواقع المعقد والديناميكي للنشر التجاري.

Pengrui Lu, Bingyu Xu, Wenjun Zhang, Shengjia Hua, Xuanjian Gao, Ranxiang Ge, Lyumanshan Ye, Linxuan Wu, Yiran Li, Junfe (…)2026-04-15
💬 NLP

Knowledge Is Not Static: Order-Aware Hypergraph RAG for Language Models

تقترح الورقة البحثية نظام "توليد معزز بالاسترجاع ذو هايبرغراف معرفي مدرك للترتيب" (OKH-RAG)، وهو إطار عمل جديد للتوليد المعزز بالاسترجاع يعمل على نمذجة المعرفة كحواف فائقة (hyperedges) مرتبة لالتقاط التبعيات التسلسلية، مما يجعله يتفوق على الطرق التقليدية غير المتغيرة بالتبديل في مهام الاستدلال الحساسة للترتيب.

Keshu Wu, Chenchen Kuai, Zihao Li, Jiwan Jiang, Shiyu Shen, Shian Wang, Chan-Wei Hu, Zhengzhong Tu, Yang Zhou2026-04-15
💬 NLP

Representing expertise accelerates learning from pedagogical interaction data

تُظهر هذه الدراسة أن تدريب نماذج المحولات (transformer models) على تفاعلات تربوية اصطناعية، بدلاً من الاكتفاء بالعروض التوضيحية من الخبراء، يُحسّن بشكل كبير من متانة التعلم ويُمكّن النماذج من إظهار سلوك شبيه بسلوك الخبراء من خلال السماح للنماذج بتمثيل وكلاء متميزين معرفياً.

Dhara Yu, Karthikeya Kaushik, Bill D. Thompson2026-04-15
💬 NLP

Thought-Retriever: Don't Just Retrieve Raw Data, Retrieve Thoughts for Memory-Augmented Agentic Systems

تقدم الورقة البحثية "Thought-Retriever"، وهو خوارزمية مستقلة عن النموذج تعمل على تعزيز الوكلاء القائمين على النماذج اللغوية الكبيرة (LLMs) من خلال استرجام وتنظيم خطوات الاستدلال الوسيطة ("الأفكار") من التفاعلات السابقة في ذاكرة طويلة الأمد ذاتية التطور، مما يتغلب على قيود طول السياق ويتفوق بشكل كبير على الأساليب الحالية لتعزيز الاسترجاء في المهام التي تتطلب فهمًا للسياقات فائقة الطول.

Tao Feng, Pengrui Han, Guanyu Lin, Ge Liu, Jiaxuan You2026-04-15
💬 NLP

Coding-Free and Privacy-Preserving MCP Framework for Clinical Agentic Research Intelligence System

تقدم الورقة البحثية إطار عمل CARIS، وهو إطار عمل للذكاء الاصطناعي الوكيل (agentic AI) خالٍ من البرمجة ويحافظ على الخصوصية، يستفيد من النماذج اللغوية الكبيرة وبروتوكول سياق النموذج لأتمتة سير عمل الأبحاث السريرية بالكامل — بدءًا من تصميم الدراسة وبناء المجموعات وصولًا إلى تطوير النماذج وإعداد التقارير — دون مطالبة المستخدمين بالوصول إلى بيانات المرضى الخام أو امتلاك مهارات البرمجة.

Taehun Kim, Hyeryun Park, Hyeonhoon Lee, Yushin Lee, Kyungsang Kim, Hyung-Chul Lee2026-04-15