🤖 AI

CallBench: A Benchmark for Dual-Goal Coordination in Phone Call Assistants

تقدم هذه الورقة CallBench، وهو معيار مرجعي صيني شامل يتكون من 50,000 حوار متعدد الجولات عبر ستة سيناريوهات لتقييم قدرات تنسيق الأهداف المزدوجة الصعبة لمساعدي المكالمات الهاتفية، مما يكشف أن الأساليب الحالية تواجه صعوبة في الموازنة بفعالية بين أهداف مالك الجهاز الصريحة والمحددة مسبقاً وبين أهداف المتصل الضمنية والديناميكية.

Xuzhao Geng, Haozhao Wang, Xuelian Li, Zhenyu Yang, Haonan Lu, Rui Zhang, Ruixuan Li2026-07-28
🤖 AI

Answering Path Queries under Linear and Guarded Existential Rules

تحدد هذه الورقة تعقيد البيانات والتعقيد المشترك للإجابة على استعلامات المسار المنتظم ثنائية الاتجاه عبر قواعد المعرفة المعرفة بقواعد وجودية خطية ومحمية، مما يثبت أن هذه المهام تطابق ملفات التعقيد الخاصة بالاستعلامات الاندماجية القياسية، وفي الحالة الخطية، استعلامات قواعد بيانات الرسوم البياسية العادية.

Jean-François Baget, Meghyn Bienvenu, Marie-Laure Mugnier, Michaël Thomazo2026-07-28
🤖 machine learning

AI-Assisted Causal Inference and Mediation Analyses of Environmental and Psychosocial Determinants of Subjective Cognitive Difficulties in the All of Us Research Program

باستخدام بيانات طولية من برنامج "All of Us" البحثي وتقنيات التعلم الآلي، تجد هذه الدراسة أنه في حين تظهر التعرضات البيئية قصيرة المدى ارتباطات محدودة بصعوبات الإدراك الذاتي بعد مراعاة التباين داخل الموقع الواحد، فإن العوامل النفسية والاجتماعية مثل عبء الصحة العقلية، والوحدة، والأداء الاجتماعي، ترتبط بشكل ثابت وأقوى بهذه النتائج الإدراكية.

Cong Cao, Shuangge Ma2026-07-28
🤖 machine learning

AutoCluster, AutoTopicModeling, AutoTrendAnalysis: A Complete AutoML Pipeline for Predicting Emerging Trends

تقدم هذه الورقة AutoCluster وAutoTopicModeling وAutoTrendAnalysis، وهي عبارة عن مسار عمل شامل للتعلم الآلي المؤتمت (AutoML) يعمل على أتمتة عمليات التجميع، ونمذجة المواضيع، والتنبؤ بالسلاسل الزمنية للبيانات النصية للتنبؤ بالاتجاهات الناشئة بدقة وبأقل قدر من التدخل اليدوي.

Ahmed Abolfadl, Marwa Mahmoud Abla, Mervat Abu-Elkheir, Maggie Mashaly2026-07-28
💬 NLP

CRAFT: Learn the Schema, Execute the Plan

يُعد CRAFT إطار عمل لتدريب ما بعد المعالجة يتكون من مرحلتين لوكلاء البرمجة في المؤسسات، حيث يتعلم سلوكيات التخطيط والتنفيذ القائمة على المخططات (schema-grounded) دون الحاجة إلى حقن المخططات بشكل شامل أثناء وقت التلقين، مما يحسن الأداء التحليلي والاتساق والكفاءة بشكل كبير مع تقليل العبء الإضافي للرموز (token overhead).

Aakash Kolekar, Sahika Genc, Shahriar Shariat, Bunyamin Sisman, Tibor Mezi, Barbara Poblete, Shree Vandana Kachroo, Calv (…)2026-07-28
🤖 AI

Reason Before You Retrieve: Agentic Planning for Multi-modal RAG

تقترح الورقة البحثية إطار عمل MM-R2، وهو إطار عمل وكيل متعدد الوسائط يعمل على تحسين التوليد المعزز بالاسترجاع من خلال التفكير الصريح في أهداف الاسترجاع وهيكلة فضاء البحث عبر خريطة معرفية (KnowledgeMap)، مدعوماً بمجموعة بيانات مسار جديدة واستراتيجية تدريب لاحق على مرحلتين لتحقيق دقة وقابلية تفسير فائقتين في مجموعات البيانات المرجعية.

Tianyu Yang, Shir Simon, Zhenzhen Li, Minhao Cheng, Xiangliang Zhang2026-07-28
🤖 machine learning

DocHRL: A Hierarchical Reinforcement Learning Framework for Cost-Optimised Document Classification

يُعد DocHRL إطار عمل للتعلم التعزيزي الهرمي يقوم باختيار سياسة التصنيف الأكثر فعالية من حيث التكلفة لكل مستند ديناميكيًا عبر الموازنة بين تكاليف الاستدلال، والتصنيف الخاطئ، والمراجعة البشرية، محققًا أداءً فائقًا وكفاءة تشغيلية على معيار RVL-CDIP مقارنة بمسارات العمل الثابتة.

Mohammed Yousif, Prabhjot Singh, Arjun Pankajakshan, Madhu Reddiboina2026-07-28
🤖 machine learning

Extracting Algorithms in Pre-trained LLMs: A Case on Hidden Markov Models

تجسّر هذه الورقة الفجوة بين أداء التعلم داخل السياق للنماذج اللغوية الكبيرة مسبقة التدريب على نماذج ماركوف الخفية وآلياتها الداخلية من خلال التضييق التجريبي للمرشحات الخوارزمية، والتحقق النظري من تنفيذها عبر بنية المحولات (Transformer)، وتقديم مسبار التنشيطات الرئيسية لتحديد والتلاعب سببيًا بالتمثيلات الخطية منخفضة الأبعاد التي تقود هذه التنبؤات.

Yijia Dai, Zhaolin Gao, Yahya Sattar, Jennifer J. Sun, Sarah Dean2026-07-28
🤖 AI

PTStore (Prefix Tensor Store): Distributed Prefix Caching and Replication for High Throughput Inference Serving

إن PTStore هو نظام موزع مستوحى من تخزين الشبكات لتوصيل المحتوى (CDN) يقوم بتكرار بادئات ذاكرة التخزين المؤقت (KV cache prefixes) الشائعة عبر العقد لتقليل زمن انتقال الاستدلال، وموازنة أحمال الخوادم، وتمكين التوسع الهائل في الذاكرة، مما يؤدي إلى كفاءة أعلى بمقدار 5-6 مرات لاستدلال النماذج اللغوية الكبيرة ذات السياق الطويل مقارنة بالنماذج المرجعية الحالية.

Meghana Maghyastha, Robert Underwood, Randal Burns, Bogdan Nicolae2026-07-28
🤖 AI

Do Language Models Converge to Themselves? Recursive Self-Refinement as Textual Relaxation

تُثبت هذه الورقة أن التحسين الذاتي المتكرر في النماذج اللغوية الكبيرة يعمل كعملية ديناميكية حيث يتقارب النص بسرعة نحو توازن مستقر يفضله النموذج، ويتميز بتضاؤل أسي في مقدار التعديل، بدلاً من الخضوع لعملية تحسين غير محدودة.

Xuening Wu, Qianya Xu, Yanlan Kang, Zeping Chen, Yubin Liu, Shenqin Yin2026-07-28