💬 NLP

FACTWASH: Catching AI Rewrites That Wash Hearsay into Fact

تقدم الورقة البحثية FACTWASH، وهو بوابة مفتوحة المصدر تعمل في وقت الكتابة وتكتشف بشكل حتمي "غسيل الحقائق" (factwashing) — أي فقدان القابلية للتحقق عندما تعيد نماذج الذكاء الاصطناعي صياغة الأقاويل لتظهر كحقائق — من خلال الجمع بين الفحوصات القائمة على القواعد للنفي الصريح مع "شاهد" (witness) مستهدف يعتمد على النماذج اللغوية الكبيرة للكشف عن التحوط والإسناد، مما يكشف عن انتشار مثل هذه الأخطاء في أنظمة الذاكرة الحوارية بينما تندر في رسائل البريد الإلكتروني للأعمال.

Alex Kwon2026-08-05
💻 computer science

MMLongBench-Doc-V2: A Corrected-Annotation, Semantics-Aware Revision of MMLongBench-Doc

تعد MMLongBench-Doc-V2 مراجعة مصححة وواعية دلالياً لـ MMLongBench-Doc، حيث قامت بتصحيح 106 من تعليقات الحقائق الأرضية، واستبدلت مقاييس مطابقة النصوص بمُحكّم يعتمد على النماذج اللغوية الكبيرة، وأزالت العينات غير الصالحة لتوفير إطار تقييم أكثر موثوقية للأسئلة والأجوبة المتعلقة بالوثائق الطويلة.

Mingtian Zhang2026-08-05
💻 computer science

Towards Robust Tool Use in Agents via Experience-Driven Adaptive Guidance

تقدم الورقة البحثية ExpG، وهي آلية توجيه تكيفية قائمة على الخبرة تعزز متانة الوكيل في استخدام الأدوات من خلال اكتساب واستخلاص وإعادة استخدام الخبرات المهيكلة من عمليات التنفيذ التاريخية، مما يمكّن النماذج الأصغر من التفوق على النماذج الأكبر عبر مهام متنوعة.

Can Wang, Haoran Chen, Li Yu, Ding Hao, Bohai Zhao, Zhaoyang Liu, Zhiying Tu2026-08-05
🤖 machine learning

AI World Cup 2026: Benchmarking Large Language Models for End-to-End Football Tournament Prediction

تقدم هذه الورقة البحثية معيار "كأس العالم للذكاء الاصطناعي"، وهو تقييم معياري حيث قامت عشرة نماذج لغوية كبيرة بالتنبؤ بكأس العالم 2026 بالكامل تحت ظروف متطابقة، مما كشف أن نموذج GPT-5.5 Thinking تفوق على الآخرين بشكل أساسسب بسبب تفوق تنبؤاته في الأدوار الإقصائية، وأن نجاح التنبؤ على مستوى البطولة يختلف اختلافاً جوهرياً عن الدقة على مستوى المباريات الفردية.

Jonaid Shianifar, Iias Faiud2026-08-05
💻 computer science

Towards Improving Sequential Decision-Making in LLM Agents via Experience Memory

تتقصى هذه الورقة الأداء دون الأمثل للنماذج اللغوية الكبيرة في مهام اتخاذ القرار المتسلسلة مثل الألعاب صفرية المجموع، وتقترح إطار عمل وكيلّي مع ذاكرة خبرة يستفيد من التأمل ما بعد اللعبة واستخراج القواعد لتحسين اللعب الاستراتيجي دون تعديل أوزان النموذج.

Jakub Rada (AI Center, Department of Computer Science, Faculty of Electrical Engineering, Czech Technical University in (…)2026-08-05
💻 computer science

OliveGemma: A 3 Billion Visual Language Model for Recognising the Mediterranean & European Diet

تقدم هذه الورقة البحثية نموذج OliveGemma، وهو نموذج لغوي بصري يتكون من 3 مليارات معلمة، تم ضبطه بدقة على مجموعة بيانات غذائية أوروبية موحدة، ويحقق دقة فائقة في التعرف على الأطبى والوجبات المتوسطية والأوروبية ومكوناتها، متفوقاً بذلك على كل من النماذج المرجعية التقليدية القائمة على الشبكات العصبية الالتفافية (CNN) والنماذح الرائدة الضخمة المملوكة لجهات أخرى بشكل ملحوظ.

Dimitrios I. Zaridis, Traianos Tsiokris, Vasileios C. Pezoulas, Daphni Plati, Eugenia Mylona, Eleni Georga, Nikos Tsikna (…)2026-08-05
💻 computer science

A Low-Cost Hybrid Reservoir Computing Model for Isolated Sign Language Video Recognition

تقترح هذه الورقة نموذج حوسبة خزان هجين وخفيف الوزن يجمع بين استخراج النقاط المفتاحية عبر MediaPipe والخزانات العميقة وثنائية الاتجاه لتحقيق دقة تنافسية في التعرف على لغة الإشارة المعزولة على مجموعة بيانات WLASL100، مع تقليل وقت التدريب والتكلفة الحسابية بشكل جذري من أجل النشر على الأجهزة الطرفية.

Nitin Kumar Singh, Arie Rachmad Syulistyo, Yuichiro Tanaka, Hakaru Tamukoh2026-08-05
🤖 machine learning

Approximate Speculative Decoding

تقدم هذه الورقة البحثية "فك التشفير التخميني التقريبي" (ASD)، وهي طريقة لا تتطلب تدريباً تعمل على تسريع التوليد ذاتي الانحدار من خلال القبول الانتقائي لعدم تطابق رموز المسودة بناءً على ميزانية الندم لإعادة استخدام اللاحقات الصالحة، مما يؤدي إلى تحسين معدل الإنتاجية دون الحاجة إلى نماذج مسودة جديدة أو ضبط دقيق.

Yuannuo Feng, Zegang Peng, Yuxin Xie, Yubing Ye, Yizhe Chen, Wenshuai Yao, Wenyong Zhou, Wang Kang2026-08-05
💬 NLP

Balancing Efficiency and Efficacy: Training-Free Attention-Guided Switching Between Explicit and Latent Thoughts for MLLMs

تقدم هذه الورقة استراتيجية التبديل الموجه بالانتباه (AGS)، وهي استراتيجية استنتاج خالية من التدريب للنماذج اللغوية الكبيرة متعددة الوسائط، تعمل ديناميكيًا على موازنة الكفاءة والدقة باستخدام نسبة انتباه الرؤية إلى النص لتفعيل الاستدلال الكامن بشكل انتقائي للمهام الإدراكية مع فرض توليد نصي صريح للاستنتاج المنطقي.

Haoqian Kang, Liupeng Li, Kuofeng Gao, Jinpeng Wang, Zhenyu Lu, Bin Chen, Ke Chen, Yaowei Wang2026-08-05
💻 computer science

DataSpace: Benchmarking Data Agents for Verifiable Analytics over Heterogeneous Workspaces

تقدم هذه الورقة DataSpace، وهو معيار شامل وإطار تقييم لمسابقة KDD Cup 2026 مصمم لتقييم قدرة وكلاء البيانات على توليد نتائج جدولية قابلة للتحقق من مساحات عمل متباينة ومتعددة الوسائط، مما يكشف عن فجوات أداء كبيرة في دمج الأدلة متعددة الوسائط والتأثير الجوهري لخيارات تسخير الوكيل على الموثوقية.

Boyan Li, Zhuowen Liang, Yupeng Xie, Xiaotian Lin, Tianqi Luo, Xinyu Liu, Yizhang Zhu, Zhangyang Peng, Yuan Li, Zhengxua (…)2026-08-05