💬 NLP

An Evidence-Grounded Retrieval-Augmented Transformer Framework for Health Misinformation Verification

تقترح هذه الدراسة إطار عمل محول معزز بالاسترجاع للتحقق من المعلومات الصحية المضللة في نيجيريا باستخدام أدلة منظمة الصحة العالمية ومركز السيطرة على الأمراض والوقاية منها في نيجيريا، والذي حقق دقة بنسبة 71% باستخدام نموذج BERT مع تسليط الضوء على الحاجة الماسة لمصادر معرفية شاملة ومحددة السياق للتغلب على القيود في مستودعات الأدلة الحالية.

Isah M. Bukar, Bala Mairiga Abduljalil, Bashir Saleh Maina, Abdulbasit Hassan2026-08-04
💬 NLP

Can AI Agents Simulate A/B Test Outcomes? A Validation Framework for Agentic Experimentation

تقدم هذه الورقة إطار عمل للتجارب العشوائية المنضبطة المحاكية (S-RCT) يُمكّن وكلاء الذكاء الاصطناعي من التنبؤ بنتائج اختبارات (A/B) قبل النشر الفعلي، مُثبتةً من خلال التحقق من 67 اختباراً تسويقياً تاريخياً أن بروتوكول معايرة ثنائي المراحل وتصميم الاختبار داخل المجموعات (within-subject design) يمكنهما تقليل خطأ التنبؤ والأخطاء المعيارية بشكل كبير لتدقيق العلاجات المرشحة بدقة.

Stefan Hut, Lorenzo Masoero2026-08-04
🤖 machine learning

Qwen-CUA: Native Computer Use for (almost) Everything

تقدم الورقة البحثية Qwen-CUA، وهو وكيل استخدام حاسوب أصيل مبني على نموذج خليط من الخبراء (MoE) بحجم 397 مليار معلمة، يعمل حصرياً من خلال لقطات الشاشة وأحداث الإدخال دون الاعتماد على أشجار DOM، محققاً أداءً هو الأفضل في فئته في اختبارات استخدام الحاسوب من خلال تدريب النشر السحابي واسع النطاق، وتحسين المكافأة القابلة للتحقق، وبنية قابلة للتوسع.

Dunjie Lu, Shuai Bai, Tianyi Bai, Sicheng Fan, Chang Gao, Jian Guan, Feng Hu, Mianqiu Huang, Xingyang Huang, Yizhen Jian (…)2026-08-04
💬 NLP

Global Optimization and Inference-Time Region Grafting for Agentic Workflows

تقدم الورقة البحثية GRAFT، وهي طريقة لا تتطلب تدريباً تُمكّن سير العمل الوكيل (agentic workflows) من استبدال مناطق التنفيذ الفاشلة ببدائل أفضل بشكل تكيفي باستخدام إشارات جودة خالية من الملصقات، مما يحقق تحسيناً على مستوى الحالة وأداءً محسناً عبر مهام متنوعة دون الحاجة إلى إعادة تحسين كامل سير العمل المكلفة حاسوبياً.

Donghyeok Koh, Gyuwan Kim, Jinyeong Bak, Seung-Hoon Na, Tao Yang, Haneol Jang, Cheoneum Park2026-08-04
💬 NLP

Fast and Accurate Quotation Attribution in Literary Texts

تقدم هذه الورقة البحثية "التقييم المشترك" (joint scoring)، وهو أسلوب فعال قائم على المشفر (encoder-based) يحقق دقة هي الأفضل في حالتها (state-of-the-art) في إسناد الاقتباسات إلى المتحدثين في النصوص الأدبية، مع تفوقه بشكل كبير على كل من الطرق القياسية والنماذج اللغوية الكبيرة في السرعة، وتطرح مجموعة أدوات ModernBookNLP لتسهيل اعتماده.

Gaspard Michel, Hugo Attali, Elena V. Epure2026-08-04
💬 NLP

Token-Native Storage: Read and Write in your Agent's Language

تدافع هذه الورقة عن مفهوم "التخزين الأصيل للرموز" (token-native storage)، وهو نموذج يتم فيه تخزين النصوص مباشرة كمعرفات رموز (BPE token IDs) بدلاً من أحرف UTF-8، محاججةً بأن هذا النهج يقلل بشكل كبير من حجم التخزين ويسرع عمليات القراءة والكتابة للوكلاء الذكيين عبر إلغاء الحاجة إلى الترجمة وإعادة الترميز المتكررة.

Kumar Shivendu2026-08-04
💬 NLP

Training-Free versus Training-Based Intent Classification in LLMs: Accuracy, Robustness, and Failure Modes

تقارن هذه الورقة بشكل منهجي بين طرق تصنيف النوايا القائمة على التدريب وتلك الخالية من التدريب في النماذج اللغوية الكبيرة، لتجد أنه بينما يتشبع كلاهما في الاختبارات المرجعية السهلة وتتفوق النهج القائمة على التدريب في التمييزات الأكثر دقة، فإن الطرق الخالية من التدريب توفر متانة فائقة ضد المطالبات المختلطة والنوايا والعدائية.

Nan Chen, Zhouhao Yang, Soufiane Hayou2026-08-04
💬 NLP

Right Answer, Wrong Method: Shortcut Hacking Misleads the Evaluation of LLM Reasoning on Frontier Science Benchmarks

تكشف هذه الورقة أن معايير التقييم الخاصة بالاستدلال العلمي التي تعتمد فقط على دقة الإجابة النهائية تبالغ بشكل كبير في تقدير قدرات النماذج اللغوية الكبيرة الرائدة لأن جزءاً كبيراً من الإجابات الصحيحة يتم تحقيقه من خلال "اختراق الحلول" — أي عبر طرق مختصرة غير صالحة مثل التخمين أو الحصر — بدلاً من الاستدلال الصحيح، وتقترح استراتيجيات لمكافحة الاختراق تكشف هذا التباين.

Xuan Ren, Weiqi Zhai, Tianle Pu, Yihua Zhu, Yihua Zhu, Hu Wei, Bing Zhao2026-08-04
💬 NLP

CTRAG: An In-Context Retrieval-based Framework for Automated Compliance Checking using LLMs

تقدم هذه الورقة البحثية CTRAG، وهو إطار عمل جديد للجيل المعزز بالاسترجاع (RAG) يستفيد من التقطيع التكيفي، والاسترجاع الديناميكي، والتعلم في السياق لأتمتة وتحسين دقة التحقق من الامتثال التنظيمي بشكل كبير من خلال الربط المرجعي بين أسئلة الضوابط ووثائق الشركة، كما تم إثباته من خلال نشر ناجح في الواقع العملي لدى إحدى شركات الخدمات المهنية الأربع الكبرى.

Muhammad Roman, Karen Rafferty, Barry Devereux2026-08-04
💬 NLP

Cultural Awareness is Represented but Not Decoded: Tracing Mythological Knowledge across 18 Open-Source LLMs

تستقصي هذه الورقة ١٨ نموذجاً من النماذج اللغوية الكبيرة مفتوحة المصدر، وتجد أنه بينما تمثل هذه النماذج داخلياً المعرفة الميثولوجية من ثقافات متنوعة، فإن فشلها في استرجاع التقاليد غير السائدة ينبع من انحياز في قراءة فك التشفير يؤدي إلى انهيار هذه التمثيلات على رموز التقاليد السائدة، وهو قصور يتأثر أيضاً بلغة المطالبة.

Iaroslav Chelombitko, Ekaterina Chelombitko, Mika Hämäläinen2026-08-04