🤖 AI

Looks Right, Works Right: A Project-Level Benchmark for Multi-Screen Mobile App Generation

تقدم هذه الورقة MobileForge، وهو أول معيار على مستوى المشروع لتوليد تطبيقات الهاتف المحمول متعددة الشاشات يقيم النماذج اللغوية الكبيرة متعددة الوسائط عبر البناء، والتنقل، والدقة المرئية، وقابلية الصيانة، والكفاءة، كاشفاً أنه بينما تستطيع النماذج الحالية تجميع التطبيقات والتنقل فيها، إلا أنها لا تزال تعاني من أجل تحقيق تفاعل موثوق وجودة برمجية.

Fan Wu, Cuiyun Gao, Yiming Huang, Yang Xiao, Yujia Chen, Qing Liao2026-08-24
🤖 AI

PrimeAgentOrchestrator: Memory-Primed Agent Spawning for Personal AI Infrastructure

تقدم هذه الورقة PrimeAgentOrchestrator (PAO)، وهو نظام يعزز وكلاء Claude Code عبر إنشاء نسخ جديدة محملة مسبقاً بذكريات ذات صلة من خلال خلفيات PostgreSQL وCloudflare Worker المتوازية عبر حقن نظام الملفات، مدعوماً بتقرير خبرة لمدة أربعة أشهر يفصل إدارة دورة حياته، وآليات تسليم السياق التكرارية، والمقايضات الهندسية.

Myron Koch (Peak Summit Labs)2026-08-24
💬 NLP

Who Do Language Models Think Is Competent? A Mechanistic Analysis of Occupational Bias

تكشف هذه الورقة أن النماذج اللغوية غالباً ما تحتفظ بانحيازات تمثيلية داخلية فيما يتعلق بكفاءة المستخدم بناءً على الخصائص الديموغرافية مثل النوع الاجتماعي والعرق، حتى عندما تبدو مخرجاتها الملحوظة غير منحازة، مما يثبت أن التقييمات السلوكية وحدها غير كافية للكشف عن أوضاع الفشل الكامنة هذه.

Keren Fuentes, Aaron Mueller2026-08-24
💬 NLP

Inhibitory Attention for Clinical Long-Context Reasoning: Characterizing and Mitigating Lost-in-the-Middle Effects in EHR Processing

تحدد هذه الورقة وتُوصّف مشكلة "الضياع في المنتصف السريري" في النماذج اللغوية الكبيرة التي تعالج السجلات الصحية الإلكترونية الطويلة، مُبينةً أن بوابة اختيار خفيفة الوزن ومشروطة بالاستعلام (QCCS) تتفوق بشكل كبير على طرق الاسترجاع التقليدية من خلال إعطاء الأولوية لصلة السياق بدلاً من مجرد الاستدعاء لتحسين دقة اتباع التعليمات.

Sanjay Basu2026-08-24
💻 computer science

Clarify-Then-Search: A Clarification Benchmark for Deep Search with End-to-End Nugget Restoration

تقدم هذه الورقة البحثية "Clarify-Then-Search" (استوضح ثم ابحث)، وهو معيار مرجعي مبني على بيانات حقيقية من بايدو (Baidu) يقيم كيفية تحسين أسئلة الاستيضاح التي تولدها النماذج اللغوية الكبيرة لأداء البحث العميق عبر استعادة قيود الاستعلام المفقودة، مما يثبت أن مثل هذه التفاعلات تعزز المنفعة النهائية بشكل كبير مع الكشف عن أوجه الفشل الشائعة مثل الإفراط في طرح أسئلة المواقع غير القابلة للإجابة.

Deqiang Huang, Jingbo Zhou, Xinjiang Lu, Tong Xu, Hua Wu, Enhong Chen2026-08-24
💬 NLP

Trilingual Topic Modeling of Sri Lankan Parliamentary Debates

تقدم هذه الورقة إطار عمل متكاملًا يستخدم استخراج النصوص القائم على النماذج اللغوية الكبيرة (LLM) وتجميع التضمين متعدد اللغات لإجراء نمذجة موضوعية غير خاضعة للإشراف بنجاح على المناظرات البرلمانية ثلاثية اللغات في سريلانكا، متجاوزةً بذلك تحديات مثل التخطيطات المعقدة والخلط اللغوي لتحديد الهياكل الموضوعية التي تتوافق مع الأحداث الوطنية الكبرى.

Himath Dhanapala, Haren Daishika, Himandhi Kuruppu, Sithija Seneviratne, Ashini Kavindya, Patalee Narasinghe, Sandeepa W (…)2026-08-24
🤖 AI

A Survey on Foundations and Frontiers of Multimodal Agentic Frameworks: Techniques and Applications

تتفحص هذه الدراسة المسحية بشكل منهجي تأثير تعدد الوسائط على الأطر الوكيلة من خلال تحليل كيفية دمج الوسائط المتنوعة في الوحدات الوظيفية الأساسية مثل الإدراك والاستدلال، وتصنيف التصميمات المعمارية، وتقييم التطبيقات عبر مجالات مثل الروبوتات والملاحة عبر الويب لتحديد الفجوات ورسم خارطة طريق لأنظمة ذكية قوية وعامة الغرض.

Neel Mokaria, Rishie Raj, Dheeraj Baiju, Xiaoqian Shen, Shraman Pramanick, Kevin Qinghong Lin, Arda Senocak, Mike Zheng (…)2026-08-24
💬 NLP

EditPPT: Faithful Long-Deck Slide Editing via Structured Tool-Using Multi-Agent with Dual-Modal Validators

يُعد EditPPT إطار عمل متعدد الوكلاء يحقق تحريراً أميناً لشرائح العروض التقديمية الطويلة عبر إعادة صياغة المهمة كمسألة اختيار أدوات مقيدة باستخدام عمليات PowerPoint الأصلية والتحقق ثنائي الوسائط، مما يظهر دقة ومتانة فائقتين على اختبار DeckEdit-Bench المستحدث.

Jiheon Kim, Kyudan Jung, Jaegul Choo2026-08-24
🤖 AI

Interpretable Multimodal Classification with Linear Discriminant Tree Ensembles

تقدم هذه الورقة إطار عمل يستخدم مجموعات أشجار التمييز الخطي لتحقيق توازن متفوق بين الدقة والقابلية للتفسير في التصنيف متعدد الوسائط، متفوقةً بذلك على نماذج المحولات (Transformer) والنماذج المرجعية القابلة للتفسير الموجودة، مع توفير مقاييس أكثر موثوقية لأهمية الميزات من أجل اتخاذ قرارات مفهومة بشرياً.

Mojtaba Moattari2026-08-24
💬 NLP

Ansari: A Retrieval-Grounded Islamic AI Assistant -- Architecture, Deployment, and Lessons from 140,000 Conversations

تقدم هذه الورقة "أنصاري"، وهو مساعد ذكاء اصطناعي إسلامي مُنشر ومعتمد على الاسترجاع، يعمل على الحد من التزييف الواقعي وعدم توافق القيم من خلال الإجابة بصرامة على الأسئلة بناءً على نصوص دينية موثقة مع الاستشهاد بها، مما يظهر أداءً فائقاً في الاختبارات المعيارية الإسلامية ويقدم دروساً بالغة الأهمية لنشر نماذج اللغات الكبيرة الحساسة للعقيدة.

M Waleed Kadous, Amr Elsayed, Abdullah Al Nahas, Ashraf Haress2026-08-24