💻 computer science

CAM-VFD: Cross-Attention Multimodal Video Forgery Detection

يُعد CAM-VFD إطار عمل مبتكرًا متعدد الوسائط يعتمد على الانتباه المتقاطع، حيث يقوم بالكشف عن فيديوهات التزييف العميق من خلال نمذجة التناقضات بين الوسائط عبر سمات المظهر والحركة والعمق، محققًا بذلك دقة فائقة ومتانة ضد مختلف الاضطرابات في مجموعات البيانات المرجعية.

Hoda Osama Elkhodary, Sherin Mostafa Youssef, Marwa Elshenawy, Dalia Sobhy2026-05-19
💻 computer science

Latent Heuristic Search: Continuous Optimization for Automated Algorithm Design

تقدم هذه الورقة البحثية "البحث الاستدلالي الكامن" (Latent Heuristic Search)، وهو إطار عمل يستفيد من التحسين المستمر ضمن فضاء كامن مُتعلم — باستخدام المشفرات، والبدائل القابلة للتفاضل، وتدفقات التوزيع الطبيعي (normalizing flows) — لتوليد استدلالات عالية الأداء لمشكلات الأمثلة التوافقية بكفاءة من خلال تكييف نموذج لغوي كبير مجمد.

Cheikh Ahmed, Mahdi Mostajabdaveh, Zirui Zhou2026-05-19
💻 computer science

Dynamics of collective creativity in AI art competitions

تحلل هذه الدراسة مجموعة بيانات ضخمة من الصور التي تم إنشاؤها بالتعاون بين البشر والذكاء الاصطناعي من حفلات إعادة المزج في "Artbreeder" لتكشف أنه بينما تلهم الصور الأبوية الأكثر ابتكاراً صوراً فرعية أكثر تعقيداً، يفضل المستخدمون مفارقةً إعادة مزج الأعمال الأبسط والأقل ابتكاراً، مما يؤدي إلى تقارب جماعي نحو جاذبات موضوعية مشتركة حيث تولد المجموعات الأكبر قدراً أكبر من الابتكار ولكن تعقيداً أقل.

Mason Youngblood, Jeff Nusz, Joel Simon2026-05-19
💻 computer science

Contrastive Conceptor Activation Steering (COAST): Unlocking Vision-Language-Action Models through Hidden States

تقترح الورقة البحثية طريقة "توجيه تنشيط المفهوم التبايني" (COAST)، وهي طريقة خفيفة الوزن ولا تتطلب تدريباً، تستخدم المفهومات (conceptors) لتحديد وتوجيه الكوامن في نماذج الرؤية واللغة والعمل (VLA) نحو فضاءات فرعية حرجة للنجاح مستمدة من أمثلة قليلة، مما يحسن معدلات نجاح المهام بشكل كبير عبر بنيات متنوعة دون الحاجة لإعادة التدريب.

Miranda Muqing Miao, Subin Kim, Brandon Yang, Lyle Ungar2026-05-19
💻 computer science

Evolutionary Extreme Learning Machine of ab-initio Energy Landscapes for Crystal Structure Prediction using Manta Ray Optimization with Levy Flight

تقترح هذه الورقة البحثية آلة التعلم المتطرف التطورية المحسنة بخوارزمية البحث عن الطعام لسمكة مانتا راي مع طيران ليفي (EELM-MRFO-LF) للتنبؤ بطاقات التكوين في الأنظمة البلورية الثنائية، وذلك باستخدام طيران ليفي لتعزيز تنوع الجمهرة وتجنب القيم المثلى المحلية أثناء عملية التدريب.

Adrian Rubio-Solis2026-05-19
💻 computer science

MADP: A Multi-Agent Pipeline for Sustainable Document Processing with Human-in-the-Loop

تقدم الورقة البحثية MADP، وهو مسار متعدد الوكلاء يجمع بين التعلم العميق، والنماذج اللغوية الكبيرة، والتحقق من جانب العنصر البشري لتحقيق أتمتة بنسبة 97% ودقة بنسبة 98.5% في معالجة مستندات المؤسسات، مما أدى إلى خفض العمالة بنسبة 70% وانخفاض الأثر البيئي بنسبة 69% مقارنة بالطرق اليدوية التقليدية.

Diego Gosmar, Giovanni Zenezini2026-05-19
💻 computer science

When Bits Break Recourse: Counterfactual-Faithful Quantization

تقدم هذه الورقة البحثية طريقة "الكمية المتوافقة مع الواقع المضاد" (CFQ)، وهي طريقة تحافظ على استقرار التراجع القابل للتنفيذ في النماذج ذات البتات المنخفضة من خلال تحسين تخصيص البتات ومعلمات المكمم للحفاظ على صلاحية وتكلفة الواقع المضاد، مما يعالج نمط فشل حرج حيث يؤدي التكميم القياسي إلى تدهور التراجع رغم الحفاظ على الدقة التنبؤية.

Chaymae Yahyati, Ismail Lamaakal, Khalid El Makkaoui, Ibrahim Ouahbi2026-05-19
💻 computer science

Responsible Agentic AI Requires Explicit Provenance

تجادل هذه الورقة بأن إرساء أصلٍ صريح، وقابل للقياس، وقابل للتتبع عبر دورة حياة الذكاء الاصطناجي الوكيل الكاملة هو المتطلب الأساسي لجعل المسؤولية قابلة للحوسبة والتنفيذ، مما يعالج عجز الثقة الحالي الناجم عن عدم القدرة على تحديد المساءلة عن الأضرار في التكوينات الوكيلية المعقدة متعددة الأطراف.

Jinwei Hu, Xinmiao Huang, Qisong He, Youcheng Sun, Yi Dong, Xiaowei Huang2026-05-19
💻 computer science

OpenJarvis: Personal AI, On Personal Devices

يقدم OpenJarvis بنية ذكاء اصطناعي شخصي مفككة ومعرفة بالأنواع، تستفيد من البحث الموجه بنماذج اللغات الكبيرة (LLM) في المواصفات لتحسين خمسة عناصر أولية مستقلة، مما يمكّن الأنظمة التي تعمل على الأجهزة من مضاهاة دقة مستوى السحابة مع تقليل تكاليف واجهة برمجة التطبيقات وزمن الاستجابة بشكل جذري.

Jon Saad-Falcon, Avanika Narayan, Robby Manihani, Tanvir Bhathal, Herumb Shandilya, Hakki Orhun Akengin, Gabriel Bo, And (…)2026-05-19
💬 NLP

Why Do Safety Guardrails Degrade Across Languages?

تقدم هذه الورقة إطار عمل لنظرية الاستجابة للمفردات متعدد المجموعات لفك الارتباط وتحليل العوامل المتميزة التي تدفع تدهور السلامة في النماذج اللغوية الكبيرة عبر اللغات، كاشفةً أن إخفاقات السلامة هي في الأساس أحادية البعد، وغالباً ما تكون أكثر شدة في اللغة الإنجليزية منها في اللغات ذات الموارد المنخفضة، وتتأثر بشكل كبير بالفجوات العابرة للغات والخاصة بالنماذج التحفيزية والمتعلقة بالأذى الجسدي والتفاوتات الثقافية بدلاً من مجرد جودة الترجمة.

Max Zhang, Ameen Patel, Sang T. Truong, Sanmi Koyejo2026-05-19