💻 computer science

DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models

تقدم الورقة البحثية DarkLLM، وهو إطار عمل مبتكر يستفيد من نموذج لغوي كبير بمليار معلمة لترجمة التعليمات باللغة الطبيعية إلى اضطرابات تنافسية متعددة الاستخدامات وعالية الفعالية، مما يوحد ويوسع نطاق الهجمات عبر مختلف النماذج التأسيسية للرؤية والنماذج متعددة الوسائط.

Ye Sun, Xin Wang, Jiaming Zhang, Yifeng Gao, Yixu Wang, Yifan Ding, Qixian Zhang, Henghui Ding, Xingjun Ma, Yu-Gang Jian (…)2026-05-20
🧬 biology

A Multi-Dimensional Clustering Approach for Identifying Inborn Errors of Immunity

تقترح هذه الورقة مساراً لتعلم الآلة يقوم بتنظيم وتحويل البيانات المناعية الخام من السجلات الصحية الإلكترونية إلى ناقلات لأغراض التجميع غير الخاضع للإشراف، بهدف تحديد أنماط وسمات جديدة لأخطاء المناعة الخلقية لتسهيل التشخيص المبكر وتحسين تحليل الأمراض النادرة.

Nishad Kulkarni, Alexandra K. Martinson, Nicholas L. Rider, Michael Keller, Syed Muhammad Anwar2026-05-20
💻 computer science

MotionMERGE: A Multi-granular Framework for Human Motion Editing, Reasoning, Generation, and Explanation

يُعد MotionMERGE إطار عمل موحداً يسد فجوة التدرج في معالجة الحركة البشرية من خلال تقديم تحكم دقيق موجه باللغة، واستراتيجية تدريب مسبق مدركة للاستنتاج، ومجموعة بيانات ضخمة دقيقة لتمكين التحرير الدقيق للحركة، والتوليد، والاستنتاج الشبيه بالبشر.

Bizhu Wu, Jinheng Xie, Wenting Chen, Zhe Kong, Jianfeng Ren, Linlin Shen, Ruibin Bai, Rong Qu2026-05-20
💻 computer science

Harnessing Self-Supervised Features for Art Classification

تُظهر هذه الورقة أن النماذج الأساسية ذات التعلم الذاتي، ولا سيما نماذج DINO وCLIP، تتفوق باستمرار على الأساليب الخاضعة للإشراف في تصنيف واسترجاع الأعمال الفنية، مما يقدم رؤى قيمة للتطبيقات الواقعية مثل الملاحة في المتاحف عبر الواقع الافتراضي.

Federico Melis, Davide Bilardello, Emanuele Prato, Evelyn Turri, Lorenzo Baraldi2026-05-20
💻 computer science

Artifact-Bench: Evaluating MLLMs on Detecting and Assessing the Artifacts of AI-Generated Videos

تقدم هذه الورقة البحثية Artifact-Bench، وهو معيار شامل يتميز بتصنيف ثلاثي المستويات للعيوب ومهام تشخيصية ثلاث لتقييم النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) في كشف عيوب الفيديو المُنشأة بواسطة الذكاء الاصطناعي، مما يكشف عن قصور كبير في دقتها الإدراكية وتوافقها مع التفضيلات البشرية.

Yuqi Tang, Yang Shi, Zhuoran Zhang, Qixun Wang, Xuehai Bai, Yue Ding, Ruizhe Chen, Bohan Zeng, Xinlong Chen, Xuanyu Zhu (…)2026-05-20
💻 computer science

EgoTraj: Real-World Egocentric Human Trajectory Dataset for Multimodal Prediction

تقدم الورقة البحثية EgoTraj، وهي مجموعة بيانات متعددة الوسائط جديدة ومفتوحة تضم 75 تسلسلاً للملاحة الحضرية في العالم الحقيقي تم التقاطها عبر سماعات الرأس Meta Quest Pro مع فيديو RGB متزامن، ووضعيات رأس بـ 6 درجات حرية، وبيانات نظرة العين ثلاثية الأبعاد، والمصممة لتعزيز الأبحاث في التنبؤ بمسار الإنسان من منظور الشخص الأول للروبوتات والأنظمة المساعدة.

Ahmad Yehia, Abduallah Mohamed, Tianyi Wang, Jiseop Byeon, Kun Qian, Junfeng Jiao, Christian Claudel2026-05-20
💻 computer science

A Systematic Failure Analysis of Vision Foundation Models for Open Set Iris Presentation Attack Detection

تقدم هذه الورقة تحليلاً منهجياً للفشل يكشف أنه بينما تُظهر نماذج الرؤية التأسيسية واعداً في الكشف عن هجمات عرض قزحية العين عبر مجموعات البيانات، إلا أنها تواجه صعوبة في التعميم على أدوات الهجوم غير المرئية وسيناريوهات الأطياف المتقاطعة، مع أن التكيف الموفر للمعلمات غالباً ما يؤدي إلى تفاقم هذه الثغرات بدلاً من حلها.

Rahul Anand, Siddharth Singh, Dileep A D, Mahadeva Prasanna, Raghavendra Ramachandra2026-05-20
💻 computer science

Personalized Face Privacy Protection From a Single Image

تقدم هذه الورقة FaceCloak، وهو نظام مبتكر يولد أقنعة خفيفة الوزن ومخصصة لحماية الهوية من صورة واحدة للتحايل بفعالية على التعرف على الوجوه عبر إزاحة تضمين هوية المستخدم بعيداً عن المرتكزات المتشابهة من خلال منهجية تعلم اضطراب ثلاثية المراحل.

Zachary Yahn, Fatih Ilhan, Tiansheng Huang, Selim Tekin, Sihao Hu, Yichang Xu, Margaret Loper, Ling Liu2026-05-20
🤖 AI

RLFTSim: Realistic and Controllable Multi-Agent Traffic Simulation via Reinforcement Learning Fine-Tuning

إن RLFTSim هو إطار عمل للضبط الدقيق القائم على التعلم التعزيزي يعمل على تعزيز واقعية وقابلية التحكم في محاكاة حركة المرور متعددة الوكلاء من خلال مواءمة مخرجات المحاكي مع توزيعات بيانات العالم الحقيقي واستخدام إشارة مكافأة كثيفة ومنخفضة التباين لتحقيق أداء رائد على مجموعة بيانات Waymo Open Motion.

Ehsan Ahmadi, Hunter Schofield, Behzad Khamidehi, Fazel Arasteh, Jinjun Shan, Lili Mou, Dongfeng Bai, Kasra Rezaee2026-05-20
⚡ electrical engineering

LiFT: Lifted Inter-slice Feature Trajectories for 3D Image Generation from 2D Generators

تقدم الورقة البحثية إطار عمل LiFT، الذي يولد صوراً طبية ثلاثية الأبعاد عالية الدقة عبر التعامل مع الأحجام كمسارات ميزات مرتبة لتعلم الاتساق بين الشرائح باستخدام مولدات ثنائية الأبعاد، مما يحقق تماسكاً تشريحياً وتوليداً عالي الجودة بتكاليف حوسبة أقل بكثير مقارنة بالنماذج الحجمية الكاملة.

Xinhe Zhang, Yuyang Zhang, Pengfei Jin, Arnau Marin-Llobet, Na Li, Quanzheng Li2026-05-20