💻 computer science

Suicide Risk Assessment from AI-powered Video Surveillance: An Interpretable Framework for Prevention in Metro Stations

تقدم هذه الورقة أول إطار عمل للذكاء الاصطناذ القابل للتفسير لتقييم مخاطر الانتحار في محطات المترو، والذي يدمج تتبع الأشخاص، والتعرف على الأنشطة، والتحليل الزماني والمكاني لفيديو المراقبة لتحقيق 83.2% في منحنى خصائص تشغيل المستقبِل (ROC-AUC) على بيانات من العالم الحقيقي من أجل التدخل المبكر.

Safwen Naimi, Wassim Bouachir, Guillaume-Alexandre Bilodeau, Brian Mishara2026-05-25
💻 computer science

Improved Vision-to-Chart Buoy Association with Learned World-to-Image Projection

تقدم هذه الورقة تحسيناً خفيف الوزن لمحول دمج قائم على نموذج DETR لتحدي MaCVi 2026 (Vision-to-Chart)، والذي يعمل على تحسين الربط بين العوامة والمخطط من خلال تدريب QueryMLP مخصص للتنبؤ صراحةً بإحداثيات بكسل الصورة من بيانات المخطط، مما يوفر أولويات مكانية تقلل من عبء الاستدلال الهندسي على وحدة فك التشفير وتحقق المركز الثاني في لوحة المتصدرين.

Borja Carrillo-Perez (Arquimea Research Center)2026-05-25
🤖 machine learning

RADAR: Relative Angular Divergence Across Representations

تقدم الورقة البحثية RADAR، وهو مقياس قائم على الأسس الهندسية يقدر قابلية النقل عبر المجالات في النماذج التأسيسية من خلال تحليل التباعد الزاوي وتغيرات المسافة النسبية في مسارات تمثيل الطبقات، مما يظهر أداءً تنبؤياً تنافسياً عبر معايير النصوص والصور.

Xavier Cadet, Mateusz Nowak, Peter Chin2026-05-25
🤖 AI

The TIME Machine: On The Power of Motion for Efficient Perception

تقدم الورقة البحثية TIME، وهو تمثيل فيديو ذاتي الإشراف تم تدريبه حصرياً على بيانات حركة اصطناعية عبر مشفر تلقائي مقنع، والذي يحقق أداءً رائعاً في التعلم الصفري بما يصل إلى 10,000 مرة أقل من بيانات التدريب من خلال التغلب على قيود القابلية للتوسع والاعتماد على اللغة التي تعاني منها نماذج الفيديو الحالية.

Mantas Skackauskas, Xinyue Hao, Laura Sevilla-Lara2026-05-25
⚡ electrical engineering

Do Synthetic Brain MRIs Reliably Improve Tumour Classification? A StyleGAN2-ADA Class-Plane Augmentation Study on BRISC 2025

تُظهر هذه الدراسة أنه في حين أن صور الرنين المغناطيسي الدماغية الاصطناعية المُولدة بواسطة StyleGAN2-ADA لا تُحسن تصنيف الأورام بشكل شامل عبر جميع بنيات النماذج، إلا أنها توفر دفعة دقة ذات دلالة إحصائية لنموذج MobileViTV2 عند استخدام تصفية فضاء الميزات بنسبة حقيقية إلى اصطناعية تبلغ 1:1، مما يسلط الض الضوء على أن فائدة التعزيز تعتمد على المصنف المحدد وتكوين البيانات بدلاً من مجرد الدقة البصرية وحدها.

José Rafael Noriega Cedeño2026-05-25✓ Author reviewed
💻 computer science

Composing People Together: Iterative Pose-Image Generation for Multi-Person Interaction Scenes

تقدم هذه الورقة إطار عمل ثنائي لتوليد الصور من الوضعيات يستفيد من الأولويات الهيكلية المتمحورة حول الشخص ومخطط بناء المشهد التكراري للتغلب على قيود نماذج تحويل النص إلى صورة الحالية في إنشاء مشاهد تفاعل متعددة الأشخاص متنوعة دلاليًا ودقيقة تركيبيًا.

Wenxuan Peng, Bharath Hariharan, Hadar Averbuch-Elor2026-05-25
🤖 AI

Lipschitz Optimization for Formal Verification of Homographies

تقدم هذه الورقة إطار عمل للتحقق الرسمي يستنتج حدوداً خطية محكمة لقيم البكسل تحت اضطرابات حركة الكاميرا ثلاثية الأبعاد من خلال الاستفادة من تحسين ليبشيتز والاستمرارية الجزئية للتحويلات الهوموجرافية، مما يتيح أول ضمانات متينة وصارمة لمتانة الشبكات الرؤيوية في المشاهد المستوية دون الاعتماد على عمليات محاكاة معقدة أو نماذج بديلة.

Jean-Guillaume Durand, Panagiotis Kouvaros, Maxime Gariel, Alessio Lomuscio2026-05-25
💻 computer science

CaST-Bench: Benchmarking Causal Chain-Grounded Spatio-Temporal Reasoning for Video Question Answering

تقدم هذه الورقة البحثية CaST-Bench، وهو معيار ومجموعة تقييم جديدة صُممت لتقييم قدرة نماذج الرؤية واللغة بدقة على إجراء الاستدلال المكاني الزماني القائم على السلسلة السببية في الإجابة على الأسئلة المتعلقة بالفيديو، وذلك من خلال توفير مجموعة بيانات تضم 2,066 سؤالاً مع تعليقات توضيحية زمانية ومكانية دقيقة.

Mingfang Zhang, Jingjing Pan, Ashutosh Kumar, Rajat Saini, Mustafa Erdogan, Hsuan-Kung Yang, Caixin Kang, Yifei Huang, Y (…)2026-05-25
💻 computer science

Beyond Normal References: Discriminative Few-Shot Anomaly Detection

تقدم الورقة البحثية IDEAL، وهو إطار عمل تمييزي للكشف عن الشذوذ في ظل ندرة البيانات (few-shot)، يستفيد من المراجع الطبيعية والشاذة لتعلم أنماط الانحراف الجوهرية عبر "ممحاة التباين الطبيعي" (Normal Variation Eraser) و"مشفر الانحراف الجوهري" (Intrinsic Deviation Encoder)، مما يحقق تعميماً فائقاً على الحالات الشاذة غير المرئية مقارنة بالأساليب الرائدة الحالية.

Huan Wang, Jun Shen, Jun Yan, Guansong Pang2026-05-25
💻 computer science

StereoGenBench: A Synthetic Multi-Camera Benchmark for Stereo Generation under Controlled Baseline Regimes

تُقدم الورقة البحثية StereoGenBench، وهو معيار تقييم اصطناعي يعتمد على محرك Unreal Engine يتميز بمصفوفة صلبة مكونة من ست كاميرات توفر بيانات ستيريو متعددة القواعد ومتقابلة المشاهد ومعايرة مع بيانات وصفية هندسية كاملة (RGB، وعمق متري، وخصائص داخلية، ووضعيات) لتمكين التقييم المنضبط لتوليد الستيريو تحت أنظمة قواعد مختلفة.

Yangzhi Cui, Feng Qiao, Nathan Jacobs2026-05-25