💻 computer science

Neuro-Cognitive Reward Modeling for Human-Centered Autonomous Vehicle Control

تقترح هذه الورقة إطار عمل للتعلم التعزيزي الموجه بتخطيط كهربية الدماغ (EEG) يدمج الرؤى المعرفية البشرية المستمدة من الجهود المرتبطة بالحدث في إشارة المكافأة، مما يؤدي إلى تحسين تجنب الاصطدام للمركبات ذاتية القيادة دون الحاجة إلى تغذية راجعة سلوكية بشرية صريحة.

Zhuoli Zhuang, Yu-Cheng Chang, Yu-Kai Wang, Thomas Do, Chin-Teng Lin2026-03-30
💻 computer science

Diffusion MRI Transformer with a Diffusion Space Rotary Positional Embedding (D-RoPE)

تقدم هذه الورقة نموذج "Diffusion MRI Transformer" مزوداً بآلية مبتكرة لتمثيل الموضع الدوراني في فضاء الانتشار (D-RoPE)، والتي تلتقط بفعالية التبعيات المكانية والاتجاهية في بيانات التصوير بالرنين المغناطيسي للانتشار (dMRI)، مما يتيح تمثيلات قوية وقابلة للنقل من خلال التدريب المسبق ذاتي الإشراف الذي يتفوق على النماذج المرجعية في المهام السريرية اللاحقة مثل تصنيف الضعف الإدراكي الخفيف والتنبؤ بالدرجات الإدراكية.

Gustavo Chau Loo Kung, Mohammad Abbasi, Camila Blank, Juze Zhang, Alan Q. Wang, Sophie Ostmeier, Akshay Chaudhari, Kilia (…)2026-03-30
💻 computer science

Neighbor-Aware Localized Concept Erasure in Text-to-Image Diffusion Models

تقترح الورقة البحثية إطار عمل "محو المفاهيم الموضعي المدرك للجوار" (NLCE)، وهو إطار عمل لا يتطلب تدريباً يعمل بفعالية على إزالة المفاهيم المستهدفة من نماذج الانتشار من نص إلى صورة مع الحفاظ على المفاهيم المجاورة ذات الصلة دلالياً من خلال تعديل التضمين الموزون طيفياً والبوابة المكانية الموجهة بالانتباه.

Zhuan Shi, Alireza Dehghanpour Farashah, Rik de Vries, Golnoosh Farnadi2026-03-30
🧬 biology

Longitudinal Boundary Sharpness Coefficient Slopes Predict Time to Alzheimer's Disease Conversion in Mild Cognitive Impairment: A Survival Analysis Using the ADNI Cohort

تُظهر هذه الدراسة أن استخدام نماذج غابة البقاء العشوائية لتحليل المنحدرات الطولية لمعامل حدة الحدود (BSC) المستمدة من التصوير بالرنين المغناطيسي الهيكلي يوفر طريقة أكثر دقة وفعالية من حيث التكلفة للتنبؤ بالتحول من الضعف الإدراكي الخفيف إلى مرض الزهايمر مقارنة بالفحوصًا الأساسية التقليدية أو النماذج المعلمية.

Ishaan Cherukuri2026-03-30
🤖 AI

FairLLaVA: Fairness-Aware Parameter-Efficient Fine-Tuning for Large Vision-Language Assistants

تُعد FairLLaVA طريقةً لضبط المعلمات بكفاءة، وهي مستقلة عن البنية الهيكلية، تعمل على تخفيف التحيزات الديموغرافية في النماذج اللغوية البصرية الكبيرة من خلال تقليل المعلومات المتبادلة بين السمات المستهدفة، مما يؤدي إلى تقليل التفاوتات بين المجموعات وتعزيز العدالة في مهام التصوير الطبي دون المساس بالأداء العام.

Mahesh Bhosale, Abdul Wasi, Shantam Srivastava, Shifa Latif, Tianyu Luan, Mingchen Gao, David Doermann, Xuan Gong2026-03-30
⚡ electrical engineering

Cone-Beam CT Image Quality Enhancement Using A Latent Diffusion Model Trained with Simulated CBCT Artifacts

تقترح هذه الورقة نموذج انتشار كامن ذاتي الإشراف، تم تدريبه على صور (pseudo-CBCT) متسقة مكانياً، لتعزيز جودة صور التصوير المقطعي المحوسب ذي المخروط (Cone-Beam CT) مع الحفاظ بفعالية على البنى التشريحية وتجنب مشكلات التصحيح المفرط الشائعة في الطرق التقليدية.

Naruki Murahashi, Mitsuhiro Nakamura, Megumi Nakao2026-03-30
🤖 AI

VLAgeBench: Benchmarking Large Vision-Language Models for Zero-Shot Human Age Estimation

تقدم هذه الورقة VLAgeBench، وهو معيار شامل للتعلم الصفري (zero-shot) لتقييم نماذج الرؤية واللغة الكبيرة المتطورة (GPT-4o، وClaude 3.5 Sonnet، وLLaMA 3.2 Vision) في تقدير العمر الوجهي عبر مجموعتي بيانات UTKFace وFG-NET، مما يظهر أداءها التنافسي مع تسليط الضو على التحديات الحرجة في العدالة، والحساسية للمطالبات، والقابلية للتفسير.

Rakib Hossain Sajib, Md Kishor Morol, Rajan Das Gupta, Mohammad Sakib Mahmood, Shuvra Smaran Das2026-03-30
💻 computer science

GeoReFormer: Geometry-Aware Refinement for Lane Segment Detection and Topology Reasoning

تُعد GeoReFormer بنية محوّلة (transformer) مدركة للهندسة، تعمل على تعزيز كشف قطع المسارات ثلاثية الأبعاد والاستدلال الطوبولوجي من خلال تضمين انحيازات استقرائية هندسية وعلاقية صريحة في وحدة فك التشفير، مما يحقق أداءً هو الأفضل في فئته على مقي-اس OpenLane-V2.

Danny Abraham, Nikhil Kamalkumar Advani, Arun Das, Nikil Dutt2026-03-30
💻 computer science

Knowledge is Power: Advancing Few-shot Action Recognition with Multimodal Semantics from MLLMs

تقدم هذه الورقة البحثية FSAR-LLaVA، وهو إطار عمل جديد متكامل (end-to-end) يستفيد من النماذج اللغوية الكبيرة متعددة الوسائط كقاعدة معرفية لاستخراج تمثيلات مكانية زمانية غنية وبناء نماذج أولية مركبة موجهة للمهام، مما يعزز بشكل كبير التعرف على الأفعال في ظروف التعلم القليل من خلال نهج تعلم متري متعدد الوسائط لا يتطلب تدريباً.

Jiazheng Xing, Chao Xu, Hangjie Yuan, Mengmeng Wang, Jun Dan, Hangwei Qian, Yong Liu2026-03-30
💻 computer science

Face2Parts: Exploring Coarse-to-Fine Inter-Regional Facial Dependencies for Generalized Deepfake Detection

تقترح الورقة البحثية Face2Parts، وهي طريقة هجينة جديدة للكشف عن التزييف العميق تعتمد على تمثيل الميزات الهرمي لالتقاط الاعتمادات المتبادلة بين المناطق من الخشن إلى الناعم بين مكونات الوجه (الإطار، والوجه، والشفاه، والعينين، والأنف) عبر انتباه القنوات والتعلم الثلاثي العميق، محققةً قدرة فائقة على التعميم والأداء عبر مجموعات بيانات مرجعية متعددة.

Kutub Uddin, Nusrat Tasnim, Byung Tae Oh2026-03-30