🤖 AI

Generalizing Soft Tissue Deformation and Force Prediction Across Material Stiffness and Geometry

تقدم هذه الورقة شبكة عصبية رسومية متساوية التباين مشروطة بالليونة، تم تدريبها على محاكاة مرنة فائقة تمت معايرتها بشكل منهجي لتحقيق تعميم دقيق وفوري لتشوه الأنسجة الرخوة والتنبؤ بالقوة عبر مستويات متفاوتة من صلابة المواد وهندسات غير مرئية.

Madina Kojanazarova, Sidaty El Hadramy, Philippe C. Cattin2026-08-24
💻 computer science

Kinematic Knowledge Maps for Pattern Alignment: Structured Latent Representational Learning in Multimodal Gait Analysis

تقدم الورقة البحثية ScoliDetect، وهو إطار عمل متعدد الوسائط وقابل للتفسير لفحص الجنف مجهول السبب لدى المراهقين، والذي يستفيد من خريطة معرفية حركية مهيكلة ونصوص قائمة على القوالب لتعزيز التعميم والقابلية للتفسير من خلال الانتباه المتقاطع ثنائي الاتجاه والتدريب المسبق التبايني.

Chen Dong, He Zonglin, Cheung Kenneth M. C2026-08-24
🤖 AI

WA-JEPA: Rethinking the Video JEPA Paradigm for World-Action Modeling in Autonomous Driving

تقدم الورقة البحثية WA-JEPA، وهو نموذج عالم-فعل (world-action model) مبتكر يعيد التفكير في نموذج Video JEPA من خلال توظيف التدريب المسبق الهجين القائم على حجب المستقبل (future-masked pre-training) ومطابقة التدفق الشرطي (conditional flow matching) لتوليد تمثيلات كامنة مستقبلية معقولة، محققاً بذلك أداءً هو الأفضل في فئته في مجال تخطيط القيادة الذاتية على معايير قياسية مثل NAVSIM وHUGSIM.

Xinlin Wang, Yujiao Xiang, Yuheng Zhou, Jingqi Wang, Minqing Huang, Jiajie Huang, Dongxu Wei, Tingguang Zhou, Xiyang Wan (…)2026-08-24
💻 computer science

Dorsal Hand Images for Immersive (XR) and Privacy-preserving Age Assurance and Child Safety

تقترح هذه الورقة استخدام صور ظهر اليد الملتقطة بواسطة كاميرات نظارات الواقع الممتد (XR) كبديل غامر ومحافظ على الخصوصية لتقنية التعرف على الوجه من أجل التحقق المستمر من العمر، مُثبتةً من خلال مجموعة بيانات متنوعة أن هذه الطريقة يمكنها التمييز بفعالية بين القاصرين والبالغين عند عتبة الـ 18 عاماً مع المتانة تجاه تباينات لون البشرة.

Riccardo Bovo, George Loukas, Josh P. Davis2026-08-24
💻 computer science

Recognition-Conditioned Reasoning: A Training-Free Multimodal-LLM Pipeline for Fine-Grained Micro-Action Understanding

تقدم هذه الورقة البحثية مسار معالجة يعتمد على الأوامر النصية فقط ولا يتطلب تدريباً، يستفيد من النماذج اللغوية الكبيرة متعددة الوسائط المجمدة مع توجيه ديناميكي للمهام لتحقيق أداء رائد في التعرف والوصف والاستدلال الدقيق للأفعال الدقيقة، محققةً المركز الأول في تحدي MAC 2026.

Fengshun Wang, Jin'ang Han, Zhigang Tu2026-08-24
🤖 AI

CoAnchor: Robust Collaborative Perception under Spatio-Temporal Misalignment via Object-Level Anchors

تقترح الورقة البحثية CoAnchor، وهو إطار عمل متمحور حول المرتكزات (anchor-centric) يوحد بين الصقل المكاني، والانتشار الزمني، والتحقق عبر مرتكزات نادرة على مستوى الكائن لمعالجة تأخيرات الاتصال وعدم محاذاة الوضعية بشكل مشترك وقوي في الإدراك التعاوني.

Chi Li, Rui Lin, Aobo Ji, Dongzhu Xu2026-08-24
🤖 AI

CIVA: Critic-Induced Value-Subspace Attacks on Visual World-Model Agents

تقترح الورقة البحثية CIVA، وهي طريقة هجوم "الصندوق الأبيض" التي تستغل الفضاء الجزئي للقيم منخفض الأبعاد الناتج عن "الناقد" (critic) الخاص بالوكيل لتوليد اضطرابات متماسكة زمنياً وفعالة من حيث التكلفة، تعمل بفعالية على تعطيل وكلاء نماذج العالم البصرية مثل DreamerV3.

Jiancheng Wang, Mingli Zhu, Tong Zhang, Jiaqi Ruan, Wei Wang, Siyuan Liang, Dacheng Tao2026-08-24
🤖 AI

A Modular Agent for Reliable and Auditable Spatial Relation Verification in CT Scans

تقدم هذه الورقة عميلاً برمجياً نموذجياً للتصوير الطبي يعزز التحقق الموثوق والقابل للتدقيق من العلاقات المكانية في الأشعة المقطعية عبر تفكيك المهمة إلى تحليل لغوي، وتحديد المواقع التشريحية، وتحقق هندسي حتمي، محققاً دقة وقابلية تفسير أعلى بكثير من نماذج الرؤية واللغة المتكاملة.

Simon Vincent Abel, Heiko Hillenhagen, Michael Götz, Timo Ropinski, Ayhan Can Erdur, Daniel Santak Wolf2026-08-24✓ Author reviewed
🤖 machine learning

Human-JEPA: A Human-Centric Vision Model that Perceives and Anticipates

يُعد Human-JEPA نموذج رؤية متمحوراً حول الإنسان، تم تدريبه عبر الفيديو بواسطة التنبؤ المرتكز، وهو يحقق في آن واحد إدراكاً استاتيكياً وتوقعاً مستقبلياً بمستوى الحالة الراهنة مع عدد أقل بكثير من المعلمات مقارنة بالنماذج المتخصصة الحالية، متجاوزاً بذلك القيود السابقة في فهم الحركة وانهيار النموذج.

Hui Wei, Licai Sun, Guoying Zhao2026-08-24
⚡ electrical engineering

Toward Vision Language Model-based Assessment of Clinical Quality and Usability of LGE-MR Images for Cardiac Ablation Planning

تقترح هذه الورقة إطار عمل لنموذج الرؤية واللغة يتكون من مرحلتين، يقوم بتوليد تقارير جودة مهيكلة بأسلوب الأشعة واستخلاص قرارات الاستخدام السريري الثنائية لصور الرنين المغناطيسي للقلب مع تعزيز تباين تعزيز الأنساذ المتأخرة (LGE-MRI) للأذين الأيسر، مما يثبت أن نموذج DeepSeek يحقق توافقاً تاماً مع أطباء الأشعة الخبراء في تحديد مدى ملاءمة الصور لتخطيط عملية الاستئصال القلبي.

Bipasha Kundu, Abhishek Chaturvedi, Axel W. E. Wismueller, Richard Simon, Cristian A. Linte2026-08-24