💻 computer science

VoDaSuRe: A Large-Scale Dataset Revealing Domain Shift in Volumetric Super-Resolution

تقدم هذه الورقة البحثية VoDaSuRe، وهي مجموعة بيانات واسعة النطاق من المسوحات الحجمية المزدوجة ذات الدقة العالية والمنخفضة الواقعية، لتوضيح أن نماذج الدقة الفائقة الحالية التي يتم تدريبها على بيانات منخفضة الدقة اصطناعية تفشل في التعميم على المسوحات الواقعية إما عن طريق تنعيم البنى الدقيقة أو إنتاج تنبؤات غير دقيقة، مما يسلط الضوء على الحاجة الماسة لمجموعات بيانات مزدوجة واقعية للنهوض بهذا المجال.

August Leander Høeg, Sophia Wiinberg Bardenfleth, Hans Martin Kjer, Tim Bjørn Dyrby, Vedrana Andersen Dahl, Anders Bjorh (…)2026-03-25
💻 computer science

Dual Contrastive Network for Few-Shot Remote Sensing Image Scene Classification

تقترح هذه الورقة شبكة تباين ثنائية (DCN) قائمة على النقل، توظف فروع تعلم تبايني موجهة بالسياق وموجهة بالتفاصيل لمعالجة تحديات التباينات الصغيرة بين الفئات والتباينات الكبيرة داخل الفئة الواحدة في تصنيف مشاهد الصور الاستشعارية عن بعد في ظل ندرة العينات، محققة أداءً تنافسياً عبر مجموعات بيانات مرجعية متعددة.

Zhong Ji, Liyuan Hou, Xuan Wang, Gang Wang, Yanwei Pang2026-03-25
🤖 machine learning

PhysSkin: Real-Time and Generalizable Physics-Based Animation via Self-Supervised Neural Skinning

يُعد PhysSkin إطار عمل يعتمد على التعلم الذاتي والمستند إلى الفيزياء، يستخدم مشفرًا تلقائيًا لجلود الشخصيات يعتمد على المحولات واستراتيجيات تدريب مبتكرة لتحقيق رسوم متحركة في الوقت الفعلي قائمة على الفيزياء وقابلة للتعميم عبر مختلف الأشكال والتقسيمات ثلاثية الأبعاد.

Yuanhang Lei, Tao Cheng, Xingxuan Li, Boming Zhao, Siyuan Huang, Ruizhen Hu, Peter Yichen Chen, Hujun Bao, Zhaopeng Cui2026-03-25
💻 computer science

PoseDriver: A Unified Approach to Multi-Category Skeleton Detection for Autonomous Driving

يُعد PoseDriver إطار عمل موحداً من الأسفل إلى الأعلى يعالج كشف الهياكل العظمية متعدد الفئات للقيادة الذاتية من خلال نمذجة كل فئة كمهمة متميزة، محققاً أداءً رائدًا في كشف المسارات ومثبتاً قابليته للنقل إلى فئات جديدة مثل الدراجات الهوائية من خلال مجموعة بيانات تم تقديمها حديثاً.

Yasamin Borhani, Taylor Mordan, Yihan Wang, Reyhaneh Hosseininejad, Javad Khoramdel, Alexandre Alahi2026-03-25
💻 computer science

Pose-Free Omnidirectional Gaussian Splatting for 360-Degree Videos with Consistent Depth Priors

تقدم هذه الورقة PFGS360، وهي طريقة لتقنية "Gaussian Splatting" ثلاثية الأبعاد شاملة الاتجاهات وخالية من تقدير الوضعية، تقوم بإعادة بناء المشاهد ثلاثية الأبعاد من فيديوهات 360 درجة غير محددة الوضعية عبر الاستفادة من الاتساق الكروي لتقدير وضعية الكاميرا ومن التكثيف المدرك لعدد النقاط المتوافقة مع العمق من أجل توليد مشاهد جديدة عالية الدقة.

Chuanqing Zhuang, Xin Lu, Zehui Deng, Zhengda Lu, Yiqun Wang, Junqi Diao, Jun Xiao2026-03-25
💻 computer science

Strain-Parameterized Coupled Dynamics and Dual-Camera Visual Servoing for Aerial Continuum Manipulators

تقدم هذه الورقة نموذجاً ديناميكياً موحداً معلماً بالانفعال للمناورات المستمرة الجوية التي تعمل بالأوتار ذات القواعد ناقصة التفعيل، ومتحكماً في التوجيه البصري ذو كاميرتين قوي، مما يثبت فعاليتها من خلال المحاكاة والتجارب على نموذج أولي تم بناؤه خصيصاً.

Niloufar Amiri, Farrokh Janabi-Sharifi2026-03-25
💻 computer science

An Explainable AI-Driven Framework for Automated Brain Tumor Segmentation Using an Attention-Enhanced U-Net

تقدم هذه الورقة إطار عمل للذكاء الاصطناعي القابل للتفسير يستخدم شبكة (U-Net) معززة بالانتباه مع دوال فقد متخصصة وتصور (Grad-CAM) لتحقيق تقسيم آلي عالي الدقة لمناطق الورم الدبقي الفرعية في صور الرنين المغناطيسي، مما يعالج تحديات التحليل اليدوي وعدم توازن الفئات للتطبيقات السريرية.

MD Rashidul Islam, Bakary Gibba2026-03-25
💻 computer science

FHAvatar: Fast and High-Fidelity Reconstruction of Face-and-Hair Composable 3D Head Avatar from Few Casual Captures

يُعد FHAvatar إطار عمل مبتكرًا يتيح إعادة بناء سريعة وعالية الدقة لصور رمزية ثلاثية الأبعاد للرأس قابلة للتركيب، مع مكونات منفصلة للوجه والشعر من خلال لقطات عفوية قليلة، وذلك عبر فك الارتباط بين تمثيلاتهما في مساحة النسيج والاستفوتادة من هيكل محول مجمع لتعلم الميزات عبر الرؤى بكفاءة.

Yujie Sun, Zhuoqiang Cai, Chaoyue Niu, Jianchuan Chen, Zhiwen Chen, Chengfei Lv, Fan Wu2026-03-25
💻 computer science

FG-Portrait: 3D Flow Guided Editable Portrait Animation

يقدم FG-Portrait إطار عمل انتشار موجه بالتدفق ثلاثي الأبعاد يستفيد من التدفقات ثلاثية الأبعاد المدفوعة بالهندسة وأخذ العينات الموجه بالعمق لتحقيق رسوم متحركة للصور الشخصية عالية الدقة وقابلة للتعديل، مع نقل حركة وحفاظ على الهوية يتفوقان على الطرق الحالية.

Yating Xu, Yunqi Miao, Evangelos Ververas, Jiankang Deng, Jifei Song2026-03-25
💬 NLP

Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning

تقدم هذه الورقة البحثية TRACE، وهي طريقة صياغة (prompting) تعزز قدرات الاستدلال المكاني ثلاثي الأبعاد للنماذج اللغوية الكبيرة متعددة الوسائط من خلال توجيهها لتوليد تمثيلات نصية مهيكلة قائمة على المنظور الخارجي (allocentric) لبيئات الفيديو ذات المنظور الذاتي (egocentric)، مما يؤدي إلى تحسينات مستمرة في الأداء عبر مختلف المعايير المرجعية وهياكل النماذج.

Jiacheng Hua, Yishu Yin, Yuhang Wu, Tai Wang, Yifei Huang, Miao Liu2026-03-25