💻 computer science

Embedding Physical Reasoning into Diffusion-Based Shadow Generation

تقترح هذه الورقة إطار عمل قائماً على الانتشار ومبنياً على أسس فيزيائية يعزز واقعية الظلال وتحديد مواقعها من خلال اشتقاق الإشارات الهندسية والضوئية من تحليل المشهد، وتنظيم تأثيرها عبر درجات الثقة، واستخدامها لتوجيه توليد ظلال دقيقة للأجسام المدرجة.

Shilin Hu, Jingyi Xu, Akshat Dave, Dimitris Samaras, Hieu Le2026-03-20
💻 computer science

Cast and Attached Shadow Detection via Iterative Light and Geometry Reasoning

تقترح هذه الورقة إطار عمل تكراريًا قائمًا على الأسس الفيزيائية يعمل على الكشف المشترك عن الظلال الملقاة والظلال الملتصقة من خلال الاستفادة من حلقة تغذية راجعة مغلقة بين وحدتي تقدير الضوء وكشف الظل، محققًا تحسينات كبيرة في الأداء على مجموعة بيانات تم تنسيقها حديثًا.

Shilin Hu, Jingyi Xu, Sagnik Das, Dimitris Samaras, Hieu Le2026-03-20
💻 computer science

GTAvatar: Bridging Gaussian Splatting and Texture Mapping for Relightable and Editable Gaussian Avatars

يقترح GTAvatar طريقة مبتكرة تربط بين تقنية Gaussian Splatting ثنائية الأبعاد ورسم خرائط أنسجة UV لإعادة بناء نماذج رمزية للرأس عالية الدقة، وقابلة لإعادة الإضاءة والتحرير بشكل بديهي من خلال فيديو أحادي العدسة عبر دمج عناصر Gaussian الأولية في نطاق UV معياري.

Kelian Baert, Mae Younes, Francois Bourel, Marc Christie, Adnane Boukhayma2026-03-20
💻 computer science

Image2Garment: Simulation-ready Garment Generation from a Single Image

تقترح هذه الورقة إطار عمل بنظام التغذية الأمامية يقوم بتوليد ملابس جاهزة للمحاكاة من صورة واحدة عبر ضبط نموذج رؤية ولغة بدقة لاستنتاج سمات المواد وربطها بالمعلمات الفيزيائية من خلال متنبئ خفيف الوزن، مما يتغلب على نقص مجموعات البيانات من الصور إلى الفيزياء ويلغي الحاجة إلى التحسين التكراري.

Selim Emir Can, Jan Ackermann, Kiyohiro Nakayama, Ruofan Liu, Tong Wu, Yang Zheng, Hugo Bertiche, Menglei Chai, Thabo Be (…)2026-03-20
🤖 machine learning

Is Hierarchical Quantization Essential for Optimal Reconstruction?

تُثبت هذه الورقة أنه عندما يتم موازنة ميزانيات التمثيل وتخفيف حدة انهيار كتاب الرموز (codebook collapse) من خلال تدخلات محددة، يمكن لشبكات VQ-VAE أحادية المستوى تحقيق دقة إعادة بناء تضاهي المتغيرات الهرمية، مما يتحدى الافتراض بأن التكميم الهرمي متفوق بطبيعته من أجل الحصول على عمليات إعادة بناء عالية الجودة.

Shirin Reyhanian, Laurenz Wiskott2026-03-20
🤖 AI

1S-DAug: One-Shot Data Augmentation for Robust Few-Shot Generalization

تقدم الورقة البحثية 1S-DAug، وهو ملحق (plugin) لا يتطلب تدريباً ومستقل عن النموذج، يعمل على تعزيز تعميم التعلم بلقطات قليلة من خلال تخليق متغيرات صور متنوعة من مثال واحد باستخدام عملية انتشار لإزالة الضجيج، مما يعزز الدقة بشكل كبير عبر المعايير القياسية دون الحاجة إلى تحديث معاملات النموذج.

Yunwei Bai, Ying Kiat Tan, Yao Shu, Tsuhan Chen2026-03-20
💻 computer science

ITKIT: Feasible CT Image Analysis based on SimpleITK and MMEngine

إن ITKIT هو إطار عمل قابل للتطبيق لتحليل صور الأشعة المقطعية مبني على SimpleITK وMMEngine، ويقدم مسار عمل متكاملاً من صور DICOM إلى التجزئة ثلاثية الأبعاد، ملبياً احتياجات المبتدئين ذوي الموارد الحوسبية المحدودة والمستخدمين المتقدمين من خلال تكوين مرن للنماذج، كما تم التحقق من ذلك عبر 12 تجربة نموذجية.

Yiqin Zhang, Meiling Chen2026-03-20
💻 computer science

Expanding mmWave Datasets for Human Pose Estimation with Unlabeled Data and LiDAR Datasets

تقترح الورقة البحثية إطار عمل EMDUL، وهو إطار عمل مبتكر يعمل على توسيع مجموعات بيانات تقدير وضعية جسم الإنسان باستخدام الموجات المليمترية (mmWave) الشحيحة من خلال الاستفادة من بيانات الموجات المليمترية غير المصنفة ومجموعات بيانات ليدار (LiDAR) المتنوعة عبر التسمية المستعارة والتحويل ذي الصيغة المغلقة، مما يحسن بشكل كبير أداء النموذج وقدرته على التعميم في كل من الإعدادات داخل النطاق وخارجه.

Zhuoxuan Peng, Boan Zhu, Xingjian Zhang, Wenying Li, S. -H. Gary Chan2026-03-20
💻 computer science

RARE disease detection from Capsule Endoscopic Videos based on Vision Transformers

تقدم هذه الورقة نموذج "جوجل فيجن ترانسفورمر" (ViT) تم ضبطه بدقة للتصنيف متعدد الملصقات لـ 17 حالة من حالات الجهاز الهضمي في فيديوهات كبسولة التنظيب، وذلك كجزء من مسابقة "جاسترو"، رغم أنه حقق متوسط دقة متوسطة (mAP) منخفضاً يبلغ حوالي 0.02 في مجموعة بيانات الاختبار.

X. Gao, C. Chien, G. Liu, A. Manullang2026-03-20
🤖 AI

S3T-Former: A Purely Spike-Driven State-Space Topology Transformer for Skeleton Action Recognition

تقدم هذه الورقة البحثية نموذج S3T-Former، وهو أول بنية Transformer تعتمد كلياً على النبضات (spike-driven) للتعرف على حركات الهيكل العظمي، والتي تحقق كفاءة في استهلاك الطاقة ونمذجة زمنية طويلة المدى من خلال تضمين تشريحي نبضي متعدد المسارات (Multi-Stream Anatomical Spiking Embedding)، وتوجيه طوبولوجي نبضي جانبي (Lateral Spiking Topology Routing)، ومحرك حالة نبضي (Spiking State-Space Engine)، متجاوزةً بذلك قيود النماذج النبضية الحالية مع الحفاظ على دقة تنافسية.

Naichuan Zheng, Hailun Xia, Zepeng Sun, Weiyi Li, Yujia Wang2026-03-20