💻 computer science

Category-Level 3D Correspondence in Camera Space via Morphable Object Priors

تقدم هذه الورقة البحثية HouseCorr3D، وهو معيار مرجعي واسع النطاق يضم 178 ألف صورة وتوصيفات لنقاط مفصلية ثلاثية الأبعاد، إلى جانب Morpheus، وهي طريقة تتعلم أوليات الأجسام القابلة للتشكل لتحقيق أداء فائق في مطابقة النقاط ثلاثية الأبعاد على مستوى الفئة في فضاء الكاميرا دون إشراف صريح على المطابقة.

Leonhard Sommer, Artur Jesslen, Basavaraj Sunagad, Adam Kortylewski2026-05-28
💻 computer science

Every9D-21M: Large-Scale Real-World 9D Canonicalization of Everyday Objects

تقدم هذه الورقة Every9D-21M، وهي مجموعة بيانات ضخمة تضم 21.8 مليون صورة من العالم الحقيقي مع تعليقات توضيحية للوضعية ذات 9 أبعاد عبر 700 فئة من الأشياء، والتي تم إنشاؤها من خلال الاستفادة من مقاطع الفيديو المتمحورة حول الأشياء والمحاذاة عبر النسخ لتجاوز ندرة الإشراف واسع النطاق في العالم الحقيقي لعملية التنميط ذات الـ 9 أبعاد.

Leonhard Sommer, Emil Akopyan, Adam Kortylewski2026-05-28
💻 computer science

EchoAvatar: Real-time Generative Avatar Animation from Audio Streams

يُعد EchoAvatar إطار عمل مبتكرًا في الوقت الفعلي يقوم بتوليد حركة أفاتار كاملة الجسم عالية الدقة ومستمرة من خلال الكلام والموسيقى المتدفقين، وذلك عبر استخدام بنية تدفق موحدة، والتعلم التعزيزي، والتحكم الدلالي المدفوع بالنماذج اللغوية الكبيرة للتفوق على النماذج المرجعية الحالية في التزامن والجودة.

Bohong Chen, Yumeng Li, Yinglin Xu, Youyi Zheng, Yanlin Weng, Kun Zhou2026-05-28
💻 computer science

Inpainting-Style Conditional Diffusion for Multivariable Time Series Forecasting

تقترح هذه الورقة إطار عمل جديد للانتشار الشرطي يعيد صياغة التنبؤ متعدد المتغيرات بالطاقة الشمسية كمسألة استكمال صور (image inpainting) عبر تحويل البيانات الزمنية إلى رقع ثنائية الأبعاد، مما يمكّن نموذجاً قائماً على شبكة U-Net من إعادة بناء الخطوات الزمنية المستقبلية بدقة من الملاحظات التاريخية من خلال عملية إزالة ضجيج موجهة بقناع.

Kourosh Kiani, S. M. Muyeen2026-05-28
💻 computer science

Transfer learning RGB models to hyperspectral images with trainable tensor decompositions

تقترح هذه الورقة طريقة جديدة للتعلم بنقل المعرفة تعمل على تكييف النماذج مسبقة التدريب ذات الصور الملونة (RGB) مع الصور فائقة الطيف من خلال تفكيك المرشحات الالتفافية إلى مكونات مكانية وطيفية، واستبدال الأخيرة بتوترات أعلى أبعاد قابلة للتدريب للحفاظ على الأنماط المكانية مع التخصص بفعالية في البيانات متعددة الأطياف.

Mariette Schönfeld, Laurens Devos, Wannes Meert, Hendrik Blockeel2026-05-28
💻 computer science

Toward Semantic-Agnostic and Shape-Aware Vision-Language Segmentation Models

تقدم هذه الورقة تقنية التجزئة "المستقلة عن الدلالات والواعية للشكل" (SANSA)، وهي نموذج جديد يعزز قدرة نماذج الرؤية واللغة على الاستنتاج حول الخصائص البصرية الجوهرية مثل الشكل والهندسة من خلال تدريبها على أوصاف نصية غير دلالية، مما يؤدي إلى مكاسب كبيرة في الأداء في المهام الواعية بالشكل مع الحفاظ على القدرات الدلالية القياسية.

Corentin Seutin, Mohamed Amine Ettaki, Michaël Clément, Pierrick Coupé, Rémi Giraud2026-05-28
💻 computer science

Sketch2Motion: Text-driven 2D Sketch to 3D Animation via Diffusion-guided Skeleton Optimization

يُعد Sketch2Motion إطار عمل موجَّهًا بالانتشار يقوم بتحويل الرسومات ثنائية الأبعاد الموجهة بالنصوص إلى رسوم متحركة ثلاثية الأبعاد واقعية لشخصيات متنوعة من خلال تحسين حركة الهيكل العظمي عبر أخذ عينات تشتت الانتباه المدركة للحركة والقيود الفيزيائية دون الحاجة إلى بيانات حركة مقترنة.

Gaurav Rai, Ojaswa Sharma2026-05-28
💻 computer science

EgoRelight: Egocentric Human Capture and Illumination Recovery for Relightable and Photoreal Avatar Rendering

يُعد EgoRelight إطار عمل شمولياً يُمكّن من التواجد عن بُعد في الواقع المختلط الغامر عبر الالتقاط المتزامن لحركة كامل الجسم، وتخليق صور رمزية (avatars) واقعية للغاية وقابلة لإعادة الإضاءة، واستعادة خرائط بيئة ذات نطاق ديناميكي عالٍ من خلال شاشة عرض واحدة مثبتة على الرأس.

Jianchun Chen, Yinda Zhang, Rohit Pandey, Thabo Beeler, Marc Habermann, Christian Theobalt2026-05-28
🤖 AI

Anomaly as Non-Conformity via Training-Free Graph Laplacian Energy Minimization

تقترح الورقة البحثية ANoCo، وهي طريقة غير خاضعة للتدريب للكشف عن الشذوذ غير الخاضع للإشراف، والتي تكمي الشذوذ البصري عبر حساب طاقة لابلاتسي المحدبة المطلوبة لمحاذاة رقعة استعلام مع متشعب سمات طبيعي ثابت، وبذلك تقيس عدم المطابقة من خلال الانحراف في السمات المستحث بالتحسين بدلاً من مجرد التشابه.

Jungwook Seo, Minjeong Kim, Younkwan Lee, Seungho Shin, Sungyong Baik2026-05-28
🤖 AI

BiasEdit: A Training-Free Bias-Detect-and-Edit Framework for Learning Fair Visual Classifiers

يُعد BiasEdit إطار عمل معياريًا لا يتطلب تدريبًا، يقوم تلقائيًا باكتشاف سمات التحيز غير المعروفة في مجموعات البيانات الصورية باستخدام التحليل الإحصائي واللغوي البصري، ثم يوظف تحرير الصور الموجه بالنصوص لإنشاء عينات واقعية متضاربة مع التحيز، مما يتيح تدريب مصنفات بصرية عادلة دون الحاجة إلى تعليقات توضيحية يدوية أو معرفة مسبقة بأنواع التحيزات.

Jungwook Seo, Yoonsik Park, Changmin Lee, Sungyong Baik2026-05-28