💻 computer science

High-speed Imaging through Turbulence with Event-based Light Fields

تقدم هذه الورقة أول نظام قادر على تصوير الأجسام غير الصلبة سريعة الحركة عبر الاضطرابات الجوية القوية بمعدلات إطارات عالية، وذلك من خلال الاستفادة من كاميرات المجال الضوئي القائمة على الأحداث والتعلم الآلي للتمييز بين حركة المشهد المترابطة والأحداث غير المترابطة الناتجة عن الاضطرابات.

Yu-Hsiang Huang, Levi Burner, Sachin Shah, Ziyuan Qu, Adithya Pediredla, Christopher A. Metzler2026-03-17
🤖 machine learning

TMPDiff: Temporal Mixed-Precision for Diffusion Models

تقدم الورقة البحثية TMPDiff، وهو إطار عمل زمني مختلط الدقة يقوم بتعيين دقات عددية متفاوتة بشكل تكيفي لخطوات إزالة الضجيج المختلفة في نماذج الانتشار لتقليل زمن انتقال الاستدلال بشكل كبير مع الحفاظ على الجودة الإدراكية أو تحسينها مقارنة بالنماذج المرجعية ذات الدقة الموحدة.

Basile Lewandowski, Simon Kurz, Aditya Shankar, Robert Birke, Jian-Jia Chen, Lydia Y. Chen2026-03-17
🤖 machine learning

MotionCFG: Boosting Motion Dynamics via Stochastic Concept Perturbation

تقترح الورقة البحثية MotionCFG، وهو إطار عمل يعزز ديناميكيات الحركة في تحويل النص إلى فيديو ويوجه المفاهيم المعقدة من خلال استبدال المطالبات السلبية الصريحة بالاضطراب المفهومي العشوائي لإنشاء ركائز سلبية صعبة ضمنية، مما يتجنب الانحياز الدلالي مع تحسين التفاصيل الزمنية بأقل قدر من التكاليف الحسابية.

Byungjun Kim, Soobin Um, Jong Chul Ye2026-03-17
💻 computer science

Enhancing Eye Feature Estimation from Event Data Streams through Adaptive Inference State Space Modeling

تقدم هذه الورقة نموذج فضاء الحالة للاستدلال التكيفي (AISSM)، وهو بنية مبتكرة معززة بشبكة ثقة ديناميكية وتقنية تعلم جديدة، لتحسين متانة وكفاءة استخراج ميزات العين من تدفقات بيانات الأحداث عبر التكيف ديناميكياً مع التغيرات المفاجئة في كثافة الأحداث وحركية النظر.

Viet Dung Nguyen, Mobina Ghorbaninejad, Chengyi Ma, Reynold Bailey, Gabriel J. Diaz, Alexander Fix, Ryan J. Suess, Alexa (…)2026-03-17
💻 computer science

Improving Visual Reasoning with Iterative Evidence Refinement

تقدم هذه الورقة البحثية إطار العمل SIEVE، وهو إطار عمل متكامل (end-to-end) يعزز الاستدلال البصري في نماذج الرؤية واللغة من خلال تدريبها على استخراج وحقن تمثيلات (embeddings) مناطق الصور البارزة داخلياً في سلاسل الاستدلال الخاصة بها عبر التعلم المعزز، مما يحسن الأداء دون الاعتماد على عمليات صور خارجية أو إعادة ترميز.

Zeru Shi, Kai Mei, Yihao Quan, Dimitris N. Metaxas, Ruixiang Tang2026-03-17
💻 computer science

Implementation and discussion of the Pith Estimation on Rough Log End Images using Local Fourier Spectrum Analysis method

تقدم هذه الورقة تنفيذاً وتقييماً بلغة بايثون لطريقة تحليل طيف فوريه المحلي (Local Fourier Spectrum Analysis) الخاصة برودولف شرامبل وأندرياس أول لتقدير مواقع النخاع في صور نهايات جذوع الأشجار الخشنة، والتي تم التحقق من صحتها عبر مجموعتي بيانات.

Henry Marichal, Diego Passarella, Gregory Randall2026-03-17
💬 NLP

MMOU: A Massive Multi-Task Omni Understanding and Reasoning Benchmark for Long and Complex Real-World Videos

تقدم هذه الورقة البحثية MMOU، وهو معيار شامل يضم 15,000 سؤال عبر 9038 فيديو متنوع طويل المدى لتقييم الاستدلال الشامل للأنماط (البصري، والصوتي، والنصي)، مما يكشف عن فجوات كبيرة في الأداء وأنماط فشل منهجية في النماذج متعددة الوسائط الحالية المتطورة.

Arushi Goel, Sreyan Ghosh, Vatsal Agarwal, Nishit Anand, Kaousheik Jayakumar, Lasha Koroshinadze, Yao Xu, Katie Lyons, J (…)2026-03-17
💻 computer science

SK-Adapter: Skeleton-Based Structural Control for Native 3D Generation

تقدم هذه الورقة SK-Adapter، وهو إطار عمل خفيف الوزن يتيح تحكماً هيكلياً دقيقاً لتوليد ثلاثي الأبعاد أصيل عبر ترميز إحداثيات المفاصل والطبولوجيا في رموز قابلة للتعلم يتم حقنها في نموذج أساسي مجمد، مدعوماً بمجموعة بيانات Objaverse-TMS واسعة النطاء وجديدة لتحقيق تلاعب هيكلي وتحرير محلي قوي مع الحفاظ على جودة النموذج التأسيسي.

Anbang Wang, Yuzhuo Ao, Shangzhe Wu, Chi-Keung Tang2026-03-17
💻 computer science

Garments2Look: A Multi-Reference Dataset for High-Fidelity Outfit-Level Virtual Try-On with Clothing and Accessories

تقدم هذه الورقة Garments2Look، وهي أول مجموعة بيانات متعددة الوسائط واسعة النطاق تضم 80 ألف زوج من تجربة القياس الافتراضية على مستوى الزي الكامل مع ملابس وإكسسوارات متعددة، إلى جانب خط معالجة للتوليف وتقييمات أساسية تكشف أن الأساليب الحالية تعاني من تعقيدات التنسيق السلس لعدة قطع وتعدد الطبقات.

Junyao Hu, Zhongwei Cheng, Waikeung Wong, Xingxing Zou2026-03-17
💻 computer science

BluRef: Unsupervised Image Deblurring with Dense-Matching References

تقدم هذه الورقة BluRef، وهي طريقة جديدة لإزالة الضبابية من الصور غير خاضعة للإشراف، تستفيد من المطابقة الكثيفة بين الصور الضبابية والحادة غير المزدوجة لتوليد حقيقة أرضية زائفة، محققةً أداءً هو الأفضل في فئته دون الاعتماد على بيانات تدريب مزدوجة أو شبكات مدربة مسبقاً.

Bang-Dang Pham, Anh Tran, Cuong Pham, Minh Hoai2026-03-17