💻 computer science

Towards 3D Scene Understanding of Gas Plumes in LWIR Hyperspectral Images Using Neural Radiance Fields

تقترح هذه الورقة نهجاً جديداً لمجال الإشعاع العصبي (NeRF) معززاً بخسارة متوسط مربع الخطأ (MSE) ذات أوزان تكيفية لإعادة بناء المشاهد ثلاثية الأبعاد من صور طيفية بالأشعة تحت الحمراء طويلة الموجة شحيحة، مما يثبت فعاليتها في تحسين أداء كشف سحابة الغاز مقارنة بالطرق القياسية.

Scout Jarman, Zigfried Hampel-Arias, Adra Carr, Kevin R. Moon2026-03-06
💻 computer science

Towards Multimodal Lifelong Understanding: A Dataset and Agentic Baseline

تقدم هذه الورقة MM-Lifelong، وهو عبارة عن مجموعة بيانات واسعة النطاق من لقطات الحياة اليومية الطبيعية وغير المكتوبة التي تمتد لفترة تصل إلى شهر، وتقترح الوكيل متعدد الوسائط المتكرر (ReMA) للتغلب على قيود الذاكرة العاملة والتحديد الموضعي للنماذج الحالية في الفهم متعدد الوسائط طويل الأمد.

Guo Chen, Lidong Lu, Yicheng Liu, Liangrui Dong, Lidong Zou, Jixin Lv, Zhenquan Li, Xinyi Mao, Baoqi Pei, Shihao Wang, Z (…)2026-03-06
⚛️ quantum physics

Schrödinger's Camera: First Steps Towards a Quantum-Based Privacy Preserving Camera

تقترح هذه الورقة نظام كاميرا مبتكرًا يعتمد على الكم للحفاظ على الخصوصية، يقوم بتخزين صور منخفضة الدقة في حالات كمومية قابلة للعكس ويستخدم خوارزمية التعلم العميق لـ Q المزدوجة للموازنة ديناميكيًا بين الخصوصية والمنفعة قبل عملية القياس، مما يثبت جدوى التحكم في كلا الجانبين في المحاكاة.

Hannah Kirkland, Sanjeev J. Koppal2026-03-05
🤖 AI

Learning to Generate Conditional Tri-plane for 3D-aware Expression Controllable Portrait Animation

تقدم هذه الورقة Export3D، وهي طريقة لتحريك الصور الشخصية ثلاثية الأبعاد بلمحة واحدة (one-shot) تعتمد على الوعي ثلاثي الأبعاد، وتستخدم إطار تدريب مسبق تبايني ومولد ثلاثي المستويات (tri-plane generator) لتحقيق توليد صور قابل للتحكم في التعبيرات ومتغير من حيث زوايا الرؤية، مع القضاء بفعالية على عمليات تبديل المظهر غير المرغوب فيها أثناء نقل التعبيرات عبر الهويات المختلفة.

Taekyung Ki, Dongchan Min, Gyeongsu Chae2026-03-05
💻 computer science

FireANTs: Adaptive Riemannian Optimization for Multi-Scale Diffeomorphic Matching

تقدم الورقة البحثية FireANTs، وهي خوارزمية تحسين ريماني تكيفية متعددة المقاييس، معززة بوحدة معالجة الرسومات وغير معتمدة على التدريب، تحقق مطابقة صور تباينية (diffeomorphic) كثيفة أسرع بكثير وأكثر كفاءة في استهلاك الذاكرة من كل من الطرق التقليدية ونهج التعلم العميق، مع الحفاظ على تعميم قوي عبر مختلف الأنماط والتركيبات التشريحية.

Rohit Jena, Pratik Chaudhari, James C. Gee2026-03-05
🤖 AI

DCENWCNet: A Deep CNN Ensemble Network for White Blood Cell Classification with LIME-Based Explainability

تقترح الورقة البحثية نموذج DCENWCNet، وهو نموذج تجميعي جديد للشبكات العصبية الالتفافية العميقة يدمج ثلاث بنيات مهيأة بشكل فريد لتحقيق دقة ومتانة فائقة في تصنيف خلايا الدم البيضاء على مجموعة بيانات Rabbin-WBC، مع توظيف تقنية LIME لتعزيز قابلية تفسير النموذج والثقة في التشخيص الآلي.

Sibasish Dhibar2026-03-05
🤖 machine learning

A dataset of high-resolution plantar pressures for gait analysis across varying footwear and walking speeds

تقدم هذه الورقة مجموعة بيانات UNB StepUP-P150، وهي مجموعة ضخمة وعالية الدقة من بيانات ضغط باطن القدم لـ 150 فردًا عبر سرعات مشي وظروف أحذية متنوعة، والمصممة لتعزيز الأبحاث في التعرف البيومتري على المشية، والميكانيكا الحيوية، والتعلم العميق.

Robyn Larracy, Angkoon Phinyomark, Ala Salehi, Eve MacDonald, Saeed Kazemi, Shikder Shafiul Bashar, Aaron Tabor, Erik Sc (…)2026-03-05
💻 computer science

Generative Human Geometry Distribution

تقترح هذه الورقة إطار عمل توليدي جديداً من مرحلتين يقوم بترميز توزيعات الهندسة البشرية كخرائط سمات ثنائية الأبعاد ضمن نطاق SMPL لتحقيق توليد صور رمزية (avatars) عالية الدقة ومشروطة بالوضعية، مع تحسين جودة الهندسة بشكل كبير مقارنة بالطرق الحالية الرائدة.

Xiangjun Tang, Biao Zhang, Peter Wonka2026-03-05
💻 computer science

Beyond the Encoder: Joint Encoder-Decoder Contrastive Pre-Training Improves Dense Prediction

تقدم هذه الورقة DeCon، وهو إطار عمل للتعلم الخاضع للإشراف الذاتي يقوم بالتدريب المسبق المشترك للمشفرات وفك التشفير باستخدام فقد تبايني موزون، محققاً أداءً هو الأفضل في فئته عبر مختلف مهام التنبؤ الكثيف ومجموعات البيانات من خلال تعزيز جودة التمثيل بشكل كبير مقارنة بالنهج التقليدي المقتصر على المشفر فقط.

Sébastien Quetin, Tapotosh Ghosh, Farhad Maleki2026-03-05
💬 NLP

Why 1 + 1 < 1 in Visual Token Pruning: Beyond Naive Integration via Multi-Objective Balanced Covering

تقدم هذه الورقة البحثية إطار عمل "التغطية المتوازنة متعددة الأهداف" (MoB)، وهو إطار عمل مبتكر لتقليم الرموز البصرية يستفيد من مسافة هوسدورف ونظرية التغطية بـ ϵ\epsilon لاستخلاص حد خطأ في صيغة مغلقة وموازنة محاذاة المطالبات مع الحفاظ البصري ديناميكيًا، مما يحقق تسارعًا كبيرًا في الاستدلال مع أدنى حد من فقدان الأداء عبر مختلف النماذج متعددة الوسائط.

Yangfu Li, Hongjian Zhan, Tianyi Chen, Qi Liu, Yue Lu2026-03-05