🔬 applied physics

Data-Driven Automated Identification of Optimal Feature-Representative Images in Infrared Thermography Using Statistical and Morphological Metrics

تقترح هذه الورقة منهجية غير خاضعة للإشراف ومعتمدة على البيانات لتحديد الصور المثالية الممثلة للعيوب تلقائياً في التصوير الحراري بالأشعة تحت الحمراء، وذلك عبر الاستفال من ثلاثة مقاييس إحصائية ومورفولوجية متكاملة — وهي مؤشر تجانس الخليط، والمساحة الأولية الممثلة، وطاقة التباين الكلي — للتغلب على قيود طرق التقييم التقليدية التي تتطلب معرفة مسبقة بمواقع العيوب.

Harutyun Yagdjian, Martin Gurka2026-04-14
💬 NLP

ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models

يعزز ProGAL-VLA نماذج الرؤية واللغة والعمل من خلال دمج رسم بياني ثلاثي الأبعاد متمحور حول الكيانات، وتخطيط الأهداف الفرعية الرمزية، وفقد التباين في محاذاة التأسيس لتحقيق وكلاء روبوتيين أقوياء وحساسين للتعليمات ومدركين للغموض يتفوقون بشكل كبير على الأساليب الحالية في التعامل مع الاضطرابات والفروق اللغوية الدقيقة.

Nastaran Darabi, Amit Ranjan Trivedi2026-04-14
🤖 AI

PAS: Estimating the target accuracy before domain adaptation

تقترح هذه الورقة البحثية طريقة PAS، وهي طريقة مبتكرة لتسجيل ما قبل التكيف تستفيد من تضمينات الميزات سابقة التدريب لتقدير القابلية للنقل وتوجيه الاختيار الأمثل للمجالات المصدرية والنماذج سابقة التدريب، مما يؤدي إلى تحسين دقة الهدف مع تقليل العبء الحسابي في مهام تكييف المجال.

Raphaella Diniz, Jackson de Faria, Martin Ester2026-04-14
🤖 machine learning

Efficient Personalization of Generative User Interfaces

تتناول هذه الورقة التحدي المتمثل في تخصيص واجهات المستخدم التوليدية من خلال تقديم مجموعة بيانات تكشف عن تباين كبير في تفضيلات المصممين، واقتراح طريقة فعالة من حيث كفاءة العينات تعمل على نمذجة المستخدمين الجدد بناءً على المصممين السابقين بدلاً من مفاهيم التصميم الثابتة، مما يؤدي في النهاية إلى التفوق على النهج المرجعية في توليد الواجهات المفضلة.

Yi-Hao Peng, Samarth Das, Jeffrey P. Bigham, Jason Wu2026-04-14
⚡ electrical engineering

Not Your Stereo-Typical Estimator: Combining Vision and Language for Volume Perception

تقدم هذه الورقة نهجاً مبتكراً متعدد الوسائط يحسن بشكل كبير من تقدير حجم الأجسام من الصور الستيريو عبر دمج الإشارات البصرية ثلاثية الأبعاد الضمنية مع المعرفة المسبقة الصريحة المستمدة من الأوصاف النصية باللغة الطبيعية.

Gautham Vinod, Bruce Coburn, Siddeshwar Raghavan, Fengqing Zhu2026-04-14
🤖 AI

GLEaN: A Text-to-image Bias Detection Approach for Public Comprehension

تقدم هذه الورقة GLEaN، وهي مسار عمل قابل للتوسع ومستقل عن النماذج، يقوم بتوليد صور بورتريه مركبة تمثيلية من نماذج تحويل النص إلى صورة لجعل التحيزات الخوارزمية مقروءة بصرياً ومفهومة بسرعة للجمهور العام دون الحاجة إلى خبرة إحصائية.

Bochu Ding, Brinnae Bent, Augustus Wendell2026-04-14
🤖 AI

I Walk the Line: Examining the Role of Gestalt Continuity in Object Binding for Vision Transformers

تُثبت هذه الورقة أن نماذج "ترانسفورمر الرؤية" (Vision Transformers) تعتمد على مبدأ الاستمرارية لـ "جشتالت" للقيام بعملية ربط الكائنات، حيث تحدد وتتحقق من رؤوس انتباه محددة مسؤولة عن تتبع الاستمرارية عبر مجموعات بيانات متنوعة.

Alexa R. Tartaglini, Michael A. Lepori2026-04-14
💬 NLP

Cross-Cultural Value Awareness in Large Vision-Language Models

تتقصى هذه الورقة البحثية كيفية إظهار نماذج الرؤية واللغة الكبيرة (LVLMs) لتحيزات القيم الثقافية من خلال تحليل أحكامها الأخلاقية والقيمية والسياسية عبر سياقات ثقافية مختلفة باستخدام مجموعات صور استباقية ونظرية الأسس الأخلاقية.

Phillip Howard, Xin Su, Kathleen C. Fraser2026-04-14
🤖 machine learning

Attention-Guided Dual-Stream Learning for Group Engagement Recognition: Fusing Transformer-Encoded Motion Dynamics with Scene Context via Adaptive Gating

تقترح هذه الورقة DualEngage، وهو إطار عمل ثنائي المسار مبتكر يدمج ديناميكيات الحركة الفردية المشفرة عبر المحولات (transformer-encoded) مع السياق الزماني المكاني على مستوى المشهد عبر بوابات تكيفية لتحقيق دقة عالية في التعرف على التفاعل الجماعي في فيديوهات الفصول الدراسية.

Saniah Kayenat Chowdhury, Muhammad E. H. Chowdhury2026-04-14
🤖 AI

MatRes: Zero-Shot Test-Time Model Adaptation for Simultaneous Matching and Restoration

تُعد MatRes إطار عمل للتكيف في وقت الاختبار بنمط الصفر (zero-shot) يعمل على تعزيز استعادة الصور والمطابقة الهندسية بشكل مشترك عبر تحديث الوحدات خفيفة الوزن فقط على زوج واحد من الصور، مما يحل بفعالية التداخل المتبادل بين هاتين المهمتين دون الحاجة إلى تدريب مسبق أو إشراف إضافي.

Kanggeon Lee, Soochahn Lee, Kyoung Mu Lee2026-04-14