💻 computer science

ZOMP: Zeroth-Order Multi-Modal Prompt Tuning for Vision-Language Models

تُعد ZOMP طريقةً فعالةً في الاستعلام، وتعمل بنظام التمرير الأمامي الكامل فقط، حيث تعمل على تحسين المطالبات العميقة في كل من فروع الرؤية والنص لنماذج CLIP المجمدة باستخدام التقريب العشوائي للاضطراب المتزامن، متفوقةً بذلك على الأساليب الحالية من الدرجة الصفرية عبر معايير متعددة من خلال الاستفادة من إعادة التشكيل منخفض الرتبة عبر الوسائط، والزخم التصحيحي للتدرج، وجدول رتبة ديناميكي.

Sajjad Ghiasvand, Yifan Yang, Mahnoosh Alizadeh, Ramtin Pedarsani2026-08-11
⚡ electrical engineering

EvBS: Event-guided Blur Synthesis for Domain-adaptive Motion Deblurring

تقترح الورقة البحثية إطار عمل EvBS، وهو إطار لتخليق الضبابية الموجه بالأحداث يستفيد من الدقة الزمنية العالية لكاميرات الأحداث لفصل الحركة عن المحتوى البصري، مما يتيح توليد أزواج تدريب متنوعة من أجل التكيف الفعال للمجال في عملية إزالة الضبابية الناتجة عن الحركة.

Junsik Jung, Seokryun Choi, Yoonki Cho, Woo Jae Kim, Andrew Jeong, Sung-Eui Yoon2026-08-11
💻 computer science

NeuroGuard: Neural Gradient Update Aware of Representation Damage

تُعد NeuroGuard طريقةً للتحكم في التحديثات خالية من المعلمات للتعلم المتزايد للفئات ذات التوزيع طويل الذيل، حيث تعمل على تعزيز خط الأساس DGR عبر تغيير مقياس تحديثات التدرج بشكل تكيفي بناءً على عدم يقين النموذج المعلم، والتقطير المعرفي المصنف حسب الثقة، وهشاشة الذاكرة، مما يحقق دقة فائقة عبر الفئات القديمة والجديدة والمتوسطة التكرار دون كبت عام للتدرج.

Taigo Sakai, Kazuhito Hotta2026-08-11
💻 computer science

SUMI: Scalable Unified Model for 3D Point Cloud Inference

تقدم الورقة البحثية نموذج SUMI، وهو نموذج موحد وقابل للتوسع يعزز عملية إكمال السحابة النقطية ثلاثية الأبعاد من الخشن إلى الناعم عبر دمج وحدة تنقية قائمة على الانتشار مع آليات الانتباه المتقاطع لتحسين إعادة بناء التفاصيل المحلية مع الحفاظ على الاتساق الهيكلي العالمي.

Yanlong LI, Kanchana Thilakarathna2026-08-11
💻 computer science

When Does An Extra View Help? Adapting Single-View 3D Reconstruction with Extra Imagery

تقدم هذه الورقة البحثية إطار عمل ASV3D، الذي يعزز إعادة البناء ثلاثي الأبعاد من منظور واحد عبر دمج صورة إضافية من خلال استراتيجيات التكيف القائمة على التعلم التبايني والتعلم الصفري، مما يحسن الدقة والاتساق بشكل كبير في كل من مجموعات البيانات المرجعية والبيانات الواقعية.

Y Huynh, Duc Thanh Nguyen, Thao Minh Le, Mohamed Abdelrazek2026-08-11
💻 computer science

Learning Structural Illumination for Unsupervised Low-light Enhancement

تقترح هذه الورقة البحثية إطار عمل RISE، وهو إطار غير خاضع للإشراف لتعزيز الإضاءة المنخفضة يعمل على فصل بنية الإضاءة النسبية عن التعرض المطلق عبر استنتاجها من المناطق الساطعة الموثوقة، ويستخدم مرجع قياس مزدوج لتعديل التعرض المتكيف مع المشهد، محققاً أداءً هو الأفضل في فئته مع نتائج بصرية طبيعية.

Tianle Du, Peiyuan He, Hainuo Wang, Tianxiu Yu, Xiaojie Guo2026-08-11
💻 computer science

Wiener Representation Filtering for VLM Hallucination Suppression

تقترح هذه الورقة "ترشيح تمثيل وينر" (Wiener Representation Filtering)، وهي تقنية لا تتطلب تدريباً وتُطبق بعد عملية التدريب (post-hoc)، تعمل على كبح الهلوسات المتعلقة بالأجسام في النماذج البصرية اللغوية من خلال تطبيق مُقدِّر من نوع "وينر" ذي صيغة مغلقة لتخفيف المكونات المرتبطة بالهلوسة في الحالات الخفية للعمود الفقري اللغوي، مما يؤدي إلى تحسين الدقة في مختلف المعايير مع الحفاظ على سرعة الاستدلال والطلاقة.

Ameen Ali, Tamim Zoabi, Lidor Brami, Lior Wolf2026-08-11
💻 computer science

VTO: Visual Tool Orchestration for Video Anomaly Detection

تقترح الورقة البحثية إطار عمل VTO، وهو إطار للتعلم التعزيزي الخاضع للإشراف على العمليات يستفيد من مُقيّم معرفي مدفوع بنموذج تأسيسي وإشراف دقيق خطوة بخطوة لتمكين الوكلاء متعددي الوسائط من تنسيق الأدوات البصرية المتخصصة ديناميكيًا لتحسين كشف الشذوذ في الفيديو، وهو ما تم التحقق منه بواسطة معيار ومجموعة أدوات جديدة تسمى VAD-Tool.

Rui Wang, Yeteng Wu, Xianling Zhang, Mengshi Qi2026-08-11
🔬 condensed matter

High-Capacity Generalized Hopfield Networks

تقدم هذه الورقة شبكات هوبفيلد المُعممة على الفضاءات المتناظرة SU(d) التي تستخدم طرقاً جبرية لية (Lie algebraic) لتحقيق زيادة في سعة الذاكرة الحرجة تقترب من رتبة مقدار كامل مقارنة بالشبكات المتجهة التقليدية، مع إثبات استرجاع قوي عبر ديناميكيات لانداو-ليفشيتز-جيلبرت وكشف الروابط مع نماذج ساشديف-يي الزجاجية عند التكميم.

Victor Galitski2026-08-11
💻 computer science

Action- and Language-Conditioned Video Assessment for Embodied Control

تقترح الورقة البحثية ALVA، وهو مُقيّم للمسارات يستفيد من نموذج لغوي بصري مُدرب مسبقاً لتقييم تقدم المهمة عبر تلخيص الانتقالات البصرية المشروطة بالأفعال ومقارنتها بالتعليمات اللغوية الطبيعية، مما يوفر آلية تغذية راجعة متحفظة وقابلة للتفسير تتفوق على النماذج المرجعية القائمة على الصور الثابتة والتضمينات في مهام التحكم المجسد.

Hwanhee Kim, Jaehyun Jang, Seungmin Cha, Hyeonseo Yun, Donghoon Lee, Chang D. Yoo2026-08-11