💻 computer science

HP-UniIF: Hierarchical Prompt Learning for Unified Image Fusion

تقترح الورقة البحثية إطار عمل HP-UniIF، وهو إطار رؤية موحد يستفيد من مسبقات الانتشار واستراتيجية تعديل شرطي هرمي عميق الاتجاه لتحقيق دمج الصور غير المتجانس، والترميم البصري، والإدراك الموجه نحو المهام في آن واحد، وذلك عبر فك الارتباط بين هذه الأهداف عبر مراحل الشبكة المختلفة.

Xingxin Xu, Siqi Zhao, Xin Li, Xinjie Yao, Yiming Sun, Pengfei Zhu2026-08-25
🤖 AI

HIRA: A Human-in-the-Loop Retrieval-Augmented Cascade for Document Classification in Regulated Industries

تُعد HIRA نظام تعاقب استرجاعي محلي، لا يتطلب تدريباً، لتصنيف المستندات الخاضعة للتنظيم، حيث يجمع بين الاسترجاع متعدد الوسائط ومُحقِّق يعتمد على نموذج لغوي كبير مستضاف محلياً وتغذية راجعة من العنصر البشري في الحلقة، وذلك لتحقيق دقة عالية مع تقليل المراجعة البشرية إلى أدنى حد وإلغاء الحاجة إلى إعادة تدريب مكلفة للنماذج.

Shangxuan Tian, Yanhui Chen, Carlos Queiroz2026-08-25
💬 NLP

PatchGate: Narrowing the Verbalization Gap with Intrinsic Object Inventories in Frozen Vision-Language Models

يُعد PatchGate إطار عمل لا يتطلب تدريباً يعمل على تضييق فجوة التعبير اللفظي في النماذج البصرية-اللغوية المجمدة عبر استخراج أدلة موضوعاتية ذاتية على مستوى الرقعة (patch-level) وخالية من المطالبات من طبقات فك التشفير واستخدامها لمعايرة لوغاريتمات فك التشفير، مما يؤدي في آن واحد إلى تحسين تغطية الموضوعات المرئية وتقليل الهلوسة دون الحاجة إلى كواشف خارجية أو ضبط دقيق.

Jihyung Ko, Eunji Jung, Hyeongsub Kim, Ziseok Lee, Jae Won Cho, Sanghyun Jo, Kyungsu Kim2026-08-25
🤖 AI

VisAdj: Learning Adjacency Matrices from Node-Link Images

يُعد VisAdj إطار عمل مبتكر يتعلم مصفوفات التجاور من صور العقد والروابط عبر توظيف عينة جيران تعتمد على الانتباه المتناثر لاختيار المرشحين، ومحول مخطط خطي لنمذجة تبعيات الحواف، مما يجعله يتفوق على الأساليب القائمة على خوارزمية أقرب جار (KNN) عبر مجموعات بيانات متنوعة.

Jiahao Xie, Guangmo Tong2026-08-25
💻 computer science

Towards Alias-Free 4D Gaussian Representations with Motion-Aware Filtering

تقترح هذه الورقة مرشح تنعيم ثلاثي الأبعاد مدركاً للحركة يتكيف ديناميكياً مع الحركة المحلية من خلال تقدير كثافة مشتركة للزمن ونسبة البعد البؤري إلى العمق، مما يقضي بفعالية على عيوب التعرج في تمثيلات غاوس رباعية الأبعاد لتخليق المشاهد الديناميكية من زوايا رؤية جديدة.

Ankit Dhiman, Kunal A Kathare, Pranav Vignesh, Lokesh R Boregowda, Venkatesh Babu Radhakrishnan2026-08-25
💻 computer science

GaussVid: Sparse-View Gaussian Splatting with 3D-Aware Video Diffusion Priors

يعالج GaussVid العيوب في تقنية "Gaussian Splatting" ثلاثية الأبعاد ذات الرؤية الشحيحة من خلال تقديم إطار عمل لاستعادة الفيديو مدرك للثلاثية الأبعاد يستفيد من مجموعة بيانات ضخمة لتقنية 3DGS ومن سابق هندسي مشروط بالكاميرا لضمان الاتساق بين المناظر المتعددة وإعادة البناء عالي الدقة.

Xinhui Liu, Can Wang, Wei Jiang, Wei Wang, Dong Xu2026-08-25
💻 computer science

Frame-Level Evaluation in Weakly Supervised Video Anomaly Detection Mostly Measures Video-Level Ranking

تكشف هذه الورقة أن مقاييس التقييم القياسية على مستوى الإطار في الكشف عن الشذوذ في الفيديو تحت الإشراف الضعيف منحازة بشدة للمقارنات بين الفيديوهات بدلاً من الترتيب الزمني داخل الفيديو الواحد، مما يسمح للنماذج بتحقيق درجات عالية بمجرد ترتيب الفيديوهات بشكل صحيح دون تحديد مواقع الشذوذ بدقة داخلها.

Inpyo Song, Jangwon Lee2026-08-25
💻 computer science

GuardPaint:SpeculativeSafetyDecodingforText-to-ImageGeneration

يقدم GuardPaint إطار عمل للتنفيذ الاستباقي يعزز سلامة نماذج الانتشار من النص إلى الصورة عبر توظيف مدقق خفيف الوزن للكشف عن المناطق غير الآمنة وإصلاحها جراحياً ضمن مسار التوليد، مما يقلل بفعالية من الهجمات العدائية مع الحفاظ على جودة الصورة ودقة المطالبة دون تعديل النموذج الأساسي.

Shreyash Dhoot, Paras Dhiman, Arsh Abbas Naqvi, Aranbi Dutta, Aman Chadha, Vinija Jain, Amitava Das2026-08-25
💻 computer science

Pixel-Space Diffusion via Observation Operators

تقدم هذه الورقة "انتشار مُعامل الملاحظة" (Observation Operator Diffusion)، وهو إطار عمل يعالج عدم التوافق بين المقياس والزمن في نماذج فضاء البكسل عبر استبدال الإشراف الكامل للصورة الثابت بمسار ملاحظة خشن إلى ناعم مرتبط زمنياً باستخدام مؤثرات "غاوس-لانزوس" (Gaussian-Lanczos)، مما يؤدي إلى تسريع التقارب وتحقيق جودة توليد رائدة.

Shaojie Guo, Lichen Ma, Haoyang Tong, Yu He, Zipeng Guo, Xiaoan Liu, Feng Yan, Yu Guo, Fei Wang, Junshi Huang, Yan Wang2026-08-25
🤖 AI

A Scalable Vector Graphics Latent Space

تقدم هذه الورقة البحثية نموذج SLS، وهو مشفر تلقائي قائم على تقنية Transformer، يعمل على إنشاء فضاء كامن متين وقابل للعكس ومتصل لرسومات المتجهات القياسية (SVG) من خلال تعلم تمثيلات مدمجة وثابتة الحجم لمسارات SVG الفردية، مما يتيح إعادة بناء عالية الدقة، وبحثاً فعالاً عن التشابه، وتوفيراً كبيراً في العمليات الحسابية مقارنة بالنهج القائم على الرموز (token-based).

Leonardo Zini, Elia Frigieri, Lorenzo Baraldi2026-08-25