💻 computer science

Towards Sparsely Annotated Open-World Object Detection

تقدم هذه الورقة البحثية مهمة الكشف عن الأشياء في العالم المفتوح ذات التوسيم المتناثر (SA-OWOD)، وهي مهمة جديدة تعالج التزامن بين الإشراف المتناثر والفئات غير المرئية، وتقترح إطار عمل اكتشاف الأشياء ثنائي المنظور (DPOD) لحل إشارات الإشراف الغامضة بفعالية وتحسين الكشف عن كل من الأشياء المعروفة وغير المعروفة.

HeeJu Han, AJeong Kim, Jinsun Park2026-08-14
⚡ electrical engineering

CW-BASS v2: Saturation-Aware Pseudo-Label Selection for Semi-Supervised Segmentation under Foundation-Model Teachers

يعالج CW-BASS v2 تحدي اختيار الملصقات الزائفة للتجزئة شبه الخاضعة للإشراف باستخدام معلمين من النماذج التأسيسية القوية عبر تقديم آلية بوابية أحادية الممر واعية بالتشبع، تقوم بالتبديل ديناميكياً بين عتبات الثقة الصارمة وأرضية تكيفية بناءً على تقديرات الموثوقية في الوقت الفعلي، مما يمنع الانحياز التأكيدي في أنظمة التشبع مع الحفاظ على الأداء عبر مختلف المعايير المرجعية.

Ebenezer Tarubinga2026-08-14
💻 computer science

Beyond Correctness: Benchmarking and Aligning Response Behaviors in Hybrid-Thinking MLLMs

تقدم هذه الورقة البحثية PatternEval، وهو معيار تشخيصي يكشف عن عدم اتساق منهجي في أنماط الاستجابة بين أوضاع التفكير وغير التفكير في النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) الهجينة، وتقترح PatternRL، وهو إطار عمل للتعلم التعزيزي يتضمن عقوبات محددة لكل نمط لمواءمة هذه السلوكيات مع الحفاظ على أداء المهام.

Xinming Wang, Weinong Wang, Hongming Yang, Yansong Lin, Zheng Ruan, Shangpin Peng, Qiming Peng, Nan Qiao, Fengyuan Lu, G (…)2026-08-14
💻 computer science

Erase but Preserve: Controllable Removal of Copyrighted Animation Characters via Optimized Semantic Anchors

تقترح هذه الورقة طريقة قابلة للتحكم لمحو شخصيات الرسوم المتحركة المحمية بحقوق الطبع والنشر من نماذج الانتشار من النص إلى الصورة عبر تحسين المرتكزات الدلالية الهيكلية والتفصيلية لاستبدال تضمينات الهدف، مما يحقق فعالية رائدة في الإزالة مع الحفاظ على دقة الصورة وتمكين التحكم الدقيق.

Qiao Li, Xiaomeng Fu, Wangjia Yu, Runze He, Baisen Wang, Jiao Dai, Jizhong Han2026-08-14
💻 computer science

Structured Local Differential Modeling for AI-Generated Image Detection

تقدم هذه الورقة البحثية RippleNet، وهو إطار عمل مبتكر للكشف عن الصور المولدة بواسطة الذكاء الاصطناعي يستفيد من الإشارات التفاضلية المحلية وآلية انتباه منقحة لتثبيط المكونات الدلالية المهيمنة وتضخيم الآثار الجنائية الدقيقة ذات نسبة الإشارة إلى الضوضاء المنخفضة لتحسين أداء الكشف.

Jiazhen Yang, Ruijin Jin, Junjun Zheng, Xiangheng Kong, Zunlei Feng, Jie Lei2026-08-14
💻 computer science

LocusGS: Spatially Grounded Tokens for Feed-Forward 3D Gaussian Splatting

يعزز LocusGS تقنية Gaussian Splatting ثلاثية الأبعاد ذات التغذية الأمامية من خلال إدخال حالات مرساة ثلاثية الأبعاد صريحة (المركز ونصف القطر) لاستعلامات Gaussian، والتي توجه تجميع الميزات والفك المتسق مكانيًا لتحسين جودة التصيير والمحاذاة الهيكلية مقارنة بالتمثيلات الكامنة البحتة.

Wenyu Li, Sidun Liu, Tongrui Hu, Peng Qiao, Yong Dou2026-08-14
💻 computer science

Semantic Steering for Controllable Generation: Tuning-Free Concept Erasure in Multimodal Diffusion Transformers

تقترح هذه الورقة طريقة خالية من الضبط تسمى "التوجيه الدلالي" (Semantic Steering) تعمل على محو المفاهيم غير المرغوب فيها في نماذج محولات الانتشار متعددة الوسائط عبر بناء وحقن متجه توجيه مشتق من الفرق بين التمثيلات غير الآمنة والآمنة في كتل النموذج الوسطى، مما يحقق تحكماً فعالاً وقوياً ومنخفض التكلفة في المفاهيم دون تعديل معاملات النموذج.

Qiao Li, Xiaomeng Fu, Yuanshu Zhao, Qipeng Wang, Jiao Dai, Jizhong Han2026-08-14
💻 computer science

Beyond Visual Evidence: Revealing and Mitigating Relational Privacy Leakage in Document MLLMs

تحدد هذه الورقة ثغرة أمنية حرجة في الخصوصية في نماذج اللغات الكبيرة متعددة الوسائط للمستندات (MLLMs)، حيث تستنتج النماذج معلومات شخصية حساسة من علاقات الحقول المحفوظة عندما تفتقر إلى الأدلة البصرية، وتقترح إطار عمل "التعلم غير المباشر للعلاقات الديناميكية" (DRUF) إلى جانب معيار "DocPrivacyBench" للتخفيف بفعالية من هذا التسريب مع الحفاظ على أداء استخراج المعلومات الأساسية.

Beining Xu, Hairui Wang, Jiaxin Wang, Changsheng Chen, Anirban Chakraborty2026-08-14
💻 computer science

A Deep RL based Framework for Targeted White Matter Tractography

تقترح هذه الورقة إطار عمل هجين للتعلم التعزيزي العميق يدمج التعلم الخاضع للإشراف ودمج السياسات المتعددة لتمكين تتبع مسارات المادة البيضاء القوي، والخالي من الاعتماد على الحقيقة الأرضية، والمحدد لكل حالة على حدة دون الحاجة إلى التجزئة الصريحة.

Ankita Joshi2026-08-14
💻 computer science

Bias Mitigation in Face Recognition via Demographic-based Supervised Contrastive Learning

تقترح هذه الورقة دالة خسارة جديدة تُسمى "التعلم التبايني الخاضع للإشراف القائم على الديموغرافيا" (DeSCon)، والتي تعمل على تحسين العدالة في التعرف على الوجوه من خلال استهداف معدلات الخطأ في ذيل توزيع درجات عدم التطابق تحديداً عبر تكوين الدفعات واختيار الأزواج الواعي بالخصائص الديموغرافية، مما يؤدي إلى التخفيف من التحيز بما يتجاوز ما يمكن أن يحققه موازنة بيانات التدريب البسيطة.

Yu Linghu, Salman Mohammad, Xinyi Zhang, Manuel Günther2026-08-14