💻 computer science

Accelerating Diffusion via Hybrid Data-Pipeline Parallelism Based on Conditional Guidance Scheduling

تقترح هذه الورقة إطار عمل هجين لتوازي خط أنابيب البيانات يستفيد من جدولة التوجيه الشرطي والتبديل التكيفي للتوازي لتسريع استنتاج نماذج الانتشار بشكل كبير مع الحفاظ على جودة التوليد عبر مختلف البنيات.

Euisoo Jung, Byunghyun Kim, Hyunjin Kim, Seonghye Cho, Jae-Gil Lee2026-02-26
🤖 machine learning

Easy to Learn, Yet Hard to Forget: Towards Robust Unlearning Under Bias

تقدم هذه الورقة البحثية إطار عمل CUPID، وهو إطار عمل جديد لـ "النسيان غير المرغوب فيه" (unlearning) يعالج ظاهرة "النسيان عبر المسارات المختصرة" (shortcut unlearning)—حيث تجد النماذج صعوبة في نسيان العينات المتوافقة مع الانحياز بدلاً من نسيان الانحياز نفسه—وذلك عن طريق تقسيم البيانات بناءً على حدة تضاريس الفقد (loss landscape sharpness) وفك تشابك معاملات النموذج لإجراء تحديثات مستهدفة تخفف بفعالية من الانحيازات غير المقصودة.

JuneHyoung Kwon, MiHyeon Kim, Eunju Lee, Yoonji Lee, Seunghoon Lee, YoungBin Kim2026-02-26
🤖 machine learning

Learning in the Null Space: Small Singular Values for Continual Learning

تقدم هذه الورقة البحثية NESS، وهي طريقة للتعلم المستمر تخفف من حدة النسيان الكارثي عبر تقييد التحديثات الخاصة بكل مهمة في فضاء صفري تقريبي مشتق من أصغر القيم المفردة لتمثيلات المدخلات، مما يتيح التكيف الفعال مع الحفاظ على الأداء في المهام السابقة.

Cuong Anh Pham, Praneeth Vepakomma, Samuel Horváth2026-02-26
💻 computer science

Geometry-as-context: Modulating Explicit 3D in Scene-consistent Video Generation to Geometry Context

تقدم هذه الورقة البحثية "الهندسة كـسياق" (geometry-as-context)، وهو إطار عمل ذاتي الانحدار يعمل على تقدير هندسة المشهد بشكل تكراري واستعادة المناظر الجديدة لتحقيق اتساق فائق للمشهد وتحكم في الكاميرا في توليد الفيديو، متجاوزاً بذلك مشكلات تراكم الأخطاء وعدم القابلية للاشتقاق التي عانت منها الطرق السابقة.

JiaKui Hu, Jialun Liu, Liying Yang, Xinliang Zhang, Kaiwen Li, Shuang Zeng, Yuanwei Li, Haibin Huang, Chi Zhang, Yanye L (…)2026-02-26
💻 computer science

Global-Local Dual Perception for MLLMs in High-Resolution Text-Rich Image Translation

تقدم هذه الورقة البحثية GLoTran، وهو إطار عمل للإدراك المزدوج العالمي-المحلي لنماذج اللغات الكبيرة متعددة الوسائط (MLLMs)، والذي يجمع بين السياق العالمي منخفض الدقة وتفاصيل مستويات المناطق متعددة المقاييس للتغلب على التحديات في ترجمة الصور الغنية بالنصوص عالية الدقة، مدعوماً بمجموعة بيانات GLoD واسعة النطاق التي تم إنشاؤها حديثاً.

Junxin Lu, Tengfei Song, Zhanglin Wu, Pengfei Li, Xiaowei Liang, Hui Yang, Kun Chen, Ning Xie, Yunfei Lu, Jing Zhao, Shi (…)2026-02-26
💻 computer science

Global-Aware Edge Prioritization for Pose Graph Initialization

تقترح هذه الورقة إطار عمل لتحديد أولويات الحواف بوعي عالمي لتهيئة مخطط بياني للوضعية في عملية "البنية من الحركة" (Structure-from-Motion)، يستفيد من الشبكات العصبية الرسومية (GNN) للتنبؤ بموثوقية الحافة وتوجيه عملية بناء مدركة للاتصال، مما يؤدي إلى عمليات إعادة بناء ثلاثية الأبعاد أكثر دقة وتماسكاً مقارنة بالطرق القائمة على الاسترجاع.

Tong Wei, Giorgos Tolias, Jiri Matas, Daniel Barath2026-02-26
💻 computer science

Brain3D: Brain Report Automation via Inflated Vision Transformers in 3D

تقدم الورقة البحثية Brain3D، وهو إطار عمل متخصص للرؤية واللغة يقوم بتحويل المشفرات مسبقة التدريب ثنائية الأبعاد إلى بنيات ثلاثية الأبعاد أصلية لأتمتة توليد تقارير الأشعة العصبية من صور الرنين المغناطيسي لأورام الدماغ، محققاً دقة سريرية أعلى بكثير ونوعية مثالية في الفحوصات السليمة مقارنة بالنماذج المرجعية ثنائية الأبعاد من خلال عملية محاذاة مكونة من ثلاث مراحل.

Mariano Barone, Francesco Di Serio, Giuseppe Riccio, Antonio Romano, Marco Postiglione, Antonino Ferraro, Vincenzo Mosca (…)2026-02-26
💻 computer science

GeoDiv: Framework For Measuring Geographical Diversity In Text-To-Image Models

تقدم الورقة البحثية GeoDiv، وهو إطار عمل مبتكر يسخر النماذج اللغوية الكبيرة ونماذج اللغة والرؤية، لقياس وكشف التحيزات الجغرافية والأنماط الاجتماعية والاقتصادية السائدة في توليد الصور من النصوص بشكل منهجي، مما يوضح كيف تصور النماذج الحالية دولاً مثل الهند ونيجيريا وكولومبيا بطرق توحي بالفقر بشكل غير متناسب.

Abhipsa Basu, Mohana Singh, Shashank Agnihotri, Margret Keuper, R. Venkatesh Babu2026-02-26
⚡ electrical engineering

Lumosaic: Hyperspectral Video via Active Illumination and Coded-Exposure Pixels

تقدم الورقة البحثية نظام "لوموزايك" (Lumosaic)، وهو نظام فيديو فائق الطيف نشط ومدمج يعمل على مزامنة مصفوفة صمامات ثنائية باعثة للضوء (LED) ضيقة النطاق مع بكسلات ذات تعريض مشفر لتحقيق إعادة بناء فيديو عالي الدقة مكون من 31 قناة للمشاهد الديناميكية في الوقت الفعلي، متفوقاً بشكل كبير على الطرق السلبية لقطة واحدة (snapshot) الحالية في كل من الدقة الطيفية والاستقرار الزمني.

Dhruv Verma, Andrew Qiu, Roberto Rangel, Ayandev Barman, Hao Yang, Chenjia Hu, Fengqi Zhang, Roman Genov, David B. Linde (…)2026-02-26
💻 computer science

WeaveTime: Stream from Earlier Frames into Emergent Memory in VideoLLMs

يُعد WeaveTime إطار عمل غير مرتبط بنموذج محدد يعالج القيود المتعلقة بعدم مراعاة الزمن في نماذج الفيديو اللغوية الكبيرة الحالية في سيناريوهات البث، وذلك عبر تقديم هدف إعادة بناء زمني خفيف الوزن لغرس تمثيلات مدركة للترتيب، وذاكرة تخزين مؤقت للتركيز الديناميكي بين الماضي والحاضر للاسترجاع المثار بالشك، مما يؤدي إلى تحسين الدقة وتقليل زمن الاستجابة دون تغييرات هيكلية.

Yulin Zhang, Cheng Shi, Sibei Yang2026-02-26