📈 economics

Network Structure in UK Payment Flows: Evidence on Economic Interdependencies and Implications for Real-Time Measurement

تُثبت هذه الورقة أن تحليل شبكات المدفوعات بين القطاعات في المملكة المتحدة باستخدام سمات نظرية المخططات يحسن بشكل كبير من دقة التنبؤ الاقتصادي والآنية (nowcasting) في الوقت الفعلي، لا سيما أثناء الاضطرابات مثل جائحة كوفيد-19، وذلك من خلال الكشف عن الترابطات الهيكلية والأهمية النظامية التي تغفلها الأساليب الثنائية التقليدية.

Aditya Humnabadkar2026-04-03
💻 computer science

PLUME: Latent Reasoning Based Universal Multimodal Embedding

يقدم PLUME إطار عمل لتمثيل متعدد الوسائط عالمي يستبدل استدلال سلسلة الأفكار الصريح والمكلف حاسوبياً بعملية تدحرج حالة كامنة موجهة دلالياً وفعالة، محققاً أداء استرجاع فائقاً على معيار MMEB-v2 مع توفير سرعة استنتاج تزيد عن 30 ضعفاً.

Chenwei He, Xiangzhao Hao, Tianyu Yang, Yuxiang Ma, Yuheng Jia, Lingxiang Wu, Chaoyang Zhao, Haiyun Guo, Jinqiao Wang2026-04-03
💻 computer science

FlowSlider: Training-Free Continuous Image Editing via Fidelity-Steering Decomposition

يُعد FlowSlider طريقةً لا تتطلب تدريباً للتحرير المستمر للصور في تدفق التصحيح (Rectified Flow)، حيث يحقق تحكماً سلساً وموثوقاً بأسلوب المنزلق عبر تفكيك التحديثات إلى حدّي دقة وتوجيه متعامدين، مما يسمح بتعديل القوة عبر تغيير قياس حد التوجيه دون الحاجة إلى وحدات مساعدة أو تدريب لاحق.

Taichi Endo, Guoqing Hao, Kazuhiko Sumi2026-04-03
💻 computer science

Center-Aware Detection with Swin-based Co-DETR Framework for Cervical Cytology

تقدم هذه الورقة حلاً فائزاً لتحدي RIVA لخلية عنق الرحم يجمع بين هيكل Swin-Large وإطار عمل Co-DINO، ويقدم التنبؤ بنقطة المركز، وتعزيز البيانات المتخصص، وتحسين الصندوق الهندسي لمعالجة تحديات التوزيع الكثيف للخلايا والتعليقات التوضيحية ذات الحجم الثابت في صور خلوات عنق الرحم.

Yan Kong, Yuan Yin, Hongan Chen, Yuqi Fang, Caifeng Shan2026-04-03
💻 computer science

Beyond the Fold: Quantifying Split-Level Noise and the Case for Leave-One-Dataset-Out AU Evaluation

تُثبت هذه الورقة أن التحقق المتقاطع الحصري للموضوعات في الكشف عن وحدات الحركة الوجهية يُدخل تباينًا عشوائيًا كبيرًا يمكن أن يحجب التحسينات الحقيقية للنموذج، مما يدعو إلى اعتماد تقييم "ترك مجموعة بيانات واحدة خارجًا" للكشف عن مقاييس أداء أكثر استقرارًا وقابلية للتفسير.

Saurabh Hinduja, Gurmeet Kaur, Maneesh Bilalpur, Jeffrey Cohn, Shaun Canavan2026-04-03
💻 computer science

Modular Energy Steering for Safe Text-to-Image Generation with Foundation Models

تقترح هذه الورقة إطار عمل معياريًا للاستدلال في وقت التشغيل لا يتطلب تدريبًا، يستفيد من التغذية الراجعة للتدرج من النماذج التأسيسية للرؤية واللغة المجمدة كإشارات إشرافية قائمة على الطاقة لتوجيه توليد الصور من النص نحو الأمان دون المساس بجودة الصورة أو قابلية توسع النموذج.

Yaoteng Tan, Zikui Cai, M. Salman Asif2026-04-03
💻 computer science

Novel Memory Forgetting Techniques for Autonomous AI Agents: Balancing Relevance and Efficiency

تقدم هذه الورقة إطار عمل للنسيان الميزاني التكيفي يوازن بين الصلة والكفاءة في وكلاء الذكاء الاصطناعي المستقلين من خلال تنظيم الذاكرة عبر الحداثة، والتكرار، والمحاذاة الدلالية، مما يمنع التراكم غير المنضبط وانتشار الذاكرة الزائفة مع تحسين أداء الاستدلال طويل الأمد.

Payal Fofadiya, Sunil Tiwari2026-04-03
💻 computer science

VOID: Video Object and Interaction Deletion

تقدم الورقة البحثية VOID، وهو إطار عمل لإزالة الكائنات من الفيديو يستفيد من نموذج رؤية-لغة لتحديد وتوجيه نموذج انتشار فيديو في توليد نتائج مضادة للواقع وواقعية فيزيائياً للتفاعلات المعقدة بين الكائنات، معالجةً بذلك أوجه القصور في الأساليب الحالية في التعامل مع الديناميكيات السببية مثل الاصطدامات.

Saman Motamed, William Harvey, Benjamin Klein, Luc Van Gool, Zhuoning Yuan, Ta-Ying Cheng2026-04-03
💻 computer science

Steerable Visual Representations

تقدم هذه الورقة البحثية "التمثيلات البصرية القابلة للتوجيه"، وهي نهج مبتكر يقوم بحقن مطالبات اللغة الطبيعية مباشرة في طبقات نماذج "Vision Transformer" سابقة التدريب عبر الدمج المبكر، مما يتيح توجيه الميزات البصرية نحو مفاهيم محددة مع الحفاظ على أداء عالٍ في المهام البصرية العامة وتحقيق تعميم صفري القدرات.

Jona Ruthardt, Manu Gaur, Deva Ramanan, Makarand Tapaswi, Yuki M. Asano2026-04-03
💻 computer science

Generative World Renderer

تقدم هذه الورقة مجموعة بيانات ديناميكية واسعة النطاق مكونة من 4 ملايين إطار من ألعاب AAA، تتميز ببيانات RGB وG-buffer متزامنة تم التقاطها عبر طريقة مبتكرة ثنائية الشاشة، لسد الفجوة في مجال التوليد الرندري (generative rendering) وتمكين الرندرة العكسية القوية، وتوليد الفيديو عالي الدقة، وتحرير الأنماط الموجه بالنص، والتي تم تقييمها جميعها من خلال بروتوكول اتساق جديد قائم على نماذج الرؤية واللغة الكبيرة (VLM).

Zheng-Hui Huang, Zhixiang Wang, Jiaming Tan, Ruihan Yu, Yidan Zhang, Bo Zheng, Yu-Lun Liu, Yung-Yu Chuang, Kaipeng Zhang2026-04-03