🔬 physics

Kaleidoscopic Scintillation Event Imaging

تقترح هذه الورقة تصميماً لوميض كاليدوسكوبي (متعدد الأوجه) يستخدم الانعكاسات المرآتية لتضخيم جمع الضوء من أحداث الجسيمات عالية الطاقة الفردية، مما يتيح التصوير ثلاثي الأبعاد عالي الدقة وتحليل الرؤية الآلية باستخدام كاميرات الفوتون المنفرد التجارية رغم تحدي انخفاض عدد الفوتونات الشديد.

Alex Bocchieri, John Mamish, David Appleyard, Andreas Velten2026-03-17
💻 computer science

Colon-X: Advancing Intelligent Colonoscopy toward Clinical Reasoning

تقدم الورقة البحثية Colon-X، وهي مبادرة مفتوحة تعزز ذكاء تنظير القولون متعدد الوسائط من خلال إصدار مجموعة بيانات ColonVQA الشاملة، وقياس حدود النماذج الحالية، وتطوير نموذج ColonR1 — وهو نموذج يركز على الاستنتاج تم تدريبه على مجموعة بيانات ColonReason الموضحة بواسطة وكلاء متعددين، والذي يتفوق بشكل كبير على الضبط الدقيق الخاضع للإشراف في ظل ظروف ندرة البيانات.

Ge-Peng Ji, Jingyi Liu, Deng-Ping Fan, Huazhu Fu, Nick Barnes2026-03-17
💻 computer science

PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling

تقدم هذه الورقة البحثية PaCo-RL، وهو إطار عمل للتعلم التعزيزي يعزز توليد الصور المتسق من خلال الجمع بين نموذج مكافأة تماثل زوجي متخصص (PaCo-Reward) وخوارزمية تحسين فعالة ومنخفضة التكلفة (PaCo-GRPO) لتحقيق أداء رائد في الحفاظ على التماسك البصري عبر صور متعددة.

Bowen Ping, Chengyou Jia, Minnan Luo, Changliang Xia, Xin Shen, Zhuohang Dang, Hangwei Qian2026-03-17
💻 computer science

VLD: Visual Language Goal Distance for Reinforcement Learning Navigation

تقدم هذه الورقة مسافة الرؤية واللغة (VLD)، وهو إطار عمل قابل للتوسع يفصل بين الإدراك وتعلم السياسة من خلال تدريب متنبئ مسافة ذاتي الإشراف على بيانات فيديو بمقياس الإنترنت لتمكين الملاحة القائمة على الأهداف متعددة الوسائط والمتينة مع نقل قوي من المحاكاة إلى الواقع.

Lazar Milikic, Manthan Patel, Jonas Frey2026-03-17
💻 computer science

Towards Reason-Informed Video Editing in Unified Models with Self-Reflective Learning

تقدم هذه الورقة مهمة التحرير المرئي القائم على الاستنتاج (RVE) ومعيارها المقابل، RVE-Bench، لمعالجة الانفصال بين الاستنتاج والتحرير في نماذج الفيديو الموحدة، مقترحةً ReViSE — وهو إطار تعلم ذاتي الانعكاس يستفيد من نماذج الرؤية واللغة الداخلية لتوفير تغذية راجعة قابلة للتفاضل لتحسين دقة التحرير والواقعية البصرية بشكل كبير.

Xinyu Liu, Hangjie Yuan, Yujie Wei, Jiazheng Xing, Yujin Han, Jiahao Pan, Yanbiao Ma, Chi-Min Chan, Kang Zhao, Shiwei Zh (…)2026-03-17
💻 computer science

From Particles to Fields: Reframing Photon Mapping with Continuous Gaussian Photon Fields

تقدم هذه الورقة حقل الفوتون الغاوسي (GPF)، وهو تمثيل مستمر قابل للتعلم يعمل على تقطير الفوتونات المتتبعة فيزيائياً إلى نماذج غاوسية ثلاثية الأبعاد متباينة الخواص، مما يتيح تقديراً فعالاً وقابلاً للتفاضل للإشعاع متعدد المناظر بدقة على مستوى الفوتون مع القضاء على الحسابات الزائدة.

Jiachen Tao, Benjamin Planche, Van Nguyen Nguyen, Junyi Wu, Yuchun Liu, Haoxuan Wang, Zhongpai Gao, Gengyu Zhang, Meng Z (…)2026-03-17
💻 computer science

LASER: Layer-wise Scale Alignment for Training-Free Streaming 4D Reconstruction

يُعد LASER إطار عمل خالٍ من التدريب يُمكّن نماذج إعادة البناء رباعية الأبعاد (4D) المتطورة غير المتصلة بالإنترنت من معالجة مقاطع الفيديو المتدفقة عبر إدخال آلية محاذاة المقياس على مستوى الطبقات لمعالجة عدم اتساق العمق عبر النوافذ الزمنية، محققاً نتائج عالية الجودة مع استهلاك منخفض للذاكرة وأداءً في الوقت الفعلي.

Tianye Ding, Yiming Xie, Yiqing Liang, Moitreya Chatterjee, Pedro Miraldo, Huaizu Jiang2026-03-17
💻 computer science

Self-transcendence: Is External Feature Guidance Indispensable for Accelerating Diffusion Transformer Training?

تقترح هذه الورقة SelfTranscendence، وهي طريقة مبتكرة تسرع تدريب محولات الانتشار (Diffusion Transformer) عبر الاستفادة من الميزات الداخلية المتوافقة هيكلياً والمعززة دلالياً كإشارات إشرافية، مما يحقق تقارباً وجودة توليد فائقتين دون الاعتماد على توجيه ميزات خارجية مدربة مسبقاً.

Lingchen Sun, Rongyuan Wu, Zhengqiang Zhang, Ruibin Li, Yujing Sun, Shuaizheng Liu, Lei Zhang2026-03-17
🤖 machine learning

ReflexSplit: Single Image Reflection Separation via Layer Fusion-Separation

يُعد ReflexSplit إطار عمل جديداً ثنائي المسار لفصل الانعكاس في الصورة الواحدة، يعالج الارتباك بين الإرسال والانعكاس من خلال الاندماج المبوّب عبر المقاييس، وكتل فصل-اندماج الطبقات مع إلغاء الانتباه، واستراتيجية تدريب منهجية لتحقيق أداء رائد.

Chia-Ming Lee, Yu-Fan Lin, Jing-Hui Jung, Yu-Jou Hsiao, Chih-Chung Hsu, Yu-Lun Liu2026-03-17
🔭 astrophysics

Denoising the Deep Sky: Physics-Based CCD Noise Formation for Astronomical Imaging

تقترح هذه الورقة إطار عمل لتخليق الضجيج قائم على الفيزياء يعمل على نمذجة مصادر ضجيج مختلف لـ CCD لتوليد بيانات تدريب مقترنة وفيرة من التعريضات الفلكية المتراكمة، مما يتيح تعلماً خاضعاً للإشراف بفعالية لإزالة الضجيج من صور السماء العميقة مع الحفاظ على الدقة العلمية.

Shuhong Liu, Xining Ge, Ziying Gu, Quanfeng Xu, Lin Gu, Ziteng Cui, Xuangeng Chu, Jun Liu, Dong Li, Tatsuya Harada2026-03-17