💻 computer science

AgentRVOS: Reasoning over Object Tracks for Zero-Shot Referring Video Object Segmentation

يُعد AgentRVOS إطار عمل لا يتطلب تدريباً يحقق أداءً فائقاً في مجال تقسيم كائنات الفيديو بالإشارة، وذلك عبر عكس المسار التقليدي لإنشاء مسارات موثوقة للكائنات أولاً باستخدام SAM3، ثم توظيف نموذج لغوي بصري كبير (MLLM) للاستدلال على هذه المسارات من أجل تحديد الهدف بدقة.

Woojeong Jin, Jaeho Lee, Heeseong Shin, Seungho Jang, Junhwan Heo, Seungryong Kim2026-03-25
💻 computer science

DA-Flow: Degradation-Aware Optical Flow Estimation with Diffusion Models

يقدم DA-Flow طريقة مبتكرة لتقدير التدفق البصري المدرك للتدهور، والتي تستفيد من الميزات الوسيطة المدركة للفساد في نماذج الانتشار لاستعادة الصور، والمعززة بالانتباه المكاني والزماني والمدمجة مع الميزات الالتفافية في إطار عمل تكراري، لتحقيق أداء فائق على مقاطع الفيديو المشوهة في العالم الحقيقي مقارنة بالطرق الحالية.

Jaewon Min, Jaeeun Lee, Yeji Choi, Paul Hyunbin Cho, Jin Hyeon Kim, Tae-Young Lee, Jongsik Ahn, Hwayeong Lee, Seonghyun (…)2026-03-25
💬 NLP

MedObvious: Exposing the Medical Moravec's Paradox in VLMs via Clinical Triage

تقدم الورقة البحثية MedObvious، وهو معيار مرجعي يتكون من 1,880 مهمة، يوضح فشل نماذج الرؤية واللغة الحالية في إجراء فحوصات التحقق المنطقي الأساسية قبل التشخيص على الصور الطبية، حيث غالبًا ما تهلوس بسرديات تبدو منطقية حتى عندما تكون المدخلات غير صالحة أو غير متسقة، مما يسلط الضرض على فجوة أمنية حرجة في النشر السريري.

Ufaq Khan, Umair Nawaz, L D M S S Teja, Numaan Saeed, Muhammad Bilal, Yutong Xie, Mohammad Yaqub, Muhammad Haris Khan2026-03-25
🧬 biology

Phenotype-preserving metric design for high-content image reconstruction by generative inpainting

تقترح هذه الورقة استراتيجية تصميم مقياس مبتكرة للحفاظ على النمط الظاهري لتقييم وتوجيه نماذج الملء التوليدي (inpainting)، مثل DeepFill V2 وEdge Connect، بما يضمن استعادة صور المجهر الفلوري عالية المحتوى بأمانة دون إدخال تلاعبات اصطناعية تغير السمات البيولوجية الحرجة مثل حجم ونوع نوى الخلايا.

Vaibhav Sharma, Artur Yakimovich2026-03-24
🤖 AI

Conditional Variational Diffusion Models

تقترح هذه الورقة نموذج انتشار تبايني شرطي مبتكر يتعلم جدول التباين أثناء التدريب بدلاً من الاعتماد على الضبط الدقيق المستهلك للوقت، محققاً نتائج متفوقة أو مماثلة في المشكلات العكسية مثل المجهر فائق الدقة وتصوير الطور الكمي.

Gabriel della Maggiora, Luis Alberto Croquevielle, Nikita Deshpande, Harry Horsley, Thomas Heinis, Artur Yakimovich2026-03-24
🧬 biology

Solving the inverse problem of microscopy deconvolution with a residual Beylkin-Coifman-Rokhlin neural network

تقترح هذه الورقة شبكة (m-rBCR)، وهي شبكة عصبية مستوحاة من الفيزياء ومستلهمة من مخطط "بيلكن-كويفمان-روكلين"، والتي تحقق جودة فائقة في استعادة الصور وكفاءة حسابية أعلى بكثير مع عدد أقل من المعلمات مقارنة بالطرق التقليدية وأحدث طرق التعلم العمخلية المستخدمة في فك التلافيف المجهري.

Rui Li, Mikhail Kudryashev, Artur Yakimovich2026-03-24
💻 computer science

SymmCompletion: High-Fidelity and High-Consistency Point Cloud Completion with Symmetry Guidance

تعد SymmCompletion طريقة مبتكرة لإكمال السحابة النقطية تستخدم شبكة تحويل التماثل المحلي لتوليد أزواج أولية متوافقة هندسياً، وتستخدم محول توجيه التماثل لتنقيحها، مما يحقق عمليات إعادة بناء عالية الدقة ومتسقة هندسياً تتفوق على الأساليب الرائدة الحالية.

Hongyu Yan, Zijun Li, Kunming Luo, Li Lu, Ping Tan2026-03-24
💻 computer science

Embedding Shift Dissection on CLIP: Effects of Augmentations on VLM's Representation Learning

تتقصى هذه الدراسة تأثير تسع عمليات تعزيز شائعة للصور على تحولات تضمين نموذج CLIP باستخدام مقاييس تشابه ومسافة متنوعة، كاشفةً أن الضجيج، وتحويلات المنظور، وتغيير المقياس تسبب التغيرات الأكثر حدة، مما يوفر رؤى تأسيسية لتحسين متانة النماذج اللغوية البصرية وقابلية تفسيرها الآلية.

Ashim Dahal, Saydul Akbar Murad, Nick Rahimi2026-03-24
💻 computer science

All Patches Matter, More Patches Better: Enhance AI-Generated Image Detection via Panoptic Patch Learning

تقترح هذه الورقة إطار عمل "تعلم الرقع البانوبتيكية" (PPL) للتغلب على "تحيز الرقع القليلة" في كشف الصور المُنشأة بواسطة الذكاء الاصطناعي، وذلك من خلال فرض استخدام الآثار عبر جميع رقع الصورة عبر استبدال الرقع العشوائي والتعلم التبايني على مستوى الرقعة، مما يعزز بشكل كبير من قوة الكشف والقدرة على التعميم.

Zheng Yang, Ruoxin Chen, Zhiyuan Yan, Ke-Yue Zhang, Xinghe Fu, Shuang Wu, Xiujun Shu, Taiping Yao, Shouhong Ding, Zequn (…)2026-03-24
💻 computer science

Subject Information Extraction for Novelty Detection with Domain Shifts

تقترح هذه الورقة طريقة جديدة غير خاضعة للإشراف للكشف عن الجدة تعمل على تحسين المتانة ضد انزياحات النطاق من خلال فصل معلومات الموضوع عن تغيرات الخلفية باستخدام تقليل المعلومات المتبادلة ونموذج غاوسي مختلط عميق، مما يتيح الكشف الدقيق بناءً على تمثيلات موضوع ثابتة فقط.

Yangyang Qu, Dazhi Fu, Jicong Fan2026-03-24