💻 computer science

Latent Transfer Attack: Adversarial Examples via Generative Latent Spaces

تقترح الورقة البحثية هجوم LTA، وهو هجوم عدائي قائم على النقل يعمل على تحسين الاضطرابات ضمن الفضاء الكامن لمشفر تلقائي (VAE) مُدرب مسبقاً لنموذج Stable Diffusion لتوليد أمثلة متماسكة مكانياً ومنخفضة التردد تحقق قدرة فائقة على النقل والمتانة ضد عمليات المعالجة المسبقة الشائعة مقارنة بالطرق التقليدية في فضاء البكسل.

Eitan Shaar, Ariel Shaulov, Yalcin Tur, Gal Chechik, Ravid Shwartz-Ziv2026-03-09
💻 computer science

P-SLCR: Unsupervised Point Cloud Semantic Segmentation via Prototypes Structure Learning and Consistent Reasoning

تقدم هذه الورقة البحثية P-SLCR، وهو إطار عمل جديد غير خاضع للإشراف لتجزئة السحابة النقطية دلالياً، يستفيد من تعلم البنية المتسقة والاستدلال المتسق للعلاقات الدلالية لتحقيق أداء هو الأفضل في مجاله على مجموعات بيانات S3DIS وSemanticKITTI وScannet، متفوقاً حتى على نموذج PointNet الخاضع للإشراف الكامل في معيار S3DIS Area-5.

Lixin Zhan, Jie Jiang, Tianjian Zhou, Yukun Du, Yan Zheng, Xuehu Duan2026-03-09
💬 NLP

The Art That Poses Back: Assessing AI Pastiches after Contemporary Artworks

تقيم هذه الدراسة قدرة ChatGPT على توليد محاكاة فنية (pastiches) لأعمال فنية معاصرة من خلال الجمع بين التغذية الراجعة البشرية من اثني عشر فناناً دولياً والتحليل الحسابي، كاشفةً عن فجوة كبيرة بين التشابهات البصرية السطحية والافتقار إلى العمق المفاهيمي، والأبعاد، والرنين العاطفي في النتائج المولدة بواسطة الذكاء الاصطناعي، مما يدعو إلى إنشاء "لوحة تحكم لنقل الأسلوب" متعددة المقاييس من أجل تقييم أكثر شمولاً.

Anca Dinu, Andreiana Mihail, Andra-Maria Florescu, Claudiu Creanga2026-03-09
💻 computer science

WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching

يُعد WorldCache إطار عمل تخزين مؤقت مبتكر يسرع نماذج العالم القائمة على الانتشار بمقدار يصل إلى 3.7 ضعفاً دون إعادة تدريب، متجاوزاً تحديات عدم تجانس الرموز والديناميكيات الزمنية غير المنتظمة من خلال التنبؤ الموجه بالانحناء والتخطي التكيفي ذي الأولوية الفوضوية للحفاظ على جودة عالية للتدفق المستمر.

Weilun Feng, Guoxin Fan, Haotong Qin, Chuanguang Yang, Mingqiang Wu, Yuqi Li, Xiangqi Li, Zhulin An, Libo Huang, Dingrui (…)2026-03-09
💻 computer science

Computer vision-based estimation of invertebrate biomass

تقدم هذه الورقة طرقاً تعتمد على الرؤية الحاسوبية، باستخدام نظام كاميرا مزدوج (BIODISCOVER) لالتقاط سرعة الهبوط والمساحة، والتي تُقدر بدقة الكتلة الجافة لللافقاريات بنسبة خطأ وسيطة تتراوح بين 10-20%، مما يوفر بديلاً قابلاً للتوسع وغير مدمر للوزن اليدوي لمراقبة التنوع البيولوجي.

Mikko Impiö, Philipp M. Rehsen, Jarrett Blair, Cecilie Mielec, Arne J. Beermann, Florian Leese, Toke T. Høye, Jenni Rait (…)2026-03-09
💻 computer science

OralGPT-Plus: Learning to Use Visual Tools via Reinforcement Learning for Panoramic X-ray Analysis

تقدم هذه الورقة البحثية OralGPT-Plus، وهو نموذج لغوي بصري وكيل يستفيد من مجموعة بيانات جديدة (DentalProbe)، وإطار عمل للتعلم التعزيزي القائم على إعادة الفحص، ومعيار شامل (MMOral-X) لتمكين الاستدلال التشخيصي التكراري، والواعي بالتماثل، والموثوق سريريًا لصور الأشعة السينية البانورامية للأسنان.

Yuxuan Fan, Jing Hao, Hong Chen, Jiahao Bao, Yihua Shao, Yuci Liang, Kuo Feng Hung, Hao Tang2026-03-09
💻 computer science

CHMv2: Improvements in Global Canopy Height Mapping using DINOv3

تقدم الورقة البحثية CHMv2، وهي خريطة ارتفاع غطاء شجري جديدة بدقة المتر على مستوى عالمي، والتي تحسن بشكل كبير الدقة والتفاصيل الهيكلية مقارنة بالمنتجات الحالية من خلال الاستفادة من نموذج تقدير عمق يعتمد على DINOv3 تم تدريبه على بيانات مسح ليزري جوي موسعة ومتنوعة وتم التحقق من صحته مقابل ملايين الملاحظات الساتلية.

John Brandt, Seungeun Yi, Jamie Tolan, Xinyuan Li, Peter Potapov, Jessica Ertel, Justine Spore, Huy V. Vo, Michaël Ramam (…)2026-03-09
💻 computer science

REACT++: Efficient Cross-Attention for Real-Time Scene Graph Generation

يُعد REACT++ نموذجاً جديداً ومتطوراً لتوليد المخططات المشهدية في الوقت الفعلي، حيث يستفيد من استخراج الميزات الفعال والانتباه المتبادل بين الموضوع والمفعول به لتحقيق أعلى سرعة استنتاج، وتحسين دقة التنبؤ بالعلاقات، والحفاظ على أداء كشف الكائنات، متفوقاً بذلك على سلفه بكونه أسرع بنسبة 20% مع زيادة في الدقة بنسبة 10%.

Maëlic Neau, Zoe Falomir2026-03-09
💻 computer science

DiffInf: Influence-Guided Diffusion for Supervision Alignment in Facial Attribute Learning

تقدم الورقة البحثية إطار عمل DiffInf، وهو إطار عمل انتشار موجه بالتأثير الذاتي يحدد الصور الوجهية غير المتسقة مع التسميات ويقوم بتصحيحها توليدياً لمواءمة المحتوى البصري مع الملصقات، مما يؤدي إلى تحسين أداء التصنيف دون التخلص من البيانات أو التضحية بالتغطية التوزيعية.

Basudha Pal, Rama Chellappa2026-03-09
💻 computer science

Locating and Editing Figure-Ground Organization in Vision Transformers

تحدد هذه الورقة أن نموذج "Vision Transformer BEiT" يحل الغموض الإدراكي بين استكمال الشكل والأرضية المقعر والمحدب في طبقاته المتأخرة، وتحديداً من خلال انحياز محدب ضعيف تسببه رأس الانتباه L0H9، والذي يمكن تعديله للسماح للأدلة المقعرة بتوجيه النتيجة.

Stefan Arnold, René Gröbner2026-03-09