🤖 AI

Adaptive Runge-Kutta Dynamics for Spatiotemporal Prediction

تقترح هذه الورقة شبكة عصبية موجهة فيزيائياً تدمج طريقة "رونج-كوتا" من الدرجة الثانية التكيفية مع قيود فيزيائية ووحدة فوريه معززة بالتردد لتحسين دقة وكفاءة مهام التنبؤ المكاني والزماني والتنبؤ بالفيديو، مع الحفاظ على عدد أقل من المعلمات مقارنة بالأساليب المتطورة.

Xuanle Zhao, Yue Sun, Ziyi Wang, Bo Xu, Tielin Zhang2026-02-24
💬 NLP

MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts

تقدم هذه الورقة MathScape، وهو معيار مرجعي جديد يضم 1,369 مسألة رياضية من واقع الحياة مع صور ملتقطة بشرياً لتقييم النماذج اللغوية الكبيرة متعددة الوسائط، كاشفةً أن حتى النماذج المتطورة تعاني في السيناريوهات الواقعية ومسلطةً الضوء على محدودية الاعتماد فقط على مجموعات البيانات الاصطناعية لتقييم الاستدلال الرياضي.

Hao Liang, Linzhuang Sun, Minxuan Zhou, Zirong Chen, Meiyi Qiang, Mingan Lin, Tianpeng Li, Fan Yang, Zenan Zhou, Wentao (…)2026-02-24
⚡ electrical engineering

CT-AGRG: Automated Abnormality-Guided Report Generation from 3D Chest CT Volumes

تقترح الورقة البحثية إطار عمل CT-AGRG، وهو إطار عمل مؤتمت يعمل على تحسين توليد تقارير الأشعة المقطعية للصدر من خلال التنبؤ أولاً باختلالات محددة ثم توليد أوصاف مستهدفة لكل منها، مما يعالج أوجه القصور في الأساليب الحالية غير الموجهة في البيئات السريرية.

Theo Di Piazza, Carole Lazarus, Olivier Nempont, Loic Boussel2026-02-24
💻 computer science

Speedy-Splat: Fast 3D Gaussian Splatting with Sparse Pixels and Sparse Primitives

تقدم الورقة البحثية Speedy-Splat، وهي طريقة تسرع عملية رندرة (rendering) الـ 3D Gaussian Splatting بمقدار 6.71 ضعفاً مع تقليل حجم النموذج ووقت التدريب من خلال تحديد موقع غاوسي (Gaussian localization) محسّن وتقنية مبتكرة لتقليم العناصر الأولية المتفرقة (sparse-primitive pruning).

Alex Hanson, Allen Tu, Geng Lin, Vasu Singla, Matthias Zwicker, Tom Goldstein2026-02-24
🤖 AI

Learning Street View Representations with Spatiotemporal Contrast

تقترح هذه الورقة إطار عمل للتعلم التبايني الزماني والمكاني ذاتي الإشراف يستفيد من التباينات الزمنية والمكانية في صور مشاهد الشوارع لتعلم تمثيلات قوية للبيئات الحضرية، متفوقة بشكل كبير على الأساليب الحالية في مهام مثل التعرف البصري على الأماكن، والتقدير الاجتماعي والاقتصادي، والإدراك البشري للبيئة.

Yong Li, Yingjing Huang, Gengchen Mai, Fan Zhang2026-02-24
💻 computer science

SphOR: A Representation Learning Perspective on Open-set Recognition for Identifying Unknown Classes in Deep Learning Models

تقترح الورقة البحثية إطار عمل SpHOR، وهو إطار عمل جديد للتعرف على المجموعات المفتوحة يعزز تعلم تمثيل الميزات من خلال تضمينات التصنيفات المتعامدة، والقيود الكروية، ودمج تقنية Mixup مع تنعيم الملصقات، محققاً أداءً هو الأفضل في فئته عبر تشكيل فضاء الميزات بشكل صريح لتمييز الفئات غير المعروفة بشكل أفضل.

Nadarasar Bahavan, Sachith Seneviratne, Saman Halgamuge2026-02-24
💻 computer science

ShapeShift: Text-to-Mosaic Synthesis via Semantic Phase-Field Guidance

تُعد ShapeShift طريقة مبتكرة تعمل على ترتيب الأجسام الصلبة في تكوينات ذات دلالة دلالية وخالية من التداخل، وذلك عبر تسخير سمات نماذج الانتشار لتوجيه تمدد حقل طور متباين الخواص، مما يؤدي إلى حل القيود الفيزيائية بطريقة تحافظ على البنية الهندسية الجوهرية للتعرف البصري.

Vihaan Misra, Peter Schaldenbrand, Jean Oh2026-02-24
💻 computer science

Can Vision-Language Models Answer Face to Face Questions in the Real-World?

تقدم هذه الورقة مجموعة بيانات كوالكوم للفيديو التفاعلي (IVD) لتقييم قدرة نماذج الرؤية واللغة على الإجابة على الأسئلة في الوقت الفعلي حول الفيديو والصوت المباشر، مما يكشف أنه بينما تتخلف النماذج الحالية بشكل كبير عن البشر، فإن الضبط الدقيق المستهدف يمكن أن يحسن أداءها بشكل كبير في هذه المهام التفاعلية.

Reza Pourreza, Rishit Dagli, Apratim Bhattacharyya, Sunny Panchal, Guillaume Berger, Roland Memisevic2026-02-24
💻 computer science

Order Matters: On Parameter-Efficient Image-to-Video Probing for Recognizing Nearly Symmetric Actions

تقدم هذه الورقة البحثية طريقة STEP، وهي طريقة استقصاء تضمين زمني خفيفة الوزن وذات انتباه ذاتي، تتغلب على عدم التباين في الترتيب الذي تعاني منه عمليات الاستقصاء القياسية والفرط في التخصيص الذي تعاني منه عمليات الضبط الدقيق كفؤة المعلمات، وذلك لتحقيق أفضل النتائج في التعرف على الأفعال البشرية شبه المتماثلة في سيناريوهات التفاعل بين الإنسان والروبوت.

Thinesh Thiyakesan Ponbagavathi, Alina Roitberg2026-02-24