💻 computer science

GRASP: Guided Residual Adapters with Sample-wise Partitioning

تقترح الورقة البحثية GRASP، وهي طريقة غير جراحية تعمل على تقسيم فضاء التكييف وتوظيف مهايئات متبقية خاصة بالمجموعات لمحاذاة التدرجات في مطابقة التدفق للنصوص إلى الصور ذات الذيل الطويل، مما يحسن بشكل كبير من دقة وتنوع فئات الذيل مع تمكين البيانات الاصطناعية من مطابقة أداء البيانات الحقيقية في مهام التصنيف اللاحقة.

Felix Nützel, Mischa Dombrowski, Bernhard Kainz2026-05-13
💻 computer science

Does Head Pose Correction Improve Biometric Facial Recognition?

تقيم هذه الورقة تقنيات تصحيح وضعية الرأس واستعادة الصور المدفوعة بالذكاء الاصطناًعي من أجل التعرف البيومتري على الوجه، وتجد أنه بينما يؤدي التطبيق الساذج لهذه الأساليب إلى تدهور الدقة، فإن الجمع الانتقائي بين CFR-GAN وCodeFormer يحقق تحسينات ملموسة.

Justin Norman, Hany Farid2026-05-13
🔬 optics

Physics-Informed Graph Neural Networks for Frequency-Aware Optical Aberration Correction

تقدم هذه الورقة البحثية ZRNet، وهو إطار عمل للشبكات العصبية الرسومية المستندة إلى الفيزياء والذي يستفيد من وحدة "Zernike Graph" وفقدان المحاذاة الواعي بالتردد للتنبؤ بمعاملات "Zernike" واستعادة الصور البصرية بشكل مشترك، محققاً أداءً هو الأفضل في فئته في تصحيح الانحرافات المعقدة وواسعة النطاق عبر مختلف أنماط المجهرية.

Yong En Kok, Bowen Deng, Alexander Bentley, Andrew J. Parkes, Michael G. Somekh, Amanda J. Wright, Michael P. Pound2026-05-13
🤖 machine learning

FlowLPS: Langevin-Proximal Sampling for Flow-based Inverse Problem Solvers

يُعد FlowLPS حلاً عكسياً خالياً من التدريب لنماذج التدفق الكامن، حيث يوازن بين دقة القياس والجودة الإدراكية عبر الجمع بين تحديثات لانجفينه (Langevin) للاستكشاف العشوائي للمتغيرات اللاحقة، والتقريب المباشر (proximal refinement) لتحقيق اتساق سريع مع القياسات.

Jonghyun Park, Jong Chul Ye2026-05-13
🤖 AI

Position: Universal Aesthetic Alignment Narrows Artistic Expression

تجادل ورقة الموقف هذه بأن الإفراط في مواءمة نماذج توليد الصور مع التفضيلات الجمالية العامة يقوض الاستقلالية الذاتية للمستخدم والتعددية الفنية من خلال معاقبة المخرجات "المناهضة للجمال" بشكل منهجي، حتى عندما تلتزم بدقة بالتعليمات الصريحة للمستخدم.

Wenqi Marshall Guo, Qingyun Qian, Khalad Hasan, Shan Du2026-05-13
🤖 machine learning

Parabolic Position Encoding: Vision-Centric, Principled, Extrapolatable, General

تقدم هذه الورقة البحثية ترميز الموضع المكافئ (PaPE)، وهو طريقة لترميز الموضع ترتكز على الرؤية وتتبع نهجاً مبدئياً، تستفيد من الدوال المكافئة لتحقيق قدرة فائقة على الاستقراء والتعميم عبر مختلف الأنماط البصرية مقارنة بالنماذج المرجعية الحالية.

Christoffer Koo Øhrstrøm, Rafael I. Cabral Muchacho, Yifei Dong, Filippos Moumtzidellis, Ronja Güldenring, Florian T. Po (…)2026-05-13
💻 computer science

Vision-aligned Latent Reasoning for Multi-modal Large Language Model

تقدم الورقة البحثية إطار عمل "الاستدلال الكامن المتوافق مع الرؤية" (VaLR)، الذي يعزز قدرات الاستدلال في سياق النصوص الطويلة للنماذج اللغوية الكبيرة متعددة الوسائط من خلال التوليد الديناميكي لرموز كامنة متوافقة بصرياً للحفاظ على المعلومات المرئية، مما يحقق مكاسب كبيرة في الأداء وتوسعاً في وقت الاختبار على معايير مثل VSI-Bench.

Byungwoo Jeon, Yoonwoo Jeong, Hyunseok Lee, Minsu Cho, Jinwoo Shin2026-05-13
🤖 machine learning

Space Syntax-guided Post-training for Residential Floor Plan Generation

تقترح هذه الورقة البحثية "التدريب اللاحق الموجه بـنحو الفضاء" (SSPT)، وهو إطار عمل يستفيد من "أوراكل تكامل نحو الفضاء" لتوفير تغذية راجعة تكوينية من جانب المخرجات لتنقيح مولدات المخططات الأرضية السكنية، مما يثبت من خلال استراتيجيات التعلم التكراري والتعزيز أن النظرية المعمارية يمكن أن تعزز بفعالية المنطق المكاني للمخططات المولدة.

Zhuoyang Jiang, Dongqing Zhang2026-05-13
💻 computer science

Pi-HOC: Pairwise 3D Human-Object Contact Estimation

يُعد Pi-HOC إطار عمل أحادي الممر ومعتمد على الكيان، يحقق دقة هي الأفضل في فئته وإنتاجية أعلى بـ 20 ضعفاً في التقدير الكثيف لاتصال الإنسان بالأشياء ثلاثي الأبعاد لسيناريوهات البشر المتعددين، وذلك من خلال الاستفادة من رموز التفاعل المخصصة وفك تشفير يعتمد على نموذج SAM، مع تعزيز إعادة البناء ثلاثي الأبعاد وتمكين التنبؤ المرجعي دون تدريب إضافي.

Sravan Chittupalli, Ayush Jain, Dong Huang2026-05-13
💻 computer science

MotionGRPO: Overcoming Low Intra-Group Diversity in GRPO-Based Egocentric Motion Recovery

يُعد MotionGRPO إطار عمل مبتكر يعزز استعادة حركة جسم الإنسان ثلاثية الأبعاد بالكامل من إشارات الأجهزة المثبتة على الرأس عبر تطبيق تحسين السياسة النسبي المجموعاتي مع آلية مكافأة هجينة واستراتيجية حقن الضجيج للتغلب على انخفاض التنوع داخل المجموعة وتحقيق أعلى مستويات الدقة البصرية.

Nanjie Yao, Junlong Ren, Wenhao Shen, Hao Wang2026-05-13