💻 computer science

AnyID: Ultra-Fidelity Universal Identity-Preserving Video Generation from Any Visual References

يُعد AnyID إطار عمل مبتكر لتوليد الفيديو فائق الدقة مع الحفاظ على الهوية، حيث يتغلب على قيود أساليب المرجع الواحد من خلال توحيد المدخلات البصرية غير المتجانسة عبر بنية مرجعية شاملة قابلة للتوسع، وتوظيف نموذج توليد يعتمد على مرجع أساسي مع تلميحات تفاضلية لتحقيق قدرة تحكم دقيقة على مستوى السمات.

Jiahao Wang, Hualian Sheng, Sijia Cai, Yuxiao Yang, Weizhan Zhang, Caixia Yan, Bing Deng, Jieping Ye2026-03-27
💻 computer science

TacSIm: A Dataset and Benchmark for Football Tactical Style Imitation

تقدم الورقة البحثية TacSIm، وهي مجموعة بيانات ومعيار ضخم مصمم لتقييم ونمذجة محاكاة الأسلوب التكتيكي لكرة القدم من خلال إعادة إنتاج الأفعال المنسقة لجميع اللاعب الأحد عشر في فريق ما باستخدام لقطات البث، مع التركيز على التشابه المكاني والزماني بدلاً من الأهداف التقليدية القائمة على المكافأة.

Peng Wen, Yuting Wang, Qiurui Wang2026-03-27
🤖 AI

Free-Lunch Long Video Generation via Layer-Adaptive O.O.D Correction

تقدم هذه الورقة FreeLOC، وهو إطار عمل متكيف مع الطبقات ولا يتطلب إعادة تدريب، يعالج تحديات التوزيع الخارج عن النطاق في توليد الفيديو الطويل من خلال توظيف إعادة ترميز الموضع النسبي القائم على الفيديو والانتباه المتناثر المتدرج لتعزيز الاتساق الزمني والجودة البصرية بشكل كبير دون الحاجة إلى إعادة التدريب.

Jiahao Tian, Chenxi Song, Wei Cheng, Chi Zhang2026-03-27
💻 computer science

SDD-YOLO: A Small-Target Detection Framework for Ground-to-Air Anti-UAV Surveillance with Edge-Efficient Deployment

تقترح هذه الورقة البحثية SDD-YOLO، وهو إطار عمل لكشف الأهداف الصغيرة يتسم بالكفاءة عند الحواف لمراقبة الطائرات بدون طيار من الأرض إلى الجو، والذي يدمج رأس P2 عالي الدقة واستراتيجيات معمارية متقدمة من YOLO26 لتحقيق أداء رائد على مجموعة بيانات DroneSOD-30K المستحدثة.

Pengyu Chen, Haotian Sa, Yiwei Hu, Yuhan Cheng, Junbo Wang2026-03-27
💻 computer science

A Unified Spatial Alignment Framework for Highly Transferable Transformation-Based Attacks on Spatially Structured Tasks

تقترح هذه الورقة إطار عمل موحد للمحاذاة المكانية (SAF) يقوم بتحويل الملصقات بالتزامن مع المدخلات لمعالجة مشكلات عدم المحاذاة المكانية، مما يتيح هجمات عدائية قائمة على التحويل عالية القابلية للنقل في المهام ذات البنية المكانية مثل التجزئة الدلالية وكشف الأشياء.

Jiaming Liang, Chi-Man Pun2026-03-27
💻 computer science

Efficient Preemptive Robustification with Image Sharpening

تقترح هذه الورقة طريقة دفاع استباقية جديدة وفعالة وقابلة للتفسير تسمى "التعزيز الاستباقي الفعال باستخدام شحذ الصور"، والتي تثبت أن مجرد تطبيق شحذ الصور على العينات السليمة يمكن أن يعزز متانتها بشكل كبير ضد الاضطرابات العدائية — لا سيما في سيناريوهات النقل — دون الاعتماد على نماذج بديلة، أو تحسين تكراري، أو شبكات توليدية.

Jiaming Liang, Chi-Man Pun2026-03-27
🤖 AI

FEAST: Fully Connected Expressive Attention for Spatial Transcriptomics

تقدم الورقة البحثية FEAST، وهو إطار عمل قائم على آلية الانتباه للترانسكريبتوميات المكانية، والذي يتغلب على قيود نماذج الرسوم البيانية المتفرقة من خلال توظيف رسم بياني كامل الاتصال مع انتباه مدرك للقيم السالبة وأخذ عينات خارج الشبكة للتنبؤ بدقة بالتعبير الجيني والتقاط التفاعلات البيولوجية المعقدة من صور الشرائح الكاملة.

Taejin Jeong, Joohyeok Kim, Jinyeong Kim, Chanyoung Kim, Seong Jae Hwang2026-03-27
💻 computer science

Semantic-Aware Prefix Learning for Token-Efficient Image Generation

تقدم هذه الورقة البحثية SMAP، وهو أداة ترميز بادئة مدركة دلاليًا تستخدم استراتيجية إسقاط رموز الذيل لفرض شروط دلالية على مستوى الفئة كعناصر لا غنى عنها لتعلم التمثيل، مما يؤدي إلى فضاء كامن مدمج ومرتكز دلاليًا يعزز بشكل كبير كلاً من جودة إعادة البناء وأداء توليد الصور في المهام اللاحقة.

Qingfeng Li, Haoxian Zhang, Xu He, Songlin Tang, Zhixue Fang, Xiaoqiang Liu, Pengfei Wan Guoqi Li2026-03-27
🤖 machine learning

Hyperspectral Trajectory Image for Multi-Month Trajectory Anomaly Detection

تقدم الورقة البحثية TITAnD، وهو إطار عمل مبتكر يعيد صياغة كشف شذوذ المسار كمسألة رؤية حاسوبية باستخدام صور المسار فائقة الطيف ومحول عامل دوري لتوحيد بيانات نظام تحديد المواقع العالمي (GPS) الكثيفة والمتفرقة بكفاءة من أجل كشف الشذوذ متعدد الأشهر وقابل للتوسع.

Md Awsafur Rahman, Chandrakanth Gudavalli, Hardik Prajapati, B. S. Manjunath2026-03-27
💻 computer science

Adaptive Learned Image Compression with Graph Neural Networks

تقترح هذه الورقة البحثية إطار عمل GLIC، وهو إطار لضغط الصور المعتمد على التعلم والشبكات العصبية الرسومية، والذي يستخدم رسومًا بيانية ثنائية المقياس واتصالًا تكيفيًا للتغلب على مجالات الاستقبال الجامدة للشبكات العصبية الالتفافية (CNNs) والمحولات (Transformers)، محققًا أداءً رائدًا مع تخفيضات كبيرة في معدل BD-rate في الاختبارات القياسية.

Yunuo Chen, Bing He, Zezheng Lyu, Hongwei Hu, Qunshan Gu, Yuan Tian, Guo Lu2026-03-27