🤖 AI

PANOPTICON: A PII-Based Assemblage of Naturalistic Output Tokens for Investigating Privacy Leakage Within LLM Context Window

تقدم هذه الورقة PANOPTICON، وهي أول مجموعة بيانات ومسار عمل مصمم لمعالجة نقص بيانات معلومات الهوية الشخصية (PII) الحقيقية لأبحاث الخصوصية من خلال توليد 67,718 مطالبة اصطناعية لقياس تسرب الخصوصية وتقييم هجمات عكس المطالبة في النماذج اللغوية الكبيرة.

Ryan Thornton, Mir Mehedi Ahsan Pritom, Maanak Gupta2026-07-28
🤖 AI

MegaSlide-DiT: Memory-Centric Adaptation and Deformable Local Attention for Efficient Video Diffusion

يُمكِّن MegaSlide-DiT التكيف بجميع المعلمات لنماذج الانتشار المرئي الضخمة بسعة 105 مليار بارامتر على وحدة معالجة رسوميات واحدة لمحطة عمل عبر ترحيل حالات النموذج المستمرة إلى ذاكرة المضيف واستبدال الانتباه العالمي التربيعي بآلية انتباه انزلاقي ثلاثي الأبعاد مشوه، ذات تعقيد خطي ومتكيف مع الحركة.

Jiacheng Liu, Jason Liu2026-07-28
🤖 machine learning

Test-Time Coverage: Test-Conditioned Data Curation for Deployment-Aware Learning

تقدم هذه الورقة البحثية TTCov، وهي طريقة لتنقية البيانات مشروطة بالاختبار تقوم ببناء أطلس معرفي من عينات النشر لاختيار بيانات التدريب بتغطية محسنة ومطابقة للتوزيع، مما يعزز أداء القيادة الذاتية دون الحاجة إلى تحديث النموذج في وقت الاستدلال.

Nadine Chang, Maying Shen, Shizhe Diao, Jialiang Wang, Jingde Chen, Thomas Breuel, Pavlo Molchanov, Rafid Mahmood, Jose (…)2026-07-28
🤖 AI

MPR-CiteG: Enhancing RAG with Multi-Portfolio Retrieval and Citation-Grounded Generation

تقدم الورقة البحثية إطار عمل MPR-CiteG، وهو إطار مكون من عنصرين يجمع بين استرجاع المحافظ المتعددة (Multi-Portfolio Retrieval) والتوليد المرتكز على الاستشهاد (Citation-Grounded Generation) لتعزيز أنظمة التوليد المعزز بالاسترجاع (RAG) من خلال تحسين كفاءة الاسترجاع وضمان الاتساق الواقعي عبر الإسناد الصريح للمصادر، مما يقلل من الهلوسة ويحقق المركز الثاني في تحدي ScienceON AI.

Hyewon Lee, Minkyung Song, Junghyun Oh, Seunghoon Han, Sungsu Lim2026-07-28
🤖 machine learning

CORVUS: Context Optimization and Reduction Via Underlying Synchronization for LLM Coding Agents

يقدم CORVUS بنية مسار مبتكرة لوكلاء البرمجة القائمين على النماذج اللغوية الكبيرة (LLMs) تعمل على فصل إجراءات قراءة الملفات عن ملاحظاتها من خلال الحفاظ على سجل متزامن لمحتويات الملفات الحالية، مما يؤدي إلى القضاء على اللقطات القديمة وإعادة القراءات المتكررة لتقليل استهلاك الرموز (tokens) ودورات الاستدلال بشكل كبير مع الحفاظ على الأداء.

Mingwei Zheng, David OBrien, Siwei Cui, Pardis Pashakhanloo, Rajdeep Mukherjee, Myeongsoo Kim, Sachit Kuhar2026-07-28
🔬 optics

scMIR: a vision-language foundation model for single-cell light microscopy image representation

تقدم الورقة البحثية نموذج scMIR، وهو نموذج تأسيسي للرؤية واللغة تم تدريبه مسبقاً على أكثر من 200,000 زوج من الصور والنصوص، يجمع بشكل تآزري بين إعادة بناء الصور ذاتي الإشراف والمحاذاة عبر الوسائط الموجهة بالنص لتوليد تمثيلات موحدة لصور المجهر أحادية الخلية، مما يجعله يتفوق على الأساليب الحالية في التعميم والدقة عبر مهام التحليل المظهري المتنوعة دون الحاجة إلى ضبط دقيق خاص بالمهمة.

Yifan Shang (Department of Biomedical Engineering, The Chinese University of Hong Kong, Hong Kong, China, College of Com (…)2026-07-28
🤖 AI

Real-Time Semantic Segmentation with Optimized RetinaNet Architectures for Embedded Automotive Systems

تقدم هذه الورقة البحثية Opt-RetinaSeg، وهي بنية محسنة للتجزئة الدلالية مشتقة من RetinaNet، تستخدم عموداً فقرياً خفيف الوزن، وهيكلاً متسلسلاً (FPN) مبسطاً، ومسار تحسين ثلاثي المراحل لتحقيق أداء عالي الدقة وفي الوقت الفعلي على المنصات السياراتية المدمجة ذات الموارد المحدودة.

Sai Sidharth D2026-07-28
🤖 AI

DAMamba-UNet3D: A Parameter-Efficient Mamba State Space U-Net with Dynamic Adaptive Scan for 3D Medical Image Segmentation

تقدم الورقة البحثية DAMamba-UNet3D، وهو نموذج هجين من نوع U-Net ثلاثي الأبعاد موفر للمعلمات لتقسيم الصور الطبية ثلاثية الأبعاد، يدمج آلية مسح تكيفي ديناميكي (DAS) مبتكرةة لتحقيق أداء تنافسي على مجموعة بيانات BraTS 2020 مع تقليل التكاليف الحسابية بشكل كبير مقارنة بالنماذج القائمة على Mamba.

Mohammad Arafat Hussain, Ellen Grant, Yangming Ou2026-07-28
🤖 machine learning

A New Kind of Adversarial Example: Measuring the Human-Model Gap, and Its Relationship to OOD Detection

تقدم هذه الورقة البحثية وتتحقق من فئة جديدة من الأمثلة التنافسية حيث تتسبب الاضطرابات الكبيرة والمرئية في جعل البشر يخطئون في التعرف على الصور بينما تحتفظ النماذج بتنبؤات صحيحة، مما يثبت أن كواشف وخوارزميات الدفاع القياسية الخاصة بالبيانات خارج التوزيع (OOD) غير فعالة إلى حد كبير ضد هذه الفجوة بين الإنسان والنموذج.

Ali Borji2026-07-28
🤖 machine learning

Cortex: Compact Behavior Cloning for Quake with Frozen Visual Features

تقدم الورقة البحثية Cortex، وهو سياسة استنساخ سلوكي مدمجة للعبة Quake تستفيد من مشفر بصري مجمد من نوع DINOv3 ومحول مكون من ست طبقات لتحقيق تقدم مستمر في المستويات ونجاح في القتال على مجموعة بيانات واسعة النطاق، مما يثبت فعالية التعلم بالتقليد البسيط قبل اللجوء إلى التعلم المعزز أو الذاكرة الصريحة.

Dzmitry Malyshau2026-07-28