🤖 machine learning

End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer

تقترح هذه الورقة مسار تدريب متكامل (end-to-end) يعمل على تحسين مشترك لمُرمِّز دلالي أحادي الأبعاد ونموذج توليدي ذاتي الانحدار، محققاً أداءً رائدًا في توليد الصور بـ FID قدره 1.48 على مجموعة بيانات ImageNet 256x256.

Wenda Chu, Bingliang Zhang, Jiaqi Han, Yizhuo Li, Linjie Yang, Yisong Yue, Qiushan Guo2026-05-04
🤖 machine learning

A Comparative Study of QSPR Methods on a Unique Multitask PAMPA dataset

تقيم هذه الدراسة طرقاً مختلفة لـعلاقة البنية بالخصائص الفيزيائية والكيميائية (QSPR) على مجموعة بيانات فريدة ومتعددة المهام لـتجرية الامتصاص في النموذج الاصطناعي للغشاء (PAMPA) مكونة من 143 جزيئاً، حيث تُظهر أن الواصفات الفيزيائية والكيميائية المصممة من قبل الخبراء تتفوق على تمثيلات التعلم العميق في التنبؤ بنفاذية الغشاء السلبية في سيناريوهات العينات المحدودة مع تقديم قدرة أفضل على التفسير.

Andrs Formanek, Anna Vincze, Richrd Bicsak, Yves Moreau, Gyorgy T. Balogh, Adam Arany2026-05-04
🔬 physics

Scale-Aware Adversarial Analysis: A Diagnostic for Generative AI in Multiscale Complex Systems

تقدم هذه المساهمة إطار عمل للتحليل التنافسي الحساس للمقاييس عبر تفكيك الانتشار المقيد، مما يثبت أن نماذج الذكاء الاصطناعي التوليدي القياسية لا تستوعب القوانين الفيزيائية عبر المقاييس، بل تُظهر بدلاً من ذلك تجمداً هيكلياً وعدم استقرار تحت تأثير الاضطرابات المقيدة فيزيائياً.

Mengke Zhao, Guang-Xing Li, Duo Xu, Keping Qiu2026-05-04
💬 NLP

ControBench: An Interaction-Aware Benchmark for Controversial Discourse Analysis on Social Networks

تقدم هذه الورقة ControBench، وهو معيار مرجعي جديد لتحليل الخطاب المثير للجدل يدمج رسوم التفاعل الاجتماعي غير المتجانسة مع دلالات نصية غنية وأيديولوجيات المستخدمين المعلنة ذاتياً من Reddit لتمكين التقييم الواقعي للنماذج حول مواضيع مثل ترامب، والإجهاض، والدين.

Ta Thanh Thuy, Jiaqi Zhu, Xuan Liu, Lin Shang, Reihaneh Rabbany, Guillaume Rabusseau, Lihui Chen, Zheng Yilun, Sitao Lua (…)2026-05-04
🤖 AI

SAGA: Workflow-Atomic Scheduling for AI Agent Inference on GPU Clusters

تُعد SAGA مجدولاً موزعاً يعمل على تحسين كفاءة سير عمل وكلاء الذكاء الاصطناعي المركبة على مجموعات وحدات معالجة الرسومات من خلال الانتقال من الجدولة على مستوى الطلب إلى الجدولة على مستوى البرنامج، مما يحافظ على حالات ذاكرة التخزين المؤقت لمفاتيح القيم (KV cache) الوسيطة ويقلل وقت إكمال المهام بمقدار 1.64 ضعفاً رغم المقايضة في ذروة الإنتاجية.

Dongxin Guo, Jikun Wu, Siu Ming Yiu2026-05-04
🤖 machine learning

Hierarchical Abstract Tree for Cross-Document Retrieval-Augmented Generation

تقدم هذه الورقة Ψ\Psi-RAG، وهو إطار عمل جديد للجيل المعزز بالاسترجاع القائم على الأشجار، يستخدم فهرس شجرة تجريدية هرمية تكيفية ووكيل استرجاع متعدد الحبيبات للتغلب على قيود الطرق الحالية في التعامل مع الأسئلة متعددة القفزات عبر المستندات، محققاً أداءً هو الأفضل في فئته على الاختبارات المرجعية ذات الصلة.

Ziwen Zhao, Menglin Yang2026-05-04
🧬 biology

Beyond Continuity: Simulation-free Reconstruction of Discrete Branching Dynamics from Single-cell Snapshots

تقدم هذه الورقة "جسر شرويدنجر غير المتوازن" (USB)، وهو إطار عمل خالٍ من المحاكاة يتغلب على قيود طرق النقل الأمثل المستمرة الحالية من خلال النمذجة الصارمة لديناميكيات الولادة والوفاة المنفصلة وشبيهة بالقفزات عند دقة الخلية الواحدة لإعادة بناء مسارات السلالات الخلوية من لقطات تدميرية.

Junda Ying, Yuxuan Wang, Bowen Yang, Peijie Zhou, Lei Zhang2026-05-04
🤖 machine learning

Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance

تقدم هذه الورقة Stable-GFlowNet (S-GFN)، وهو إطار عمل مبتكر يعزز عمليات اختبار الاختراق لنماذج اللغات الكبيرة (LLM red-teaming) من خلال إلغاء تقدير دالة التجزئة (partition function) واستخدام تقنيات القناع المتين واستقرار الطلاقة للتغلب على عدم استقرار التدريب وانهيار النمط، مما يحقق أداءً هجومياً وتنوعاً فائقين.

Minchan Kwon, Sunghyun Baek, Minseo Kim, Jaemyung Yu, Dongyoon Han, Junmo Kim2026-05-04
📊 statistics

Gradient Regularized Newton Boosting Trees with Global Convergence

تقدم هذه الورقة "أشجار تعزيز نيوتن المنظمة بالتدرج" (Gradient Regularized Newton Boosting Trees)، وهي خوارزمية لتعزيز التدرج من الدرجة الثانية (GBDT) متقاربة عالمياً تحقق معدل تقارب قدره O(1/k2)\mathcal{O}(1/k^2) لخسائر التحدب العام عبر توسيع "هبوط نيوتن المقيد" (Restricted Newton Descent) باستخدام حد تنظيم 2\ell_2 تكيفي، مما يطابق أداء التعزيز من الدرجة الأولى مع معالجة مشكلات التباعد في خوارزمية "نيوتن تعزيز" التقليدية.

Nikita Zozoulenko, Daniel Falkowski, Thomas Cass, Lukas Gonon2026-05-04
🤖 AI

Jailbreaking Vision-Language Models Through the Visual Modality

تُثبت هذه الورقة البحثية أنه يمكن كسر حماية نماذج الرؤية واللغة بفعالية من خلال أربعة هجمات مبتكرة على النمط البصري، مما يكشف عن فجوة حرجة في التوافق عبر الأنماط حيث تفشل تدريبات السلامة القائمة على النصوص في التعميم على المدخلات البصرية الضارة.

Aharon Azulay, Jan Dubiński, Zhuoyun Li, Atharv Mittal, Yossi Gandelsman2026-05-04