💻 computer science

Rethinking Cross-Layer Information Routing in Diffusion Transformers

تقدم هذه الورقة البحثية آلية التوجيه التكيفي مع الانتشار (DAR)، وهي آلية متبقية قابلة للتعلم وتكيفية مع الخطوات الزمنية تحل محل عملية الجمع المتبقي التقليدية في محولات الانتشار (Diffusion Transformers) للتخفيف من مشكلات تدفق المعلومات، مما يحسن بشكل كبير من جودة توليد صور ImageNet وكفاءة التدريب مع الحفاظ على التفاصيل عالية التردد أثناء الضبط الدقيق.

Chao Xu, Maohua Li, Qirui Li, Yixuan Xu, Yanke Zhou, Yunhe Li, Cuifeng Shen, Hanlin Tang, Kan Liu, Tao Lan, Lin Qu, Shao (…)2026-05-21
🤖 machine learning

SAVER: Selective As-Needed Vision Evidence for Multimodal Information Extraction

تقترح الورقة البحثية إطار عمل SAVER، وهو إطار استخراج معلومات متعدد الوسائط انتقائي يستخدم بوابة قابلية التحقق المطابقة (Conformal Groundability Gate) لتقرير متى وأي مجموعة فرعية من الصور يجب استشارتها بشكل ديناميكي، مما يؤدي إلى تحسين دقة الاستخراج مع تقليل التكاليف الحسابية وزمن الاستجابة بشكل كبير مقارنة بطرق الدمج المستمرة.

Miaobo Hu, Shuhao Hu, Bokun Wang, Rui Chen, Xin Wang, Xiaobo Guo, Daren Zha, Jun Xiao2026-05-21
🤖 machine learning

AGPO: Adaptive Group Policy Optimization with Dual Statistical Feedback

تقترح الورقة البحثية تحسين سياسة المجموعة التكيفي (AGPO)، وهو إطار عمل للتعلم المعزز خالٍ من الناقد (critic-free) يستخدم إحصائيات على مستوى المجموعة لضبط حدود القص ودرجات حرارة فك الترميز ديناميكيًا، مما يؤدي إلى تحسين أداء النماذج اللغوية الكبيرة في الاستنتاج على اختبارات الرياضيات والعلوم والتكنولوجيا والهندسة والرياضيات مقارنة بطريقتي PPO وGRPO القياسيتين.

Miaobo Hu, Shuhao Hu, Bokun Wang, Ruohan Wang, Xin Wang, Xiaobo Guo, Daren Zha, Jun Xiao2026-05-21
💬 NLP

Distributional Alignment as a Criterion for Designing Task Vectors in In-Context Learning

تقدم هذه الورقة البحثية "متجه المهمة الخطي" (LTV)، وهي طريقة تصمم متجهات المهام من خلال تقليل التفاوت التوزيعي بين الاستدلال القائم على متجه المهمة والاستدلال القائم على التعلم في السياق، مما يحسن الدقة والكفاءة بشكل كبير عبر مهام التصنيف، والانحدار، ونقل النماذج المتقاطعة.

Jihoon Kwon, Jiwon Choi, Jy-yong Sohn2026-05-21
📊 statistics

TASTE: A Designer-Annotated Multi-Dimensional Preference Dataset for AI-Generated Graphic Design

تقدم هذه الورقة البحثية TASTE، وهي مجموعة بيانات تفضيلات متعددة الأبعاد تم تعليقها من قبل مصممين محترفين عبر تسعة معايير للتصميم الجرافيكي، وتوضح أنه في حين تكافح المقيمات بالذكاء الاصطناعي الحالية لمضاهاة الإجماع البشري، فإن نموذجاً متخصصاً تم تدريبه على مجموعة البيانات هذه يحسن بشكل كبير من التوافق مع أحكام الخبراء.

Haonan Zhu, Elad Hirsch, Alexandria Minetti, Allison Nulty, Purvanshi Mehta2026-05-21
🤖 machine learning

Distribution-Aware Reward: Reinforcement Learning over Predictive Distributions for LLM Regression

تقدم هذه الورقة البحثية "المكافأة المدركة للتوزيع" (Distribution-Aware Reward)، وهي هدف للتعلم التعزيزي يعمل على تحسين النماذج اللغوية الكبيرة لتوليد توزيعات تنبؤية معايرة لمهام الانحدار من خلال تقييم عينات متعددة تم فك تشفيرها باستخدام درجة الاحتمالية المستمرة المرتبة (Continuous Ranked Probability Score)، مما يؤدي إلى تحسين تقدير عدم اليقين، وأداء التصنيف، والمتانة مقارنة بطرق تدريب التقدير النقطي التقليدية.

Jungsoo Park, Hyungjoo Chae, Ethan Mendes, Jay DeYoung, Varsha Kishore, Wei Xu, Alan Ritter2026-05-21
🤖 machine learning

Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale

تقدم هذه الورقة نموذج تقييم جديد ومعيار "Hack-Verifiable TextArena"، الذي يدمج فرص استغلال المكافآت القابلة للكشف مباشرة في البيئات لتمكين قياس حتمي وآلي وقابل للتوسع لكيفية استغلال النماذج اللغوية لمثل هذه الثغرات.

Amit Roth, Ankur Samanta, Matan Halevy, Yoav Levine, Yonathan Efroni2026-05-21
🤖 machine learning

The Hidden Signal of Verifier Strictness: Controlling and Improving Step-Wise Verification via Selective Latent Steering

تقدم هذه الورقة بحثًا حول VerifySteer، وهي طريقة تتحكم في صرامة التحقق خطوة بخطوة وتحسنها من خلال اكتشاف وتوجيه إشارات الحالة الخفية انتقائيًا عند حدود الفقرات، مما يؤدي إلى التفوق على النماذج المرجعية الحالية بتكلفة حوسبية أقل بكثير.

Yefan Zhou, Yilun Zhou, Austin Xu, Soroush Vosoughi, Shafiq Joty, Jiang Gui2026-05-21
📊 statistics

Correcting Stochastic Update Bias in Preconditioned Language Model Optimizers

تحدد هذه الورقة وتصحح انحيازين في العينات المحدودة في مُحسّنات النماذج اللغوية ذات المسبقات الشرطية —وهما اقتران التدرج بالمسبق الشرطي وانحياز الارتداد غير الخطي— وذلك عبر اقتراح إطار عمل أحادي الدفعة يجمع بين التكييف المتقاطع المتبادل والارتداد المصحح للتباين، مما يقلل من خسارة ما قبل التدريب ويحسن الأداء عبر نماذج مثل AdamW وSophia وShampoo.

Nikhil Nayak, Julia White, Urchade Zaratiana, Kelton Zhang, Henrijs Princis, Dhruv Atreja, Henry Fawcett, Matthew Thomas (…)2026-05-21
🤖 machine learning

Interaction Locality in Hierarchical Recursive Reasoning

تقدم هذه الورقة البحثية "محلية التفاعل" (interaction locality)، وهو إطار عمل مدرك للمهمة والهندسة يستخدم رقع التنشيط واستئصال الميزات لإثبات أن نماذج الاستدلال الهرمي والعودي (HRM و TRM) تحل المهام المكانية المعقدة من خلال تجميع عمليات كتابة المعلومات المحلية في هياكل عالمية، وهو نمط يتناقض مع المحلية المركزة عند الحدود الملحوظة في النماذج المجسمة ثلاثية الأبعاد واسعة النطاق.

Yosuke Miyanishi, Tetsuro Morimura2026-05-21