💬 NLP

WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning

تقدم الورقة البحثية WIDE، وهو أول إطار عمل قابل للتفاضل من طرف إلى طرف يتيح تقليم العرض الديناميكي على مستوى الرمز (token-level) للنماذج اللغوية الكبيرة عبر السماح بالاختيار الدقيق لرؤوس الانتباه وقنوات الشبكات العصبية المغذية (FFN)، مقترناً بتصميم مشترك متخصص للنواة (kernel co-design) لتحقيق تسريع كبير في الاستنتاج من طرف إلى طرف مع الحفاظ على دقة عالية.

Haozhe Hu, Hao Wu, Peiran Yin, Chao Han, Yunpu Ma, Xiaoyu Shen2026-07-31
🤖 machine learning

The Role of Causality in Algorithmic Recourse

تقدم هذه الورقة إطاراً سببيّاً أدائياً للتعويض الخوارزمي ينمذج كيفية انتشار الإجراءات الموصى بها عبر نموذج سببي بنيوي لضمان تحسينات حقيقية في المؤهلات، مما يحقق توازنات مستقرة تمنع التلاعب الاستراتيجي وتحد من الحاجة إلى إعادة تدريب النموذج بشكل متكرر.

Srikanth Avasarala, Varun Gupta, Shahin Jabbari, Saber Salehkaleybar, Juba Ziani2026-07-31
🤖 machine learning

Same Graph Cross-Task Transfer in GNNs: Protocols and Predictors

تضع هذه الورقة بروتوكول تقييم خالٍ من التسريب لنقل المهام عبر الرسوم البيانية نفسها بين تصنيف العقد والتنبؤ بالروابط في الشبكات العصبية الرسومية (GNNs)، كاشفةً أن النقل يكون اتجاهياً للغاية وقابلاً للتنبؤ بناءً على تجانس الرسم البياني (graph homophily)، كما تقدم "درجة كوتاسك" (CoTask Score) لتوجيه اختيار الآلية وتجنب النقل السلبي.

Neelam Akula, Surbhi Kumar, Murat Kantarcioglu, Baris Coskunuzer2026-07-31
💬 NLP

Sample More, Reflect Less: Self-Refine and Reflexion Lose to Repeated Sampling at Equal Token Cost, from 1.5B to 7B

تُثبت هذه الورقة أنه عبر مختلف النماذج مفتوحة المصدر (من 1.5 إلى 7 مليارات معلمة) واختبارات الرياضيات المرجعية، يتفوق أخذ العينات المتكرر باستمرار على أساليب الصقل الذاتي والتفكير المعقد أو يضاهيها عند تقييمها بتكلفة رموز متساوية، مما يكشف أن المكاسب الظاهرية للأخيرة تنبع غالباً من زيادة حجم التوليد بدلاً من استراتيجيات التفكير المتفوقة.

Iliya Mirzaei2026-07-31
🤖 machine learning

β\beta-OPSD: Deriving with Policy Optimization, Training with Self-Distillation

تقدم هذه الورقة β\beta-OPSD، وهو إطار عمل منهجي يعمم التقطير الذاتي داخل السياسة عبر معاملة وزن جزاء KL كمعامل قابل للضبط، مما يتيح التدريب الفعال من خلال خلط اللوجيت (logit mixing) لتقريب الاستيفاء الأمثل للسياسة بين نموذج مرجعي ومعلم، مع تحسين الاستقرار وأداء الاستدلال بشكل كبير مقارنة بـ OPSD التقليدي.

Jiawei Xu, Minghui Liu, Juzheng Zhang, Tom Goldstein, Furong Huang2026-07-31
🤖 machine learning

MixFrag: Fragility-Guided Mixed-Precision Post-Training Quantization for Vision Transformers

تُعد MixFrag إطار عمل للكمّ بعد التدريب مختلط الدقة وموجّه بالهشاشة لنماذج المحولات الرؤيوية (Vision Transformers)، حيث يقوم بتقدير حساسية مستوى المكونات عبر تباعد كولباك - ليبلر (KL divergence) ويُحسّن تخصيص البتات باستخدام مسألة حقيبة متعددة الخيارات لتحقيق أداء رائد في مهام تصنيف الصور وكشف الأشياء.

Md. Mehrab Hossain Opi, Robiul Islam Ryad, Md. Umar Faruk2026-07-31
💬 NLP

Change2Task: From Repository Changes to Executable Coding Agent Tasks and Environments

تقدم الورقة البحثية Change2Task، وهو نظام يقوم تلقائياً بتحويل طلبات السحب المدمجة إلى مهام لوكلاء برمجيين تم التحقق منها وقابلة للتنفيذ عن طريق إعادة بناء حالات المستودعات التاريخية والتحقق من صحتها على قواعد برمجية حديثة، مما يزيد بشكل كبير من عرض بيانات التدريب مع تقليل تكاليف الإعداد وتحسين معدلات استرداد المهام مقارنة بالنماذج المرجعية الحالية.

Haomin Qi, Xingliang Wang, Xuanqi Gao, Baihui Sang, Xin Zhang, Minghua Ma, Pengfei Gao, Yu Kang, Qingwei Lin, Saravan Ra (…)2026-07-31
💬 NLP

AskChem: Claim-Centered Infrastructure for Chemistry Literature Synthesis

تُعد AskChem بنية تحتية جديدة تُحدث تحولاً في تركيب الأدبيات الكيميائية عبر نقل عملية الاسترجاع من الوثائق الكاملة إلى ادعاءات ذرية حاملة للمصدر، مما يُمكّن من بحث واكتشاف أكثر دقة وقابلية للتحقق والوصول عبر الذكاء الاصطناعي بين الأوراق البحثية المختلفة.

Bing Yan, Gregory Wolfe, Stefano Martiniani, Kyunghyun Cho2026-07-31
🤖 machine learning

ReToken: One Token to Improve Vision-Language Models for Visual Retrieval

تُعد ReToken عبارة عن تضمين واحد خفيف الوزن وقابل للتعلم، يعمل بكفاءة على استرجاع الرموز البصرية ذات الصلة بالاستعلام من ذاكرة التخزين المؤقت (KV cache) المعبأة مسبقاً، مما يحسن بشكل كبير أداء نماذج الرؤية واللغة في مهام استرجاع الصور والفيديوهات ذات السياق الطويل مع بقائه ممكناً من الناحية الحسابية على وحدة معالجة رسوميات واحدة.

Yao Xiao, Reuben Tan, Zhen Zhu, Yuqun Wu, Jianfeng Gao, Derek Hoiem2026-07-31
📊 statistics

Differentially Private Permutation Tests

تقدم هذه الورقة إطاراً صارماً لاختبارات التبديل ذات الخصوصية التفاضلية التي توسع الطرق الكلاسيكية لتشمل الأطر الخاصة مع الحفاظ على الصلاحية في العينات المحدودة وتحقيق القدرة المثلى من الناحية الدنيا والقصوى، وتثبت فعاليتها تحديداً من خلال تطوير اختبارات dpMMD وdpHSIC القائمة على النواة لاختبارات العينة الثنائية واختبار الاستقلال.

Ilmun Kim, Antonin Schrab2026-07-30