🤖 machine learning

GFlowNet Training by Policy Gradients

تقترح هذه الورقة إطار عمل جديد لتدريب شبكات تدفق التوازن (GFlowNet) يربط بين توازن التدفق وتحسين المكافأة المتوقعة لاستخلاص أساليب جديدة قائمة على السياسة، وتتميز باستراتيجية مقترنة للتدريب المشترك للسياسات الأمامية وتصميم السياسات الخلفية، وهو أمر مضمون نظرياً ومثبت تجريبياً في تحسين الأداء على كل من مجموعات البيانات المحاكية والواقعية.

Puhua Niu, Shili Wu, Mingzhou Fan, Xiaoning Qian2026-08-06
🤖 machine learning

Unforgettable Generalization in Language Models

تتقصى هذه الورقة كيفية سلوك النماذج اللغوية عند "نسيان" المهارات عبر الضبط الدقيق باستخدام تسميات عشوائية، كاشفةً أن تعميم النسيان غير متوقع للغاية ويعتمد على المهمة، حيث يفشل غالباً في الامتداد إلى ما وراء أمثلة تدريبية محددة رغم المخرجات العشوائية ظاهرياً، بينما تظل قدرات المهام الكامنة سليمة كما يتضح من نجاح الاختبار الخطي.

Eric Zhang, Leshem Choshen, Jacob Andreas2026-08-06
📊 statistics

Towards Understanding Gradient Flow Dynamics of Homogeneous Neural Networks Beyond the Origin

توسع هذه الورقة تحليل ديناميكيات تدفق التدرج في الشبكات العصبية المتجانسة إلى ما وراء نظام التهيئة الصغيرة من خلال توصيف أول نقطة سرج يتم مواجهتها بعد الهروب من الأصل، وإثبات أن بنية التناثر التي تشكلت قبل هذا الهروب تظل محفوظة حتى نقطة السرج التالية.

Akshay Kumar, Jarvis Haupt2026-08-06
🤖 AI

Curiosity-Diffuser: Curiosity Guide Diffusion Models for Reliability

تقدم هذه الورقة البحثية Curiosity-Diffuser، وهي طريقة تعزز موثوقية سياسات التقليد الروبوتية باستخدام وحدة تقطير الشبكة العشوائية (RND) لتوجيه نماذج الانتشار الشرطية نحو توليد مسارات ذات فضول أقل، مما يقلل من الهلوسة والتعميم المفرط مع مواءمة السلوكيات بشكل وثيق مع بيانات التدريب.

Zihao Liu, Xing Liu, Yuhang Dong, Haitao Chang, Zhengxiong Liu, Panfeng Huang2026-08-06
🤖 AI

Review Text as a Leading Indicator of Displayed Reputation in Platform Rating Systems: Evidence from 34 U.S. Short-Term Rental Markets

تُثبت هذه الورقة أن المشاعر المُعبَّر عنها في نصوص المراجعات السابقة تعمل كمؤشر استباقي دقيق للتحسينات المستقبلية في التقييمات المعروضة في أسواق التأجير قصير الأمد في الولايات المتحدة، مما يكشف أن أنظمة التقييم الحالية للمنصات تتجاهل معلومات قيمة محتفظ بها داخل نص المراجعة نفسه.

Ali Safari2026-08-06
🤖 machine learning

One Surrogate to Fool Them All: Universal, Transferable, and Targeted Adversarial Attacks with CLIP

تقدم الورقة البحثية UnivIntruder، وهو إطار عمل لهجوم عدائي مبتكر يستفيد من نموذج CLIP عام واحد ومفاهيم نصية لتوليد اضطرابات عالمية، وقابلة للنقل، ومستهدفة تحقق معدلات نجاح عالية ضد الشبكات العصبية العميقة والأنظمة الواقعية المتنوعة دون الحاجة إلى الوصول إلى بيانات تدريب الهدف أو استعلامات مفرطة للنماذج.

Binyan Xu, Xilin Dai, Di Tang, Kehuan Zhang2026-08-06
💬 NLP

Esoteric Language Models: A Family of Any-Order Diffusion LLMs

تقدم الورقة البحثية نماذج Eso-LMs، وهي عائلة جديدة من النماذج اللغوية التي تدمج بين نماذج الانتشار المقنعة والنماذج ذات الترتيب الذاتي باستخدام الانتباه السببي لتمكين الحساب الدقيق للاحتمالية وتخزين الذاكرة المخبأة (KV caching)، مما يحقق أداءً رائدًا في الكفاءة والجودة على جبهة باريتو (Pareto frontier) بين السرعة والجودة في التوليد غير المشروط.

Subham Sekhar Sahoo, Zhihan Yang, Yash Akhauri, Johnna Liu, Deepansha Singh, Zhoujun Cheng, Zhengzhong Liu, Eric Xing, J (…)2026-08-06
🤖 AI

Pun Intended: Multi-Agent Translation of Wordplay with Contrastive Learning and Phonetic-Semantic Embeddings for CLEF JOKER 2025 Task 2

تقدم هذه الورقة إطار عمل جديداً متعدد الوكلاء يتكون من ثلاث مراحل يجمع بين النماذج اللغوية الكبيرة، والتضمينات الصوتية-الدلالية، والتعلم التبايني لترجمة التورية اللغوية من الإنجليزية إلى الفرنسية بنجاح، محققةً مراكز متقدمة في مسابقة CLEF JOKER 2025 عبر إعطاء الأولوية للإبداع اللغوي على الترجمة الحرفية.

Russell Taylor, Benjamin Herbert, Michael Sana2026-08-06
🤖 machine learning

Multi-Model Ensemble and Reservoir Computing for River Discharge Prediction in Ungauged Basins

تقدم الورقة البحثية إطار عمل HYPER، وهو إطار عمل جديد وفعال حاسوبياً يجمع بين المتوسط البايزي للنماذج الهيدرولوجية المفاهيمية غير المعايرة وبين الحوسبة الخزانية لتصحيح الخطأ، مما يظهر متانة وقدرة على التعميم تتفوق على معايير التعلم العميق مثل شبكات الذاكرة الطويلة قصيرة المدى (LSTM) في التنبؤ بتصريف الأنهار للأحواض غير المقاسة.

Mizuki Funato, Yohei Sawada2026-08-06