🤖 machine learning

Logic of Hypotheses: from Zero to Full Knowledge in Neurosymbolic Integration

تقدم هذه الورقة "منطق الفرضيات" (LoH)، وهو إطار عمل عصبي رمزي مبتكر يوحد بين القواعد المصممة يدويًا والتعلم القائم على البيانات عبر توسيع المنطق القضايا بمعامل اختيار قابل للتعلم يتم تجميعه في منطق ضبابي قابل للتفاضل، مما يتيح تكاملاً مرنًا للمعرفة واستدلالًا بولينياً منفصلاً دون فقدان في الأداء.

Davide Bizzaro, Alessandro Daniele2026-05-18
📊 statistics

Painless Activation Steering: An Automated, Lightweight Approach for Post-Training Large Language Models

تقدم هذه الورقة البحثية "توجيه التنشيط غير المؤلم" (Painless Activation Steering - PAS)، وهو أسلوب مؤتمت بالكامل وخفيف الوزن يقوم ببناء ناقلات التنشيط من مجموعات البيانات المصنفة دون تدخل بشري لتوجيه النماذج اللغوية الكبيرة بفعالية نحو السلوكيات المرغوبة، متفوقاً على التقنيات الحالية في القدرة على التحكم والكفاءة مع إظهار فعالية محددة للمهام الموجهة نحو السلوك.

Sasha Cui, Zhongren Chen2026-05-18✓ Author reviewed
💬 NLP

How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models

تقدم هذه الورقة "نماذج المستشار" (Advisor Models)، وهي طريقة لتدريب نماذج صغيرة مفتوحة الأوزان لتوليد نصائح لغوية طبيعية ديناميكية لكل حالة على حدة، مما يعمل بفعالية على توجيه وتعزيز أداء النماذج اللغوية الكبيرة الأمامية غير القابلة للوصول (black-box) من خلال التحسين البارامتري دون تعديل أوزانها.

Parth Asawa, Alan Zhu, Abigail O'Neill, Matei Zaharia, Alexandros G. Dimakis, Joseph E. Gonzalez2026-05-18
🧬 biology

SAE-RNA: A Sparse Autoencoder Model for Interpreting RNA Language Model Representations

تقدم الورقة البحثية SAE-RNA، وهو نموذج للمشفّر التلقائي المتناثر (sparse autoencoder) يفسر تمثيلات نماذج لغة الحمض النووي الريبوزي (RNA) عبر رسم خرائط لها إلى سمات بيولوجية بمستوى بشري، مما يعمل كمسبار على مستوى التمثيل لتوصيف كيفية تنظيم هذه النماذج للمعلومات البيولوجية وتحديد المكونات المتناثرة المتعلقة بهوية عائلة الحمض النووي الريبوزي والسياق الهيكلي.

Taehan Kim, Sangdae Nam2026-05-18
💬 NLP

ADMIT: Few-shot Knowledge Poisoning Attacks on RAG-based Fact Checking

تقدم الورقة البحثية تقنية ADMIT، وهي تقنية حقن عدائي متعدد ومتوافق دلاليًا وقليل العينات، تنجح في تسميم أنظمة التحقق من الحقائق القائمة على التوليد المعزز بالاسترجاع (RAG) عبر حقن محتوى عدائي ضئيل لتجاوز الأدلة الأصلية والتلاعب بمخرجات النماذج اللغوية الكبيرة بمعدل نجاح هجوم مرتفع عبر نماذج ومجالات متنوعة.

Yutao Wu, Xiao Liu, Yinghui Li, Yifeng Gao, Yifan Ding, Jiale Ding, Xiang Zheng, Xingjun Ma2026-05-18
🤖 machine learning

Monotone and Separable Set Functions: Characterizations and Neural Models

تقدم هذه الورقة دالات المجموع الرتيبة والقابلة للفصل (MAS) للحفاظ على ترتيب احتواء المجموع، وتضع حدوداً نظرية لوجودها وأبعادها، وتقترح نموذجاً عصبياً "ضعيف الـ MAS" مستقراً للمجموعات الأرضية اللانهائية، وتثبت فعاليتها في مهام احتواء المجموع من خلال كل من ضمانات التقريب الشامل والنتائج التجريبية.

Soutrik Sarangi, Yonatan Sverdlov, Nadav Dym, Abir De2026-05-18
🤖 machine learning

SemanticOpt: Towards LLM-Based Semantic Black-Box Optimization

يُعد SemanticOpt إطار عمل مبتكر يعزز النماذج اللغوية الكبيرة من أجل التحسين الدلالي للصندوق الأسود عبر ضبطها بدقة على مسارات بايزية مهيكلة ومثرية بسياق لغوي طبيعي، مما يمكنها من الاستفادة بفعالية من المعرفة بالمجال والتفوق على كل من المحسنات الكلاسيكية والمحسنات القائمة على النماذج اللغوية الكبيرة في السيناريوهات التجريبية المكلفة.

Jamison Meindl, Yunsheng Tian, Tony Cui, Veronika Thost, Zhang-Wei Hong, Jie Chen, Wojciech Matusik, Mina Konaković Luko (…)2026-05-18
🤖 machine learning

Weight Concentration Regularization for Improving Pruning Robustness Under High Sparsity

تقترح هذه الورقة البحثية "تنظيم تركيز الأوزان" (WCR)، وهو منظم جديد أثناء التدريب يعمل على تضخيم مجموعة فرعية صغيرة من المعلمات المعلوماتية مع كبح غيرها لتحسين متانة تقليم المقدار بضربة واحدة بشكل كبير تحت ظروف التشتت العالي عبر مختلف مهام التعلم العميق.

Vincent-Daniel Yun, Junhyuk Jo, Sunwoo Lee2026-05-18
💬 NLP

DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research

تقدم الورقة البحثية نموذج DR Tulu، وهو نموذج بحث عميق مفتوح المصدر تم تدريبه عبر التعلم التعزيزي باستخدام معايير التقييم المتطورة (RLER) التي تطور معايير التقييم بالتزامن مع السياسة، مما يمكّنه من التفوق على الوكلاء المفتوحين الحاليين ومنافسة الأنظمة المملوكة في مهام البحث طويلة المدى مع كونه أكثر فعالية من حيث التكلفة بشكل كبير.

Rulin Shao, Akari Asai, Shannon Zejiang Shen, Hamish Ivison, Varsha Kishore, Jingming Zhuo, Xinran Zhao, Molly Park, Sam (…)2026-05-18
🤖 AI

CodeDistiller: Automatically Generating Code Libraries for Scientific Coding Agents

تقدم الورقة البحثية CodeDistiller، وهو نظام يقوم تلقائياً بتقطير مستودعات GitHub العلمية إلى مكتبات برمجية مدققة، مما يعزز بشكل كبير دقة واكتمال وكلاء الاكتشاف العلمي المؤتمت مع إثبات جدوى استخدام "النموذج اللغوي الكبير كحَكَم" (LLM-as-a-judge) كبديل تقييمي قابل للتوسع.

Peter Jansen, Samiah Hassan, Pragnya Narasimha2026-05-18