🤖 machine learning

Escaping Plato's Cave: JAM for Aligning Independently Trained Vision and Language Models

تقدم هذه الورقة البحثية "المُعدِّل التلقائي المشترك" (JAM)، وهو أسلوب يعمل على محاذاة نماذج الرؤية واللغة المدربة بشكل مستقل عبر التحسين المشترك للمشفرات التلقائية الخاصة بكل نمط من خلال إعادة بناء منسقة وفقد انتشار متعدد الوسائط مبتكر، مما يثبت إمكانية استحثاث تمثيلات دلالية مشتركة بشكل صريح حتى عبر فضاءات تمثيلية منفصلة.

Lauren Hyoseo Yoon, Yisong Yue, Been Kim2026-05-18
💬 NLP

Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling

تقدم هذه الورقة Prefix-RFT، وهي طريقة ضبط دقيق هجينة تدمج بين الضبط الدقيق الخاضع للإشراف والضبط الدقيق بالتعزيز من خلال أخذ عينات البادئة للتغلب على قيود كل نهج على حدة، مما يظهر أداءً فائقًا ومتانة في مهام الاستدلال الرياضي.

Zeyu Huang, Tianhao Cheng, Zihan Qiu, Zili Wang, Yinghui Xu, Edoardo M. Ponti, Ivan Titov2026-05-18
💬 NLP

Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty

تقدم هذه الورقة البحثية RLCR (التعلم التعزيزي مع مكافآت المعايرة)، وهو نهج تدريب مبتكر يعزز مكافآت الصحة الثنائية بنتيجة "براير" (Brier score) لتحسين الدقة والثقة المعايرة للنماذج اللغوية في آن واحد، مما يقلل من الهلوسة وتدهور المعايرة الذي غالباً ما يسببه التعلم التعزيزي القياسي.

Mehul Damani, Isha Puri, Stewart Slocum, Idan Shenfeld, Leshem Choshen, Yoon Kim, Jacob Andreas2026-05-18
⚛️ high-energy theory

Viability of perturbative expansion for quantum field theories on neurons

تتقصى هذه الورقة مدى جدوى استخدام بنيات الشبكات العصبية ذات العصبونات المحدودة لمحاكاة نظريات الحقل الكمي المحلية، وتجد أنه بينما يمكن لهذه البنيات إعادة إنتاج النتائج في الحد اللانهائي، فإن توسعاتها الاضطرابية لقيم NN المحدودة تعاني من ضعف التقارب بسبب الحساسية فوق البنفسجية، مما يستدعي اقتراح تعديلات بنيوية لتحسين الدقة.

Srimoyee Sen, Varun Vaidya2026-05-18
🧬 biology

Genome-Factory: A Library for Tuning, Deploying, and Interpreting Genomic Foundation Models

تُعد Genome-Factory أول مكتبة بايثون متكاملة توحد سير العمل الشامل لنماذج التأسيس الجينومية، حيث تعمل على تبسيط عمليات جمع البيانات، وضبط النماذج، والاستدلال، والمقارنة المرجعية، والتفسير البيولوجي من خلال أدوات مثل المفسر القائم على المشفر التلقائي المتناثر.

Weimin Wu, Xuefeng Song, Yibo Wen, Qinjie Lin, Zhihan Zhou, Jerry Yao-Chieh Hu, Zhong Wang, Han Liu2026-05-18
🤖 machine learning

Investigating Modality Contribution in Audio LLMs for Music

تتقصى هذه الورقة مساهمات الأنماط في النماذج اللغوية الكبيرة الصوتية (Audio LLMs) الخاصة بالموسيقى عبر تطويع إطار عمل MM-SHAP للكشف عن أنه بينما تعتمد النماذج ذات الأداء العالي بشكل كبير على الاستدلال النصي، إلا أنها لا تزال تستخدم الصوت بفعالية لتحديد مواقع الأحداث الصوتية الرئيسية.

Giovana Morais, Magdalena Fuentes2026-05-18
🤖 machine learning

Logic of Hypotheses: from Zero to Full Knowledge in Neurosymbolic Integration

تقدم هذه الورقة "منطق الفرضيات" (LoH)، وهو إطار عمل عصبي رمزي مبتكر يوحد بين القواعد المصممة يدويًا والتعلم القائم على البيانات عبر توسيع المنطق القضايا بمعامل اختيار قابل للتعلم يتم تجميعه في منطق ضبابي قابل للتفاضل، مما يتيح تكاملاً مرنًا للمعرفة واستدلالًا بولينياً منفصلاً دون فقدان في الأداء.

Davide Bizzaro, Alessandro Daniele2026-05-18
📊 statistics

Painless Activation Steering: An Automated, Lightweight Approach for Post-Training Large Language Models

تقدم هذه الورقة البحثية "توجيه التنشيط غير المؤلم" (Painless Activation Steering - PAS)، وهو أسلوب مؤتمت بالكامل وخفيف الوزن يقوم ببناء ناقلات التنشيط من مجموعات البيانات المصنفة دون تدخل بشري لتوجيه النماذج اللغوية الكبيرة بفعالية نحو السلوكيات المرغوبة، متفوقاً على التقنيات الحالية في القدرة على التحكم والكفاءة مع إظهار فعالية محددة للمهام الموجهة نحو السلوك.

Sasha Cui, Zhongren Chen2026-05-18✓ Author reviewed
🤖 machine learning

Training-Free Multimodal Guidance for Video to Audio Generation

تقترح هذه الورقة آلية توجيه متعددة الوسائط جديدة لا تتطلب تدريباً، تستفيد من تضمينات الوسائط لفرض محاذاة موحدة عبر الفيديو والصوت والنص، مما يؤدي إلى تحسين الجودة الإدراكية والتماسك الدلالي لتوليد الفيديو إلى صوت دون الحاجة إلى إعادة تدريب مكلفة.

Eleonora Grassucci, Giuliano Galadini, Giordano Cicchetti, Aurelio Uncini, Fabio Antonacci, Danilo Comminiello2026-05-18
💬 NLP

How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models

تقدم هذه الورقة "نماذج المستشار" (Advisor Models)، وهي طريقة لتدريب نماذج صغيرة مفتوحة الأوزان لتوليد نصائح لغوية طبيعية ديناميكية لكل حالة على حدة، مما يعمل بفعالية على توجيه وتعزيز أداء النماذج اللغوية الكبيرة الأمامية غير القابلة للوصول (black-box) من خلال التحسين البارامتري دون تعديل أوزانها.

Parth Asawa, Alan Zhu, Abigail O'Neill, Matei Zaharia, Alexandros G. Dimakis, Joseph E. Gonzalez2026-05-18