💬 NLP

Towards the Anonymization of the Language Modeling

تقترح هذه الورقة منهجيات الحجب ونمذجة اللغة السببية التي تحافظ على الخصوصية لتخصيص النماذج الشبيهة بـ BERT والشبيهة بـ GPT على البيانات الحساسة، مما يمنع بفعالية حفظ المعرفات المباشرة وغير المباشرة مع الحفاظ على فائدة عالية للمشاركة.

Antoine Boutet, Lucas Magnana, Juliette Sénéchal2026-05-21
💬 NLP

LLMs on the Line: Data Determines Loss-to-Loss Scaling Laws

تُثبت هذه الورقة أن بيانات ما قبل التدريب هي المحدد الرئيسي لقوانين القياس من الخسارة إلى الخسارة في النماذج اللغوية الكبيرة، بينما يكون لآثار مثل حجم النموذج، والبنية، والمعلمات الفائقة تأثير ضئيل، مما يشير إلى أن تنقية البيانات أكثر أهمية من الخيارات الهيكلية لتحسين الأداء في المهام اللاحقة.

Prasanna Mayilvahanan, Thaddäus Wiedemer, Sayak Mallick, Matthias Bethge, Wieland Brendel2026-05-21
📊 statistics

Batched Single-Index Global Multi-Armed Bandits with Covariates

تقترح هذه الورقة خوارزمية BIDS، وهي خوارزمية شبه معلمية (semi-parametric) جديدة للمتعدد الأذرع ذي الدفعات (batched multi-armed bandits) مع المتغيرات المصاحبة، والتي تستفيد من نموذج المؤشر الفردي المشترك (shared single-index model) لتحقيق معدلات ندم مثالية دنيا (minimax-optimal regret rates) وتجاوز لعنة الأبعاد عبر توظيف آلية تقسيم ديناميكية (dynamic binning mechanism) مسترشدة باتجاه المؤشر الفردي.

Sakshi Arya, Hyebin Song2026-05-21
💬 NLP

Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs

تقدم الورقة البحثية "المستنتج الشامل" (UniR)، وهو وحدة برمجية نمطية وقابلة للتركيب والتشغيل المباشر تعزز قدرات الاستنتاج للنماذج اللغوية الكبيرة المجمدة عبر تدريب مكون استنتاج منفصل على مكافآت قابلة للتحقق وإضافة مخرجات الاحتمالات (logits) الخاصة به إلى النموذج الأساسي عند الاستدلال، مما يحقق أداءً فائقاً وتعميماً عابراً للمجالات دون الحاجة إلى إعادة تدريب النموذج بالكامل.

Jaemin Kim, Hangeol Chang, Hyunmin Hwang, Choonghan Kim, Jong Chul Ye2026-05-21
🧬 biology

Task-conditioned probing of instruction-tuned multimodal LLMs: Region-specific brain alignment patterns under naturalistic stimuli

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة متعددة الوسائط والمنضبطة بالتعليمات تُبدي محاذاة أقوى وأكثر تخصصاً في المهام مع نشاط الدماغ البشري أثناء مشاهدة الأفلام الطبيعية مقارنة بالنماذج غير المنضبطة بالتعليمات ونماذج التعلم بالسياق، مما يشير إلى أن الضبط بالتعليمات ينظم التمثيلات حول المتطلبات الوظيفية للمهام بدلاً من الدلالات السطحية.

Subba Reddy Oota, Khushbu Pahwa, Prachi Jindal, Satya Sai Srinath Namburi, Maneesh Singh, Tanmoy Chakraborty, Bapi S. Ra (…)2026-05-21
🔬 materials science

Machine-Learned Force Fields for Lattice Dynamics at Coupled-Cluster Level Accuracy

تُظهر هذه الدراسة أن حقول القوة المتعلمة آلياً والمدرّبة على بيانات "كوبلد كلاستر" (coupled-cluster)، والمعززة بأساليب "تعلم دلتا" (delta-learning) والنهج الواعي بالشحنة لمعالجة التأثيرات بعيدة المدى ومحدودية البيانات، تحقق دقة فائقة في التنبؤ بتشتت الفونونات وخصائص الاهتزاز غير المتوافقة لـلألماس وهيدريد الليثيوم مقارنة بنظرية الكثافة الوظيفية التقليدية.

Sita Schönbauer, Johanna P. Carbone, Fredrik V. Eriksson, Florian Libisch, Andreas Grüneis2026-05-21
💬 NLP

Diverse LLMs or Diverse Question Interpretations? That is the Ensembling Question

تُثبت هذه الورقة أنه بالنسبة للإجابة على الأسئلة الثنائية باستخدام النماذج اللغوية الكبيرة، فإن تجميع التفسيرات المتنوعة للأسئلة من نموذج واحد يتفوق باستمرار على تجميع نماذج مختلفة متعددة عند استخدام التصويت بالأغلبية.

Rafael Rosales, Santiago Miret2026-05-21
🤖 machine learning

STM3: Mixture of Multiscale Mamba for Long-Term Spatio-Temporal Time-Series Prediction

تقترح الورقة البحثية إطار عمل STM3، وهو بنية مبتكرة تجمع بين هندسة "م ambitions" (Mamba) متعددة المقاييس وهيكل "خليط من الخبراء" (Mixture-of-Experts) مفكك الارتباط وشبكة سببية رسومية تكيفية لالتقاط التبعيات المكانية والزمانية المعقدة طويلة المدى بكفاءة، محققةً أداءً هو الأفضل في فئته عبر عشر معايير مرجعية واقعية.

Haolong Chen, Liang Zhang, Zhengyuan Xin, Guangxu Zhu2026-05-21
💬 NLP

Anti-establishment sentiment on TikTok: Implications for understanding influence(rs) and expertise on social media

تستخدم هذه الدراسة نهجاً حوسبياً لتحليل منشورات تيك توك في مجالات التمويل، والعافية، ونظريات المؤامرة، حيث وجدت أنه بينما يسود الشعور المناهض للمؤسسات في محتوى نظريات المؤامرة، فإن أنماط التفاعل وحوافز المنصة تشير إلى أنه قد لا يزال يؤثر على سلوك المستخدمين عبر هذه المجالات الموضوعية.

Tianliang Xu, Ariel Hasell, Sabina Tomkins2026-05-21