💬 NLP

Towards the Anonymization of the Language Modeling

تقترح هذه الورقة منهجيات الحجب ونمذجة اللغة السببية التي تحافظ على الخصوصية لتخصيص النماذج الشبيهة بـ BERT والشبيهة بـ GPT على البيانات الحساسة، مما يمنع بفعالية حفظ المعرفات المباشرة وغير المباشرة مع الحفاظ على فائدة عالية للمشاركة.

Antoine Boutet, Lucas Magnana, Juliette Sénéchal2026-05-21
💬 NLP

LLMs on the Line: Data Determines Loss-to-Loss Scaling Laws

تُثبت هذه الورقة أن بيانات ما قبل التدريب هي المحدد الرئيسي لقوانين القياس من الخسارة إلى الخسارة في النماذج اللغوية الكبيرة، بينما يكون لآثار مثل حجم النموذج، والبنية، والمعلمات الفائقة تأثير ضئيل، مما يشير إلى أن تنقية البيانات أكثر أهمية من الخيارات الهيكلية لتحسين الأداء في المهام اللاحقة.

Prasanna Mayilvahanan, Thaddäus Wiedemer, Sayak Mallick, Matthias Bethge, Wieland Brendel2026-05-21
💬 NLP

END: Early Noise Dropping for Efficient and Effective Context Denoising

تقدم الورقة البحثية طريقة "إسقاط الضجيج المبكر" (Early Noise Dropping - END)، وهي طريقة لا تتطلب ضبطاً دقيقاً، تستفيد من المسابير الخطية في الطبقات الأولى من النماذج اللغوية الكبيرة لتحديد واستبعاد أجزاء المدخلات المشوشة، مما يؤدي إلى تحسين كل من الأداء والكفاءة في المهام ذات السياق الكثيف.

Hongye Jin, Pei Chen, Jingfeng Yang, Zhengyang Wang, Fangran Mo, Jinghan Zhang, Meng Jiang, Yifan Gao, Binxuan Huang, Xi (…)2026-05-21
💰 quantitative finance

Bridging Language Models and Financial Analysis

تجسر هذه الدراسة الفجوة بين التطورات المتسارعة في النماذج اللغوية الكبيرة وتبنيها الحذر في القطاع المالي من خلال تقديم نظرة شاملة على المنهجيات المبتكرة وقدرتها على تحليل البيانات المالية المعقدة ومتعددة الأوجه بفعالية.

Alejandro Lopez-Lira, Jihoon Kwon, Sangwoon Yoon, Jy-yong Sohn, Chanyeol Choi2026-05-21
💬 NLP

Universal Reasoner: A Single, Composable Plug-and-Play Reasoner for Frozen LLMs

تقدم الورقة البحثية "المستنتج الشامل" (UniR)، وهو وحدة برمجية نمطية وقابلة للتركيب والتشغيل المباشر تعزز قدرات الاستنتاج للنماذج اللغوية الكبيرة المجمدة عبر تدريب مكون استنتاج منفصل على مكافآت قابلة للتحقق وإضافة مخرجات الاحتمالات (logits) الخاصة به إلى النموذج الأساسي عند الاستدلال، مما يحقق أداءً فائقاً وتعميماً عابراً للمجالات دون الحاجة إلى إعادة تدريب النموذج بالكامل.

Jaemin Kim, Hangeol Chang, Hyunmin Hwang, Choonghan Kim, Jong Chul Ye2026-05-21
💬 NLP

Causal Path Alignment: Anchoring the Optimization Trajectory for Controllable In-Parameter Knowledge Editing

تقترح هذه الورقة إطار عمل "محاذاة المسار السببي" (CPA)، وهو إطار عمل غير مرتبط بنموذج محدد يعمل على التخفيف من تداخل الذاكرة المهيمنة على الموضوع في النماذج اللغوية الكبيرة، وذلك عبر إرساء مسارات التحسين على حالات وسيطة مدركة للعلاقات، مما يتيح تحرير المعرفة بدقة مع حد أدنى من الآثار الجانبية.

Xiyu Liu, Zhengxiao Liu, Naibin Gu, Zheng Lin, Weiping Wang2026-05-21
🧬 biology

Task-conditioned probing of instruction-tuned multimodal LLMs: Region-specific brain alignment patterns under naturalistic stimuli

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة متعددة الوسائط والمنضبطة بالتعليمات تُبدي محاذاة أقوى وأكثر تخصصاً في المهام مع نشاط الدماغ البشري أثناء مشاهدة الأفلام الطبيعية مقارنة بالنماذج غير المنضبطة بالتعليمات ونماذج التعلم بالسياق، مما يشير إلى أن الضبط بالتعليمات ينظم التمثيلات حول المتطلبات الوظيفية للمهام بدلاً من الدلالات السطحية.

Subba Reddy Oota, Khushbu Pahwa, Prachi Jindal, Satya Sai Srinath Namburi, Maneesh Singh, Tanmoy Chakraborty, Bapi S. Ra (…)2026-05-21
💬 NLP

Diverse LLMs or Diverse Question Interpretations? That is the Ensembling Question

تُثبت هذه الورقة أنه بالنسبة للإجابة على الأسئلة الثنائية باستخدام النماذج اللغوية الكبيرة، فإن تجميع التفسيرات المتنوعة للأسئلة من نموذج واحد يتفوق باستمرار على تجميع نماذج مختلفة متعددة عند استخدام التصويت بالأغلبية.

Rafael Rosales, Santiago Miret2026-05-21
💬 NLP

Anti-establishment sentiment on TikTok: Implications for understanding influence(rs) and expertise on social media

تستخدم هذه الدراسة نهجاً حوسبياً لتحليل منشورات تيك توك في مجالات التمويل، والعافية، ونظريات المؤامرة، حيث وجدت أنه بينما يسود الشعور المناهض للمؤسسات في محتوى نظريات المؤامرة، فإن أنماط التفاعل وحوافز المنصة تشير إلى أنه قد لا يزال يؤثر على سلوك المستخدمين عبر هذه المجالات الموضوعية.

Tianliang Xu, Ariel Hasell, Sabina Tomkins2026-05-21
⚡ electrical engineering

Enhancing Speech Large Language Models through Reinforced Behavior Alignment

تقدم هذه الورقة البحثية "محاذاة السلوك المعززة" (RBA)، وهو إطار عمل يستفيد من البيانات المُخلّقة ذاتيًا من نموذج لغوي كبير (LLM) مُعلم ومن التعلم المعزز لتعزيز قدرات اتباع التعليمات لنماذج اللغات الكبيرة الصوتية بشكل كبير، مما يمكنها من التفوق على نظيراتها القائمة على النصوص وتحقيق نتائج رائدة في المهام المنطوقة دون الاعتماد على التوضيحات البشرية.

Yansong Liu, Jiateng Li, Yuan Liu2026-05-21