💬 NLP

Bayesian Preference Learning for Test-Time Steerable Reward Models

تقترح هذه الورقة نموذج نمذجة المكافأة داخل السياق المتغير (ICRM)، وهو إطار عمل بايزي مبتكر يتيح إمكانية التوجيه في وقت الاختبار لنماذج المكافأة من خلال التكيف مع توزيعات التفضيلات غير المرئية عبر نماذج توضيحية داخل السياق، مما يحسن الدقة، والمعايرة، والمواءمة متعددة الأهداف مع توفير ضمانات نظرية ضد الإفراط في التحسين.

Jiwoo Hong, Shao Tang, Zhipeng Wang2026-05-21
💬 NLP

AI-Assisted Scientific Assessment: A Case Study on Climate Change

تُظهر هذه الورقة أنه بينما يمكن للذكاء الاصطناعي أن يسرع سير العمل العلمي بشكل كبير ويحافظ على الاتساق المنطقي في تقييمات تغير المناخ، مثل تحليل استقرار دوران التقلب الأطلسي (AMOC)، فإنه يتطلب إشرافاً خبيراً وتوليفاً بشرياً كبيراً لإنتاج تقارير علمية دقيقة ومقبولة.

Christian Buck, Levke Caesar, Michelle Chen Huebscher, Massimiliano Ciaramita, Erich M. Fischer, Zeke Hausfather, Özge K (…)2026-05-21
💬 NLP

Gated Normalization Removal and Scale Anchoring in Pre-Norm Transformers

تقدم هذه الورقة البحثية TaperNorm، وهو نهج بوابي لنماذج الـ transformer من نوع pre-norm يقوم بإزالة طبقات التقييس (normalization) الداخلية تدريجيًا لتحسين إنتاجية الاستدلال، وتكشف أن التقييس النهائي يعمل أساسًا على تثبيت مقياس تمثيلات ما قبل الطبقة الخطية (pre-logit)، وهو دور يمكن استبداله بالتحجيم ذي الهدف الثابت لتمكين نماذج خالية تمامًا من طبقات التقييس.

Andrei Kanavalau, Carmen Amo Alonso, Sanjay Lall2026-05-21
💬 NLP

MASFactory: A Graph-centric Framework for Orchestrating LLM-Based Multi-Agent Systems with Vibe Graphing

تقدم الورقة البحثية MASFactory، وهو إطار عمل متمحور حول الرسوم البيانية يستخدم نهج "Vibe Graphing" القائم على تدخل العنصر البشري لترجمة النوايا باللغة الطبيعية إلى سير عمل متعدد الوكلاء قابل للتنفيذ، مما يعالج تحديات التنفيذ اليدوي، وإعادة الاستخدام، وتكامل السياق، مع إثبات فعاليته عبر سبعة معايير مرجعية عامة.

Yang Liu, Jinxuan Cai, Yishen Li, Qi Meng, Zedi Liu, Xin Li, Chen Qian, Chuan Shi, Cheng Yang2026-05-21
💬 NLP

Shiny Stories, Hidden Struggles: Investigating the Representation of Disability Through the Lens of LLMs

تتقصى هذه الورقة كيفية تمثيل نماذج اللغات الكبيرة (LLMs) للإعاقة من خلال مقارنة منشورات وسائل التواصل الاجتماعي التي أنشأها الذكاء الاصطناعي بتلك التي كتبها أفراد حقيقيون، كاشفةً أن نماذج اللغات الكبيرة تميل إلى إنتاج صور نمطية مثالية وإيجابية بشكل مفرط تمحو التحديات الواقعية، بينما تظهر في الوقت ذات ذاته تحيزات سلبية تستبعد ذوي الإعاقة من مواضيع مثل العمل والترفيه.

Marco Bombieri, Simone Paolo Ponzetto, Marco Rospocher2026-05-21
💬 NLP

Improving Quantized Model Performance in Qualitative Analysis with Multi-Pass Prompt Verification

تقترح هذه الدراسة طريقة تحقق من المطالبات متعددة المراحل واعية بالكمية للتخفيف من الهلوسة وعدم الاستقرار في نماذج LLaMA-3.1 المكممة ذات البتات المنخفضة، مما يثبت أنه بينما تتطابق نماذج 8 بت بشكل أفضل مع الحقيقة الأرضية المرمزة بشرياً، فإن التقنية المقترحة تعزز بشكل كبير دقة وموثوقية النماذج ذات البتات الأقل (4 بت، و3 بت، و2 بت) من أجل الأبحاث النوعية منخفضة التكلفة.

Aisvarya Adeseye, Jouni Isoaho, Adeyemi Adeseye2026-05-21
💬 NLP

Parallel LLM Reasoning for Bias-Resilient, Robust Conceptual Abstraction

تقترح هذه الورقة إطاراً هيكلياً يجمع بين المعالجة المتوازية على مستوى الأجزاء والدمج المرتكز على الأدلة للحد بشكل كبير من التحيز التحليلي، وأخطاء الحذف، والادعاءات غير المدعومة في النماذج اللغوية الكبيرة عند تحليل المستندات الطويلة، مما يعزز بشكل خاص أداء النماذج الأصغر حجماً.

Aisvarya Adeseye, Jouni Isoaho, Adeyemi Adeseye2026-05-21
💬 NLP

MedicalBench: Evaluating Large Language Models Toward Improved Medical Concept Extraction

تقدم الورقة البحثية MedicalBench، وهو معيار مرجعي مبتكر مستمد من بيانات MIMIC-IV، والذي يقيم النماذج اللغوية الكبيرة في المهمة الصعبة المتمثلة في استخراج المفاهيم الطبية الضمنية مع ربطها بأدلة على مستوى الجملة، مما يكشف عن قصور النماذج الحالية في الاستنتاج الطبي والقابلية للتفسير.

Zhichao Yang, Gregory D. Lyng, Sanjit Singh Batra, Robert E. Tillman2026-05-21
💬 NLP

Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning

تقدم الورقة البحثية ProxyCoT، وهو إطار تدريب يعزز الاستدلال في السياقات الطويلة لدى النماذج اللغوية الكبيرة من خلال نقل مسارات سلسلة الأفكار عالية الجودة المستمدة من سياقات وسيطة قصيرة إلى تسلسلات كاملة الطول عبر الضبط الدقيق الخاضع للإشراف، مما يحقق أداءً فائقاً مع تقليل التكاليف الحسابية وقدرة قوية على التعميم خارج النطاق.

Miao Li, Irina Saparina, Alexander Gurung, Mirella Lapata2026-05-21
💬 NLP

Under Pressure: Emotional Framing Induces Measurable Behavioral Shifts and Structured Internal Geometry in Small Language Models

تُظهر هذه الدراسة أن المحفزات ذات الإطار العاطفي تُحدث تحولات سلوكية ملموسة وأنماط تمثيل داخلي متميزة ومنظمة في النماذج اللغوية الصغيرة، مما يكشف عن اتجاهات تحكم حساسة للمحفزات دون الإيحاء بوجود حالات عاطفية جوهرية.

Rana Muhammad Usman2026-05-21