💬 NLP

Take Out Your Calculators: Estimating the Real Difficulty of Question Items with LLM Student Simulations

تُثبت هذه الورقة أن محاكاة فصول دراسية متنوعة للطلاب باستخدام نماذج لغوية كبيرة مفتوحة المصدر لتتناسب مع نماذج نظرية الاستجابة للمفردة يمكن أن تتنبأ بفعالية بصعوبة أسئلة الرياضيات في العالم الحقيقي، محققةً معاملات ارتباط تصل إلى 0.82 وكاشفةً أن النماذج ذات القدرات الرياضية الأضعف غالباً ما تقدم تنبؤات أفضل من النماذج الأقوى.

Christabel Acquaye, Yi Ting Huang, Marine Carpuat, Rachel Rudinger2026-04-22
💬 NLP

On Temperature-Constrained Non-Deterministic Machine Translation: Potential and Evaluation

تحدد هذه الورقة الترجمة الآلية غير الحتمية (ND-MT) المقيدة بدرجة الحرارة كنهج واعد لمعالجة تعدد الأنماط في الترجمة، بينما تكشف أن مقاييس التقييم الحالية تعاني من "تأثير الدلاء" (Buckets Effect) الذي يعطي الأولوية للمرشحات الأسوأ حالاً، مما يؤدي إلى اقتراح استراتيجية جديدة تسمى ExpectoSample لاختيار الأنظمة القوي.

Weichuan Wang, Mingyang Liu, Linqi Song, Chen Ma2026-04-22
💬 NLP

Beyond Marginal Distributions: A Framework to Evaluate the Representativeness of Demographic-Aligned LLMs

تقترح هذه الورقة إطاراً لتقييم مدى تمثيل النماذج اللغوية الكبيرة المتوافقة ديموغرافياً من خلال تحليل أنماط الارتباط متعدد المتغيرات بدلاً من مجرد التوزيعات الهامشية، مما يكشف أن تقنيات التوجيه الحالية تفشل في استيعاب العلاقات الهيكلية الكامنة للقيم الإنسانية رغم مطابقتها لمعدلات الاستجابة الفردية.

Tristan Williams, Franziska Weeber, Sebastian Padó, Alan Akbik2026-04-22
💬 NLP

One Persona, Many Cues, Different Results: How Sociodemographic Cues Impact LLM Personalization

تُظهر هذه الورقة أن الاعتماد على إشارة ديموغرافية اجتماعية واحدة لتحفيز شخصيات النماذج اللغوية الكبيرة يمكن أن يؤدي إلى نتائج غير متسقة واستنتاجات مضللة حول التحيز، مما يحث الباحثين على مراعاة تباين الإشارات والصلاحية الخارجية عند دراسة تخصيص النماذج.

Franziska Weeber, Vera Neplenbroek, Jan Batzner, Sebastian Padó2026-04-22
💬 NLP

Temporal Leakage in Search-Engine Date-Filtered Web Retrieval: A Retrospective Forecasting Case Study

تُثبت هذه الورقة أن مرشحات التاريخ في محركات البحث غير موثوقة لتقييمات التنبؤ الاسترجاعي بسبب التسرب الزمني واسع النطاق، مما يؤدي إلى تضخيم دقة التنبؤ بشكل كبير ويستلزم استخدام ضمانات استرجاع أقوى أو لقطات ثابتة للويب.

Ali El Lahib, Ying-Jieh Xia, Zehan Li, Yuxuan Wang, Xinyu Pi2026-04-22
💻 computer science

Who Shapes Brazil's Vaccine Debate? Semi-Supervised Modeling of Stance and Polarization in YouTube's Media Ecosystem

تقدم هذه الدراسة أكبر تحليل طولي لخطاب اللقاحات في البرازيل على يوتيوب، باستخدام إطار عمل شبه مُشرف لتصنيف 1.4 مليون تعليق وكشف كيف تبلغ الاستقطابية ذروتها أثناء الأزمات بينما تصبح مجزأة في حقبة ما بعد الجائحة، مع بروز مسؤولي التواصل العلمي والمنصات الرقمية الأصلية كمحركات رئيسية لكل من التفاعل المؤيد والمعارض.

Geovana S. de Oliveira, Ana P. C. Silva, Fabricio Murai, Carlos H. G. Ferreira2026-04-22
💬 NLP

Two-dimensional early exit optimisation of LLM inference

تقدم هذه الورقة استراتيجية خروج مبكر ثنائية الأبعاد غير مرتبطة بنموذج محدد، تنسق بين المعالجة على مستوى الطبقات وعلى مستوى الجمل لتحقيق توفير حسابي مضاعف وتسريع كبير في استنتاج النماذج اللغوية الكبيرة لمهام التصنيف، لا سيما عندما تتراكم المعلومات الدلالية بشكل يمكن التنبؤ به عبر البنى المدخلة.

Jan Hůla, David Adamczyk, Tomáš Filip, Martin Pavlíček, Petr Sosík2026-04-22
💻 computer science

Unlocking the Edge deployment and ondevice acceleration of multi-LoRA enabled one-for-all foundational LLM

تقدم هذه الورقة إطار عمل مدركاً للعتاد يتيح النشر الفعال لنماذج LLaMA التأسيسية المدعومة بـ multi-LoRA على أجهزة Samsung Galaxy S24/S25 عبر دمج تبديل المهام الديناميكي، وفك التشفير متعدد المسارات، وفك التشفير الذاتي التخميني الديناميكي (Dynamic Self-Speculative Decoding) لتحقيق انخماثات كبيرة في الذاكرة وزمن الاستجابة مع الحفاظ على الدقة عبر لغات ومهام متعددة.

Sravanth Kodavanti, Sowmya Vajrala, Srinivas Miriyala, Utsav Tiwari, Uttam Kumar, Utkarsh Kumar Mahawar, Achal Pratap Si (…)2026-04-22
💻 computer science

Owner-Harm: A Missing Threat Model for AI Agent Safety

تقدم هذه الورقة البحثية "إلحاق الضرر بالمالك" (Owner-Harm)، وهو نموذج تهديد رسمي يعالج الفجوة الأمنية الحرجة المتمثلة في إلحاق وكلاء الذكاء الاصطناعي الضرر بجهات النشر الخاصة بهم، حيث تُظهر أن الدفاعات الحالية تفشل في التعميم عبر مفردات الأدوات المختلفة، وتقترح إطار عمل "التعميم الدفاعي الرمزي-الدلالي" (SSDG) للكشف عن هذه المخاطر والتخفيف من حدتها بفعالية.

Dongcheng Zhang, Yiqing Jiang2026-04-22
💬 NLP

Probing for Reading Times

تُظهر هذه الدراسة أن تمثيلات الطبقات المبكرة في النماذج اللغوية تتنبأ بفعالية بأوقات القراءة البشرية في الممر الأول عبر خمس لغات، متفوقةً بذلك على المفاجأة القياسية، بينما تظل المفاجأة القياسية متفوقة في مقايسات الممر المتأخر، مما يسلط الضوء على توافق وظيفي بين عمق النموذج والمراحل الزمنية للقراءة البشرية.

Eleftheria Tsipidi, Samuel Kiegeland, Francesco Ignazio Re, Tianyang Xu, Mario Giulianelli, Karolina Stanczak, Ryan Cott (…)2026-04-22