⚡ electrical engineering

MEUSLI: a Multilingual Projector for LLM-based ASR and Beyond

تقدم الورقة البحثية MEUSLI، وهي أول عائلة أجهزة عرض متعددة اللغات قائمة على العلم المفتوح تربط مشفر كلام Whisper مع نماذج لغوية كبيرة مفتوحة المصدر لتمكين التعرف التلقائي على الكلام القابل للتوسع من طرف إلى طرف وغير القائم على النصوص، بالإضافة إلى مهام فهم الكلام الأخرى عبر 28 لغة أوروبية.

Lorenzo Concina, Seraphina Fong, Marco Matassoni, Alessio Brutti2026-07-27
💬 NLP

Why Large Language Models and Humans Converge and Diverge in Evaluating Creativity

تكشف هذه الورقة أنه في حين تتوافق النماذج اللغوية الكبيرة مع تقييمات الإبداع البشري فيما يتعلق بالخصائص الجوهرية مثل الجدة، إلا أنها تتباعد بشكل كبير بسبب اعتمادها على معايير أضيق خاصة بالنماذج وعدم حساسيتها للمعلومات السياقية، مما يجعل اختيار نموذج لغوي كبير محدد كـمُقيّم قراراً ذا عواقب وخيمة لتقييم الإبداع.

Pengzhao Lyu, Yeun Joon Kim, Hanlin Xiao, Yingyue Luna Luan2026-07-27
💬 NLP

Cross-Tokenizer On-Policy Distillation via Byte-Prefix Marginalization

تقدم هذه الورقة البحثية طريقة "تجزئة بادئة البايت" (BPM)، وهي طريقة استخلاص معرفة جديدة تعتمد على السياسة الموحدة عبر أجهزة الترميز (cross-tokenizer on-policy distillation)، تعمل على إعادة التعبير عن توزيعات النموذج المعلم عبر مساحة بايت مشتركة للحفاظ على الكتلة الاحتمالية وتحسين أداء النموذج الطالب عبر معايير الرياضيات والبرمجة.

Hao Wang, Kun Yuan, Wenlin Zhong, Minglei Zhang, Han Xiao, Ming Sun, Honggang Qi2026-07-27
💬 NLP

A Factorial Study of Synthetic Data Generation for Low-Resource Machine Translation using Grammar Books

تقدم هذه الورقة مساراً يستفيد من النماذج اللغوية الكبيرة لاستخراج القواعد النحوية والأمثلة من كتب القواعد الوصفية لتوليد مجموعات بيانات متوازية اصطناعية، مما يثبت أن الضبط الدقيق لنماذج الترجمة الآلية باستخدام هذه البيانات الاصطناعية يحسن الأداء بشكل كبير للغات المهددة بالانقراض مثل كالامانغ وتواتشين وماندان مقارنة بالنماذج المرجعية القائمة على البيانات الأولية.

Varun Ghat Ravikumar, Sina Ahmadi, Lena Jäger, Rico Sennrich2026-07-27
💬 NLP

grapheme-kit: Grapheme-Level Metrics and Text Processing for Multilingual NLP

تقدم الورقة البحثية grapheme-kit، وهي مكتبة بايثون مفتوحة المصدر تعزز تقييم معالجة اللغات الطبيعية متعددة اللغات من خلال العمل على مجموعات الحروف (grapheme clusters) بدلاً من نقاط كود يونيكود (Unicode code points)، مما يوفر معالجة محسنة للخطوط المعقدة مثل التاميلية والسينهالية ويوفر مقاييس خطأ أكثر دقة لأنظمة الكتابة المعقدة.

Izzath Nisfer, Ashini Kavindya, Ovindu Atukorala, Purushoth Velayuthan, Menan Velayuthan2026-07-27
💬 NLP

Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science

تُظهر هذه الورقة أن النماذج اللغوية الكبيرة التجارية تُبدي مواقف معرفية غير مستقرة وغامضة تجاه الادعاءات العلمية الزائفة، حيث تعتمد نتائج التحقق على تكوينات النشر، وأنواع الواجهات، والتحديثات الصامتة، بدلاً من كونها خصائص متأصلة في النماذج نفسها.

Davide Scarso, Hugo Noronha de Almeida, Joaquim Pina2026-07-27
💬 NLP

Breaking Information Cocoons: A Hyperbolic Framework for Balancing Exploration and Exploitation in Recommender Systems

تقترح الورقة البحثية HERec، وهو إطار عمل زائدي يجمع بين النمذجة الهرمية المعززة دلاليًا والتجميع التلقائي لموازنة الاستكشاف والاستغلال بفعالية في أنظمة التوصية، مما يؤدي إلى التخفيف من حدة الشرانق المعلوماتية مع التفوق على النماذج المرجعية الحالية الإقليدية والزائدية.

Qiyao Ma, Menglin Yang, Mingxuan Ju, Tong Zhao, Neil Shah, Rex Ying2026-06-01
💬 NLP

Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions

تقدم هذه الورقة مجموعة بيانات تقييمية مبتكرة قائمة على نحو القواعد (Construction Grammar) لتقييم قدرات التعميم الدلالي للنماذج اللغوية الكبيرة، كاشفةً أن حتى النماذج الأكثر تطوراً تعاني في التمييز بين التراكيب العبارية المتطابقة تركيبياً والمتباينة دلالياً، حيث أظهرت انخفاضاً في الأداء يتجاوز 40% مقارنة بالحدس البشري.

Wesley Scivetti, Melissa Torgbi, Austin Blodgett, Mollie Shichman, Taylor Hudson, Claire Bonial, Harish Tayyar Madabushi2026-06-01
💬 NLP

Chain-of-Thought Reasoning In The Wild Is Not Always Faithful

تُظهر هذه الورقة أن استدلال "سلسلة الأفكار" (Chain-of-Thought) في النماذج اللغوية الكبيرة غالباً ما يكون غير مخلص حتى في المطالبات الطبيعية غير العدائية، حيث تولد النماذج في كثير من الأحيان تبريرات متماسكة ولكن متناقضة مدفوعة بانحيازات ضمنية أو اختصارات غير منطقية، مما يكشف أن الاستدلال المنطوق لا يعكس بدقة عملية اتخاذ القرار الداخلية.

Iván Arcuschin, Jett Janiak, Robert Krzyzanowski, Senthooran Rajamanoharan, Neel Nanda, Arthur Conmy2026-06-01
💬 NLP

Reassessing Extractive QA Datasets at Scale: LLM-as-a-Judge and In-Depth Analyses

تقدم هذه الورقة دراسة منهجية تثبت أن استخدام النماذج اللغوية الكبيرة كحكم (LLM-as-a-judge) يتفوق بشكل كبير على مقاييس المطابقة التامة (Exact Match) وF1 التقليدية في تقييم استخراج الإجابات من النصوص، وذلك من خلال تحقيق ارتباط أعلى مع التقييمات البشرية، مع الكشف عن نقاط قوته المحددة في التعامل مع الإجابات القائمة على الأرقام، وعدم وجود انحياز للتفضيل الذاتي، والحد الأدنى من الحساسية تجاه تغيرات الأوامر البرمجية (prompts).

Xanh Ho, Jiahao Huang, Florian Boudin, Akiko Aizawa2026-06-01