🤖 machine learning

Efficient Inference of Large Vision Language Models

تقدم هذه الورقة مسحاً شاملاً للتقنيات الحديثة لتسريع استنتاج نماذج اللغة والرؤية الكبيرة (LVLM)، حيث تقدم تصنيفاً منهجياً عبر أربعة أبعاد هي: ضغط الرموز المرئية، وإدارة الذاكرة، والبنية الفعالة، واستراتيجيات فك الترميز، مع فحص نقدي للقيود الحالية وتحديد الاتجاهات البحثية المستقبلية.

Surendra Pathak2026-03-31
💬 NLP

Rethinking Atomic Decomposition for LLM Judges: A Prompt-Controlled Study of Reference-Grounded QA Evaluation

تتحدى هذه الدراسة التفوق المفترض للتفكيك الذري (atomic decomposition) في تقييم الإجابة على الأسئلة المرتكزة على المراجع والقائمة على النماذج اللغوية الكبيرة، وذلك من خلال إثبات أن حكماً كلياً (holistic judge) يتم التحكم فيه عبر التلقين مع معيار تفصيلي غالباً ما يضاهي أو يتفوق على الأحكام ذاتية التفكك أحادية التلقين، لا سيما في اكتشاف الدعم الجزئي، عبر عدة معايير قياسية وعائلات نماذج مختلفة.

Xinran Zhang2026-03-31
💬 NLP

Transfer Learning for an Endangered Slavic Variety: Dependency Parsing in Pomak Across Contact-Shaped Dialects

تتناول هذه الورقة البحثية تحليل التبعية للغة البوماك المهددة بالانقراض من خلال تقييم نقل التعلم صفري المحتوى من مدونة شجرية ذات تنوع يوناني إلى التنوع التركي، وإثبات أن الجمع بين نقل التعلم عبر التنوعات مع مدونة جديدة صغيرة مشروحة يدويًا من النوع التركي يحسن دقة التحليل بشكل كبير.

Sercan Karakaş2026-03-31
💬 NLP

Who Wrote the Book? Detecting and Attributing LLM Ghostwriters

تقدم هذه الورقة البحثية GhostWriteBench، وهي مجموعة بيانات من النصوص الطويلة التي تم إنشاؤها بواسطة النماذج اللغوية الكبيرة الرائدة لاختبار إسناد التأليف، وتقترح TRACE، وهو أسلوب بصمة قابل للتفسير وخفيف الوزن يحقق أداءً هو الأفضل في فئته في اكتشاف وتحديد هوية كُتّاب النصوص الوهميين من النماذج اللغوية الكبيرة عبر سيناريوهات متنوعة وخارج نطاق التوزيع.

Anudeex Shetty, Qiongkai Xu, Olga Ohrimenko, Jey Han Lau2026-03-31
💬 NLP

\textit{Versteasch du mi?} Computational and Socio-Linguistic Perspectives on GenAI, LLMs, and Non-Standard Language

تجمع هذه الورقة البحثية متعددة التخصصات بين اللسانيات الاجتماعية النقدية واللسانيات الحاسوبية لفحص كيفية تكييف النماذج اللغوية الكبيرة تقنياً للتعامل مع المتنوعات اللغوية غير المعيارية مثل لهجات جنوب تيرول والكردية، بهدف معالجة الفجوات اللغوية الرقمية وتعزيز استراتيجيات الذكاء الاصطناعي لإنهاء الاستعمار.

Verena Platzgummer, John McCrae, Sina Ahmadi2026-03-31
💬 NLP

Categorical Perception in Large Language Model Hidden States: Structural Warping at Digit-Count Boundaries

تُظهر هذه الورقة أن النماذج اللغوية الكبيرة تُبدي نوعاً من التشويه الهندسي الشبيه بالإدراك الفئوي في حالاتها الخفية عند حدود عدد الأرقام (مثل 10 و100)، وهي ظاهرة مدفوعة بانقطاعات هيكلية في عملية التجزئة (tokenization) وليس بالمعرفة الدلالية، مما يتجلى إما في شكل تصنيف صريح أو تشويه هندسي بحت اعتماداً على بنية النموذج.

Jon-Paul Cacioli2026-03-31
💬 NLP

Coconstructions in spoken data: UD annotation guidelines and first results

تقترح هذه الورقة مبادئ توجيهية لتعليق التبعيات العالمية ونموذجين متميزين للتمثيل لمعالجة التبعيات النحوية التي تمتد عبر أدوار المتحدثين في اللغة المنطوقة، وتحديداً فيما يتعلق بالبناء المشترك التعاوني، والاستجابات التأكيدية، وإعادة الصياغة، والعبارات غير المكتملة.

Ludovica Pannitto, Sylvain Kahane, Kaja Dobrovoljc, Elena Battaglia, Bruno Guillaume, Caterina Mauri, Eleonora Zucchini2026-03-31
💬 NLP

Merge and Conquer: Instructing Multilingual Models by Adding Target Language Weights

تُثبت هذه الورقة أن دمج النماذج اللغوية الكبيرة المضبوطة للتعليمات مع النماذج الأساسية الخاصة بلغات محددة هو استراتيجية فعالة وذات كفاءة حوسبية لتمكين قدرات اتباع التعليمات في اللغات ذات الموارد المنخفضة، مما يلغي الحاجة إلى الضبط الدقيق المكلف أو مجموعات بيانات التعليمات الضخمة.

Eneko Valero, Maria Ribalta i Albado, Oscar Sainz, Naiara Perez, German Rigau2026-03-31
💬 NLP

Kernel-Smith: A Unified Recipe for Evolutionary Kernel Optimization

يُعد Kernel-Smith إطار عمل موحداً يجمع بين وكيل تطوري مستقر مدفوع بالتقييم وبين وصفة تدريب لاحق متخصصة لتوليد نوى معالجة رسومية عالية الأداء، محققاً بذلك تسريعاً في الأداء من فئة الحالة الراهنة على منصتي NVIDIA وMetaX مع إثبات كفاءة النشر العملي في أنظمة الإنتاج.

He Du, Qiming Ge, Jiakai Hu, Aijun Yang, Zheng Cai, Zixian Huang, Sheng Yuan, Qinxiu Cheng, Xinchen Xie, Yicheng Chen, Y (…)2026-03-31
💬 NLP

Not All Subjectivity Is the Same! Defining Desiderata for the Evaluation of Subjectivity in NLP

تقترح ورقة الموقف هذه سبعة معايير تقييم تتمحور حول المستخدم لنماذج معالجة اللغات الطبيعية الحساسة للذاتية، وتحدد الفجوات الحرجة في الأبحاث الحالية، مثل عدم التمييز الكافي بين المدخلات الغامضة والمتعددة الأصوات والافتقار إلى التفاعل بين معايير التقييم المختلفة.

Urja Khurana, Michiel van der Meer, Enrico Liscio, Antske Fokkens, Pradeep K. Murukannaiah2026-03-31