💬 NLP

Dark & Stormy: Modeling Humor in Sentences from the Bulwer-Lytton Fiction Contest

تقدم هذه الورقة بحثاً لمتن لغوي جديد من الفكاهة "السيئة" المستمدة من مسابقة "بولور-ليتون" للرواية، كاشفةً أن نماذج اكتشاف الفكاهة القياسية تخفق في استيعاب مزيجها الفريد من الأساليب الأدبية، وأن النماذج اللغوية الكبيرة، رغم قدرتها على محاكاة هذا القالب، تميل إلى المبالغة في هذه السمات وتوليد تركيبات (صفة-اسم) أكثر ابتكاراً من تلك التي يكتبها البشر.

Venkata S Govindarajan, Laura Biester2026-04-17
💬 NLP

Graph-Based Alternatives to LLMs for Human Simulation

تقدم هذه الورقة نماذج GEMS (النماذج القائمة على الرسوم البيانية لمحاكاة البشر)، وهي نهج يعتمد على الشبكات العصبية الرسومية يصيغ مهام محاكاة البشر مغلقة النهايات كمسألة تنبؤ بالروابط لتتجاوز أو تضاهي أداء النماذج اللغوية الكبيرة مع استخدام عدد معاملات أقل بثلاث مراتب عشرية.

Joseph Suh, Suhong Moon, Serina Chang2026-04-17
💬 NLP

AccelOpt: A Self-Improving LLM Agentic System for AI Accelerator Kernel Optimization

إن AccelOpt هو نظام وكيل لغوي كبير (LLM) ذاتي التحسين يعمل على تحسين نوى مسرعات الذكاء الاصطناحي ذاتياً من خلال الاستفادة من ذاكرة قائمة على الخبرة، محققاً مكاسب كبيرة في معدل الإنتاجية على أجهزة AWS Trainium مع مضاهاة أداء النماذج الاحتكارية باهظة الثمن بجزء ضئيل من التكلفة.

Genghan Zhang, Shaowei Zhu, Anjiang Wei, Zhenyu Song, Allen Nie, Zhen Jia, Nandita Vijaykumar, Yida Wang, Kunle Olukotun2026-04-17
💬 NLP

Style Amnesia: Investigating Speaking Style Degradation and Mitigation in Multi-Turn Spoken Language Models

تحدد هذه الورقة البحثية وتتقصى ظاهرة "فقدان الذاكرة الأسلوبية" في نماذج اللغة المنطوقة، مظهرةً أن الأنظمة الحالية تخفق في الحفاظ باستمرار على الأساليب شبه اللغوية (مثل العاطفة، واللكنة، ومستوى الصوت، والسرعة) عبر المحادثات متعددة الأدوار رغم التعليمات الصريحة، وإن كان يمكن التخفيف من حدة هذا الأداء جزئياً من خلال الاستدعاء الأسلوبي الصريح.

Yu-Xiang Lin, Cheng-Han Chiang, Hung-yi Lee2026-04-17
💬 NLP

Beyond Literal Mapping: Benchmarking and Improving Non-Literal Translation Evaluation

تقدم هذه الورقة البحثية MENT، وهي مجموعة بيانات للتقييم الميتافيزيقي للترجمات غير الحرفية، وتقترح RATE، وهو إطار تقييم وكيل (agentic) مبتكر يتفوق بشكل كبير على المقاييس التقليدية ونهج "النماذج اللغوية الكبيرة كحكم" (LLM-as-a-Judge) في التوافق مع الأحكام البشرية لسيناريوهات الترجمة المعقدة.

Yanzhi Tian, Cunxiang Wang, Zeming Liu, Heyan Huang, Wenbo Yu, Dawei Song, Jie Tang, Yuhang Guo2026-04-17
💬 NLP

Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference

تقدم هذه الورقة البحثية طريقة ASL، وهي طريقة خالية من التدريب تختار بشكل تكيفي الطبقة المثلى لتقليم الرموز (token pruning) بناءً على تباين درجات الانتباه، مما يوازن بين سرعة الاستنتاج والدقة عبر مهام متنوعة مع التفوق على الأساليب الحالية لتقليم الطبقات ذات الحالة الفنية الأحدث.

Rei Taniguchi, Yuyang Dong, Makoto Onizuka, Chuan Xiao2026-04-17
💬 NLP

HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding

يُعد HERMES بنية مبتكرة لا تتطلب تدريباً، حيث يصيغ ذاكرة الـ KV cache كإطار عمل ذاكرة هرمي لتمكين فهم الفيديو المتدفق في الوقت الفعلي وبدقة وكفاءة في استهلاك الموارد، محققاً سرعة أكبر بـ 10 أضعاف في زمن الوصول لأول توكن (time-to-first-token) ودقة أعلى بنسبة تصل إلى 11.4% في مجموعات بيانات البث مقارنة بالطرق الرائدة الحالية.

Haowei Zhang, Shudong Yang, Jinlan Fu, See-Kiong Ng, Xipeng Qiu2026-04-17
💬 NLP

CausalEmbed: Auto-Regressive Multi-Vector Generation in Latent Space for Visual Document Embedding

يُعد CausalEmbed نهجاً ذاتي الانحدار يقلل بشكل كبير من عبء التخزين في استرجاع المستندات المرئية عبر توليد تضمينات متعددة المتجهات مدمجة تتكون من عشرات الرموز فقط، مع الحفاظ على أداء تنافسي من خلال فقدان الهامش التكراري وتمكين التوسع المرن في وقت الاختبار.

Jiahao Huo, Yu Huang, Yibo Yan, Ye Pan, Kening Zheng, Wei-Chieh Huang, Yi Cao, Mingdong Ou, Philip S. Yu, Xuming Hu2026-04-17
💬 NLP

POP: Prefill-Only Pruning for Efficient Large Model Inference

تقدم هذه الورقة البحثية استراتيجية "التقليم المقتصر على مرحلة الملء المسبق" (POP)، وهي استراتيجية استدلال مدركة للمراحل تعمل على تسريع عملية الملء المسبق للنماذج الكبيرة عن طريق حذف الطبقات العميقة الزائدة بشكل انتقائي أثناء ترميز السياق مع الحفاظ على دقة النموذج الكاملة لفك تشفير الرموز، مما يحقق تقليلاً كبيراً في زمن الاستجابة مع حد أدنى من فقدان الدقة.

Junhui He, Zhihui Fu, Jun Wang, Qingan Li2026-04-17
💬 NLP

How Retrieved Context Shapes Internal Representations in RAG

تتقصى هذه الورقة البحثية كيفية تأثير السياق المسترجع على التمثيلات الكامنة الداخلية للنماذج اللغوية الكبيرة في أنظمة التوليد المعزز بالاسترجاع، كاشفةً كيف يشكل كل من صلة الوثيقة والمعالجة على مستوى الطبقات هذه التمثيلات لتفسير سلوكيات التوليد اللاحقة.

Samuel Yeh, Sharon Li2026-04-17