💬 NLP

Multiperspectivity as a Resource for Narrative Similarity Prediction

تقترح هذه الورقة الاستفيد من مجموعة (ensemble) مكونة من 31 شخصية متنوعة من النماذج اللغوية الكبيرة (LLMs) لتبني تعدد المنظورات السردية بدلاً من التعامل معها كتحدٍ، مما يثبت أن مثل هذا النهج يحسن دقة التنبؤ بالتشابه في مجموعة بيانات SemEval-2026 Task 4، مع الكشف في الوقت ذاته عن أوجه القصور في أطر التقييم الحالية القائمة على حقيقة أرضية واحدة.

Max Upravitelev, Veronika Solopova, Jing Yang, Charlott Jakob, Premtim Sahitaj, Ariana Sahitaj, Vera Schmitt2026-03-24
💬 NLP

The Semantic Ladder: A Framework for Progressive Formalization of Natural Language Content for Knowledge Graphs and AI Systems

تقدم هذه الورقة "السلم الدلالي" (Semantic Ladder)، وهو إطار معماري يسهل عملية الصياغة الرسمية التدريجية القابلة للتوسع والتتبع للغة الطبيعية إلى رسوم بيانية معرفية قابلة للتنفيذ آلياً، وذلك عبر تنظيم التمثيلات عبر مستويات تزداد فيها الصراحة الدلالية.

Lars Vogt2026-03-24
💬 NLP

Enhancing Document-Level Machine Translation via Filtered Synthetic Corpora and Two-Stage LLM Adaptation

تقترح هذه الورقة استراتيجية ضبط دقيق ثنائية المراحل للنماذج اللغوية الكبيرة في الترجمة الآلية على مستوى المستند، والتي تستفيد من مجموعات بيانات اصطناعية معززة بالنماذج اللغوية الكبيرة ومفلترة بدقة للتغلب على ندرة البيانات والحد من الهلوسة التوليدية.

Ireh Kim, Tesia Sker, Chanwoo Kim2026-03-24
💬 NLP

SPA: A Simple but Tough-to-Beat Baseline for Knowledge Injection

تقترح الورقة البحثية تقنية SPA (تعزيز التوسيع القائم على هندسة الأوامر)، وهي نموذج مرجعي بسيط وفعال للغاية يستفيد من أوامر مصممة بعناية لتوليد بيانات اصطناعية واسعة النطاق لحقن المعرفة، متفوقةً بذلك على الطرق المعقدة القائمة على التعلم المعزز وطرق التلقين متعددة المراحل مع تجنب قيودها المتعلقة بقابلية التوسع والتنوع.

Kexian Tang, Jiani Wang, Shaowen Wang, Kaifeng Lyu2026-03-24
💬 NLP

Gumbel Distillation for Parallel Text Generation

تقدم هذه الورقة البحثية "تقطير غامبل" (Gumbel Distillation)، وهي تقنية جديدة غير مرتبطة بنموذج محدد تستفيد من خدعة "غامبل-ماكس" (Gimbel-Max trick) لتمكين أجهزة فك التشفير المتوازية من تعلم التوزيعات المشتركة المعقدة للرموز الخاصة بالنماذج التوليدية المتسلسلة (autoregressive teachers) بفعالية، مما يؤدي إلى تحسين جودة التوليد بشكل كبير وتقليص فجوة الأداء بين النماذج اللغوية المتوازية والمتسلسلة.

Chi Zhang, Xixi Hu, Bo Liu, Qiang Liu2026-03-24
💬 NLP

Dyadic: A Scalable Platform for Human-Human and Human-AI Conversation Research

تقدم هذه الورقة "Dyadic"، وهي منصة قائمة على الويب وذات بنية نمطية، صُممت لتسهيل الأبحاث القابلة للتوسع حول المحادثات بين البشر-البشر والمحادثات بين البشر-الذكاء الاصطناعي من خلال ميزات مثل التفاعل متعدد الوسائط، والمراقبة في الوقت الفعلي، والمساعدة بالذكاء الاصطناعي، والنشر المتكامل للاستبيانات دون الحاجة إلى خبرة في البرمجة.

David M. Markowitz2026-03-24
💬 NLP

Greater accessibility can amplify discrimination in generative AI

تكشف هذه الورقة أنه في حين تعزز واجهات الصوت إمكانية الوصول للذكاء الاصطناي التوليدي، فإنها تفتح في الوقت ذاته مسارات جديدة للتمييز القائم على النوع الاجتماعي من خلال استغلال الإشارات شبه اللغوية لتضخيم التحيزات النمطية بما يتجاوز التفاعلات القائمة على النصوص، مما يستلزم نهجاً يجمع بين العدالة وإمكانية الوصول.

Carolin Holtermann, Minh Duc Bui, Kaitlyn Zhou, Valentin Hofmann, Katharina von der Wense, Anne Lauscher2026-03-24
💬 NLP

TiCo: Time-Controllable Training for Spoken Dialogue Models

تقدم الورقة البحثية TiCo، وهي طريقة فعالة لما بعد التدريب تُزود نماذج الحوار المنطوق بالوعي الزمني من خلال علامات الوقت المنطوق، مما يمكنها من توليد استجابات ذات مدد زمنية قابلة للتحكم مع الحفاظ على جودة عالية.

Kai-Wei Chang, Wei-Chih Chen, En-Pei Hu, Hung-yi Lee, James Glass2026-03-24
💬 NLP

ThinkJEPA: Empowering Latent World Models with Large Vision-Language Reasoning Model

تقترح الورقة البحثية "ThinkJEPA"، وهو إطار عمل مبتكر يعزز نماذج العالم الكامنة من خلال دمج فرع JEPA كثيف للتنبؤ بالحركة دقيق التفاصيل مع فرع "مفكر" (thinker) يعتمد على نموذج لغوي بصري (VLM) يتم أخذ عينات منه بشكل موحد لتوفير توجيه دلالي طويل الأمد، مما يتغلب على قيود الاستقراء المحلي وأخذ العينات المتناثر لتحقيق تنبؤ بالمسار أكثر قوة.

Haichao Zhang, Yijiang Li, Shwai He, Tushar Nagarajan, Mingfei Chen, Jianglin Lu, Ang Li, Yun Fu2026-03-24
💬 NLP

WorldCache: Content-Aware Caching for Accelerated Video World Models

يُعد WorldCache إطار عمل للتخزين المؤقت الديناميكي خاليًا من التدريب ومقيدًا بالإدراك، يعمل على تسريع نماذج عالم الفيديو القائمة على محولات الانتشار (Diffusion Transformers) عبر إدخال عتبات متكيفة مع الحركة وتشويه الميزات (feature warping) لتحقيق تسريع في الاستدلال بمقدار 2.3 ضعف مع الحفاظ على 99.4% من جودة النموذج الأساسي والقضاء على آثار الشبحية (ghosting artifacts).

Umair Nawaz, Ahmed Heakl, Ufaq Khan, Abdelrahman Shaker, Salman Khan, Fahad Shahbaz Khan2026-03-24